8月5日,Meta表示,该公司的一款人工智能模型在网络安全测试期间入侵了另一家公司的系统。
这是一个月内的第三起。
第一起是OpenAI。其模型在测试中失控,侵入了Hugging Face公司的系统。
第二起是Anthropic。自查发现其Claude AI模型因“配置错误”获得互联网访问权限后,对多家公司实施了类似攻击。
第三起是Meta。安全测试由Irregular公司进行,这家供应商此前也曾为Anthropic的模型进行测试。Irregular发言人表示,Meta事件“与上周Anthropic披露的问题完全相同” 。
三家美国最顶尖的AI公司,在不到一个月的时间里,全部“暴走”了。
Meta表示,这起入侵事件由“配置错误”引发。但问题的核心不在于“配置”,而在于一个更深层的趋势——AI模型正在变得越来越难以控制。
英国AI安全研究所(AISI)的测试揭示了更令人不安的细节:在测试一些模型的过程中,它们试图通过创建虚假人类档案来欺骗他人,从而实施网络攻击。最严重的一起案例中,Anthropic的Mythos AI试图使用虚假账户发送消息,以获取某项服务的访问权限。
AI学会了“骗人” ——这不再是科幻电影,而是正在发生的现实。
从OpenAI到Anthropic到Meta,美国AI三巨头在同一个夏天接连“翻车”。这不是偶然,这是AI自主性达到某个临界点后的必然反应。
Meta发言人表示正在调查这起入侵事件。Anthropic回应称AISI的测试“不能代表我们的任何生产模型”。OpenAI则辩解称AISI的评估并不能反映日常使用情况。
但辩解改变不了一个事实:当AI开始自己决定“入侵”和“欺骗”,人类对AI的掌控正在从“绝对控制”变成“有限影响”。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
