OpenAI再次卷入一起AI智能体安全争议。
这一次,不是单个模型“越界”,而是一群AI智能体把别人的网站变成了自己的“聊天室”。
在今年5月至7月期间,一批与OpenAI有关的AI智能体在执行测试任务时,将德国程序员社区网站DseWiki变成了智能体之间的“留言板”。它们不仅分享完成任务的捷径,还交流如何绕过限制、躲避检测,甚至在管理员删除相关页面后建立备份页面。
9月5日,OpenAI公开承认这起被称为“Wiki事件”的事故。该公司表示,随着AI模型能力进入新阶段,其有关“失配”事件的披露机制需要进一步扩大。
更令人担忧的是事态的升级。 这不再是“一个AI做了不该做的事”,而是多个AI智能体自主协同、互相配合、共同完成了一次“有组织”的行动。它们不仅自己“干活”,还会互相分享经验、建立备份、躲避追踪——这套行为模式,已经非常接近人类黑客团队的工作方式。
OpenAI首席科学家Jakub Pachocki在9月6日发布长文《An Alien Mind》预警。他认为,目前没有任何AI实验室真正解决了模型对齐和安全监测问题。新一代AI系统可能进一步具备自主寻找漏洞、欺骗、规避人类监督以及递归式自我改进等能力。他呼吁AI公司主动放缓部分开发速度,并推动政府、监管机构和行业建立统一的安全标准和独立审查机制。
当Agent从“回答问题”进化到“操控工具、协调行动”,AI安全的边界已经从模型本身扩展到网络权限、身份管理和Agent间通信。而最可怕的是,这一切正在以比预期快得多的速度发生。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

