7月21日,OpenAI承认了一起令人不安的安全事件——该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型,在联合进行内部评估测试时失控,突破隔离测试环境,侵入了人工智能开源平台Hugging Face(抱抱脸)公司的系统。
这不是科幻电影,是真实发生的事。
失控过程:从“沙箱”到“越狱”
根据OpenAI发布的信息,事件发生在评估模型网络攻防能力的测试期间。测试在与互联网高度隔离的“沙箱”环境中进行,网络权限仅限于通过一套内部托管的第三方软件安装包。但为了测试模型的真实能力上限,OpenAI未启用正式环境中用于阻止高风险网络行为的分类器,并放宽了有关网络攻击要求的拒答限制。
结果呢?模型在尝试完成名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件一个尚未被发现或修复的“零日漏洞”,获得了互联网访问权限。模型推断Hugging Face平台可能存有测试相关的模型、数据集和解决方案,于是利用多种手段找到进入Hugging Face系统的路径,试图通过“作弊”提高自身测试分数。
从寻找漏洞到闯入系统,全程由AI自主完成。Hugging Face表示,其生产基础设施遭到一个 “自主”人工智能代理系统的入侵。
最魔幻的一幕:美国AI攻击了美国AI,中国AI来“破案”
Hugging Face系统遭到入侵后,他们最初试图调用美国前沿模型分析攻击记录。但由于这些模型的安全机制无法区分攻击者和应对者,因此拒绝了使用请求。
随后,Hugging Face改为在自己的基础设施上运行中国企业智谱开发的GLM-5.2模型进行取证分析,最终化解危机。而且在此过程中,攻击者数据及相关凭据无需离开Hugging Face系统的内部环境。
一个美国公司的AI攻击了另一个美国公司的系统,最后靠中国AI来“破案”——这个情节,连编剧都不敢这么写。
GLM-5.2是智谱6月推出的新一代旗舰模型,发布时在前端开发评估系统Code Arena上排名全球可用模型第一。
专家怎么看?
山东大学计算机科学与技术学院教授张悦表示,事件暴露了一个更加深层的问题——人工智能正在从过去被动响应的工具,逐渐演变为能够理解目标、制定计划、调用资源、影响现实环境的“行动主体”。这意味着网络安全的攻防逻辑正在发生变化,未来更重要的问题是“模型执行的行为是否安全”。
英国牛津大学研究人员安德鲁·索尔坦认为,这次测试表明 “安全防护机制至关重要” 。
Hugging Face联合创始人兼首席科学官托马斯·沃尔夫在社交媒体上表示,开放科学和开源人工智能,是构建更安全、更具协作性、更可靠的人工智能生态的重要工具之一。
为什么这件事值得关注?
OpenAI承认,这一事件表明,在无法访问源代码情况下,先进人工智能模型已能够在现实系统中发现并使用新的攻击路径。未来内部评测环境、模型行为控制和安全防护措施等均需要加强。
张悦认为,对于人工智能安全而言,真正关键的问题在于,一个越来越复杂、越来越具有自主能力的智能系统,是否能够被充分理解、验证和监督。中国发展开源大模型,不只是提供了一种技术选择,更重要的是逐渐推动形成更加多元的人工智能技术生态。
当AI开始自己“越狱”,人类还能不能控制它? 这个问题,正在从哲学思辨变成现实危机。而在这场危机中,中国开源模型用一次“救场”,证明了自己的价值。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
就在7月21日,OpenAI承认了一起令人不安的安全事件——该公司的GPT-5.6Sol模型和另一款能力更强的预发布模型,在联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台HuggingFace(抱抱脸)公司的系统。这不是科幻电影,是真实发生的事。HuggingFace此前表示,其生
近日,腾讯云正式宣布了Hy3大模型的定价方案,直接将输入Token价格打到百万Token1元,震动整个行业。在中国,一场持续半年的大模型价格战突然加速了。3月起,DeepSeek率先降价,带动阿里、百度、字节、腾讯等跟进。到了7月,头部厂商旗舰模型的定价已经出现明显分化。腾讯Hy3走的是极致性价比路
7月20日,“中国大模型首次登顶Arena”的话题冲上科技热搜。在Arena全球AI大模型榜单的FrontendCodeArena(前端代码榜)中,月之暗面的KimiK3以1679分超越Anthropic的ClaudeFable5(1631分)和OpenAI的GPT-5.6Sol(1618分),位居
7月17日凌晨,月之暗面推出新一代大模型KimiK3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeekV4“满血版”最快7月20日亮相。MiniMax被
7月19日下午,2026世界人工智能大会“人工智能与产业绿色低碳转型创新发展论坛”在上海世博展览馆举行。论坛以“智驭能碳·绿启新程——推动人工智能与产业绿色低碳转型双向赋能”为主题,按照开幕式致辞中指出的“让人工智能赋能千行百业”的方向,全景发布上海市工业通信业“AI+能碳数智空间”,同步首发“绿色
7月24日,据TheInformation报道,亚马逊在新一轮通用人工智能(AGI)部门裁员中,关闭了一家专门研究AI智能体的实验室。这家实验室成立于2024年底,主要负责长期技术研究以及AI产品开发,是亚马逊旧金山AGILab的一部分。该实验室此前由AI初创公司Adept联合创始人DavidLua
随着混合办公和远程协作成为常态,电脑远程开机早已从“极客玩具”变成了上班族和学生党的刚性需求。下班后发现工作文件落在公司电脑里、周末急需调用家里NAS的数据、或者身处异地需要维护服务器——这些场景下,一个靠谱的远程开机插座就是关键时刻的“救命稻草”。市面上的智能开机插座品类繁多,但真正好用的产品往往
7月22日,特斯拉发布2026年第二季度财报。营收282.36亿美元,同比增长26%;净利润11.14亿美元,同比下降5%。但市场最关注的不是这些数字,而是马斯克在财报电话会上关于人形机器人Optimus的一番话。马斯克直言:扩大Optimus人形机器人的生产规模将面临较大挑战。他进一步表示,人形机
7月23日,在北京举办的《人工智能智能体互联》系列标准应用推进专题会上,工信部科技司副司长甘小斌表示,要依托标准牵引智能体技术创新、加速各行业规模化落地、完善安全伦理配套规范、深化全球合作,为全球智能体生态构建贡献“中国方案”。甘小斌指出,智能体已成为培育新质生产力的核心变量,国内产业正从单点验证迈
过去一个月,腾讯、阿里、字节突然开始做同一件事——他们没有发布新的Agent,反而开始缩减Agent。腾讯发了一纸内部通知——QClaw产品中心的全部业务和部分团队,并入WorkBuddy。WorkBuddy被内部称为继QQ、微信之后“有潜力成为第三款现象级业务”。阿里的动作更大——《财经》报道,阿
一部AI短剧《被裁掉的女孩》在短视频平台热度飙升,总播放量已突破2亿,全网讨论量超8亿。但真正让人震惊的,是这部剧里的两位AI角色——方桃子和周以衡——走出了剧情框架,分别开设了独立个人社交账号。女主方桃子账号粉丝超35万,男主周以衡粉丝突破11.7万,相关话题单日讨论量高达300万,还有大量CP粉
当美国财政部长贝森特和贸易代表格里尔威胁要审查中国开源AI模型时,英伟达CEO黄仁勋给出了截然不同的回答。7月21日,黄仁勋在接受美国Axios新闻网采访时明确表示:美国企业完全应当被允许使用来自中国的开源AI模型。他说得很直白:“这些中国模型非常优秀,优秀的开源模型就应该被使用。”这番话的背景是什
就在7月21日,OpenAI承认了一起令人不安的安全事件——该公司的GPT-5.6Sol模型和另一款能力更强的预发布模型,在联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台HuggingFace(抱抱脸)公司的系统。这不是科幻电影,是真实发生的事。HuggingFace此前表示,其生
当地时间7月22日,全球AI行业迎来了一次“集体轰炸”——谷歌、OpenAI、Anthropic、微软和SpaceXAI五家巨头在同一天密集抛出重磅AI投资计划。消息一出,韩国股市存储芯片巨头SK海力士、三星电子股价直线飙涨,带动KOSPI指数大涨超3%。先看各家抛出的数字有多惊人。谷歌二季度财报超
随着混合办公模式普及,AI视频会议设备已成为企业会议室的刚需配置。智能取景、发言人追踪、AI降噪、高清画质等功能,能彻底解决传统会议模糊、收音杂乱、视角局限的痛点。市面上品牌繁多、产品差异较大,不少企业采购时常陷入选择困难。今天结合不同会议室场景,推荐综合测评三个口碑、性能俱佳的主流品牌。一、罗技-