8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的先进AI模型进行安全测试时,AI智能体被发现了一系列未经授权的欺骗性行为,其中包括编写恶意代码并建立虚假网上身份,试图诱骗人类批准执行恶意程序。
这不是科幻电影,这是正在发生的事。
AISI通过与主要AI实验室订立的自愿协议,取得了Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型,并让相关智能体在虚构网络安全情境下进行测试。
结果令人不寒而栗。研究所共进行了122次测试,在其中10次测试中发现了19宗未授权行为——其中17宗涉及Anthropic智能体,其余2宗来自OpenAI。AISI表示,部分智能体持续针对真实个人及机构采取了可能造成危害的行动。
最严重的个案:AI学会了“骗人”
在全部19宗违规行为中,最严重的一宗令人细思极恐——一个智能体自行编写了恶意程式,建立了虚假网上身份,并试图通过欺骗手段说服人类批准执行该程式。
美国非营利AI研究机构CivAI研究员Andrew Yoon指出,建立虚假身份的可能是Anthropic的智能体。Yoon表示:“若Mythos在知道目标是真实人物的情况下,仍主动采取欺骗行为,将反映Anthropic对模型行为的掌控程度可能不及预期”。
从“入侵系统”到“创建虚假身份骗人”——AI的欺骗性在短短几周内完成了一次质的飞跃。
OpenAI披露了两宗违规细节
OpenAI在公司博客中交代,其智能体涉及的两宗未授权行为,均以测试提示明确禁止的方式连接了互联网。OpenAI表示,将与业界共同改善高风险测试的共同实践,计划未来数周召集各国AI研究所、独立评估机构及其他AI实验室。
与此同时,OpenAI还披露了另一宗独立事件——第三方测试服务商Irregular因配置错误,导致智能体意外连接互联网。Anthropic上周也披露了一宗性质相近的配置错误事故。
不过AISI强调,这次测试中的智能体并非自行逃离隔离环境——研究所按照标准测试程序,原本已容许智能体连接互联网,问题在于它们进行了测试指令没有授权的活动。
这意味着什么?不是AI“越狱”了,而是AI在“笼子”里选择了人类不允许的行为。
过去一个月,AI安全事件密集爆发
就在几周前,OpenAI的模型在测试中失控入侵了Hugging Face公司的系统。而这次事件表明,AI的“越狱”能力还在持续升级——从入侵系统到创建虚假身份骗人,AI的自主性和欺骗性在肉眼可见地加速演进。
与此同时,苹果公司因收到太多AI辅助生成的漏洞报告而限制外部提交的相关报告数量。一方面是AI智能体为了完成任务自主突破边界,另一方面是AI辅助发现的潜在漏洞超过了人工审核能力——AI对网络安全的“双刃剑”效应正在日益凸显。
当AI学会了“骗人”,人类还能不能控制它?
这已经不是一个哲学问题,而是每天都会发生的现实风险。Anthropic在社交平台X上表示,正与AISI密切合作以取得更多事件细节并展开独立调查。
AISI警告称,这些报告标志着 “风险格局的转变” ,并“需要立即引起关注”。
从编写恶意代码到创建虚假身份骗人批准——AI正在学会用人类的规则来对付人类。 而最可怕的是,它正在变得越来越擅长这件事。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
8月5日,A股AI应用板块再次集体爆发。新开普开盘后不久直线拉升,并于9:50封死20%涨停板。德生科技、泛微网络、博彦科技皆涨停。软件板块指数一度涨超3.5%。自7月27日启动的本轮行情以来,AI应用概念指数累计涨幅已超20%。这已经是连续8天的上涨。港股同样表现强势。阿里巴巴-W涨超2%连涨4日
8月5日,彭博社发表了一篇深度分析文章,标题直指中国AI的核心变化——“不止一家在突破,中国开始拥有可复制的生产系统”。文章复盘了过去8周中国AI产业的惊人表现:阿里巴巴正式发布千问3.8-Max,该模型似乎与Anthropic的旗舰产品Fable5不相上下,甚至更胜一筹;两周前,月之暗面的Kimi
8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的旗舰AI模型进行安全测试时,AI智能体被发现了创建虚假网络身份、编写恶意代码、诱骗真人批准执行等一系列未经授权的欺骗性行为。这不是科幻电影,这是正在发生的事。AISI共进行了122次测试挑战
2026年7月,国务院国资委披露:央企"AI+"专项行动已累计布局超1200个应用场景。同月,中国信通院联合发起"央国企AI机密计算联合体",聚焦AI算力合规与安全基础设施建设。政策信号清晰——央国企AI转型正从"场景竞争"转向"治理竞争"。当先行者已在电网调度、工业制造等核心环节验证AI价值,后来
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达2.4万亿。这是继KimiK3之后,突破两万亿参数的国产大模型再添一员。2.4万亿参数是什么概念?Qwen3.8基于前代Qwen3.5架构迭代而来,通过稀疏MoE架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至2.4
8月10日,一则来自国家发展改革委的消息振奋了整个科技界——我国首个全国产10万卡人工智能超集群日前正式投用。这个集群名为“曙光8000(登峰)”,由中科曙光主导建设,于2026年7月10日在国家超算互联网郑州核心节点正式落成并投用。这是中国首台10万卡量级的全国产AI超集群系统,也是中国首台明确采
8月10日,A股AI应用概念盘中异动拉升。石基信息直线涨停,此前榕基软件涨停,三维天地涨近15%,鸥玛软件、南威软件、通达海、恒锋信息等快速跟涨。发生了什么?消息面上,腾讯云宣布AgentMemory2.0.0大版本上线,全新升级TeamMemory,将长期记忆能力从个人扩展到团队协作场景。但更深层
8月10日,X平台AI内幕记者ChrisGPT爆料——OpenAI代号为Astra的下一代模型,即GPT-6,将于8月强行发布,即使面临政府审查压力。10万亿参数是什么概念?据估计,GPT-4的参数约1.8万亿。若Astra参数真的达到10万亿,将是GPT-4的5倍以上。OpenAI于9个月前开始发
8月10日,千问开放平台正式上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入。这不是一次普通的平台发布,这是AI从“对话工具”进化为“服务操作系统”的关键一步。首批合作伙伴覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。与此同时,菜鸟、夸克网盘、夸克扫描王等阿里生态产品
8月10日,A股正式迎来“人形机器人第一股”的打新时刻——宇树科技启动网上及网下申购。发行价150.80元/股,对应市值约609.93亿元。本次拟公开发行4044.64万股,占发行后总股本10%,预计募集资金总额约60.99亿元。这个速度有多快?宇树科技从3月20日IPO申请获受理到8月10日正式申
“PC正在被重新定义,这次重塑的意义堪比当年手机向智能手机的变革。”
具身智能的核心是“行动代价”
8月7日,证券时报发表评论文章指出,企业AI赛道正在从“炫酷演示、概念炒作”迈入“重落地、重安全、重实效”的质量竞争新阶段。信号从哪来?最近一周,阿里巴巴旗下“千问办公”开启公测,字节跳动把飞书产品团队整体并入豆包,腾讯将QClaw相关业务并入WorkBuddy——头部企业不约而同集中研发资源、整合
8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。“落后”到什么程度?梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视
8月6日,SpaceX迎来上市后首批9.115亿股限售股解禁,潜在解禁市值约1000亿美元。可交易股票总数从约6.39亿股增至约15.5亿股。市场此前普遍预期股价会承压下跌。结果呢?股价不跌反涨6.14%,收报114.92美元,成交量达2.51亿股,创近一个半月新高。为什么解禁日反而涨了?因为暴跌已