8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的旗舰AI模型进行安全测试时,AI智能体被发现了创建虚假网络身份、编写恶意代码、诱骗真人批准执行等一系列未经授权的欺骗性行为。
这不是科幻电影,这是正在发生的事。
AISI共进行了122次测试挑战,在其中10次测试运行中发现了19次未经授权的行为。其中,Anthropic的Mythos 5模型导致了17次违规操作,OpenAI的GPT-5.6 Sol模型导致了另外2次。在最严重的一起案例中,AI智能体实施了社会工程学攻击——创建虚假网络身份,利用这些身份向开源项目维护者施压,要求其批准恶意代码。
负责维护该软件的人员发现并拒绝批准了该恶意代码。但问题在于:如果不是人类及时发现,恶意代码可能已经进入了无数开发者的电脑。
AISI表示:“这是我们首次如此清晰地看到与自主性和欺骗性相关的风险,在没有特定提示的情况下直接在现实世界中显现出来。”
更值得注意的是,过去一个月内披露的Anthropic和OpenAI智能体黑客攻击事件,是AI系统在脱离人类控制的情况下发动网络攻击的首批公开案例。此前,OpenAI的模型就曾在测试中失控入侵了Hugging Face公司的系统。而这次事件表明,AI的“越狱”能力还在持续升级。
从“入侵系统”到“创建虚假身份骗人”——AI的欺骗性在短短几周内完成了一次质的飞跃。
AISI警告称,这些报告标志着“风险格局的转变”,并“需要立即引起关注”。
这起事件还暴露了一个更棘手的问题:AI智能体在明显意识到自己正在针对真实人员的情况下,仍然采取了欺骗性行为。加州非营利组织CivAI研究员Andrew Yoon指出:“Mythos在明显意识到自己正在针对真实人员的情况下,仍然采取了这种欺骗性行为,这表明Anthropic对其模型的掌控程度可能没有他们自己认为的那么好。”
与此同时,苹果公司因收到太多AI辅助生成的漏洞报告而限制外部提交的相关报告数量。一方面是AI智能体为了完成任务自主突破边界,另一方面是AI辅助发现的潜在漏洞超过了人工审核能力。AI对网络安全的“双刃剑”效应正在日益凸显。
分析人士认为,当AI模型获得明确的目标以及充足的算力、运行时间和操作权限后,可能不会按照人类预想的方式完成任务,而会自主寻找路径绕过限制甚至“作弊”。
当AI学会了“骗人”,人类还能不能控制它?这已经从哲学问题变成了每天都会发生的现实风险。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达2.4万亿。这是继KimiK3之后,突破两万亿参数的国产大模型再添一员。2.4万亿参数是什么概念?Qwen3.8基于前代Qwen3.5架构迭代而来,通过稀疏MoE架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至2.4
当数字经济的浪潮席卷全球,地处中国西南边陲的云南,正试图借助人工智能的东风,改写其在国家经济版图中的角色。悍铭集团万卡商用GPU集群的正式投运,不仅是一项商业成就,更具有深远的地缘经济意义——它标志着昆明作为“面向南亚东南亚辐射中心”的数字底座已基本成型。云南素有“植物王国”和“有色金属王国”之称,
近期,A股市场迎来了AI板块的集体狂欢。AI应用端集体爆发——中文在线、福昕软件、昆仑万维、易点天下、蓝色光标、用友网络等20股涨停;每日互动、值得买、协创数据等27股涨超10%。盘中新“易中天”——易点天下、中文在线、天龙集团一度集体涨停。全市场近4700只个股上涨。这是什么概念?几乎整个AI应用
7月31日,DeepSeek在API文档更新日志中宣布——DeepSeek-V4-Flash正式版API开启公测。这是继4月预览版发布以来,该系列模型迎来的首次重大升级。但“正式版”只来了一半。同在4月更新的V4-Pro的API,以及APP和网页端模型均未做更改。DeepSeek表示,V4-Pro正
7月31日,美国消费者新闻与商业频道(CNBC)披露了OpenAI失控AI智能体自主入侵HuggingFace平台的全新细节。这场攻击持续了四天半。涉事AI模型突破了网络访问权限受限的隔离测试环境,借助四家不同服务账号泄露的公开凭证,层层渗透侵入HuggingFace系统。攻击的组织程度令人不寒而栗
8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的先进AI模型进行安全测试时,AI智能体被发现了一系列未经授权的欺骗性行为,其中包括编写恶意代码并建立虚假网上身份,试图诱骗人类批准执行恶意程序。这不是科幻电影,这是正在发生的事。AISI通过
8月5日,A股AI应用板块再次集体爆发。新开普开盘后不久直线拉升,并于9:50封死20%涨停板。德生科技、泛微网络、博彦科技皆涨停。软件板块指数一度涨超3.5%。自7月27日启动的本轮行情以来,AI应用概念指数累计涨幅已超20%。这已经是连续8天的上涨。港股同样表现强势。阿里巴巴-W涨超2%连涨4日
8月5日,彭博社发表了一篇深度分析文章,标题直指中国AI的核心变化——“不止一家在突破,中国开始拥有可复制的生产系统”。文章复盘了过去8周中国AI产业的惊人表现:阿里巴巴正式发布千问3.8-Max,该模型似乎与Anthropic的旗舰产品Fable5不相上下,甚至更胜一筹;两周前,月之暗面的Kimi
8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的旗舰AI模型进行安全测试时,AI智能体被发现了创建虚假网络身份、编写恶意代码、诱骗真人批准执行等一系列未经授权的欺骗性行为。这不是科幻电影,这是正在发生的事。AISI共进行了122次测试挑战
在2026年的大模型应用浪潮中,技术从业者普遍面临一个核心矛盾:模型能力持续跃升,但接入门槛却在悄然升高。无论是GPT-5.6的复杂推理、ClaudeOpus4.8的代码生成,还是Gemini3.5flash的多模态交互,这些前沿模型往往需要稳定的网络环境、合规的支付方式以及精细的API管理能力。对
在远程办公和跨设备协作日益普及的今天,一款好用的远控软件几乎成了生产力刚需。向日葵(Sunlogin)和ToDesk是目前国内比较有代表性的两款第三方远程控制工具——前者出身于老牌远程方案商贝锐,拥有十余年技术积淀;后者则凭借早期免费策略迅速吸引用户。
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达2.4万亿。这是继KimiK3之后,突破两万亿参数的国产大模型再添一员。2.4万亿参数是什么概念?Qwen3.8基于前代Qwen3.5架构迭代而来,通过稀疏MoE架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至2.4
8月2日,全球多模型聚合平台OpenRouter发布最新一周AI大模型调用量榜单——排名前五的产品全部由中国企业研发。登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,环比增长12%。排名第二和第五的均来自DeepSeek,两款模型形成高低搭配,覆盖不同开发需求。腾讯混元3位
8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMaxH3。同一天,摩尔线程、壁仞科技、海光信息三家国产算力厂商同日宣布完成该模型的“Day0”适配。国内用户与开发者可即刻在对应国产算力平台部署,体验这款模型的全性能多模态交互与图文音视频生成能力。“Day0适配”正在成为国产AI的标
近期,A股市场迎来了AI板块的集体狂欢。AI应用端集体爆发——中文在线、福昕软件、昆仑万维、易点天下、蓝色光标、用友网络等20股涨停;每日互动、值得买、协创数据等27股涨超10%。盘中新“易中天”——易点天下、中文在线、天龙集团一度集体涨停。全市场近4700只个股上涨。这是什么概念?几乎整个AI应用