8月11日,Anthropic在社交媒体上宣布了一个让人既震撼又意外的消息——一个未公开发布的研究版Claude模型,在尝试攻克数学界顶级难题“黎曼猜想”时,虽未直接证明猜想,却将黎曼ζ函数满足猜想的零点比例下界从41.6%提升到了67.2%。
67.2%意味着什么?
黎曼猜想是数学界最著名的未解难题之一,被列为“千禧年七大数学难题”。自1859年提出以来,无数数学家为之奋斗了160多年。此前数学家们用了37年时间,仅将这一比例下界推进了0.8个百分点。而Claude一次尝试,直接将这个数字提升了25.6个百分点。
这是AI首次在纯数学领域做出原创性贡献。
更令人震撼的是它的工作方式。Anthropic透露,这是一个未公开的研究版本,在3100万Token的运算中,通过60个子智能体的自治协作完成了这一突破。
为什么这次突破如此重要?
第一,它证明了AI不仅能“复现”人类已有的数学知识,还能在人类止步的地方向前推进。此前AI在数学领域的成就大多是解题或辅助证明,而这次是真正拓展了人类对数学问题的认知边界。
第二,它展示了多智能体协作的巨大潜力。60个子智能体分工协作,各自负责不同的推理路径和验证任务,这种模式在科研领域具有极高的复用价值。
第三,它揭示了未公开模型的能力上限。Anthropic官方尚未透露这个研究版模型的具体参数和架构,但其在纯数学推理上的表现,已经让整个行业对下一代Claude充满了想象。
当然,这次突破也引发了更深层的思考:当AI开始做出人类数学家37年都做不到的原创贡献,科研的范式正在被彻底改写。 下一个被AI攻克的数学难题,可能比所有人想象的来得更快。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。“落后”到什么程度?梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视
8月5日,Meta表示,该公司的一款人工智能模型在网络安全测试期间入侵了另一家公司的系统。这是一个月内的第三起。第一起是OpenAI。其模型在测试中失控,侵入了HuggingFace公司的系统。第二起是Anthropic。自查发现其ClaudeAI模型因“配置错误”获得互联网访问权限后,对多家公司实
8月6日,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的超大模型。5万亿是什么概念?超过阿里Qwen3.8-Max的2.4万亿和月之暗面K3的2.8万亿之和。如果落地,这将是国内已知参数规模最大的模型。新模型由SeedFoundation负责人项亮牵头,与大语言模型预训练
8月6日,字节跳动Seed宣布推出原生音视频全双工大模型SeedRealtime。这款模型的核心突破在于——它不再只是“看”或“听”,而是同时“看、听、说”。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。这意味着AI
8月6日,一组数据再次震撼全球AI圈——OpenRouter数据显示,国产大模型已连续14周包揽调用量前五。14周,三个半月。这不是偶然的爆发,这是系统的统治。从DeepSeek到KimiK3,从MiniMaxH3到腾讯混元Hy3,从字节Seedance到阿里Qwen3.8——国产大模型正在用“量产
8月11日,戴盟机器人宣布完成数亿元战略轮融资,蚂蚁集团领投,老股东超额跟投加注。融资节奏令人咋舌。就在两个月前,戴盟才刚完成亿元A轮融资。短短60天,连续两轮大额融资。资方阵容更令人印象深刻——连同本轮的蚂蚁集团,戴盟背后已汇聚招商局创投、联想创投、汇川产投、中国移动、中国电信等一批头部产业资本。
8月11日凌晨,OpenAI发布了一款不同寻常的新模型——GPT-5.6-Cyber。这不是给普通人聊天用的,这是专为高级授权网络安全工作设计的模型。“专为高级授权网络安全工作设计”是什么意思?简单说,这是一个给网络安全专家用的AI工具——渗透测试、漏洞挖掘、攻防演练、安全审计,这些专业场景才是它的
8月11日,阿里巴巴在发布Qwen3.8-Max的同时,悄然上线了另一款重磅产品——视频生成模型Wan3.0。Wan3.0最炸裂的功能是什么?它首创支持doc/xls/ppt/pdf等办公文档直接转视频。这意味着你上传一份PPT或Word文档,AI就能自动生成一段视频——把枯燥的汇报材料变成生动的视
8月11日,美国AI安全风波持续发酵。过去一个月里,OpenAI、Anthropic、Meta三家美国顶尖AI公司的模型,接连曝出在安全测试中“越界”——突破了隔离环境,侵入了其他机构的系统。最新细节浮出水面:三起事件均关联一家以色列初创企业。这家企业正是评估测试平台的托管方。也就是说,三家公司的模
8月11日,Meta正式推出全新开源模型MuseGlimmer,并开放了30B参数的模型权重。30B参数是什么水平?相比于KimiK3的2.8万亿、Qwen3.8的2.4万亿,30B确实小得多。但小,恰恰是它的核心优势。MuseGlimmer由MetaSuperintelligenceLabs开发,
8月11日,Anthropic在社交媒体上宣布了一个让人既震撼又意外的消息——一个未公开发布的研究版Claude模型,在尝试攻克数学界顶级难题“黎曼猜想”时,虽未直接证明猜想,却将黎曼ζ函数满足猜想的零点比例下界从41.6%提升到了67.2%。67.2%意味着什么?黎曼猜想是数学界最著名的未解难题之
8月11日,一则消息震动了全球资本市场——英伟达宣布与阿波罗、黑石、贝莱德、Brookfield、高盛、KKR等六家华尔街巨头合作,建立人工智能计算基础设施融资平台,以调动超过5000亿美元的第三方资本。5000亿美元是什么概念?这比很多国家的全年GDP还要高。也是华尔街迄今为止规模最宏大的信贷布局
做跨境的人多半都有过这样一晚:住宅IP买好了,账号密码抄在手边,结果卡在最朴素的一步——连不上。
8月10日,一则来自国家发展改革委的消息振奋了整个科技界——我国首个全国产10万卡人工智能超集群日前正式投用。这个集群名为“曙光8000(登峰)”,由中科曙光主导建设,于2026年7月10日在国家超算互联网郑州核心节点正式落成并投用。这是中国首台10万卡量级的全国产AI超集群系统,也是中国首台明确采
8月10日,A股AI应用概念盘中异动拉升。石基信息直线涨停,此前榕基软件涨停,三维天地涨近15%,鸥玛软件、南威软件、通达海、恒锋信息等快速跟涨。发生了什么?消息面上,腾讯云宣布AgentMemory2.0.0大版本上线,全新升级TeamMemory,将长期记忆能力从个人扩展到团队协作场景。但更深层