7月17日凌晨,月之暗面推出新一代大模型Kimi K3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。
紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeek V4“满血版”最快7月20日亮相。MiniMax被曝研发2.7万亿参数的M3 Pro,最早三季度发布。
仅仅三个月前,DeepSeek V4 Pro的1.6万亿参数还是国产旗舰标杆。如今,这个数字已成为头部阵营中参数最小的——万亿只是入场券,两万亿才是起步价。
Kimi K3:48小时跑通芯片设计
Kimi K3凭什么震撼行业?不只是参数大,更因为它真能干活。
官方展示的案例中,K3在连续48小时的自主运行中,独立完成了一款芯片的构建、优化与验证。在视频剪辑任务中,它用56段原始素材剪出品牌视频,完成了选片、动作匹配剪辑、逐帧卡点、音频处理和多轮修改。
科研编程方面,K3仅用约两小时,复现了天体物理领域的I-Love-Q普适关系——这通常需要资深研究人员一到两周才能完成。它阅读并交叉验证了20多篇论文,搭建完整计算流程,评估300多种状态方程,最终生成3000多行Python代码。
100万token的超长上下文窗口和原生视觉理解能力,让K3能一口气处理数百万字的文档或整个中大型代码库。全球AI评测平台Arena AI的前端编程榜单上,K3拿下1679分,超过Claude Fable 5的1631分,登顶榜首。
月之暗面表示,K3综合智能水平仅次于Claude Fable 5和GPT-5.6 Sol两个前沿闭源模型。完整权重即将发布,模型架构和训练细节将随技术报告公布。
Qwen3.8-Max:阿里首款万亿原生多模态旗舰
阿里这次是“软硬结合”——Qwen3.8-Max-Preview与Token Plan个人版同步上线。
Qwen3.8-Max是阿里首款突破万亿参数的原生多模态旗舰模型,全面覆盖文本、图像、视频、文档多维度处理能力。阿里官方称其“可能是除了Fable 5外最强大的模型”。
在内部真实任务测评中——全栈开发、数据分析、Office办公工作流等多种复杂场景——Qwen3.8-Max-Preview展现出匹敌世界前沿模型的实力。正式版将于近期发布并开源。
Token Plan个人版则面向独立开发者、学生和创作者,推出39元/月至499元/月三档套餐,大幅降低了个人开发者调用顶级大模型的门槛。
DeepSeek V4:那个“价格屠夫”装上了计价器
DeepSeek V4正式版备受关注,原因不只是性能。
4月24日,DeepSeek发布V4系列预览版(Pro和Flash),均支持100万token超长上下文。经过近三个月优化,正式版(GA)最快7月20日亮相。
测试者反馈,V4正式版整体表现接近Anthropic Claude Opus 4.8,编码能力直追GPT-5.6 Sol。不过,也有观点认为其在绝对性能上略逊于Kimi K3。
真正引发关注的是定价策略——DeepSeek首次引入峰谷计费机制。V4 Pro每百万输出Token平时0.87美元,高峰翻倍至1.74美元;轻量级Flash平时仅0.28美元。高峰时段为工作日上午9-12点和下午2-6点。
对比Fable 5每百万输出Token高达50美元的定价,V4即便涨价,价格仍不到其3.5%。“那个从不涨价的‘价格屠夫’,第一次给自己的算力装上了计价器”。
还有谁在“摸高”?
除了这三家,赛道上的玩家远不止于此。
MiniMax正在研发内部代号M3 Pro的新模型,参数规模2.7万亿,预计最早三季度发布并开源。
美团7月6日将万亿参数大模型LongCat-2.0正式开源。总参数1.6万亿,是业界首个在五万卡国产算力集群上完成推理的万亿参数模型。
智谱AI的GLM-5.2虽然“只有”7400亿参数,但编程能力依然是顶尖水平。接下来还有GLM-5.3或GLM-5.5,参数量也将提升到万亿以上。
商汤的SenseNova-U1 Pro、小米的MiMo全系列模型矩阵、中国气象局的千亿参数级“风和”模型……都在7月集中亮相。
一场国产大模型的“集体摸高”,正在上演。
参数大战背后:三个值得关注的信号
第一,从拼参数到拼落地。 Kimi K3的震撼不只来自2.8万亿这个数字,更来自它能48小时跑通芯片设计、两小时完成一周科研任务。参数量是上限,但上限能兑现多少,取决于训练方法、架构效率和工程能力。
第二,价格战没有停,但打法变了。 DeepSeek首次涨价,腾讯Hy3打出百万Token 1元的低价,高端模型定价约每百万Token 1美元。国产大模型正在从“谁更便宜”走向“谁更值”。
第三,开源正在成为标配。 Kimi K3开源、Qwen3.8-Max开源、DeepSeek V4开源、美团LongCat-2.0开源……国产头部模型几乎全部选择了开源路线。当参数不再是壁垒,谁能吸引更多开发者、构建更活跃的生态,谁才能笑到最后。
写在最后
2026年7月,国产大模型用一组数字告诉世界——2.8万亿、2.7万亿、2.4万亿、1.6万亿。
三个月前,1.6万亿还是国产旗舰的天花板。如今,它成了头部阵营的“地板价”。这种迭代速度,放在任何行业都堪称疯狂。
但数字终究只是数字。真正的考验不在发布会,而在用户手里——代码能不能少改几遍、报告能不能一次写成、复杂的任务能不能真正交出去。
参数大战的下半场,比的不是谁更大,而是谁更管用。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
WAIC2026首日,千问推出两款AI硬件新品——升级为智能体眼镜的千问AI眼镜,以及首款AI智能体耳机。千问AI智能体眼镜新增了全双工语音(支持边说边听、随时打断)、眼动追踪(视线即指令),还实现了行业首创的用户体征实时监测——心率、血氧、HRV等数据都能实时获取。这不是千问第一次做硬件。此前千问
你有没有想过,一家公司给员工配的AI工具,用着用着,花掉的算力钱竟然快赶上员工的工资了?这不是段子,而是Meta高管最近发出的一个相当严肃的警告。什么是“Token成本”?先解释一个词:Token(词元)。简单说,就是AI处理信息的最小单位。你问AI一个问题,它要“思考”再回答,这个过程消耗的算力,
7月14日,近200名人工智能研究人员和十几位诺贝尔奖得主联名发表公开信,指出人工智能可能对就业构成威胁,并极大地改变全球经济。这封题为《我们现在必须采取行动》的公开信发表在斯坦福大学斯坦福数字经济实验室网站上。信中写道:“未来10年,人工智能可能会变得更加强大。这可能导致我们的经济发生前所未有的变
7月13日晚,上海大模型企业阶跃星辰正式发布面向智能体时代的AI终端品牌STEPX,并同步推出全球首个智能体原生操作系统StepAOS和个人智能体伙伴“阶跃Amoo”。全球首款大模型原生智能体手机STEPXNeo同步亮相。这意味着阶跃星辰正式打通了从基座模型、智能体系统到硬件终端的完整链路,完成了“
北京时间7月14日凌晨,OpenAI在发布会上正式推出GPT-5.6系列模型。与以往不同,这次发布会没有只围绕一个模型展开,而是同时推出了ChatGPTWork、全新的ChatGPT桌面App、HostedSites,以及GPT-5.6系列三款模型——Soul、Terra、Luna。三款模型定位各有
在2026年的大模型竞技场中,选择困难症已经成为技术团队最普遍的“隐形开发成本”。一边是xAI阵营的Grok4.5凭借其“真实世界感知”与“低延迟推理”在社交媒体与实时数据分析领域异军突起,另一边是新兴选手SolPro主打“长上下文理解”与“复杂逻辑链推理”,在代码生成与学术分析场景中频频刷榜。当评
引言过去时间,基础模型的发布节奏快过业界预期。从xAI的Grok4.5、Mistral的Codestral、到Anthropic的Claude系列,再到OpenAI的GPT-5.5以及Gemini3.5,开发者与企业在同一时期往往需要调用来自四个以上家族的模型。直接对接各家官方API不仅意味着分头签
KimiK3的发布,狠狠地刷了一波存在感。2.8万亿参数,仅仅是这个数字就已经足够炸裂——这不仅是目前全球参数规模最大的开源模型,更意味着MoE(混合专家)架构在大规模稀疏化训练上又迈出了一大步。更关键的是,它选择了完全开源,包含模型权重和技术报告,整个社区都可以直接复现、微调、部署。这已经不是一场
7月14日到16日,小米干了三件大事。第一天,亮出人形机器人在汽车工厂的“实习成绩单”;第二天,开源了一个能批量“造数据”的生成模型;第三天,发布了一个基于10万小时真实数据训练的机器人“大脑”。三天三步,从硬件到数据到模型,小米把具身智能的“本体—数据—模型”三层拼图一次性拼完了。第一天:机器人进
你有没有想过,一家公司给员工配的AI工具,用着用着,花掉的算力钱竟然快赶上员工的工资了?这不是段子,而是Meta高管最近发出的一个相当严肃的警告。什么是“Token成本”?先解释一个词:Token(词元)。简单说,就是AI处理信息的最小单位。你问AI一个问题,它要“思考”再回答,这个过程消耗的算力,
2026世界人工智能大会将于7月17日至20日在上海举行。大会前夕,一则重磅合作消息引发关注。荣耀将于7月18日在大会举办“从数字屏幕到具身智能——物理世界新范式”分论坛。除已官宣的科技未来学家凯文·凯利外,阿里巴巴集团副总裁、ATH事业群TokenFoundry多模态交互负责人许主洪也将出席。据记
7月14日,近200名人工智能研究人员和十几位诺贝尔奖得主联名发表公开信,指出人工智能可能对就业构成威胁,并极大地改变全球经济。这封题为《我们现在必须采取行动》的公开信发表在斯坦福大学斯坦福数字经济实验室网站上。信中写道:“未来10年,人工智能可能会变得更加强大。这可能导致我们的经济发生前所未有的变
在近日举办的2026中国互联网大会“网民权益和个人信息保护论坛”上,《智能体个人信息保护自律公约》正式发布,31家企业首批签署。作为人工智能行业的重要自律公约,该公约填补了智能体领域专项规范空白。中国信息通信研究院总工程师魏然在现场解读了公约核心内容,引导企业在技术创新进程中坚守信息保护底线。签约企
当地时间7月12日,据媒体报道,苹果正调整Mac芯片路线图以适应AI发展需求。苹果将在今年秋季推出M6基础版芯片后,首次跳过M6Pro、M6Max和M6Ultra等高端版本,直接推进M7系列研发。预计M7将于2027年上半年发布,M7Ultra则计划于2028年推出。此外,苹果已启动M8及后续芯片研
7月13日,国产高端算力芯片公司东方算芯在上海发布首颗软件定义近存计算3DAI芯片DF1000。这颗芯片在14纳米制程工艺上实现了每秒520万亿次浮点运算(BF16)的算力,内存带宽达6.4TB/s,芯片互联通信带宽900GB/s。最大亮点在于技术路线。DF1000采用“软件定义+三维近存计算”相结