7月17日凌晨,月之暗面推出新一代大模型Kimi K3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。
紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeek V4“满血版”最快7月20日亮相。MiniMax被曝研发2.7万亿参数的M3 Pro,最早三季度发布。
仅仅三个月前,DeepSeek V4 Pro的1.6万亿参数还是国产旗舰标杆。如今,这个数字已成为头部阵营中参数最小的——万亿只是入场券,两万亿才是起步价。
Kimi K3:48小时跑通芯片设计
Kimi K3凭什么震撼行业?不只是参数大,更因为它真能干活。
官方展示的案例中,K3在连续48小时的自主运行中,独立完成了一款芯片的构建、优化与验证。在视频剪辑任务中,它用56段原始素材剪出品牌视频,完成了选片、动作匹配剪辑、逐帧卡点、音频处理和多轮修改。
科研编程方面,K3仅用约两小时,复现了天体物理领域的I-Love-Q普适关系——这通常需要资深研究人员一到两周才能完成。它阅读并交叉验证了20多篇论文,搭建完整计算流程,评估300多种状态方程,最终生成3000多行Python代码。
100万token的超长上下文窗口和原生视觉理解能力,让K3能一口气处理数百万字的文档或整个中大型代码库。全球AI评测平台Arena AI的前端编程榜单上,K3拿下1679分,超过Claude Fable 5的1631分,登顶榜首。
月之暗面表示,K3综合智能水平仅次于Claude Fable 5和GPT-5.6 Sol两个前沿闭源模型。完整权重即将发布,模型架构和训练细节将随技术报告公布。
Qwen3.8-Max:阿里首款万亿原生多模态旗舰
阿里这次是“软硬结合”——Qwen3.8-Max-Preview与Token Plan个人版同步上线。
Qwen3.8-Max是阿里首款突破万亿参数的原生多模态旗舰模型,全面覆盖文本、图像、视频、文档多维度处理能力。阿里官方称其“可能是除了Fable 5外最强大的模型”。
在内部真实任务测评中——全栈开发、数据分析、Office办公工作流等多种复杂场景——Qwen3.8-Max-Preview展现出匹敌世界前沿模型的实力。正式版将于近期发布并开源。
Token Plan个人版则面向独立开发者、学生和创作者,推出39元/月至499元/月三档套餐,大幅降低了个人开发者调用顶级大模型的门槛。
DeepSeek V4:那个“价格屠夫”装上了计价器
DeepSeek V4正式版备受关注,原因不只是性能。
4月24日,DeepSeek发布V4系列预览版(Pro和Flash),均支持100万token超长上下文。经过近三个月优化,正式版(GA)最快7月20日亮相。
测试者反馈,V4正式版整体表现接近Anthropic Claude Opus 4.8,编码能力直追GPT-5.6 Sol。不过,也有观点认为其在绝对性能上略逊于Kimi K3。
真正引发关注的是定价策略——DeepSeek首次引入峰谷计费机制。V4 Pro每百万输出Token平时0.87美元,高峰翻倍至1.74美元;轻量级Flash平时仅0.28美元。高峰时段为工作日上午9-12点和下午2-6点。
对比Fable 5每百万输出Token高达50美元的定价,V4即便涨价,价格仍不到其3.5%。“那个从不涨价的‘价格屠夫’,第一次给自己的算力装上了计价器”。
还有谁在“摸高”?
除了这三家,赛道上的玩家远不止于此。
MiniMax正在研发内部代号M3 Pro的新模型,参数规模2.7万亿,预计最早三季度发布并开源。
美团7月6日将万亿参数大模型LongCat-2.0正式开源。总参数1.6万亿,是业界首个在五万卡国产算力集群上完成推理的万亿参数模型。
智谱AI的GLM-5.2虽然“只有”7400亿参数,但编程能力依然是顶尖水平。接下来还有GLM-5.3或GLM-5.5,参数量也将提升到万亿以上。
商汤的SenseNova-U1 Pro、小米的MiMo全系列模型矩阵、中国气象局的千亿参数级“风和”模型……都在7月集中亮相。
一场国产大模型的“集体摸高”,正在上演。
参数大战背后:三个值得关注的信号
第一,从拼参数到拼落地。 Kimi K3的震撼不只来自2.8万亿这个数字,更来自它能48小时跑通芯片设计、两小时完成一周科研任务。参数量是上限,但上限能兑现多少,取决于训练方法、架构效率和工程能力。
第二,价格战没有停,但打法变了。 DeepSeek首次涨价,腾讯Hy3打出百万Token 1元的低价,高端模型定价约每百万Token 1美元。国产大模型正在从“谁更便宜”走向“谁更值”。
第三,开源正在成为标配。 Kimi K3开源、Qwen3.8-Max开源、DeepSeek V4开源、美团LongCat-2.0开源……国产头部模型几乎全部选择了开源路线。当参数不再是壁垒,谁能吸引更多开发者、构建更活跃的生态,谁才能笑到最后。
写在最后
2026年7月,国产大模型用一组数字告诉世界——2.8万亿、2.7万亿、2.4万亿、1.6万亿。
三个月前,1.6万亿还是国产旗舰的天花板。如今,它成了头部阵营的“地板价”。这种迭代速度,放在任何行业都堪称疯狂。
但数字终究只是数字。真正的考验不在发布会,而在用户手里——代码能不能少改几遍、报告能不能一次写成、复杂的任务能不能真正交出去。
参数大战的下半场,比的不是谁更大,而是谁更管用。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
WAIC2026首日,千问推出两款AI硬件新品——升级为智能体眼镜的千问AI眼镜,以及首款AI智能体耳机。千问AI智能体眼镜新增了全双工语音(支持边说边听、随时打断)、眼动追踪(视线即指令),还实现了行业首创的用户体征实时监测——心率、血氧、HRV等数据都能实时获取。这不是千问第一次做硬件。此前千问
你有没有想过,一家公司给员工配的AI工具,用着用着,花掉的算力钱竟然快赶上员工的工资了?这不是段子,而是Meta高管最近发出的一个相当严肃的警告。什么是“Token成本”?先解释一个词:Token(词元)。简单说,就是AI处理信息的最小单位。你问AI一个问题,它要“思考”再回答,这个过程消耗的算力,
7月14日,近200名人工智能研究人员和十几位诺贝尔奖得主联名发表公开信,指出人工智能可能对就业构成威胁,并极大地改变全球经济。这封题为《我们现在必须采取行动》的公开信发表在斯坦福大学斯坦福数字经济实验室网站上。信中写道:“未来10年,人工智能可能会变得更加强大。这可能导致我们的经济发生前所未有的变
7月13日晚,上海大模型企业阶跃星辰正式发布面向智能体时代的AI终端品牌STEPX,并同步推出全球首个智能体原生操作系统StepAOS和个人智能体伙伴“阶跃Amoo”。全球首款大模型原生智能体手机STEPXNeo同步亮相。这意味着阶跃星辰正式打通了从基座模型、智能体系统到硬件终端的完整链路,完成了“
北京时间7月14日凌晨,OpenAI在发布会上正式推出GPT-5.6系列模型。与以往不同,这次发布会没有只围绕一个模型展开,而是同时推出了ChatGPTWork、全新的ChatGPT桌面App、HostedSites,以及GPT-5.6系列三款模型——Soul、Terra、Luna。三款模型定位各有
做跨境的人多半都有过这样一晚:住宅IP买好了,账号密码抄在手边,结果卡在最朴素的一步——连不上。
8月10日,一则来自国家发展改革委的消息振奋了整个科技界——我国首个全国产10万卡人工智能超集群日前正式投用。这个集群名为“曙光8000(登峰)”,由中科曙光主导建设,于2026年7月10日在国家超算互联网郑州核心节点正式落成并投用。这是中国首台10万卡量级的全国产AI超集群系统,也是中国首台明确采
8月10日,A股AI应用概念盘中异动拉升。石基信息直线涨停,此前榕基软件涨停,三维天地涨近15%,鸥玛软件、南威软件、通达海、恒锋信息等快速跟涨。发生了什么?消息面上,腾讯云宣布AgentMemory2.0.0大版本上线,全新升级TeamMemory,将长期记忆能力从个人扩展到团队协作场景。但更深层
8月10日,X平台AI内幕记者ChrisGPT爆料——OpenAI代号为Astra的下一代模型,即GPT-6,将于8月强行发布,即使面临政府审查压力。10万亿参数是什么概念?据估计,GPT-4的参数约1.8万亿。若Astra参数真的达到10万亿,将是GPT-4的5倍以上。OpenAI于9个月前开始发
8月10日,千问开放平台正式上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入。这不是一次普通的平台发布,这是AI从“对话工具”进化为“服务操作系统”的关键一步。首批合作伙伴覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。与此同时,菜鸟、夸克网盘、夸克扫描王等阿里生态产品
8月10日,A股正式迎来“人形机器人第一股”的打新时刻——宇树科技启动网上及网下申购。发行价150.80元/股,对应市值约609.93亿元。本次拟公开发行4044.64万股,占发行后总股本10%,预计募集资金总额约60.99亿元。这个速度有多快?宇树科技从3月20日IPO申请获受理到8月10日正式申
“PC正在被重新定义,这次重塑的意义堪比当年手机向智能手机的变革。”
具身智能的核心是“行动代价”
8月7日,证券时报发表评论文章指出,企业AI赛道正在从“炫酷演示、概念炒作”迈入“重落地、重安全、重实效”的质量竞争新阶段。信号从哪来?最近一周,阿里巴巴旗下“千问办公”开启公测,字节跳动把飞书产品团队整体并入豆包,腾讯将QClaw相关业务并入WorkBuddy——头部企业不约而同集中研发资源、整合
8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。“落后”到什么程度?梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视