1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

Kimi K3登顶全球编程榜:中国大模型首次站上Arena榜首

 2026-07-21 15:20  来源:互联网  我来投稿 撤稿纠错

  一键部署OpenClaw

7月20日,“中国大模型首次登顶Arena”的话题冲上科技热搜。

在Arena全球AI大模型榜单的Frontend Code Arena(前端代码榜) 中,月之暗面的Kimi K3以1679分超越Anthropic的Claude Fable 5(1631分)和OpenAI的GPT-5.6 Sol(1618分),位居全球第一。在Arena综合榜中,Kimi K3也首次杀入Top 10,以1486分位列第9,成为首个进入全球前十的开源模型。分项来看,K3在创意写作、代码生成和指令遵循三个核心类别均进入前十,在物理与社会科学、法律与政府、医疗健康等专业领域排名第一,商业管理与金融运营排名第三。

Arena的测评机制是“盲测”——用户同时和两个匿名模型对话,然后选出哪个回答更好,没有品牌滤镜,纯粹靠体验说话。Kimi K3能登顶,意味着在“对话体验”这个维度上,国产模型已经站到了最前面。

但争议也随之而来。

Kimi K3发布后选择了开源。对此,OpenAI新上任的战略未来主管Dean W. Ball公开批评,称开放权重模型“本质上是减速主义的”,会阻碍进一步的AI资本支出。硅谷关于开源与闭源路线的激烈辩论随之爆发。

更有意思的是,K3发布后48小时内,因用户请求量大幅超出预估并逼近集群承载极限,月之暗面不得不在7月19日宣布暂停C端新用户订阅。一款开源模型的发布,竟然以“算力不足”收场。这与高盛此前的预判形成了直接冲突——高盛曾警告“扩展不再是唯一制胜路径”,但K3的算力熔断恰恰证明了算力需求远未到顶。

技术层面,K3总参数2.8万亿,采用Kimi Delta Attention与Attention Residuals架构,配合Stable LatentMoE实现896个专家中每token仅激活16个的高稀疏度。据官方测算,整套架构的扩展效率较Kimi K2提升约2.5倍。加州大学伯克利分校计算机科学教授斯托伊卡表示:“过去我们一直认为中国的开源模型大约落后最先进模型6-9个月。而现在,这种差距可能已经缩小到2-3个月。 ”

中国大模型,正在从追赶者变成挑战者。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关标签
月之暗面
大模型

相关文章

  • 国产大模型扎堆发布:万亿参数已是“起步价”

    7月17日凌晨,月之暗面推出新一代大模型KimiK3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeekV4“满血版”最快7月20日亮相。MiniMax被

    标签:
    大模型
    ai技术
  • 阶跃星辰发布全球首款大模型原生智能体手机

    7月13日晚,上海大模型企业阶跃星辰正式发布面向智能体时代的AI终端品牌STEPX,并同步推出全球首个智能体原生操作系统StepAOS和个人智能体伙伴“阶跃Amoo”。全球首款大模型原生智能体手机STEPXNeo同步亮相。这意味着阶跃星辰正式打通了从基座模型、智能体系统到硬件终端的完整链路,完成了“

    标签:
    大模型
  • 中国AI大模型连续五周领跑全球,调用量大幅增长

    如今出门,如果你还没用过AI智能助手,可能真有点跟不上节奏了。无论是写作文、查资料,还是规划出行路线,越来越多的人已经习惯随手打开AI问一句。这股热潮背后,中国AI大模型用实打实的数据交出了一份亮眼的成绩单。根据全球知名AI模型聚合平台OpenRouter的最新数据,在3月30日至4月5日这一周,中

    标签:
    大模型
  • 一秒当导演:小云雀上线短剧Agent,10万字剧本一键生成60集

    凌晨两点,小王合上笔记本,揉了揉酸胀的眼睛。花了一个月写出来的10万字短剧剧本躺在硬盘里,要真正把它拍成剧,得找演员、租场地、请摄像、做后期……粗算下来少说要几十万,他只能把剧本继续锁在抽屉里。不过,现在小王的剧本可以“见光”了。2026年3月19日,字节跳动旗下的小云雀AI正式上线了短剧Agent

    标签:
    大模型
  • 谷歌 Gemma 4 正式开源,开源赛道迎来变局!

    4月3日凌晨,谷歌DeepMind悄然甩出一枚重磅炸弹——全新一代开源大模型Gemma4正式发布,以极其宽松的Apache2.0协议向全球开发者免费开放。这是自2025年3月发布Gemma3以来,谷歌时隔整整一年的重大迭代。本次发布的Gemma4包含四个不同规格的版本:E2B(有效20亿参数)、E4

    标签:
    大模型
  • Kimi K3登顶全球编程榜:中国大模型首次站上Arena榜首

    7月20日,“中国大模型首次登顶Arena”的话题冲上科技热搜。在Arena全球AI大模型榜单的FrontendCodeArena(前端代码榜)中,月之暗面的KimiK3以1679分超越Anthropic的ClaudeFable5(1631分)和OpenAI的GPT-5.6Sol(1618分),位居

  • 向日葵 vs ToDesk 2026横评:免费版无限时长真的更香吗?

    一句话结论:经过一段时间的深度实测,向日葵在免费政策、连接稳定性、远程开机生态三大核心维度上全面领先;ToDesk短时内体验尚可,但其每月80小时+200次连接的“双限制”策略与数据虚标问题,使其难以成为长期可靠的远控工具。核心指标速览(2026年7月实测)为了让大家3秒看清差距,笔者将最关键的真实

    标签:
    向日葵
  • 国产大模型扎堆发布:万亿参数已是“起步价”

    7月17日凌晨,月之暗面推出新一代大模型KimiK3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeekV4“满血版”最快7月20日亮相。MiniMax被

    标签:
    大模型
    ai技术
  • AI硬件爆发:千问推出智能体眼镜和耳机

    WAIC2026首日,千问推出两款AI硬件新品——升级为智能体眼镜的千问AI眼镜,以及首款AI智能体耳机。千问AI智能体眼镜新增了全双工语音(支持边说边听、随时打断)、眼动追踪(视线即指令),还实现了行业首创的用户体征实时监测——心率、血氧、HRV等数据都能实时获取。这不是千问第一次做硬件。此前千问

  • WAIC 2026落幕:AI从“能说”进入“会干”时代!

    7月17日至20日,2026世界人工智能大会(WAIC)暨人工智能全球治理高级别会议在上海举行。展览面积首次突破10万平方米,1100余家企业参展,展出3000余项展品,超300款产品全球首发。今年最大的变化是什么?AI不拼参数了,拼落地。前两年WAIC上,厂商忙着比谁的模型参数多、跑分高。今年不一

    标签:
    ai智能
  • 阿里千问输入法App正式发布:主打AI语音,说完即成稿

    7月19日,阿里正式发布千问输入法App,目前已登陆苹果AppStore及各大安卓应用商店。这款产品定位为以语音输入为核心的AI输入法,依托千问语音大模型,宣称语音输入速度最快可达每分钟300字,主打“说完即成稿”。这是继腾讯微信输入法、字节跳动豆包输入法之后,第三家入局AI输入法赛道的互联网大厂。

    标签:
    阿里千问

热门排行

编辑推荐