当前位置:首页 >  科技 >  互联网 >  正文

智谱发布GLM-5.3:模型不变,靠后训练把编程能力提了50%

 2026-08-15 16:21  来源: 互联网   我来投稿 撤稿纠错

  一键部署OpenClaw

近日,智谱发布了GLM-5.3。这次发布会的看点不是更大的参数、更新的架构,恰恰相反——基座模型没换,提升全部来自后训练。

官方数据显示,GLM-5.3的编程能力比上一代GLM-5.2提升了50%,网络安全任务的表现也上了一个台阶。同一个基座,靠后训练阶段的投入把能力拉上来,这是智谱这次选择的技术路线。

这条路线的意义在于成本。训练一个新基座模型的费用动辄数千万美元,而后训练的投入量级小得多。如果后训练能持续挖出基座的潜力,就意味着模型能力的提升不再完全依赖烧钱堆算力。对整个行业来说,这是个值得盯着的信号。

编程是这次升级的重头。AI写代码的能力直接决定它能不能真正进入生产环境,现在的趋势很明显:编程能力强的模型,商业化的路就宽。GLM-5.3把编程作为主攻方向,打法是对路的。

还有一个对开发者友好的消息:GLM-5.3的权重会在两周内开源。开源意味着中小企业和个人开发者可以免费拿去部署,不用按调用量付费。编程能力排进第一梯队还坚持开源的模型,市场上选择不多。

国内大模型的竞争已经从“谁的参数大”转向“谁能落地”。智谱这两年在To B市场积累了不少行业客户,GLM-5.3这种强化专项能力、快速开源的策略,明显是冲着实际商用去的。

接下来的看点是实测。50%的提升是官方口径,真实场景里写复杂业务代码的表现如何,开发者社区会很快给出答案。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关标签
AI编程
AI大模型

相关文章

  • 苹果联手阿里开发中国版AI模型:Apple Intelligence终于要来了

    8月14日,路透社援引三位知情人士的消息报道——苹果公司已专门针对中国市场训练出了一款大语言模型,由阿里巴巴提供支持。这标志着苹果的策略发生了根本性转变。此前,苹果在中国市场依赖第三方模型来支持AI功能。而这次,苹果选择专门为中国市场训练一款自研模型——不是“拿来用”,而是“量身定做”。为什么是阿里

  • Anthropic冲刺2万亿美元IPO:史上最大IPO即将易主

    8月14日,一则消息让全球资本市场屏住了呼吸——Anthropic最快将于今年10月上市,部分投资者给出的估值预期已达到2万亿美元甚至更高。2万亿美元是什么概念?这将超越SpaceX此前创下的1.77万亿美元IPO估值纪录,成为史上规模最大的IPO。Anthropic的估值在5月已超越OpenAI,

    标签:
    AI大模型
  • 智谱发布GLM-5.3:编程能力提升50%,两周后开源

    8月14日,智谱正式发布GLM-5.3。这次升级的核心是“后训练Scaling”——基座模型未变,但通过极致的后训练大幅提高了模型的智能上界。编程能力是最亮眼的升级。官方数据显示,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%。在包括TerminalBench3.0、Agents'La

    标签:
    AI大模型
  • 大模型双雄齐涨:智谱、MINIMAX-W均涨逾6%,中国AI正“走出”价格战

    8月12日,港股大模型双雄集体走高,智谱、MINIMAX-W均涨逾6%。消息面的核心驱动力来自摩根士丹利的一份研报。大摩称,中国大模型正“走出”价格战,“走向”智能战。中国大模型行业正经历从价格竞争到智能竞争的结构性转变。三重变化:DeepSeek宣布大幅上调API价格,定价回归理性;KimiK3和

  • 英伟达被曝开发万亿参数开源模型Nemotron 4:GPU巨头也要下场“卷”模型了

    8月12日,据媒体报道,英伟达正在开发新一代开源人工智能模型Nemotron4,预计参数规模至少达到1万亿。GPU巨头亲自下场做开源大模型——这件事本身就值得细品。Nemotron4的目标是与全球领先的开源大模型竞争。英伟达希望通过开放模型生态扩大AI应用范围,并进一步推动市场对其GPU算力的需求。

热门排行

信息推荐