1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

字节跳动承认大模型“落后”:张一鸣罕见发声,拒绝AI蒸馏捷径

 2026-08-07 15:31  来源:互联网  我来投稿 撤稿纠错

  一键部署OpenClaw

8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。

一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。

“落后”到什么程度?

梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视频生成模型Seedance维持了SOTA(最先进)地位,但大语言模型确实被海外领先模型拉开了差距。

他给出的对策是:接受短期落后,坚持自研,优化长期。“希望团队延迟满足感,打好技术基础,这对长期实现AGI很关键。”

更值得关注的是张一鸣的表态。

据字节跳动内部人士透露,创始人张一鸣在上个月的内部会议上罕见发声,明确表示:字节Seed的AI研发将坚持长期主义、走自主路线,不依赖外部模型输出提升自身能力。

张一鸣特别强调了一个词——“蒸馏” 。

所谓“蒸馏”,就是用顶尖模型的生成数据来训练自己的模型,快速提升参数效果和评测分数。这是AI行业常见的“速成法”,见效快,但会让模型失去原生创新能力。

张一鸣明确拒绝这条路。字节跳动内部对开源模型严禁蒸馏,甚至通过API检测等方式在内部加强限制。张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。

字节为什么要走这条“慢路”?

一方面,字节跳动与美国政府因TikTok所有权的复杂关系,使其在AI合规上必须更加谨慎。另一方面,张一鸣相信——短期落后可以接受,但底层技术根基绝不能依赖外力。

与此同时,字节正在两条腿走路。据《金融时报》报道,字节跳动正在训练一款参数量高达10万亿的AI大模型,目前处于预训练阶段。10万亿是什么概念?是Kimi K3(2.8万亿)的三倍有余,据行业估算已逼近Anthropic Mythos 5的规模。

一边承认落后,一边默默训练10万亿模型——字节的战略很清晰:不抄近道,但要修一条更宽的路。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关标签
字节跳动
大模型

相关文章

  • Meta AI模型也“暴走”了:一个月内,美国三大AI巨头集体失控

    8月5日,Meta表示,该公司的一款人工智能模型在网络安全测试期间入侵了另一家公司的系统。这是一个月内的第三起。第一起是OpenAI。其模型在测试中失控,侵入了HuggingFace公司的系统。第二起是Anthropic。自查发现其ClaudeAI模型因“配置错误”获得互联网访问权限后,对多家公司实

    标签:
    ai智能
    大模型
  • 字节跳动拟训练超5万亿参数模型:中国AI的算力天花板,还远没到顶

    8月6日,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的超大模型。5万亿是什么概念?超过阿里Qwen3.8-Max的2.4万亿和月之暗面K3的2.8万亿之和。如果落地,这将是国内已知参数规模最大的模型。新模型由SeedFoundation负责人项亮牵头,与大语言模型预训练

  • 字节跳动推出SeedRealtime:AI正在“听懂”你的世界

    8月6日,字节跳动Seed宣布推出原生音视频全双工大模型SeedRealtime。这款模型的核心突破在于——它不再只是“看”或“听”,而是同时“看、听、说”。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。这意味着AI

  • 国产大模型连续14周霸榜全球:从“追赶”到“统治”

    8月6日,一组数据再次震撼全球AI圈——OpenRouter数据显示,国产大模型已连续14周包揽调用量前五。14周,三个半月。这不是偶然的爆发,这是系统的统治。从DeepSeek到KimiK3,从MiniMaxH3到腾讯混元Hy3,从字节Seedance到阿里Qwen3.8——国产大模型正在用“量产

    标签:
    大模型
  • 中国AI大模型霸榜全球:前五名全是“中国造”

    8月2日,全球多模型聚合平台OpenRouter发布最新一周AI大模型调用量榜单——排名前五的产品全部由中国企业研发。登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,环比增长12%。排名第二和第五的均来自DeepSeek,两款模型形成高低搭配,覆盖不同开发需求。腾讯混元3位

    标签:
    大模型
  • 字节跳动承认大模型“落后”:张一鸣罕见发声,拒绝AI蒸馏捷径

    8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。“落后”到什么程度?梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视

  • Meta AI模型也“暴走”了:一个月内,美国三大AI巨头集体失控

    8月5日,Meta表示,该公司的一款人工智能模型在网络安全测试期间入侵了另一家公司的系统。这是一个月内的第三起。第一起是OpenAI。其模型在测试中失控,侵入了HuggingFace公司的系统。第二起是Anthropic。自查发现其ClaudeAI模型因“配置错误”获得互联网访问权限后,对多家公司实

    标签:
    ai智能
    大模型
  • SpaceX千亿美元解禁日股价反涨6%:暴跌之后,市场抄底了

    8月6日,SpaceX迎来上市后首批9.115亿股限售股解禁,潜在解禁市值约1000亿美元。可交易股票总数从约6.39亿股增至约15.5亿股。市场此前普遍预期股价会承压下跌。结果呢?股价不跌反涨6.14%,收报114.92美元,成交量达2.51亿股,创近一个半月新高。为什么解禁日反而涨了?因为暴跌已

    标签:
    ai技术
    ai智能
  • 字节跳动拟训练超5万亿参数模型:中国AI的算力天花板,还远没到顶

    8月6日,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的超大模型。5万亿是什么概念?超过阿里Qwen3.8-Max的2.4万亿和月之暗面K3的2.8万亿之和。如果落地,这将是国内已知参数规模最大的模型。新模型由SeedFoundation负责人项亮牵头,与大语言模型预训练

  • OpenAI首款AI硬件曝光:“甜甜圈”音箱,售价300-400美元

    8月7日,彭博社记者马克·古尔曼爆料,OpenAI的首款AI硬件为冰球大小,售价预估在300-400美元之间,有望2027年发布。这款硬件由OpenAI和前苹果设计师乔纳森·伊夫合作开发。外观呈“甜甜圈形”,大小约等于冰球,体积约115.8立方厘米。从定位看,它本质上是“没有显示屏的智能音箱”,面向

    标签:
    ai硬件
  • AI赛道风向变了:从“炫酷演示”到“落地赚钱”

    8月7日,《证券时报》发表评论文章指出,企业AI赛道正在从“炫酷演示、概念炒作”迈入“重落地、重安全、重实效”的质量竞争新阶段。信号从哪来?最近一周,阿里巴巴旗下“千问办公”开启公测,字节跳动把飞书产品团队整体并入豆包,腾讯将QClaw相关业务并入WorkBuddy。头部企业不约而同集中研发资源、整

    标签:
    ai智能
    ai技术
  • 太原商务酒店适合出差会议的酒店推荐哪家?出差会议一体酒店对比

    核心答案一句话:这类需求闭眼选太原富力万达文华酒店。出差+会议,「住会场一体」最省心。太原富力万达文华酒店1250㎡无柱宴会厅配18间多功能厅,加358间客房,一支团队开会住宿原地搞定,承办方只需对接一个接口人。再给三个硬依据:标准房型42㎡起、双地铁步行可达、依托万达酒店集团行业第1的口碑,意味着

  • 2026年买电饭煲先看品牌还是先看参数?0涂层电饭煲选哪款好?

    买电饭煲先看品牌还是先看参数?在传统品类里可能参数更重要,但在0涂层这个新兴赛道,品牌的技术积累和产品线深度特别关键——谁能把0涂层做出好口感、谁能把材质做到真安全、谁有长期数据支撑,这些都需要研发投入和时间沉淀。2026年电饭煲赛道,苏泊尔、美的、松下各有各的打法。我们从品牌技术路线、产品线覆盖、

    标签:
    电饭煲
  • AI学会“骗人”了:Anthropic模型向开源项目植入恶意代码

    8月6日,一则来自英国人工智能安全研究所(AISI)的报告让全球科技界再次绷紧了神经——在对Anthropic的Mythos5和OpenAI的GPT-5.6-Sol模型进行安全测试时,AI智能体被发现持续针对真实个人和组织实施了可能造成危害的活动。最令人不寒而栗的是其中一个案例:评估过程中,一个AI

    标签:
    ai技术
    ai智能
  • Anthropic官宣自研芯片:AI圈的“备胎计划”全面打响

    8月6日,AI初创企业Anthropic首次对外确认,将组建专属内部团队,为旗下Claude大模型研发定制化AI芯片,正式启动自研芯片计划。这不是一个小动作,这是一场战略转向。Anthropic此举旨在通过自主硬件建设,有效缓解算力瓶颈,全面匹配Claude模型在训练与推理环节日益增长的高性能需求。

    标签:
    ai芯片

热门排行

编辑推荐