8月6日,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的超大模型。
5万亿是什么概念?超过阿里Qwen3.8-Max的2.4万亿和月之暗面K3的2.8万亿之和。如果落地,这将是国内已知参数规模最大的模型。新模型由Seed Foundation负责人项亮牵头,与大语言模型预训练数据负责人沈科共同推进。Seed团队正重新梳理组织、划分职责、分配资源。
字节的算力底牌有多厚?
截至今年6月,豆包大模型日均Token调用量达180万亿,字节大模型业务年化收入已达40亿美元。支撑这些数字的,是字节在算力基础设施上的持续重仓。训练5万亿参数的模型,对算力的要求远超现有任何国产模型——这不仅是模型竞赛,更是算力竞赛。
从DeepSeek的1.6万亿到Kimi K3的2.8万亿,再到Qwen3.8的2.4万亿,国产大模型的参数纪录在短短几个月内被反复刷新。字节的5万亿计划,直接把这个数字推到了另一个量级。
一位业内人士分析,字节此举意味着国内大模型正从“应用层优势”向“底层模型参数规模”发起全面冲击。国内大模型“参数竞赛”进入5万亿量级时代,与海外模型的差距正在进一步收敛。
当然,5万亿仍处于早期讨论阶段。更大的模型不等于更好的模型——训练效率、推理成本、实际能力,才是真正的考验。但字节敢讨论5万亿,至少说明了一件事:中国AI的算力天花板,还远没到顶。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
8月6日,字节跳动Seed宣布推出原生音视频全双工大模型SeedRealtime。这款模型的核心突破在于——它不再只是“看”或“听”,而是同时“看、听、说”。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。这意味着AI
8月6日,一组数据再次震撼全球AI圈——OpenRouter数据显示,国产大模型已连续14周包揽调用量前五。14周,三个半月。这不是偶然的爆发,这是系统的统治。从DeepSeek到KimiK3,从MiniMaxH3到腾讯混元Hy3,从字节Seedance到阿里Qwen3.8——国产大模型正在用“量产
8月2日,全球多模型聚合平台OpenRouter发布最新一周AI大模型调用量榜单——排名前五的产品全部由中国企业研发。登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,环比增长12%。排名第二和第五的均来自DeepSeek,两款模型形成高低搭配,覆盖不同开发需求。腾讯混元3位
7月31日,国产大模型公司MiniMax正式发布新一代多模态生成模型MiniMaxH3,并宣布近期开源。港股MiniMax开盘涨超20%,截至午间收盘涨幅回落至约12%,报230港元/股。资本市场给出了最直接的回应。H3强在哪里?首先,它是一款通用的全模态生成模型,支持文本、图片、音频和视频等多种输
7月,中国AI办公赛道走到了一个关键的拐点。易观数据显示,国内17款主流桌面端AI原生办公智能体合计月访问量突破6000万次。与此同时,腾讯、阿里、字节几乎在同一周完成了AI办公产品的整合——收拢战线、统一入口,行业竞争的节奏正在从“各自试错”切换到“集中推进”。字节跳动:把飞书“塞进”豆包7月30
7月,生命科学板块迎来久违的大爆发。“十五五”国民健康规划落地、BD出海交易额创历史新高、国产创新药获批加速、企业回购潮涌、机构持续看好,确立长期向好趋势。生物科技板块内资金涌动,7月中旬,迪哲医药、博瑞医药、睿智医药、昭衍新药等多家创新药公司率先涨停。但随后资金开始涌入医疗科技领域,7月21日,德
8月14日,央广网披露了一组震撼数据——腾讯、字节跳动、阿里、百度四家头部互联网企业合计资本开支年增速超过80%。二季度,腾讯单季资本开支飙升至528亿元,是上年同期的近三倍。字节跳动的投入力度更大,重心落在大型数据中心、自研芯片平台及国产AI算力方案的建设与落地。盘古智库高级研究员江瀚分析:“AI
8月14日,DeepSeek宣布——DeepSeekHarness的开发者预览版面向全球开发者开放测试,并同步以MIT协议开放源代码。Harness是什么?这是一款面向编程与智能体场景的工具。开源协议选择了最宽松的MIT协议——这意味着开发者可以自由使用、修改、商用,几乎没有任何限制。为什么Harn
8月14日,《日经亚洲》披露了一则重磅消息——腾讯将从Meta手中收购中国AI开发商Manus的股份,成为其最大股东。Manus是谁?Manus是中国AI领域的明星创业公司。Meta在去年12月以20亿美元将其收入囊中。但今年4月,中国发改委要求撤销该交易。Manus在周二宣布将与Meta切断关系,
8月14日,路透社援引三位知情人士的消息报道——苹果公司已专门针对中国市场训练出了一款大语言模型,由阿里巴巴提供支持。这标志着苹果的策略发生了根本性转变。此前,苹果在中国市场依赖第三方模型来支持AI功能。而这次,苹果选择专门为中国市场训练一款自研模型——不是“拿来用”,而是“量身定做”。为什么是阿里
8月14日,一则消息让全球资本市场屏住了呼吸——Anthropic最快将于今年10月上市,部分投资者给出的估值预期已达到2万亿美元甚至更高。2万亿美元是什么概念?这将超越SpaceX此前创下的1.77万亿美元IPO估值纪录,成为史上规模最大的IPO。Anthropic的估值在5月已超越OpenAI,
8月14日,智谱正式发布GLM-5.3。这次升级的核心是“后训练Scaling”——基座模型未变,但通过极致的后训练大幅提高了模型的智能上界。编程能力是最亮眼的升级。官方数据显示,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%。在包括TerminalBench3.0、Agents'La
8月14日,OpenAI发布公告——针对GPT-5.6Sol推出Ultrafast(超高速)模式,速度是标准处理速度的14倍,最高每秒输出750个Token。14倍是什么概念?以前你要等10秒才能读完AI的回复,现在不到1秒就读完了。对于需要实时响应的场景——客服对话、金融交易分析、事故响应——这1
8月13日,谷歌宣布推出Gemini3.7Flash,专为编程与Agent场景打造。迭代速度惊人。距Gemini3.6Flash发布仅间隔约三周。谷歌称,该版本的推出直接源于开发者反馈以及一系列算法创新。能力全面提升。在软件工程、知识工作及网页开发工作流方面均实现了大幅提升。价格更是“杀手锏”。在今
8月14日,财联社报道——高盛正与潜在投资者就参与英伟达5000亿美元人工智能融资计划进行磋商。这笔交易有多大?英伟达8月10日宣布,与包括高盛在内的六家主要金融机构合作,目标是为AI基础设施筹集超过5000亿美元的第三方资本。英伟达的角色是“搭桥”——用自己的行业地位做信用背书,让华尔街的钱流进A