8月12日深夜,阿里云旗下魔搭ModelScope社区投下了一颗重磅炸弹——阿里Qwen团队正式向全球开发者开放Qwen3.8-2.4T-A95B模型权重。
这是Qwen-Max级别模型首次开源权重。
总参数2.4万亿,每个Token激活95B参数,原生支持262,144 Token上下文,可扩展至101万Token。模型采用高效的稀疏架构,虽然整体规模庞大,但每次处理任务时只调用其中一小部分能力,既保证了性能又控制了计算成本。
它能干什么?
官方公布的测试案例相当震撼:连续自主编程约16天、独立复现并改进研究论文、在超2000轮交互中经营虚拟电商企业。在编程、办公自动化、科研分析等复杂任务场景中,模型表现尤为突出。
这不是阿里第一次开源模型,但第一次把旗舰级模型完全放开,意义完全不同。 此前开源的大多是中杯、小杯版本,而这次是Max级别——阿里最强的大模型,免费开放给全球开发者。
商业层面,开源正在从“追赶”变成“围剿”。
据Hugging Face 2026年春季报告,中国自研开源模型下载占比达41%,首次超过美国。市场研究公司Counterpoint直言:“如果西方科技巨头只顾构建封闭的围墙花园,开发者和企业自然会转向中国的开放权重模型。”
当开源模型在性能上逼近闭源对手,却以数分之一的价格和自由部署的方式提供服务时,闭源厂商的定价权与利润率将同时承压。
开发者大量转向开源方案,意味着闭源实验室不仅失去直接的API收入,更失去了构建开发者生态的机会。
阿里这次开源,不是一次孤立的发布——DeepSeek V4 Pro同一天上线,Meta发布Muse Glimmer,英伟达推出Nemotron 3.5 Lightning。头部厂商正在用开源“围剿”闭源,而阿里把旗舰模型免费开放,相当于在围剿战中投下了最重的一颗炸弹。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
8月13日,AI开源赛道迎来了一场集体爆发。DeepSeekV4Pro正式版上线,性能接近Fable5。阿里正式开放Qwen3.8-2.4T-A95B模型权重,这是阿里首次将Max级旗舰模型对外开放权重。几天前,Meta发布开源模型MuseGlimmer,并预告将开放旗舰模型MuseSpark1.2
8月11日,阿里巴巴在发布Qwen3.8-Max的同时,悄然上线了另一款重磅产品——视频生成模型Wan3.0。Wan3.0最炸裂的功能是什么?它首创支持doc/xls/ppt/pdf等办公文档直接转视频。这意味着你上传一份PPT或Word文档,AI就能自动生成一段视频——把枯燥的汇报材料变成生动的视
8月3日,MiniMax正式开源多模态生成模型MiniMaxH3。同日,摩尔线程基于AI训推一体智算卡MTTS5000及MUSA软件栈,率先完成H3的极速适配与高效运行。3小时,打通了从推理框架到高性能算子库的完整适配路径。这意味着什么?MiniMaxH3是MiniMax首款开源多模态生成模型,突破
8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMaxH3。同一天,摩尔线程、壁仞科技、海光信息三家国产算力厂商同日宣布完成该模型的“Day0”适配。国内用户与开发者可即刻在对应国产算力平台部署,体验这款模型的全性能多模态交互与图文音视频生成能力。“Day0适配”正在成为国产AI的标
7月,中国AI办公赛道走到了一个关键的拐点。易观数据显示,国内17款主流桌面端AI原生办公智能体合计月访问量突破6000万次。与此同时,腾讯、阿里、字节几乎在同一周完成了AI办公产品的整合——收拢战线、统一入口,行业竞争的节奏正在从“各自试错”切换到“集中推进”。字节跳动:把飞书“塞进”豆包7月30
8月13日凌晨,DeepSeek突然发布了全世界都在期盼的V4Pro大语言模型正式版。这款被命名为DeepSeek-V4-Pro-0813的模型,性能炸裂。官方公布的基准测试显示,V4-Pro-0813在多项指标中稳定优于Opus4.8,与业界公认的顶尖模型Fable5相比,整体表现旗鼓相当。相比预
8月13日,一个看似遥远却影响深远的概念走进公众视野——太空算力。在《新质生产力发展大会——太空算力产业》活动现场,一家企业展示了自主研发的航天级算力专用GPU芯片,把太空算力硬件成本从数万元降至几千元甚至几百元。现场还亮相了全国产化太空服务器,搭载双内核星载操作系统,当遭遇宇宙高能粒子干扰时,可毫
8月13日,AI开源赛道迎来了一场集体爆发。DeepSeekV4Pro正式版上线,性能接近Fable5。阿里正式开放Qwen3.8-2.4T-A95B模型权重,这是阿里首次将Max级旗舰模型对外开放权重。几天前,Meta发布开源模型MuseGlimmer,并预告将开放旗舰模型MuseSpark1.2
8月12日盘后,腾讯控股发布2026年第二季度财报。核心数据:当季营收2047.9亿元,同比增长11%;Non-IFRS经营利润756.4亿元;若剔除新AI产品收入,Non-IFRS经营利润同比增长19%至861亿元。最引人注目的是资本开支。二季度资本开支527.8亿元,同比增长176%,环比增长6
8月12日,港股大模型双雄集体走高,智谱、MINIMAX-W均涨逾6%。消息面的核心驱动力来自摩根士丹利的一份研报。大摩称,中国大模型正“走出”价格战,“走向”智能战。中国大模型行业正经历从价格竞争到智能竞争的结构性转变。三重变化:DeepSeek宣布大幅上调API价格,定价回归理性;KimiK3和
8月12日,IT之家报道了一组令人震撼的数据——DeepSeek创始人梁文锋的净资产从2025年的10亿美元飙升至2026年的395亿美元,一年内增长了惊人的3850%。3850%是什么概念?这意味着一年的时间里,他的财富翻了近40倍。梁文锋不仅是跻身全球最富有的50人之列,更是一年来财富增长速度最
8月12日,中信证券发布研报披露,字节跳动近期成立了一级部门“AI数据与安全”,进一步提升数据在AI战略中的组织定位。这不是一次普通的组织调整,这是大模型竞争逻辑发生根本转变的信号。中信证券在研报中指出,随着公开互联网数据逐步被充分利用、模型向Coding、Agent、世界模型及专业领域持续延伸,大
8月12日,据媒体报道,英伟达正在开发新一代开源人工智能模型Nemotron4,预计参数规模至少达到1万亿。GPU巨头亲自下场做开源大模型——这件事本身就值得细品。Nemotron4的目标是与全球领先的开源大模型竞争。英伟达希望通过开放模型生态扩大AI应用范围,并进一步推动市场对其GPU算力的需求。
8月12日凌晨,美国AI云服务巨头CoreWeave在美股盘后交易中一度暴涨超16%。暴涨的背后,是一份让市场重新相信AI“算力故事”的财报。CoreWeave二季度实现营收25.75亿美元,同比增长112%,超出市场预期。更关键的是——合同在手订单达到1040亿美元(约合人民币7000亿元)。而且
8月12日,据Axios报道,由英伟达、思科和CrowdStrike等超过120家组织组成的联盟,正提议为AI智能体建立一套新的事故报告机制。该机制将要求参与企业披露特定的智能体故障,并保留详细的事故原因记录。为什么需要这个机制?答案写在过去一个月密集发生的AI“越界”事件里。OpenAI的模型在测