1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

生产力工具中的“六边形战士”:解密海螺AI“红海突围”的底气

 2024-05-24 17:04  来源:A5专栏  我来投稿 撤稿纠错

  一键部署OpenClaw

2023年可以说是人工智能行业最振奋的一年,大模型的能力每隔一段时间就会上一个新台阶,汹涌澎湃的技术革命迅速影响着每一个人的生活,AGI不再是一种技术理想,而是触手可及的现实。

到了2024年,人工智能的热度不减,但口口相传的“百模大战”并未上演。资本市场罕见地“降温”,不少大模型悄无声息地消失,有机会进入决赛圈的大模型创业者,仅剩下寥寥数家。

其中就有孵化出海螺AI的MiniMax,一家不为太多人所熟知,估值却早已超过25亿美元的现象级独角兽。

01 技术路线几乎没有退路

目前国内估值超过10亿美元的大模型创业团队只有五六家,MiniMax恰恰又是其中最为特殊的存在:

1、月之暗面、百川智能、零一万物等均成立于2023年,MiniMax却是一家诞生于2021年的企业,比友商们早了两年时间。

2、有别于李开复、王小川等人的“明星”身份和高调风格,MiniMax的创始人闫俊杰不可谓不低调,很少在公开场合露面。

3、“抢算力”俨然是整个AI行业的常态,MiniMax没有够购买任何GPU,而是以相对便宜的价格找火山引擎租了大量GPU算力。

为何特立独行的MiniMax能够活下来?答案就藏在闫俊杰时常提及的一句话里:“我选的技术路线几乎没有退路”。

直接的例子就是MoE(混合专家模型)上的“豪赌”。

时间回到2023年夏天,国内的大模型厂商们纷纷加快了研发进度,摆在MiniMax面前的现实问题是:自家2B和2C的产品已经有很多用户,传统dense(稠密)模型生成token的成本太高,延时太严重;在计算资源有限的情况下,只有MoE才能训练完当时的数据。

理论上讲,MoE相较于dense模型的预训练速度更快,在相同参数的情况下,有着更快的推理速度,但在微调方面存在诸多挑战,比如泛化能力不足容易引发过拟合现象,属于典型的“技术派才有的红利”。

其他厂商选择dense模型快速迭代的时候,MiniMax放了80%以上的算力和研发资源做MoE,而且没有Plan B。

拐点出现在2024年初,MiniMax发布了国内首个基于MoE架构的abab 6,找到了越来越多加速实现Scaling Laws的途径,包括改进模型架构、重构数据pipeline等等,并在三个月后研发出了更强大的abab 6.5。

正如外界所熟知的,长文本能力在2024年成为生产力工具的“胜负手”,万亿参数的abab 6.5已经200k tokens 的上下文长度,综合能力已经不逊于国外主流大模型;使用同样的训练技术和数据的abab 6.5s,进一步提升了推理速度,可以在1秒内处理近3万字的文本。

按照业界常用的“大海捞针”机制,即在很长的文本中放入一个和该文本无关的句子(针),然后通过自然语言提问模型,看模型是否准确将这个针回答出来。在891次问答中,abab 6.5均能正确回答。

现在,MoE模型已经上升为行业共识,被认为是高性能AI大模型的必选项,而MiniMax已经在这条路上“抢跑”了一年。

02 技术驱动的产品方法论

让许多人没想到的是,一群痴迷于技术的工程师,“意外”做出了多个日活用户超过100万的产品,包括Glow、星野、海螺AI等,涵盖内容社区、生产力工具等不同方向。

曾有媒体在采访时询问闫俊杰:“你们第一个模型还没做出来,就招了产品经理,当时你如何向他描述你想要一个怎样的产品?”出乎预料的是,闫俊杰给出的回答只要三个字:“不知道。”

闫俊杰口中的“不知道”,源于对技术的敬畏:当前AI原生的超级产品,无不源自突破性的技术进步。

比如搜索问答几乎是所有对话式AI的标配,也是我们使用生产力工具提升工作效率的刚需功能。但越是基础的功能,越能验证生产力工具的价值,考验背后大模型的能力。

百度发布2024年Q1财报后,我们同时在海螺AI和国外的一款产品进行了对比,用户体验可谓高下立见:

海螺AI整理出了百度的核心业务信息,包括营收、利润等关键数据,以及百度智能云、开发者社区、百度APP、萝卜快快等核心业务数据,有着清晰的逻辑和侧重,并且每条内容都关联了对应的信息源,甚至在末尾附加了和百度财报相关的常见问题。

另一款产品也准确回答了财报的核心信息,但仅仅引述了一些媒体报道,输出内容的结构化很弱,需要人工二次处理信息。和直接用搜索引擎查找信息的方式相比,并未节省太多的时间。

再比如长尾内容的检索和生成能力。像百度财报这样的热门议题,很容易找到相关的媒体报道,一些小众的长尾内容,似乎更能考验生产力工具的内容检索和生成能力。

我们的问题是皮尔斯·布朗的代表作《火星崛起》,曾被《娱乐周刊》评为2014年度最佳图书,但知名度不如《火星救援》、《星球崛起》等可能被AI混淆的名著。海螺AI准确理解了我们的需求,生成的故事梗概可圈可点,并给出了深刻的评价;豆包将我们的需求误解为《星球崛起》,生成的内容居然是《火星三部曲》的介绍。

技术的上限左右着产品的上限。

MiniMax之所以做出了海螺AI这样“能打”的生产力工具,根源在于技术驱动的产品方法论,只有具备足够好的产品能力,才能承接和转化取得的技术进展,否则会落得一场空。

当然,MiniMax也有自己的“野心”。就像闫俊杰所筹划的:“在技术快速进化的窗口关闭前,做出用户量巨大的To C产品。”

03 做普通人每天用的产品

资本圈里流传着一句话:判断一位人工智能创业者是否真正的AGI信仰,就看这个人创业是在2023年之前还是之后。作为普通用户,则有另一套判断标准,即能不能解决实际问题,扎扎实实地提高工作效率。

行事低调的闫俊杰,很少围绕AGI的话题高谈阔论,但在媒体采访时讲述了自己朴素的信仰:Intelligence with everyone。

怎么理解“与用户共创智能”?海螺AI无疑是最直观的研究对象。

生产力工具作为当下最拥挤的大模型赛道,市面上的产品已经多达几十款,豆包、文心一言、智谱清言、Kimi……哪怕是在高度内卷的局面下,肩负MiniMax信仰的海螺AI,依然表现出了差异化和稀缺性。

首先是简洁的产品设计。

为了争夺用户的注意力和时长,越来越多的对话式AI产品在首页上添加了丰富的菜单栏,努力向用户表达功能的多样性。海螺AI不可谓不克制,首页上除了简单的功能引导和对话框外,并没有其他影响注意力的元素。

不同的设计风格,似乎谈不上孰优孰劣,但从生产力工具的定位来说,页面的简洁与否和大模型能力不无关系。倘若大模型的能力足够强大,哪怕没有花里胡哨的功能露出,也可以通过生成的内容占领用户心智。刻意强调功能的多样性和玩法的趣味性,反而在大模型的能力上漏了怯。

其次是过硬的产品能力。

诸如搜索问答、语音对话、长文总结等功能,早已是对话式AI产品的标配,也是高度同质化的主要诱因。但只要深入使用一段时间,或者进行简单的结果对比,并不难判断能力上的高下,找到最适合的生产力工具。

而产品能力的强弱,往往体现在一些细节中。以我们高频使用的长文总结为例,将第三方行业报告上传到海螺AI,可以准确梳理报告的核心信息,并根据报告内容进行对话。原先阅读一篇报告需要至少两个小时的时间,现在不到5分钟就能完成,工作效率可以说是实现了指数级增长。

然后是多元的使用场景。

有些产品尽可能在首页上推荐足够多的“角色”,来告诉我们有很多使用场景,适合不同的用户。仅仅在prompt下功夫,当真可以满足不同人群的需求吗?市场初期也许奏效,可终归不是解决问题的最优解。

海螺AI的答案是从能力上满足不同人群的需求:帮研究人员快速总结和分析长篇学术论文或研究报告、帮内容创作者整合关键信息并生成爆款文章、帮知识工作者整理和回顾学习资料、为日常用户提供生活中的即时帮助……就像是一个能打的六边形战士,背后是万亿参数MOE大模型的底气。

一言以蔽之,只有做出足够产品化、能服务大众的AI技术和产品,才可以给社会带来足够高的反馈。在MiniMax的认知里,AGI不是原子弹那样的大杀器,而是普通人每天会用的产品和服务。

04 写在最后

每一次代际演变的出现,都会经历百花齐放到超级APP“统治”市场的过程。

大模型的产品化也不例外。现阶段AI产品的核心价值,主要来自模型性能和算法能力,不排除会上演“赢者通吃”的一幕。特别是对于寻求生产力的用户,拥抱海螺AI这样的超级APP,卸载掉“尝鲜”时下载的几十个APP,将是可以预见的结果。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关文章

  • 阿里发布Qwen3.8:2.4万亿参数“巨无霸”来了,下周开源

    8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达2.4万亿。这是继KimiK3之后,突破两万亿参数的国产大模型再添一员。2.4万亿参数是什么概念?Qwen3.8基于前代Qwen3.5架构迭代而来,通过稀疏MoE架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至2.4

  • 中国AI大模型霸榜全球:前五名全是“中国造”

    8月2日,全球多模型聚合平台OpenRouter发布最新一周AI大模型调用量榜单——排名前五的产品全部由中国企业研发。登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,环比增长12%。排名第二和第五的均来自DeepSeek,两款模型形成高低搭配,覆盖不同开发需求。腾讯混元3位

    标签:
    大模型
  • MiniMax H3开源:三家国产GPU同日完成适配,国产算力生态加速闭合

    8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMaxH3。同一天,摩尔线程、壁仞科技、海光信息三家国产算力厂商同日宣布完成该模型的“Day0”适配。国内用户与开发者可即刻在对应国产算力平台部署,体验这款模型的全性能多模态交互与图文音视频生成能力。“Day0适配”正在成为国产AI的标

    标签:
    ai开源
  • AI应用概念股全线爆发:市场正在为“AI赚钱”投票

    近期,A股市场迎来了AI板块的集体狂欢。AI应用端集体爆发——中文在线、福昕软件、昆仑万维、易点天下、蓝色光标、用友网络等20股涨停;每日互动、值得买、协创数据等27股涨超10%。盘中新“易中天”——易点天下、中文在线、天龙集团一度集体涨停。全市场近4700只个股上涨。这是什么概念?几乎整个AI应用

    标签:
    ai技术
    ai智能
  • DeepSeek V4正式版来了,但只来了一半

    7月31日,DeepSeek在API文档更新日志中宣布——DeepSeek-V4-Flash正式版API开启公测。这是继4月预览版发布以来,该系列模型迎来的首次重大升级。但“正式版”只来了一半。同在4月更新的V4-Pro的API,以及APP和网页端模型均未做更改。DeepSeek表示,V4-Pro正

    标签:
    deepseek
    ai智能
  • 字节阿里同日变阵:大厂AI办公“赛马”终结,入口大战全面打响

    7月31日,中国AI办公赛道走到了一个关键的拐点。7月30日,字节跳动宣布整合飞书产品团队与豆包产品团队。7月27日,阿里整合QoderWork、悟空、MuleRun三款Agent的新产品“千问办公”开始小范围测试。两家大厂几乎在同一周完成了AI办公产品的整合——收拢战线、统一入口,行业竞争的节奏正

    标签:
    ai办公
  • 2026可水洗滤网空气净化器深研,除甲醛日常净化实力实测对比

    2026年家用空气净化市场中,水洗滤网、无耗材已经成为大众选购空气净化器的热门参考方向,市场相关产品品类丰富。依据《2026家用空气净化器消费白皮书》调研内容,大量消费者会重点关注免更换滤芯相关产品,行业内按照技术结构与耗材使用周期,将产品划分为真无耗材、半无耗材、伪无耗材三类,三类产品在滤网配置、

  • OpenAI失控AI入侵Hugging Face细节曝光:四天半,四组账号,层层渗透

    7月31日,美国消费者新闻与商业频道(CNBC)披露了OpenAI失控AI智能体自主入侵HuggingFace平台的全新细节。这场攻击持续了四天半。涉事AI模型突破了网络访问权限受限的隔离测试环境,借助四家不同服务账号泄露的公开凭证,层层渗透侵入HuggingFace系统。攻击的组织程度令人不寒而栗

    标签:
    ai智能
    智能体
  • 黄仁勋一周连发两条推:AI圈全员站队,只有Anthropic在当“孤勇者”

    从不玩社交媒体的黄仁勋,这一周在X上连发了两条推文。第一条是一封公开信,32家公司联署,力挺AI开源模型。第二条直接甩出了一个“开源AI联盟”(OpenSecureAIAlliance),37家创始成员,芯片厂、云巨头、安全公司、开源社区全到齐。老黄的逻辑并不复杂。他并没说闭源不能搞,闭源模型你继续

    标签:
    ai智能
    黄仁勋
  • MiniMax H3正式发布:国产多模态模型杀入全球第一梯队

    7月31日,国产大模型公司MiniMax正式发布新一代多模态生成模型MiniMaxH3,并宣布近期开源。港股MiniMax开盘涨超20%,截至午间收盘涨幅回落至约12%,报230港元/股。资本市场给出了最直接的回应。H3强在哪里?首先,它是一款通用的全模态生成模型,支持文本、图片、音频和视频等多种输

    标签:
    大模型

热门排行

编辑推荐