当前位置:首页 >  科技 >  互联网 >  正文

此芯科技发布AGX X2平台,端侧单Token能耗降低超50%

 2026-09-22 09:39  来源: 互联网   我来投稿 撤稿纠错

  一键部署OpenClaw

9月18日,此芯科技在深圳举办2026客户大会,正式发布AGX X2平台,同时以AGXcelerator作为该平台的产品名。平台定位为面向边缘推理与智能体应用的算力底座,官方给出的规格是80至300TOPS的端侧峰值算力,支持7B至122B参数的大模型在本地原生推理,配置64至160GB LPDDR5统一内存,单Token能耗比行业水平降低50%以上。

这套规格针对的是边缘设备的三个现实门槛:模型规模受限、内存带宽不足、功耗与散热受限。统一内存容量上探到160GB,意味着原本只能在数据中心跑的百亿参数级模型有机会落到终端;把能耗压下来,则直接关系到设备能否在无风扇或小体积散热的条件下持续工作。

平台还定义了Agentic Compute开放架构,兼容多家国产AI加速卡、GPU卡与VPU卡,支持多卡级联扩展算力。配套的自研Agentic OS采用一套系统、两端协同的方式,主打服务端与客户端的端云协同,并通过模型即服务的方式对Token做统一生产与计量。

产品形态上,平台给出办公智能体主机、个人AI超算、混合模态智能体集群三类部署方式,可覆盖桌面超算、智能制造、阵列服务器、智能座舱与具身智能等边缘场景,按端侧实时推理、边缘聚合算力、云端训练迭代组织协同闭环。

把这件事放在行业脉络里看,端侧算力的竞争已经从单一芯片指标转向系统能力。模型每几个月换代一次,而芯片与软件栈的适配需要编译、算子与精度对齐等长期工程投入,两者节奏不一致时,再高的峰值算力也难以转化为可用的性价比。开放架构与统一软件栈要解决的正是这个问题。

对开发者而言,值得关注的是平台能否把内存、功耗与软件生态三件事同时交代清楚;对整机厂商而言,关键是同一套底座能否覆盖从办公设备到机器人本体的不同形态。规格已经摆在台面上,接下来要看的是实际交付与生态落地节奏。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关标签
端侧算力

相关文章

热门排行

信息推荐