当前位置:首页 >  科技 >  IT业界 >  正文

基于RK3588+双RK1828算力卡级联的端侧数字人 + 本地知识库方案

 2026-10-09 16:04  来源: 互联网   我来投稿 撤稿纠错

  一键部署OpenClaw

现在在展厅、体验中心、政企接待区等区域的数字人系统,核心并不是让模型随便聊天,而是让它能够按照企业自己的资料回答问题,背后同时涉及本地的语音识别、大模型问答、知识库检索、数字人播报以及本地数据安全等,但是传统数字人方案,要么依赖讲解员反复讲一套固定话术,人工成本高、现场体验容易受影响;要么接入云端大模型,虽然交互能力更强,但是对网络环境有依赖,比较慢。

定昌电子基于RK3588主控板DC_M588与双RK1828算力卡做级联,升级到了46TOPS算力,算力卡部署Qwen3.5-9B大模型,搭建了一套流畅的端侧数字人+本地知识库方案,让模型、知识库和交互能力都可以运行在设备侧。是一个知道企业资料、按照指定口径回答,而且不用把资料传到云端的数字人。

方案核心:本地知识库

对于企业应用来说,数字人更重要的是:它知道什么,以及它只能按照什么口径回答,例如展厅可以准备这样的知识文件:

文件格式

典型内容

现场问题

Markdown

产品介绍、方案说明、、操作手册

“这款设备有什么特点?”

TXT

参观须知、讲解词、制度

“今天几点开放?”

CSV

标准问答、FAQ

“数据会上传云端吗?”

JSON

设备参数、联系人、接口信息

“技术联系人是谁?”

这套方案像一个“企业自己的数字讲解员”。不是让AI什么都知道,而是这些资料放入本地知识库以后,用户通过语音提出问题,系统先从知识库中找到相关内容,再交给端侧大模型进行组织和表达,最后由数字人播报出来。

本地数字人方案特点

① 当面语音交互

支持持续聆听,用户开口即可提问,说完经过短暂停顿后自动进入识别、检索和回答,接近人与人面对面沟通。

② 数字人实时播报:通过HDMI输出数字人形象 + 现场音频播放,实现“看得见、听得到”的交互效果,适合展厅、接待台、产品体验区以及封闭演示空间等场景。

③ 连续对话体验:数字人回答过程中不会立即抢断用户,播报完成后自动恢复监听,变成连续对话。

④ 资料在本地:支持TXT、Markdown、CSV、JSON等常见资料格式,更新回答口径,不需要重新训练大模型。适合对数据安全、网络环境和内容口径有要求的政企、园区、工厂及私有化项目。

和云端数字人的差别

对比维度

云端数字人

本地数字人方案

网络

通常依赖公网

可完全离线本地运行

资料存储

企业资料需要上传云端服务处理,容易出域

知识库文档保存在本地设备

数据安全

存在数据出域和云端传输环节

模型、知识库和问答过程均可部署在设备侧

讲解和更新

换人就要重新培训,并且依赖后台平台进行维护

换文档就能换,很方便

回答口径

依赖云端大模型生成,模型存在自由发挥空间

先检索本地知识库,再由模型组织回答

交互

受网络状态、云端服务影响

本地推理,减少网络往返带来的延迟

现场部署

要等网络、怕断网

更用于封闭网络及离线场景,当场就能问

适用场景

通用客服、开放式AI助手等

政府、金融内网、工厂园区、军工配套、保密展厅等

方案开发架构

基于RK3588主控板+双RK1828异构算力架构平台,RK3588主要负责系统控制、视频与图形处理、网络通信以及外设管理;RK1828作为独立AI协处理器,通过M.2 PCIe接口扩展AI算力。单颗RK1828提供约20TOPS@INT8算力,RK3588本身具备最高6TOPS NPU,因此接入两颗RK1828后,整个平台理论上可形成约46TOPS的异构AI算力。

本机运行Qwen3.5-9B大模型,推理部署在RK1828算力卡上,知识检索、问答生成和内容播报均可在设备侧完成,减少对云端网络的依赖。通过主控+AI协处理器算力卡的方式也方便后续扩展CV视觉大模型、目标检测等AI应用。

适合的项目

l 展厅和体验中心:固定问答 + 形象接待,可以用数字人替代重复讲解;

l 政企接待场景:可以把固定话术和资料放进本地知识库,资料不上传云端;

l 工厂产线和园区问询:可以将制度、流程、联系人做成结构化知识,让员工直接问;

l 方案商演示:可以快速把自家的产品手册导入系统,,十分钟变成可对话的样机,搭建属于自己的AI数字人Demo。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关文章

热门排行

信息推荐