一、架构分工转变(核心逻辑)
传统用法:RK3588 整机独立完成系统运行 + 视频解码 + AI 推理,依靠内置 6TOPS NPU 承载全部模型运算,多路视频、7B/14B 本地大模型场景极易触达算力瓶颈。
新一代异构方案:RK3588 = 主控调度底座;M.2 PCIe 算力卡 = 专用推理加速单元
✅ RK3588(底座职责):运行 Linux 系统、多路视频硬编解码、采集预处理、外设驱动、任务调度、结果后处理、网络交互、轻量实时小模型推理;发挥 8 核 ARM CPU、Mali GPU、多媒体硬编解的综合能力
✅ M.2 Key M 算力卡(推理专职):承载大批量、高并发、大参数量 LLM/VLM 视觉语言模型推理,自带板载专用显存,减少 PCIe 总线数据搬运延迟,横向叠加多卡进一步扩容算力
二、主流适配 M.2 算力卡组合
1. 瑞芯微原生 RK1820 / RK1828(RK182X)
单卡 20TOPS@INT8,M.2 Key M,RK1820 搭载 2.5GB DRAM(支持 3B 模型);RK1828 搭载 5GB DRAM(支持 7B 模型);RK3588 主板可扩展 1~2 张,整机最高可达 46TOPS,适配 Qwen 系列多模态大模型、16 路 1080P 视频智能分析
2. 第三方通用加速卡
Hailo-8(26TOPS)、DEEPX DX-M1M(25TOPS)等,工业主板广泛适配,开箱扩展,适合项目快速落地
三、方案核心优势
1. 算力弹性升级:硬件改版成本极低,无需更换主控整机,按需增配 M.2 算力卡,适配项目前期 POC 测试与后期扩容,缩短交付周期
2. 功耗与体积可控:整套嵌入式架构保持小尺寸、低功耗,相比 x86 独显服务器更适配工控机箱、机器人、车载、明厨亮灶、智慧工地等边缘场景
3. 资源负载隔离:多路码流解码、系统业务不抢占 NPU 算力,推理任务卸载至算力卡,大幅降低 CPU 占用,端到端推理时延更稳定
4. 国产全栈闭环:RK3588+RK182X 整套瑞芯微方案,统一 RKNN 工具链,模型转换、部署运维生态对齐,适配信创、银河麒麟等国产系统
四、适用场景
多路高清视频结构化分析、本地部署 7B 及以上多模态大模型、工业视觉缺陷检测、服务机器人多模态感知、智能座舱、边缘存算一体机、AI 网关
五、需要注意的约束点
1. PCIe 通道带宽、供电能力限制:RK3588 PCIe 3.0×2 带宽,多卡并发时存在数据传输瓶颈;高算力 M.2 卡需确认主板供电是否充足
2. 软件适配:多卡异构调度、模型拆分部署需要适配 RKNN 多硬件后端,预处理 / 后处理链路优化影响最终吞吐量
3. 散热设计:叠加多张算力卡后整机功耗上升,整机散热方案需要重新评估
总结
RK3588 不再单打独斗做全栈推理,转型为边缘异构计算主控底座,依托标准 M.2 PCIe 接口外挂专用 AI 算力卡,实现推理算力模块化扩容,是当下国产边缘 AI 主流落地架构。
需求留言: