随着边缘侧大模型部署、多路摄像头并发分析需求爆发,仅靠 RK3588 内置 6TOPS NPU 算力,已经难以承载多模型并行、高帧率推理任务。近期多款国产 RK3588 工业边缘盒子重点强化双 M.2 M‑Key PCIe 插槽,支持双算力卡并行扩展,实现主控 NPU + 外置 AI 加速卡异构算力叠加,不用更换整机硬件,即可弹性提升边缘推理能力。

核心硬件架构
主控底座:RK3588/RK3588J,8nm 八核架构,内置 NPU 6TOPS@INT8,原生支持 8K 编解码,最高可解码 32 路 1080P 视频流,承担系统调度、多媒体预处理、轻量 AI 推理工作,兼容 Ubuntu、Debian、麒麟信创系统。
双 M.2 扩展位:两路 M.2 M‑Key PCIe 通道,专为 AI 算力卡优化,强化供电与散热设计,支持两张算力卡同时运行,可按需选择国产算力模组,如 RK1828、BM1684X、后摩、DEEPX 等,也可兼容 Hailo‑8 加速卡,部分插槽可切换为 NVMe SSD 用于本地录像存储。
算力区间:单卡扩展整机算力可达 26‑32TOPS;双卡并行异构叠加,整机最高可达数百 TOPS INT8 异构算力,满足边缘大模型、多路视频同时 AI 分析需求。
主流兼容 M.2 算力卡
算力卡 | INT8 算力 | 典型功耗 | 适配场景 |
20TOPS | 712W | 瑞芯微生态,RKNN 工具链,视觉 + 端侧大模型 | |
BM1684X M.2 模组 | 32TOPS | 15W | 国产信创,多路视频推理,私有化大模型部署 |
Hailo-8 | 26TOPS | 10W | 成熟视觉推理,YOLO 系列模型优化 |
DEEPX DX-M1M | 25TOPS | 8W | 低功耗工业场景,多目标检测 |
双卡配置可相同或异构搭配,一张负责多路视频检测,一张运行大语言多模态模型,实现视觉识别 + 本地问答一体化。
产品设计优化点(双 M.2 版本重点改进)
1. 供电强化:双算力卡同时满载功耗上升,整机 DC 宽压 9‑36V,提升 M.2 插槽供电电流,避免高负载掉卡、降频;工业型号支持反接、过流保护。
2. 散热重构:铝型材壳体,加大散热鳍片;无风扇 / 带风扇两种版本可选,解决两张算力卡叠加发热,满足‑40℃~+85℃工业宽温运行。
3. 接口完备:双千兆网口,部分型号带 PoE 网口;RS485/RS232/CAN 串口、HDMI2.1、USB3.0;预留 M.2 E‑Key 支持 4G/5G/Wi‑Fi6,适配工地、园区、车间现场部署。
4. 软件适配:系统层面做多卡调度,RKNN、TPU‑SDK、Sophon‑SDK 共存,支持 YOLOv5/v8、ResNet、MiniCPM、Qwen 等主流视觉与大模型,支持模型拆分分配到不同算力卡执行推理。
典型落地场景
1. 智慧工地、明厨亮灶:多路 IPC 摄像头接入,安全帽检测、烟火识别、行为分析;双卡分工,一张跑 20 + 路视频目标检测,另一张跑多模态大模型做事件复盘与文本输出,本地闭环,降低带宽依赖。
2. 工业质检:多工位相机并发,缺陷检测,多模型并行推理,不用云端,降低延迟。
3. 园区安防、智慧电力:视频分析 + 本地大模型,告警语义解析,断网条件下持续工作。
4. 信创边缘节点:国产 RK3588 + 国产算力卡组合,适配麒麟操作系统,满足政企国产化项目要求。
选型注意事项
1. 确认双 M.2 插槽是否均为PCIe 通道,部分盒子一槽算力卡、一槽仅 SATA SSD,不能插两张 AI 加速卡。
2. 双卡整机功耗会明显抬升,电源适配器功率需要预留余量。
3. 异构多卡开发复杂度高于单卡,需要确认厂商提供多卡调度 demo、工具链适配包,降低二次开发工作量。
4. 散热是双卡最大瓶颈,户外机柜密闭环境优先选择带风扇强化散热版本。
小结
RK3588 + 双 M.2 算力卡扩展这套方案,最大价值是算力弹性扩容:小项目只用 RK3588 自带 NPU;业务扩容时直接插入 M.2 算力卡,不用更换盒子整机,硬件迭代成本低,兼顾多媒体编解码能力与国产算力扩展,是当前智慧工地、明厨亮灶、工业视觉非常热门的边缘硬件方案。
需求留言: