架构说明:RK3588 为主控,RK1820/RK1828(瑞芯微 M.2 协算卡)、力擎 LQ50 M.2 算力卡作为 PCIe AI 加速卡,异构协同;RK3588 负责系统、视频采集预处理,算力卡专职大模型 LLM/VLM 推理,不占用主控 NPU 资源。

参数对照
| 型号 | NPU 算力 | 板载 DRAM | 支持模型上限 | 功耗 |
|---|---|---|---|---|
|RK1820|20TOPS INT8|2.5GB|3B 大模型 |<8W|
|RK1828|20TOPS INT8|5GB|7‑8B 大模型 |≈10W|
| 力擎 LQ50|M.2 2280 算力卡 | 依硬件版本 | 适配 RK3588 PCIe3.0 x4|7‑12W|
一、硬件准备与接线
1. 硬件清单
1. RK3588 核心板 / 底板,底板必须引出PCIe3.0 X4 M.2 M‑Key 插槽(仅 M‑Key 支持算力卡,B‑Key 只能 SSD)
2. M.2 算力卡:RK1828 / RK1820 / LQ50
3. 散热:算力卡散热片 + 风扇;RK182X 工作温度高,无散热会降频死机
4. 电源:底板电源,部分算力卡需要独立 12V 供电(部分 M.2 仅靠插槽 3.3V 供电不足)
5. 调试工具:USB‑TTL 串口、网线
2. 硬件安装 & 上电时序(极易踩坑)
1. 断电状态,把算力卡插入 M.2 M‑Key 插槽,锁紧固定螺丝;有外接供电的,接好 12V 辅助供电
2. 上电顺序:先算力卡供电,再给 RK3588 底板上电,保证 PCIe 设备正常枚举识别;严禁热插拔 M.2 算力卡,会损坏 PCIe 控制器
3. 接串口、网线,接显示器(可选)
注意:底板 BIOS / 设备树必须开启PCIe3.0 X4,不能设置成 SATA 模式;部分底板 M.2 插槽默认 NVMe,需要设备树修改为通用 PCIe 模式,否则识别不到 AI 算力卡。
二、系统固件要求
1. 系统版本:Ubuntu22.04 arm64 / Debian11;内核版本≥5.10,必须使用支持 RK182X/LQ50 的适配内核,原生 RK3588 固件不自带算力卡驱动。
2. 获取 SDK 包
RK1820/RK1828:使用 RKNN3‑SDK,rknn3_rk182x_sodimm_installer_arm64.tgz 驱动安装包
LQ50 力擎 M.2 算力卡:使用厂商提供的驱动包、runtime 库
重要:RK182X 为协处理器,只能跑 LLM/VLM 大模型;常规 YOLO、CNN 视觉推理依然使用 RK3588 板载 NPU,不要把 CV 模型丢给 RK1828 跑,无性能提升。
三、驱动部署(RK1820/RK1828)
1. 将rknn3_rk182x_sodimm_installer_arm64.tgz传到 RK3588 开发板
tar -zxvf rknn3_rk182x_sodimm_installer_arm64.tgz
cd rknn3_rk182x_sodimm_installer_arm64
sudo ./install.sh
脚本自动部署 pcie‑rkep 内核模块、rknn3 runtime、systemd 后台服务。
2. 重启开发板
sudo reboot
3. 硬件识别校验
#查看PCIe设备,应当出现Rockchip 182a设备
lspci | grep Processing
#查看内核模块加载
lsmod | grep rkep
#查看rk182x服务状态
systemctl status rk182x
若 lspci 看不到设备:①检查设备树 PCIe 配置;②上电时序错误;③M.2 插槽模式错误;④硬件接触不良,重新拔插算力卡。
四、力擎 LQ50 M.2 算力卡适配步骤
1. 把 LQ50 驱动压缩包上传板卡,解压,编译安装内核驱动模块
tar -zxvf LQ50_driver_arm64.tgz
cd LQ50_driver_arm64
sudo ./build.sh
sudo ./install.sh
2. 安装用户态 runtime 库,注册系统服务
sudo cp ./lib/*.so /usr/local/lib
sudo ldconfig
sudo systemctl enable lq50.service
sudo systemctl start lq50.service
3. 校验
lsmod | grep lq50
lspci #看到LQ50对应加速设备
五、模型转换与推理运行
5.1 RK1820/RK1828 大模型转换(PC 端操作)
使用 RKNN3‑Toolkit,把 HuggingFace 模型转为.rkllm格式,转换脚本指定目标芯片:rk1820或rk1828
#PC端转换示例
python convert.py qwen2‑3b.onnx rk1828
转换完成将.rkllm模型文件拷贝到 RK3588 板卡。
5.2 板卡端推理测试
#进入rknn3‑model‑zoo大模型demo目录
cd rknn3‑model‑zoo/examples/rkllm_demo
#指定加速卡设备运行
./rkllm_demo qwen2‑3b.rkllm rk1828
如果是 LQ50,使用 LQ50 配套 demo 程序加载对应量化模型。
5.3 区分 NPU 调度
RK3588 本地 NPU:用于 YOLO、检测、分类等 CV 任务
RK1828/RK1820/LQ50:专门卸载大语言、多模态 VLM 推理任务,实现异构分流。
六、常见故障排查
1. lspci 看不到算力卡
确认底板 M.2 是 M‑Key,设备树开启 PCIe3.0 X4,没有复用为 SATA;重新上电,严格遵守上电顺序。
2. 驱动安装成功,但打开模型报错 platform not supported
模型转换时目标平台写错,必须严格写rk1820/rk1828,大小写敏感。
3. 大模型加载 OOM 内存溢出
RK1820 最大支持 3B;RK1828 最大 7‑8B,不要加载超过显存上限模型;开启 INT4 量化降低显存占用。
4. 运行几分钟自动降频卡顿
算力卡散热不足,加装风扇,监控温度;工业场景建议增加外壳散热。
5. LQ50 和 RK1828 同时插两张 M.2 卡
需要底板两路 PCIe 通道,设备树启用双路 PCIe,电源功率要充足。
七、应用场景
工业边缘盒子、本地大模型网关、多路视频 + VLM 多模态分析、机器人本地大模型交互;RK3588 做视频解码、外设控制,M.2 算力卡跑大模型推理,实现算力扩展到 26‑46TOPS。
需求留言: