算能针对BM1684X M.2 AI 算力卡推出新版固件,重点优化 VPU 视频编解码调度、内存带宽分配与 TPU 任务调度逻辑,多路视频解码 + AI 推理综合并发性能提升 22%,针对安防 NVR、智慧工地、明厨亮灶、多路视频结构化等高路数边缘场景收益显著。

固件核心优化点
1. 多路视频并发调度优化
重构 VPU 硬件任务队列,优化 H.264/H.265 码流调度,减少多路流下任务抢占、帧抖动;同等硬件条件下,1080P@25fps 多路视频(解码 + AI 分析)综合并发吞吐提升22%,降低帧丢包、时延抖动问题。
2. 内存与带宽优化
优化 DDR 内存碎片回收逻辑,视频帧缓冲区动态分配,多流并发场景内存占用下降,缓解高路数下 OOM 风险,充分释放 M.2 形态 PCIe3.0 带宽能力。
3. TPU/VPU 资源协同
改善 AI 推理与视频编解码的资源抢占,多模型并行 + 多路视频同时运行时,推理时延波动降低,适合同时跑目标检测、车牌识别、人脸结构化等多算法混合负载。
4. 稳定性增强
高负载长时间 7×24 小时压测稳定性优化,降低长时间跑多路流偶发解码异常
温控策略微调,高并发下降频触发阈值优化,减少高温降频带来性能跳水
修复部分高码率、大 GOP 监控码流解码异常问题
实测参考(M.2 BM1684X,INT8,1080P@25fps H.265)
测试条件:解码 + 目标检测推理全链路
旧固件:最大稳定并发 26 路
新版固件:最大稳定并发 32 路,整体并发提升 22%
说明:实际可跑路数受码率、GOP 长度、算法模型复杂度、主机 CPU、PCIe 带宽影响,以现场压测为准。
✅适配场景
边缘 NVR、智能安防盒子
智慧工地、明厨亮灶、园区视频结构化
工业视觉多路相机分析
多卡级联部署,多片 BM1684X M.2 堆叠扩容视频路数
升级注意事项
1. 需要同步配套升级对应版本 SophonSDK,固件与 SDK 版本必须匹配,避免兼容性异常。
2. M.2 卡为 PCIe 设备,升级固件请勿断电,避免设备变砖。
3. 升级完成执行bm‑smi确认固件版本,再使用官方 decode 压测脚本验证多路并发性能。
4. 原有业务应用无需修改业务代码,升级固件 + SDK 即可获得性能增益。
需求留言: