
当下视频监控、AI摄像头、工业视觉与自助终端等视觉设备正加速向"端侧智能化"演进,画面内叠加时间、LOGO、警戒线、AI识别框等实时信息,已成为各类视频终端的标配能力。信息叠加做得好不好,直接决定设备交付后的易用性与产品竞争力。
然而,传统视频信息叠加方案短板明显:依赖上位机或工控机后期合成,叠加信息无法随帧实时上屏,实时性大打折扣;叠加AI识别结果需外挂智能分析盒子,多一套硬件就多一分成本与故障点;云端处理虽省事,但时延、带宽与数据隐私问题始终绕不开。想要信息实时、硬件精简、成本可控,把"叠加"搬进端侧,成为视频类设备破局的关键。
基于触觉智能RV1126B核心板(SOM1126B),搭载四核Cortex-A53处理器与3TOPS算力NPU,原生AI双ISP图像预处理,内置RGA 2D硬件加速,支持OSD叠加引擎,UVC免驱视频采集与多路视频输入。文字、图形、AI识别结果随帧实时上屏,经H.264/H.265编码后直接网络推流,专为攻克端侧视频信息叠加痛点而生。
触觉智能RV1126B核心板基于软硬件整合,已构建端侧视频信息叠加的硬件底座,终端厂家可进行算力调度、叠加图层、识别算法的二次开发,下文分享常见的产品应用场景。痛点:传统摄像头信息叠加依赖平台端后期合成,水印随回放才可见,实时性差;叠加AI识别框需外挂智能分析盒子,硬件成本高、链路复杂;依赖云端识别又存在时延与数据隐私风险。方案: 依托触觉智能RV1126B核心板(型号:SOM1126B)的RGA 2D硬件OSD叠加引擎,时间、通道名、LOGO、警戒线随帧实时上屏,零延迟、不依赖服务器;内置3TOPS端侧NPU可本地运行人脸检测、人数统计、区域入侵警戒等算法,识别结果同帧叠加进画面;H.264/H.265编码后直接RTSP/RTMP/GB28181推流,整条链路在核心板端侧闭环完成,免驱动、不上云、免改造。触觉智能RV1126B OSD相关演示详见视频:痛点: 产线质检需要在画面中实时标注检测结果、NG框选、时间戳与产品计数,传统方案需PLC与上位机联动,集成繁琐、改动量大;检测数据与视频流不同步,追溯取证困难。方案:RV1126B支持UVC免驱与多路MIPI-CSI相机接入,检测算法经NPU端侧推理后,由OSD引擎将OK/NG标记、缺陷定位框、检测计数等结果实时叠加到视频帧,随编码码流一并输出,数据与画面严格同步,便于产线追溯与远程巡检。
RV1126B作为RV1126的全新迭代产品,同样条件运行原厂yolov5 rknn。RV1126B推理速度比RV1126快了2.6倍、帧率从勉强实时(15FPS)进入了流畅实时(38FPS)!痛点:传统门禁识别结果依赖室内机或平台联动显示,信息滞后;比对依赖云端或外挂服务器,存在时延、断网瘫痪与隐私合规风险;姓名、权限、开门状态等提示信息无法与识别画面同步呈现。
方案:依托SOM1126B端侧3TOPS NPU本地完成人脸检测与比对,识别结果(姓名/工号/权限)、体温数值、开门状态(验证通过/请重试)、时间日期等经OSD引擎随帧叠加上屏;支持MIPI-DSI本地屏显与RTSP推流至室内机、监控中心,离线可用、数据不出设备,适配写字楼、社区、园区、工地等门禁场景。
痛点:车载监控、巡检记录仪需要在画面中实时叠加车速、定位、车牌框、告警信息等,传统外挂叠加设备体积大、功耗高,难以满足车载严苛工况。方案:依托RV1126B低功耗设计与端侧叠加能力,车速、定位、车牌识别框、越界告警等数据经OSD引擎随帧上屏,支持工业宽温与常电快速启动,满足车载、移动场景长期稳定运行。针对高低温严苛环境,触觉智能RV1126B核心板、开发板均进行了相关实测,让您量产无忧,详见视频:触觉智能RV1126B核心板(SOM1126B)专为端侧视频与AI应用打造:(1)搭载四核Cortex-A53处理器,主频1.6GHz,集成3TOPS算力NPU,支持主流AI框架与模型部署;(2)原生AI双ISP:支持12M@30fps ISP与8M@30fps AI-ISP,具备低照度增强、HDR、3D降噪能力,暗光画面清晰通透;
(3)内置RGA 2D硬件加速引擎,为OSD文字/图形叠加与图层合成提供硬件级支撑,不占用CPU算力;(4)支持8M@45fps H.265/H.264硬件编码、4K@30fps解码,多路视频输入与多目拼接,满足全景监控与多角度覆盖;
(5)接口丰富:2×MIPI CSI摄像头输入、USB、千兆以太网、MIPI-DSI、CAN FD、多路UART等,可扩展性强;
(6)宽温级RV1126B(-20~80℃)/工业级RV1126BJ(-40~85℃)可选,低功耗、ESD性能佳、支持快速启动,长期稳定运行,稳定批量供货。