尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
[具身智能-611]:JPG / RAW / NV12 格式深度解析(适配 RDK X5 MIPI 相机场景)
表格格式类型压缩存储内容典型用途CPU 开销JPG封装图像有损压缩有损压缩RGB 压缩码流图片存储、网页推流、websocket解压开销中等RAW传感器原始裸数据无压缩Sensor 光电原始采样Bayer 拜耳相机底层调试、图像标定极高必须 ISP 做去马赛克NV12YUV 平面格式未压缩无压缩亮度 Y 交错 UVMIPI 相机输出、硬件编解码、BPU 推理输入极低嵌入式标准格式1. RAWBayer Raw传感器原始数据核心说明The data directly output by the MIPI camera sensor isnot an image, but merely the photoelectric signal collected by photosensitive diodes. Common formats:RGGB8/RGGB10(OV5647/IMX219/IMX335). Data arrangement example (RGGB):plaintextR G R G G B G B R G R G G B G B✅ 需要经过ISP 流水线才能生成可视图像 去马赛克 (Demosaic) → 白平衡 → 降噪 → 伽马校正 → 输出 YUV (NV12)工程特点只能在最前端获取mipi_cam 底层 VIO 接收层一旦经过 ISP输出就不再是 RAW。文件后缀常见.raw/.bayer无法直接使用普通图片软件打开。适用场景镜头标定、调试 Sensor 寄存器、排查曝光 / 噪点问题。⚠️不能直接送入 FCOS/YOLO 神经网络网络只能接收 YUV/RGB。在地平线 Demo【2. 摄像头图像本地保存】中可以选择抓取RAW 帧用于底层调试。2. NV12YUV420 Semi-Planar重中之重内存布局关键分为两个平面连续存放Y 平面全部亮度信息分辨率 H × WUV 平面色度信息U、V 交错存储分辨率 H/2 × W/2plaintextYYYYYYYY YYYYYYYY UVUVUVUV UVUVUVUV采样比例 4:2:0色度分辨率宽高各减半。嵌入式核心优势RDK X5 标准MIPI相机 ISP 默认输出格式你的mipi_cam节点/image_combine_raw话题就是 NV12硬件编解码原生支持hobot_codec H264/H265 编码输入优先使用 NV12VPS、BPU 零拷贝友好地平线硬件单元全部原生支持 NV12避免转 RGB 带来内存拷贝相比 RGB24 节省50% 内存带宽。常见坑NV12没有文件头单纯二进制数据保存成文件后播放器无法直接打开必须附带分辨率。AI 推理注意网络输入要求 RGB 时需要在 ISP/VPS 或 CPU 完成 NV12→RGB 转换。3. JPGJPEG有损压缩图像核心说明基于 YUV420 进行离散余弦有损压缩带文件头、元信息通用图片格式。在项目里的链路位置NV12 图像 → hobot 硬件 JPEG 编码器 → JPG 码流 对应你日志里的参数out_format: jpeg、jpg_quality:85、websocket 接收/image_combine_jpeg✅优点通用、体积小浏览器直接解码❌缺点有损压缩损失图像细节不建议送入 AI 目标检测网络多一层编码开销不适合作为算法输入仅用于预览、上传、存档。在整套视觉链路中的标准数据流推荐plaintextMIPI Sensor → RAW(Bayer) → ISP处理 → NV12主链路 ├─分支1NV12直接送入VPS缩放 → FCOS/YOLO推理最优无多余转换 ├─分支2NV12送入硬件JPEG编码器 → JPG → websocket网页预览 ├─分支3NV12送入H264编码器 → .h264视频录像 ├─分支4调试抓帧保存RAW底层调试 / 保存NV12算法调试选型决策速查表AI 算法推理输入→ 优先NV12禁止使用 JPG网页远程预览、截图存档→JPG调试 Sensor、标定镜头、排查底层图像问题→RAW本地硬件编码录像→ 使用原始 NV12 送入编码器补充实操RDK X5mipi_cam 输出话题/image_combine_raw NV12hobot_codecNV12 → JPG / H264如果你保存裸 NV12 文件播放命令示例必须指定分辨率bash运行ffplay -f rawvideo -pixel_format nv12 -video_size 1280x720 frame.nv12p运行ffplay -f rawvideo -pixel_format nv12 -video_size 1280x720 frame.nv12
RELATED

相关推荐

Hugging Face:为什么说它是AI界的GitHub,却比GitHub走得更远?

Hugging Face:为什么说它是AI界的GitHub,却比GitHub走得更远?

一、一句话定义 Hugging Face 是全球最大的 AI 开源社区与模型协作平台,它汇集了数十万个预训练模型、数万个数据集和数万个在线演示应用,已从最初的 NLP 工具包成长为机器学习领域的“GitHub”。 二、发展简史:从聊天机器人到 AI 基础设施 …

📅 2026/9/14 2:11:08
现在做AI的产品经理,到底有多难

现在做AI的产品经理,到底有多难

现在做产品经理难得不是做原型与需求调研了,而是让产品的设计方案从MVP再到产品上线能够获得用户,并且推向市场验证。 在大厂,一个产品的ideal需要经过法务、财务、宣发布等部门来完成需求审核之后才可以做,而一个大厂领头产品的单…

📅 2026/8/22 18:30:35
未来三年,是转型AI产品经理的最佳机会

未来三年,是转型AI产品经理的最佳机会

这是一篇写给所有在产品路上迷茫、焦虑、寻找破局点的人的文章。不是贩卖焦虑,而是陈述一个正在发生的结构性机会窗口。它正在打开,且不会永远敞开。全文约20000字,建议收藏后深度阅读。引言:一个正在关闭的时间窗口 2024年初&…

📅 2026/8/22 18:30:34
MORE NEWS

更多资讯

📰

AI时代教育系统的困境与转型路径

1. 教育系统的时代困境那天在教师休息室,听到几位老教师在讨论:"现在的学生拿着手机5分钟就能查到我们备课两小时的内容,这课还怎么上?"这句话像一记重锤,让我开始认真思考我们教育系统面临的真实挑战。当前…

📰

VC++ MFC双人围棋程序:19×19棋盘实现与绘图交互详解

简介:这是一份面向VC初学者与游戏开发兴趣者的双人围棋对弈程序源码包,聚焦MFC框架下的GUI界面设计与基础博弈逻辑实现,帮助开发者掌握Windows桌面游戏开发的核心流程。资源共24个文件,包含6个CPP源文件与7个H头文件构成完整程序架…

📰

系统拓展CSS核心能力:从选择器、布局到动效与工程化实战

写CSS这行,写久了都会遇到一个尴尬时刻:排版调了又调没问题,一到动效、响应式、复杂布局就卡壳;或者干脆不知道自己“到底哪里不行”只是照着网上的代码抄,换个场景就不会了。这篇文章想说的“拓展”,不是让…

📰

人脸设备如何深度嵌入业务流程?从识别终端到边缘智能节点

1. 一台设备,千种用法:人脸设备不是“刷脸机器”,而是业务流程的嵌入式神经节点你手头那台标着“人脸识别终端”的设备,大概率正安静地立在公司前台、小区门禁旁、或者工厂考勤通道里。它看起来就干一件事:拍张脸&…

📰

二叉树重建算法:前序+中序与后序+中序实现详解

1. 二叉树重建问题解析前些天帮团队新人调试代码时,发现不少人对二叉树遍历序列的转换存在理解偏差。这个问题在技术面试中出现频率极高,根据我参与校招面试的统计数据显示,每场面试平均会出现1.2次与二叉树重建相关的考察点。今天我们就来深…

📰

【郑州工程技术学院主办 | 河南郑州召开 | SPIE出版】第三届模式识别与图像分析国际学术会议(PRIA 2026)

第三届模式识别与图像分析国际学术会议(PRIA 2026) 2026 3rd International Conference on Pattern Recognition and Image Analysis 第三届模式识别与图像分析国际学术会议(PRIA 2026)将于2026年11月6-8日在河南郑州召开&#…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬