高质量 GPU Debayer 软件
更新日期:
Fastvideo GPU Debayer 在 NVIDIA GPU 上,用四种高质量去马赛克算法 — HQLI、L7、DFPD 与 MG — 将来自相机或单反的原始拜耳图像转换为全彩 RGB 图像。画质最高的 MG 算法在 Kodak 数据集上达到约 40.5 dB 的平均 PSNR;在 NVIDIA GeForce RTX 4090 上,这些算法的吞吐最高可达 69 GPix/s(65 MPix,16 位)— 远快于任何 CPU 实现。它同时也是一款测试工具:测量每种方法的处理时间,并与参考图像对比计算 PSNR/MSE,因此可以在构建高负载图像处理服务之前比较去马赛克的画质与速度。如果要把这些算法嵌入您自己的流水线,也可使用 CUDA Debayer 库(英文)。

- 将来自相机或单反的 8/16 位原始拜耳图像转换为 24/48 位 RGB
- 在 NVIDIA GPU 上运行极快(英文),远超任何 CPU
- 高质量的去马赛克方法
- 对每种方法进行实时耗时测量
- 与参考图像对比并计算 PSNR/MSE
受成像团队信赖
“Fastvideo SDK 快如闪电……我们现在能在 10 分钟内处理完 28,800 张图像的序列,而过去需要 10 小时。”
GPU Debayer 软件的独特之处
- 业界最快的 GPU 去马赛克实现之一
- PSNR/SSIM 高、伪影低的复杂去马赛克算法
- 使用简单,工作快速,检查方便
- 在构建高负载图像处理服务之前,用于检验去马赛克算法质量、耗时与性能的测试工具
- 由拥有多年 CUDA 与 GPU 成像经验的团队开发
详细基准数据。测得结果发布在我们的基准页面:去马赛克基准(英文)、全部基准(英文)。
GPU Debayer 软件功能
GPU Debayer 支持哪些去马赛克算法?
- 支持输入数据的所有拜耳模式(RGGB、BGGR、GBRG、GRBG)
- 可由任意 24/48 位 PPM 生成拜耳图像(马赛克)
- 以 PGM 格式,从相机、单反或 HDD/SSD/RAID 读取 8/16 位输入拜耳原始图像
- 输出格式:24/48 位 PPM
- 最小图像分辨率 128 × 128 像素
- 各算法的去马赛克质量:
- HQLI 去马赛克(高质量线性插值,5 × 5 窗口)— Kodak 数据集平均 PSNR~36 dB(SSIM~0.965)
- L7 去马赛克(高质量线性插值,7 × 7 窗口)— Kodak 数据集平均 PSNR~37.1 dB(SSIM~0.971)
- DFPD 去马赛克(定向滤波与后验判定,11 × 11 窗口)— Kodak 数据集平均 PSNR~39 dB(SSIM~0.978)
- MG 去马赛克(多梯度,23 × 23 窗口)— Kodak 数据集平均 PSNR~40.5 dB
- NVIDIA GeForce RTX 4090 上的峰值性能(仅 GPU 计算,65 MPix 分辨率、16 位图像、无批处理、无流式传输):
- HQLI 去马赛克 — 高达 69 GPix/s
- L7 去马赛克 — 高达 62 GPix/s
- DFPD 去马赛克 — 高达 48 GPix/s
- MG 去马赛克 — 高达 20 GPix/s
- 质量评估:MSE 与 PSNR
- 对每种算法进行耗时与性能测量
- 面向 Windows 10/11、Linux Ubuntu 与 L4T 的命令行演示程序
- NVIDIA Jetson:Nano、Xavier NX/AGX、Orin NX/AGX
| 去马赛克算法 | 窗口 | 平均 PSNR(Kodak) | SSIM | RTX 4090 峰值速度* |
| HQLI | 5 × 5 | ~36 dB | ~0.965 | 高达 69 GPix/s |
| L7 | 7 × 7 | ~37.1 dB | ~0.971 | 高达 62 GPix/s |
| DFPD | 11 × 11 | ~39 dB | ~0.978 | 高达 48 GPix/s |
| MG(最高画质) | 23 × 23 | ~40.5 dB | — | 高达 20 GPix/s |
* 仅 GPU 计算,65 MPix 16 位图像,无批处理、无流式传输。
Fastvideo GPU Debayer 还有哪些亮点
Fastvideo GPU Debayer 是一个由高质量去马赛克算法 — HQLI、L7、DFPD 与 MG — 组成的 CUDA 库,在 NVIDIA GPU 上将 8/16 位拜耳数据转换为 RGB。画质更高的 MG 算法在 Kodak 数据集上达到约 40.5 dB 的平均 PSNR,四种算法都足够快,既适合实时相机流水线,也适合对画质要求苛刻的离线处理。
- 我们可为您的特定需求提供高性能去马赛克库(英文),尤其是高速批量去马赛克
- 我们也提供在 NVIDIA GPU 上去马赛克与 JPEG 压缩相结合(英文)的定制软件设计
- 我们已为高速高分辨率相机设计了 GPU 上的快速图像处理 SDK:暗场扣除、平场校正、白平衡、去马赛克、去噪、颜色校正、色调映射、图像滤波、旋转、裁剪、缩放、锐化、OpenGL 渲染与输出,JPEG、JPEG2000、拜耳、H.264、H.265、AV1 编码,CUDA FFmpeg 集成、流式传输等
- 上述 GPU 去马赛克是用于机器视觉相机的 FastVCR 软件的组成部分
GPU 去马赛克常见问题
哪种去马赛克算法画质最好?
MG(多梯度,23 × 23 窗口)画质最高,在 Kodak 数据集上约 40.5 dB 平均 PSNR。HQLI、L7、DFPD 以部分画质换取更高速度,因此选择取决于流水线更看重画质还是吞吐。
GPU 去马赛克有多快?
在 NVIDIA GeForce RTX 4090 上,峰值吞吐从 HQLI 的高达 69 GPix/s 到最高画质 MG 的 20 GPix/s(65 MPix 16 位图像,仅 GPU 计算)— 远超任何 CPU 去马赛克。
支持哪些拜耳模式与位深?
支持全部四种拜耳模式(RGGB、BGGR、GBRG、GRBG)。输入为来自相机、单反或 PGM 文件的 8/16 位原始拜耳图像;输出为 24/48 位 RGB 图像。
GPU Debayer 能在 NVIDIA Jetson 上运行吗?
可以。它支持 NVIDIA Jetson 系列 — Nano、Xavier NX/AGX 与 Orin NX/AGX — 运行于 Linux4Tegra,也支持 Windows 与 Linux 下的桌面 NVIDIA GPU。
GPU Debayer 与 CUDA Debayer 库有何区别?
GPU Debayer 是一款开箱即用的演示与测试工具:它为每种方法计时,并与参考图像对比计算 PSNR/MSE。CUDA Debayer 库(英文)则把相同算法嵌入您自己的 GPU 流水线。
去马赛克画质如何测量?
画质以标准 Kodak 数据集上、相对参考图像的平均 PSNR(与 SSIM)表示。程序直接计算 MSE 与 PSNR,因此您可以在自己的图像上验证画质。
能否在我自己的图像与硬件上测试?
可以。面向 Windows 10/11、Linux Ubuntu 与 L4T 的命令行演示程序可从磁盘读取 PGM 格式的 8/16 位拜耳图像,无需相机,并为每种算法报告在您自己 GPU 上的耗时与画质。
GPU Debayer 路线图
GPU Debayer 是 Fastvideo SDK 的成熟量产模块,仍在持续开发中。近期工作交付了高质量 MG 算法(Kodak 上约 40.5 dB 平均 PSNR)、将其集成到 FastVCR,以及针对 Ampere 与 Ada GPU 架构的优化。
当前开发聚焦于:
- MG2 — 一种画质更佳的新型高性能去马赛克算法

