CVPR 2024 | Modular Blind Video Quality Assessment:模块化无参视频质量评估
内容提要
本文提出了一种模块化BVQA模型,用于视频质量评估。该模型包括基础质量预测模块、空域矫正模块和时域矫正模块,能够准确评估视频质量的视觉内容和失真、空域分辨率和时域帧率变化。实验结果表明,该模型在专业生成的内容和用户生成的内容上表现优于当前方法。模型还可以轻松添加其他与质量相关的视频属性。
延伸解读
为何传统BVQA模型忽视分辨率与帧率?
早期基于CNN的BVQA方法受限于计算复杂度和数据集规模,通常将视频下采样或局部块采样,导致实际空域分辨率和时域帧率信息丢失。随着高分辨率高帧率视频普及,这种简化在跨分辨率/帧率转码画质评估中误差显著。本文提出的模块化设计正是为了显式建模这些被忽视的因素。
模块化矫正机制如何工作?
模型包含基础质量预测、空域矫正和时域矫正三个模块。基础模块用稀疏下采样关键帧预测初始质量分;空域矫正模块基于拉普拉斯金字塔计算缩放和移位参数;时域矫正模块处理关键帧周围的视频块,同样输出校正参数。训练时随机丢弃矫正模块,迫使基础模块独立有效,同时保证组合后性能更优。
实验验证了哪些关键优势?
在四个PGC数据集(BVI-SR、Waterloo IVC 4K、BVI-HFR、LIVE-YT-HFR)和八个UGC数据库上,空域和时域矫正模块分别有效感知分辨率和帧率对质量的影响,集成后显著提升预测性能,与当前最优模型相比具有竞争力。模块化设计还便于添加动态范围、色域等新矫正模块,扩展性强。
Q&A
模块化BVQA模型的主要组成部分是什么?
模块化BVQA模型包括基础质量预测模块、空域矫正模块和时域矫正模块。
该模型如何评估视频质量的视觉内容和失真?
模型通过基础质量预测模块、空域矫正模块和时域矫正模块分别响应视频质量中的视觉内容和失真、空域分辨率和时域帧率变化。
实验结果显示该模型在什么类型的视频内容上表现优于当前方法?
实验结果表明,该模型在专业生成的内容和用户生成的内容上表现优于当前方法。
模块化设计对模型的优势是什么?
模块化设计允许轻松添加其他与质量相关的视频属性,并提供对UGC数据库中主要失真类型的全面理解。
更高的空域分辨率和帧速率对视频质量有什么影响?
研究表明更高的空域分辨率和帧速率对视频主观画质有积极影响。
该模型在处理高分辨率和高帧率视频时面临什么挑战?
基于CNN的BVQA方法在处理高分辨率和高帧率视频时面临计算复杂度高的问题。