LEHA-CVQAD
收藏资源简介:
LEHA-CVQAD 数据集是一个大规模、丰富的、由人工标注的视频质量评估数据集,包含 6,240 个视频片段,用于压缩相关的视频质量评估。这些视频片段来自 59 个原始视频,经过 186 种编解码器预设编码,融合了约 1.8M 对比率和约 1.5k MOS 评分,形成一个单一的质量尺度。数据集的一部分视频保持隐藏,用于盲评估。LEHA-CVQAD 数据集旨在克服现有视频质量评估数据集的局限性,通过三方面的创新:多模态质量标签、内容和编解码器的多样性以及结构化评估。数据集公开部分和结果可通过指定网址访问。
The LEHA-CVQAD dataset is a large-scale, comprehensive, manually annotated video quality assessment dataset comprising 6,240 video clips for compression-related video quality assessment. These video clips are sourced from 59 raw videos, which have been encoded using 186 codec presets, integrating approximately 1.8 million contrast ratios and around 1.5k MOS scores to form a unified quality scale. A portion of the videos in the dataset is withheld for blind evaluation purposes. The LEHA-CVQAD dataset aims to overcome the limitations of existing video quality assessment datasets through three innovative dimensions: multimodal quality annotations, diversity of content and codecs, and structured evaluation. The publicly available portion of the dataset and corresponding results can be accessed via a designated URL.
LEHA-CVQAD 数据集概述
数据集简介
LEHA-CVQAD是一个新颖的大规模数据集,包含6000多个压缩视频流,由186种现代编解码器和编码预设生成。该数据集以真实世界内容为特色,并基于Subjectify.us的众包主观质量评分,为评估和推进视频质量评估方法提供了可靠基础。
关键特性
- 包含186种不同的视频编解码器
- 支持5种以上压缩标准(包括H.264/AVC、H.265/HEVC、H.266/VVC、AV1、VP9)
- 包含6000多个压缩视频流
- 包含200万以上主观评分
- 涉及15000名以上主观评估者
- 包含多种内容类型,包括用户生成内容(UGC)和屏幕内容
视频来源与处理
- 从Vimeo、media.xiph和YouTubeUGC等平台收集高质量、开放许可的视频(主要为FullHD)
- 从收集的25,562个视频中,基于SI/TI特征聚类并采样60个视频
- 将采样视频转码为统一的YUV 4:2:0格式
- 每个参考视频使用多种现代编解码器(AVC/H.264、HEVC/H.265、AV1、VVC/H.266、VP9等)进行编码,采用多种预设和比特率级别
主观研究
- 采用两项连续的主观研究获取可靠评分:
- 对每个参考视频进行成对比较,应用ELO和Bradley-Terry模型
- 从每组中采样三个视频评估其MOS值
- 使用MAP方法将两种主观评分合并,投影到单一尺度上
数据集对比
- 包含与其他数据集在以下方面的比较:
- SI/TI特性
- 色彩丰富度
- 对比度
- IC9600复杂度度量
- 亮度
- 锐度
评估结果
- 包含比特率对齐评估指标的可视化
- 在LEHA-CVQAD上的结果
- Bradley-Terry与最终融合主观评分的散点图比较
- 最终主观评分的分布




