EAPO-EmoPrefer
收藏资源简介:
EAPO-EmoPrefer是基于错误增强偏好优化(EAPO)引入的受控错误增强偏好数据集。它是EmoPrefer的扩展:从其人工标注的多模态偏好对出发,构建了流畅但故意不可靠的描述,涵盖四种受控错误类型。
EAPO-EmoPrefer is a controlled error-augmented preference dataset developed based on Error-Augmented Preference Optimization (EAPO). It is an extension of EmoPrefer: starting from its manually annotated multimodal preference pairs, it constructs fluent but intentionally unreliable descriptions that cover four types of controlled errors.
EAPO-EmoPrefer 数据集详情
数据集概述
EAPO-EmoPrefer 是一个受控错误增强(Error-Augmented)的多模态情绪偏好数据集,源自 Error-Augmented Preference Optimization (EAPO) 论文,发表于 ACM-MM 2026 Workshop(MRAC 26)。该数据集在 EmoPrefer 基础上构建,通过引入四类受控错误类型的描述,用于增强多模态大模型在情感偏好判断中的可靠性。
数据来源与访问要求
该数据集并非独立的源媒体数据集,需要结合以下资源使用:
- EmoPrefer / EmoPrefer-Data-V2:提供原始候选描述和人工偏好标注,需遵循上游仓库许可。
- MER2025:提供音频和视频片段,需通过门控学术访问申请,接受 EULA 并获得批准。
- EAPO-EmoPrefer:新增四类受控错误负样本及其构建/验证元数据,受上游媒体资源限制约束。
注意:本仓库不重新分发 MER2025 的音视频内容,用户需通过 sample_id 自行关联媒体数据。
数据集构成
| 数据集 | 角色 | 偏好对数量 |
|---|---|---|
| EmoPrefer-Data-V2 | 正常训练 | 1,618 |
| Error-Aug Train-Set | 错误增强训练 | 2,908 |
| EmoPrefer-Data | 原始验证 | 563 |
| Error-Aug Val-Set | 受控错误验证 | 944 |
| MER-Prefer Test Stage 1 | 官方测试 | 379 |
| MER-Prefer Test Stage 2 | 官方测试 | 515 |
四类受控错误类型
- 情感翻转(Emotion Flip):改变推断的情感类别或效价,保留引用的多模态证据。
- 强度不匹配(Intensity Mismatch):仅改变情感或线索的程度,保留类别。
- 证据矛盾(Evidence Contradiction):反转某一模态的一个或多个相关观察,保留整体解释。
- 模态遗漏(Modality Omission):移除某一模态的一个独立证据子句,不添加新事实。
构建流程
- 偏好锚点选择:从原始偏好对中选择人工偏好的描述并分段编号。
- Qwen3 编辑规划:使用 Qwen3-30B-A3B-Instruct-2507 模型提出结构化局部编辑方案。
- 程序化构建:仅应用局部替换,冻结非目标文本。
- 规则验证:检查类型特定约束、引号、局部性、长度、句子数和词汇重叠。
- 独立 Qwen3 验证:验证错误类型、非目标保留、流畅性和构建质量,仅接受通过的候选。
主要实验结果
验证集加权 F1(WAF,%)
| 模型 | 训练设置 | Orig. Val | 4-Error Avg |
|---|---|---|---|
| MiniCPM-o-2.6-8B | 零样本 | 61.53 | 69.46 |
| MiniCPM-o-2.6-8B | Error-Aug SFT+DPO | 73.89 | 86.09 |
| Qwen2.5-Omni-7B | 零样本 | 68.17 | 58.01 |
| Qwen2.5-Omni-7B | Error-Aug SFT+DPO | 78.29 | 76.89 |
| Qwen3-Omni-30B-A3B | 零样本 | 73.43 | 70.15 |
| Qwen3-Omni-30B-A3B | Error-Aug SFT+DPO | 79.04 | 83.91 |
| EAPO 校准融合 | 融合 Judges 11+14+21 | 80.31 | 85.35 |
官方测试集结果
| 系统 | 融合方式 | Stage 1 | Stage 2 | Macro |
|---|---|---|---|---|
| 最佳单模型 | Judge 21 | 90.25 | 68.56 | 79.40 |
| EAPO 归一化融合 | Judges 11+16+21 | 91.30 | 69.17 | 80.23 |
数据文件
controlled_negatives.jsonl:标准发布格式,含嵌套编辑和验证元数据。controlled_negatives.csv:扁平化版本。preference_pairs.csv:配对偏好格式。preference_pairs_position_balanced.csv:含双向候选顺序以控制位置偏差。
质量与局限说明
当前发布版本采用自动化质量控制和独立的文本 Qwen3 验证,未经过详尽的人工审核。验证器可能接受错误的错误类型、遗漏非预期的语义变化,或与编辑规划器共享系统性偏差(两者使用同一检查点)。因此,本数据集应视为模型审计标注的研究数据集,而非无错误的人工验证真值。计划在未来更新中添加针对性人工审核和修订版本。
许可证
- 代码:MIT 许可证
- 数据:CC BY-NC 4.0(详见 DATA_LICENSE.md)
- 源音视频不重新分发,样本 ID 仅作为合法访问用户的连接键。




