跳到正文
arXiv cs.CV· Carlotta Segna, Joel Tschesche, Anna Rohrbach·· 3 小时前AI 评分24

BabelFake:多语言音视频 DeepFake 基准

BabelFake: A Multilingual Audio-Visual DeepFake Benchmark

AI 导读

研究者发布 BabelFake 多语言音视频 DeepFake 基准,包含来自 496 名知情同意参与者的 399k 个片段(1,323 小时),覆盖英语、德语、意大利语、法语、西班牙语五种语言。其模块化生成流程将 11 种现代视频篡改方法与 4 种语音克隆引擎配对,区分仅视觉(换脸)与音视频联合篡改(唇形同步、人像动画)。基准测试显示检测难度取决于音视频生成配对,保留真实音频时检测性能大幅下降。

来源:arXiv cs.CV · arxiv.org