arXiv cs.CV· Bingxuan Li, Yiwen Song, Xueqing Wu, Yanzhou Pan, Yang Li, Kuang Su, Jingyun Liu, Sebastian Ko, Huan Zhang, Tong Zhang, Nanyun Peng, Tomas Pfister, Yale Song·· 4 小时前AI 评分24
VIS-Ground:基于上下文锚定的视频交互式叙事生成
VIS-Ground: Video Interactive Storytelling with Contextual Grounding
AI 导读
VIS-Ground 将异构输入上下文转化为可执行的约束模型,用于视频交互式叙事生成,在三种视频生成骨干模型上均取得最高综合评分,平均绝对提升 10.3 分。该方法通过结构化上下文抽象、生成约束归纳和约束视频生成三步,恢复锚定状态与跨上下文依赖,并在叙事锚定和知识锚定两类任务上均有增益。
来源:arXiv cs.CV · arxiv.org