ContextAnyone: Context-Aware Diffusion for Character-Consistent Text-to-Video Generation
ContextAnyone: 基于上下文的扩散模型用于一致的文本到视频生成
机构 * Dartmouth College(达特茅斯学院)
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);分类 cs.CV
AI总结 ContextAnyone通过上下文感知扩散模型实现从文本和参考图像生成一致的角色视频,结合双引导损失和Gap-RoPE位置嵌入提升视觉质量和身份一致性。