arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1272 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1272 篇

2605.07402 2026-05-11 cs.CV 57%

InsHuman: Towards Natural and Identity-Preserving Human Insertion

InsHuman: 向自然且身份保持的人体插入迈进

Jie Li, Shulian Zhang, Yangyang Gao, Wenbo Li, Yulun Zhang, Yong Guo, Jian Chen

机构 * South China University of Technology(南方科技大学) Chinese University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学) Max Planck Institute for Informatics(马克斯·普朗克研究所)

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV

AI总结 本文提出InsHuman,通过HBAF、FFIP和BDP方法实现自然且身份保持的人体插入,提升生成图像的合理性与身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20211 2026-04-29 cs.CV cs.AI 57%

OmniAlpha: Aligning Transparency-Aware Generation via Multi-Task Unified Reinforcement Learning

OmniAlpha:通过多任务统一强化学习对透明度感知生成进行对齐

Hao Yu, Jinglin Wang, Jiabo Zhan, Rui Chen, Zile Wang, Huaisong Zhang, Hongyu Li, Xinrui Chen, Yongxian Wei, Chun Yuan

机构 * Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beihang University(北航)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 OmniAlpha通过多任务统一强化学习框架,解决透明度感知生成中RGB外观、alpha透明度和跨层合成的建模问题,提升RGBA生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24842 2026-04-29 cs.AI cs.MA cs.MM 57%

Co-Director: Agentic Generative Video Storytelling

Co-Director: 基于代理的生成视频叙事

Yale Song, Yiwen Song, Nick Losier, Nathan Hodson, Ye Jin, Rhyard Zhu, Yan Xu, Daniel Vlasic, Carina Claassen, Jasmine Leon, Khanh G. LeViet, Zack Chomyn, Joe Timmons, Brett Slatkin, Scott Penberthy, Tomas Pfister

机构 * Google(谷歌)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.MM

AI总结 本文提出Co-Director框架,通过分层多代理方法解决视频生成的语义一致性问题,引入分层参数化和多模态自优化循环,实现叙事策略探索与有效配置的平衡,通过GenAD-Bench验证其在个性化广告中的优越性。

Comments Project Page: https://co-director-agent.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23584 2026-04-28 cs.CV cs.IR 57%

Identity-Decoupled Anonymization for Visual Evidence in Multi-modal Retrieval-Augmented Generation

多模态检索增强生成中视觉证据的身份解耦匿名化

Zehua Cheng, Wei Dai, Jiahao Sun

机构 * Department of Computer Science University of Oxford, UK

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出身份解耦MRAG框架,通过在检索与生成之间插入生成匿名化模块,解耦人脸身份与属性,利用生成对抗网络和拒绝采样器实现隐私保护。

Comments ACM International Conference on Multimedia Retrieval 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02316 2026-04-28 cs.CV cs.AI 57%

ConsDreamer: Advancing Multi-View Consistency for Zero-Shot Text-to-3D Generation

ConsDreamer:推进多视图一致性以实现零样本文本到3D生成

Yuan Zhou, Shilong Jin, Litao Hua, Wanjun Lv, Haoran Duan, Jungong Han

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) Lenovo(联想)

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 ConsDreamer通过消除视图偏差和几何一致性约束,解决多面Janus问题,提升零样本文本到3D生成的多视图一致性。

Comments Accepted by IEEE Transactions on Image Processing, Code is available at: https://github.com/GAInuist/ConsDreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00296 2026-04-21 cs.CV 57%

TimeColor: Flexible Reference Colorization via Temporal Concatenation

TimeColor:通过时间拼接实现灵活的参考着色

Bryan Constantine Sadihin, Yihao Meng, Michael Hua Wang, Matteo Jiahao Chen, Hang Su

机构 * Computer Science and Technology(计算机科学与技术) Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 TimeColor通过时间拼接技术实现灵活的参考着色,利用显式每参考区域分配支持异构、可变数量的参考,提高颜色保真度、身份一致性和时间稳定性。

Comments Our project page is available at https://bconstantine.github.io/TimeColor/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16958 2026-04-21 cs.CV 57%

Self-Reasoning Agentic Framework for Narrative Product Grid-Collage Generation

具有自我推理代理机制的叙事产品网格-拼贴生成框架

Minyan Luo, Yuxin Zhang, Yifei Li, Xincan Wang, Fuzhang Wu, Tong-Yee Lee, Oliver Deussen, Weiming Dong

机构 * MAIS,Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所马克思主义学院) Tsinghua University(清华大学) Shanghai Theatre Academy(上海戏剧学院) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National Cheng Kung University(国立成功大学) University of Konstanz(康斯坦茨大学)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出一种自我推理代理框架,用于生成叙事产品网格拼贴,通过构建产品叙事框架和约束-aware提示,提升视觉一致性和叙事丰富度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16108 2026-04-20 cs.CV 57%

Polyglot: Multilingual Style Preserving Speech-Driven Facial Animation

Polyglot:多语言风格保留的语音驱动面部动画

Federico Nocentini, Kwanggyoon Seo, Qingju Liu, Claudio Ferrari, Stefano Berretti, David Ferman, Hyeongwoo Kim, Pablo Garrido, Akin Caliskan

机构 * University of Florence(佛罗伦萨大学) Flawless AI Imperial College London(伦敦帝国学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出Polyglot,一种统一的扩散架构,用于多语言语音驱动面部动画,通过结合语言和风格信息,提升动画的真实性和一致性。

Comments The project website is available at https://fedenoce.github.io/polyglot/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12281 2026-04-15 cs.CV cs.AI 57%

MAST: Mask-Guided Attention Mass Allocation for Training-Free Multi-Style Transfer

MAST:基于掩码的注意力质量分配用于无训练多风格迁移

Dongkyung Kang, Jaeyeon Hwang, Junseo Park, Minji Kang, Yeryeong Lee, Beomseok Ko, Hanyoung Roh, Jeongmin Shin, Hyeryung Jang

机构 * Division of Computer Science and Artificial Intelligence, Dongguk University(计算机科学与人工智能系,东国大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 MAST提出一种无训练框架,通过布局保留查询锚定、注意力质量分配、温度缩放和细节注入模块,实现多风格迁移中无边界伪影和结构一致性的保持。

Comments 16 pages, 16 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22736 2026-04-14 eess.IV cs.AI cs.CV cs.LG physics.med-ph stat.ML 57%

PnP-CM: Consistency Models as Plug-and-Play Priors for Inverse Problems

PnP-CM:一致性模型作为逆问题的即插即用先验

Merve Gülle, Junno Yun, Yaşar Utku Alçalar, Mehmet Akçakaya

机构 * University of Minnesota(明尼苏达大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出PnP-CM,将一致性模型视为先验的近端算子,用于解决多种逆问题,通过改进的ADMM框架和噪声扰动,在低NFE情况下实现高质量重建。

Comments IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09989 2026-04-14 cs.CV cs.AI 57%

FlowPalm: Optical Flow Driven Non-Rigid Deformation for Geometrically Diverse Palmprint Generation

FlowPalm: 基于光流的非刚性变形生成几何多样性指纹

Yuchen Zou, Huikai Shao, Lihuang Fang, Zhipeng Xiong, Dexing Zhong

机构 * Xi’an Jiaotong University(西安交通大学) Sichuan Digital Economy Industry Development Research Institute(四川数字经济发展研究院) Southern University of Science and Technology(南方科技大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 FlowPalm通过光流驱动生成几何多样性的指纹,结合统计变形模式与渐进采样过程,提升指纹识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08828 2026-04-13 cs.LG cs.CV 57%

Post-Hoc Guidance for Consistency Models by Joint Flow Distribution Learning

通过联合流分布学习提升一致性模型的后验指导

Chia-Hong Hsu, Randall Balestriero

机构 * Brown University(布朗大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出JFDL方法,通过预训练一致性模型实现后验指导,无需扩散模型教师,有效降低FID并提升生成图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08760 2026-04-13 cs.CV 57%

SIC3D: Style Image Conditioned Text-to-3D Gaussian Splatting Generation

SIC3D:基于风格图像的文本到3D高斯点云生成

Ming He, Zhixiang Chen, Steve Maddock

机构 * School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 SIC3D通过引入变分风格化分数蒸馏损失,提升文本到3D生成的可控性和纹理精度,实验表明其在几何真实性和风格一致性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05296 2026-04-08 cs.CV 57%

From Measurement to Mitigation: Quantifying and Reducing Identity Leakage in Image Representation Encoders with Linear Subspace Removal

从测量到缓解:量化并减少图像表示编码器中的身份泄露

Daniel George, Charles Yeh, Daniel Lee, Yifei Zhang

机构 * Persona Identities

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种针对图像表示编码器中身份泄露的评估基准和缓解方法,通过线性子空间移除技术在保持实用性的前提下提升隐私保护。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05039 2026-04-08 cs.CV cs.AI 57%

ID-Sim: An Identity-Focused Similarity Metric

ID-Sim:一种以身份为中心的相似性度量

Julia Chae, Nicholas Kolkin, Jui-Hsien Wang, Richard Zhang, Sara Beery, Cusuh Ham

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Adobe Research(Adobe研究院)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出ID-Sim,一种以身份为中心的相似性度量,通过高质量图像数据集和生成合成数据,提升身份识别和生成任务的评估能力。

Comments SB and CH equal advising; Project page https://juliachae.github.io/id_sim.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07951 2026-04-06 cs.CV 57%

Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality

保留源视频真实性:面向电影质量的高保真面部交换

Zekai Luo, Zongze Du, Zhouhang Zhu, Hao Zhong, Muzhi Zhu, Wen Wang, Yuling Xi, Chenchen Jing, Hao Chen, Chunhua Shen

机构 * Zhejiang University, State Key Laboratory of CAD & CG(浙江大学,计算机辅助设计与图形学国家重点实验室) Zhejiang University of Technology(浙江工业大学) Ant Group(蚂蚁集团)

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV

AI总结 本文提出LivingSwap模型,通过关键帧和视频参考引导实现高保真面部交换,提升视频真实感与时间一致性,减少生产流程中的手动工作量。

Comments Accepted to CVPR 2026. Project webpage: https://aim-uofa.github.io/LivingSwap

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12090 2026-04-02 cs.CV cs.CR cs.LG 57%

SPDMark: Selective Parameter Displacement for Robust Video Watermarking

SPDMark:基于选择性参数位移的鲁棒视频水印技术

Samar Fares, Nurbek Tastan, Karthik Nandakumar

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Michigan State University (MSU)(密歇根州立大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 SPDMark通过在视频扩散模型中选择性位移参数,在生成视频时嵌入不可见水印,实现高鲁棒性和计算效率的平衡。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00293 2026-04-02 cs.CV cs.CR cs.LG 57%

MOLM: Mixture of LoRA Markers

MOLM:LoRA标记的混合

Samar Fares, Nurbek Tastan, Noor Hussein, Karthik Nandakumar

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Michigan State University (MSU)(密歇根州立大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出MOLM,一种基于路由的LoRA标记方法,通过轻量级LoRA适配器在残差和注意力块中实现参数扰动,提升水印的鲁棒性和隐蔽性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04485 2026-04-02 cs.CV 57%

Not All Birds Look The Same: Identity-Preserving Generation For Birds

并非所有鸟都看起来一样:用于鸟类的身份保持生成

Aaron Sun, Oindrila Saha, Subhransu Maji

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出NABirds Look-Alikes数据集,用于评估鸟类身份保持生成,显示基于物种、年龄和性别的训练提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29587 2026-04-01 cs.GR 57%

Style-Instructed Mask-Free Virtual Try On

风格指导的无掩膜虚拟试穿

Mengqi Zhang, Qi Li, Mehmet Saygin Seyfioglu, Karim Bouyarmane

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.GR

AI总结 本文提出一种无需掩膜的虚拟试穿框架,通过注意力引导机制和指令提示提升试穿准确性与交互灵活性,实验表明其在多个数据集上均优于现有方法。

Comments Project page: https://smf-vto.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28068 2026-04-01 cs.CV 57%

AIBench: Evaluating Visual-Logical Consistency in Academic Illustration Generation

AIBench:评估学术示意图生成中的视觉-逻辑一致性

Zhaohe Liao, Kaixun Jiang, Zhihang Liu, Yujie Wei, Junqiu Yu, Quanhao Li, Hong-Tao Yu, Pandeng Li, Yuzheng Wang, Zhen Xing, Shiwei Zhang, Chen-Wei Xie, Yun Zheng, Xihui Liu

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) SJTU(上海交通大学) FDU(复旦大学) USTC(中国科学技术大学) SEU(东南大学) HKU(香港大学)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出AIBench,首个通过VQA评估学术示意图逻辑正确性及VLM评估美观性的基准,通过四层问题验证生成示意图与论文的一致性,发现模型在该任务上的性能差异显著,且逻辑与美观难以同时优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12766 2026-04-01 cs.CV 57%

Catalyst4D: High-Fidelity 3D-to-4D Scene Editing via Dynamic Propagation

Catalyst4D: 通过动态传播实现高保真的3D到4D场景编辑

Shifeng Chen, Yihui Li, Jun Liao, Hongyu Yang, Di Huang

机构 * State Key Laboratory of Complex and Critical Software Environment, Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Zhejiang Industrial Big Data and Robot Intelligent System Key Laboratory, Hangzhou Innovation Institute, Beihang University(北京航空航天大学杭州创新研究院浙江省工业大数据与机器人智能系统重点实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出Catalyst4D框架,通过动态传播实现高保真的4D场景编辑,保持时空一致性,优于现有方法。

Comments https://junliao2025.github.io/Catalyst4D-ProjectPage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14255 2026-03-31 cs.CV 57%

Identity-Preserving Image-to-Video Generation via Reward-Guided Optimization

通过奖励引导优化实现身份保持的图像到视频生成

Liao Shen, Wentao Jiang, Yiran Zhu, Jiahe Li, Tiezheng Ge, Zhiguo Cao, Bo Zheng

机构 * Huazhong University of Science and Technology(华中科技大学) Taobao & Tmall Group of Alibaba(阿里巴巴淘宝天猫集团) Alibaba Group(阿里巴巴集团)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出IPRO框架,通过强化学习优化扩散模型,提升身份一致性。引入面部评分机制和KL散度正则化,改进性能并加速收敛。

Comments accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16649 2026-03-31 cs.CV 57%

Mixture of Style Experts for Diverse Image Stylization

风格专家混合模型用于多样化图像风格化

Shihao Zhu, Ziheng Ouyang, Yijia Kang, Qilong Wang, Mi Zhou, Bo Li, Ming-Ming Cheng, Qibin Hou

机构 * VCIP, CS, Nankai University(南开大学计算机学院视觉与图像处理实验室) NKIARI, Shenzhen Futian(深圳福田南开大学新一代人工智能研究院) Tianjin University(天津大学) vivo BlueImage Lab(vivo蓝心影像实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出StyleExpert框架,基于MoE模型实现语义感知的图像风格化,通过统一编码器和动态门控机制处理多层级语义风格,实验表明其在保持语义和材质细节方面优于现有方法。

Comments 24 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09472 2026-03-30 cs.CV 57%

Zero-Shot Personalized Camera Motion Control for Image-to-Video Synthesis

零样本个性化摄像机运动控制用于图像到视频合成

Pooja Guhan, Divya Kothandaraman, Geonsun Lee, Tsung-Wei Huang, Guan-Ming Su, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学帕克分校) Dolby Laboratories(杜比实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出零样本扩散框架,实现从单参考视频向静态图像转移电影级运动,提升非专家创作者的创意表达与视频制作可及性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22172 2026-03-26 cs.CV 57%

CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation

CA-LoRA:面向领域对齐的分割数据集生成的概念感知LoRA

Minho Park, Sunghyun Park, Jungsoo Lee, Hyojin Park, Kyuwoong Hwang, Fatih Porikli, Jaegul Choo, Sungha Choi

机构 * KAIST(韩国科学技术院) Qualcomm AI Research(高通AI研究) Kyung Hee University(庆熙大学)

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 本文提出CA-LoRA方法,通过文本到图像生成模型生成分割数据集,解决数据稀缺问题。该方法通过选择性更新与领域对齐相关的概念权重,提升生成样本的多样性和信息量,在城市场景分割中表现优异。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23462 2026-03-25 cs.CV 57%

RealMaster: Lifting Rendered Scenes into Photorealistic Video

RealMaster: 将渲染场景提升为逼真视频

Dana Cohen-Bar, Ido Sobol, Raphael Bensadoun, Shelly Sheynin, Oran Gafni, Or Patashnik, Daniel Cohen-Or, Amit Zohar

机构 * Tel Aviv University(特拉维夫大学) Reality Labs, Meta(Meta现实实验室) Technion Israel(技术学院以色列)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 RealMaster通过视频扩散模型将渲染视频提升为逼真视频,保持与3D引擎输出的精确对齐,同时通过IC-LoRA训练实现高质量输出和泛化能力。

Comments Project page: https://danacohen95.github.io/RealMaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23295 2026-03-25 cs.CV 57%

Mamba-driven MRI-to-CT Synthesis for MRI-only Radiotherapy Planning

基于Mamba的MRI到CT合成用于仅MRI的放疗计划

Konstantinos Barmpounakis, Theodoros P. Vagenas, Maria Vakalopoulou, George K. Matsopoulos

机构 * School of Electrical Computer Engineering, National Technical University of Athens Archimedes, Athena Research Center CentraleSup\'elec, University of Paris-Saclay

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出基于Mamba架构的MRI到CT合成方法,以提高跨模态翻译的准确性与效率,通过3D Mamba架构捕捉复杂体积特征和长距离依赖,实现快速且精确的CT合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23265 2026-03-25 cs.CL cs.CV 57%

PaperBanana: Automating Academic Illustration for AI Scientists

PaperBanana:为AI科学家自动化学术插图

Dawei Zhu, Rui Meng, Yale Song, Xiyu Wei, Sujian Li, Tomas Pfister, Jinsung Yoon

机构 * Peking University(北京大学) Google Cloud AI Research(谷歌云AI研究)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 PaperBanana通过整合先进视觉语言模型和图像生成模型,自动化生成出版级学术插图,提升了科研流程中插图制作的效率与质量。

Comments Add Citations

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05905 2026-03-24 cs.CV 57%

SCAIL: Towards Studio-Grade Character Animation via In-Context Learning of 3D-Consistent Pose Representations

SCAIL:通过上下文学习3D一致姿态表示实现工作室级角色动画

Wenhao Yan, Sheng Ye, Zhuoyi Yang, Jiayan Teng, ZhenHui Dong, Kairui Wen, Xiaotao Gu, Yong-Jin Liu, Jie Tang

机构 * Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 SCAIL通过创新的3D姿态表示和全上下文姿态注入机制,提升角色动画的结构保真度和时间一致性,实现工作室级控制。

详情

展开后加载摘要…

URL PDF HTML 收藏