arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-05-08 至 2026-05-08 共收录 3
2603.14209 2026-05-08 cs.CV cs.AI

ChArtist: Generating Pictorial Charts with Unified Spatial and Subject Control

ChArtist:通过统一的空间和主题控制生成图像图表

Shishi Xiao, Tongyu Zhou, David Laidlaw, Gromit Yeuk-Yin Chan

机构 * Adobe Research(Adobe研究院) Brown University(布朗大学)

AI总结 ChArtist通过统一的空间和主题控制生成图像图表,结合骨骼基空间控制和主题驱动控制,提升数据准确性与视觉美感。

Comments Project page: https://chartist-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15689 2026-05-08 cs.CV

DOLLAR: Few-Step Video Generation via Distillation and Latent Reward Optimization

DOLLAR: 通过蒸馏和潜在奖励优化实现少步视频生成

Zihan Ding, Chi Jin, Difan Liu, Haitian Zheng, Krishna Kumar Singh, Qiang Zhang, Yan Kang, Zhe Lin, Yuchen Liu

机构 * Princeton University(普林斯顿大学) Adobe Research(Adobe研究)

AI总结 本文提出结合变分分数蒸馏和一致性蒸馏的方法,实现高质量且多样化的少步视频生成,并通过潜在奖励模型微调提升生成性能,实现高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13549 2026-05-08 cs.CV

KFC-W: Generating 3D-Consistent Videos from Unposed Internet Photos

KFC-W: 从未经摆拍的互联网照片生成3D一致的视频

Gene Chou, Kai Zhang, Sai Bi, Hao Tan, Zexiang Xu, Fujun Luan, Bharath Hariharan, Noah Snavely

机构 * Cornell University(康奈尔大学) Adobe Research(Adobe研究)

AI总结 本文提出KFC-W模型,通过自监督学习从未经摆拍的互联网照片生成3D一致的视频,无需3D标注,优于现有方法,在几何和外观一致性上表现更佳,适用于3D高斯点扩散等应用。

Comments project page: https://genechou.com/kfcw/

详情

展开后加载摘要…

URL PDF HTML 收藏