arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Baidu(百度)

2026-03-11 至 2026-03-11 共收录 2
2603.09883 2026-03-11 cs.CV

DISPLAY: Directable Human-Object Interaction Video Generation via Sparse Motion Guidance and Multi-Task Auxiliary

DISPLAY:通过稀疏运动引导和多任务辅助实现可直接控制的人机交互视频生成

Jiazhi Guan, Quanwei Yang, Luying Huang, Junhao Liang, Borong Liang, Haocheng Feng, Wei He, Kaisiyuan Wang, Hang Zhou, Jingdong Wang

机构 * Baidu Inc.(百度公司)

AI总结 DISPLAY通过稀疏运动引导和多任务辅助训练,实现高保真且可控的人机交互视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08387 2026-03-11 cs.CV

Recognition-Synergistic Scene Text Editing

识别协同场景文本编辑

Zhengyao Fang, Pengyuan Lyu, Jingjing Wu, Chengquan Zhang, Jun Yu, Guangming Lu, Wenjie Pei

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Tencent(腾讯) Department of Computer Vision Technology, Baidu Inc.(百度公司计算机视觉技术部门)

AI总结 RS-STE通过整合文本识别与编辑的协同效应,提出了一种统一框架,实现高效且一致的场景文本编辑,提升了复杂场景下的性能。

Comments accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏