arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Meituan(美团)

2025-12-24 至 2025-12-24 共收录 2
2512.20615 2025-12-24 cs.CV

Active Intelligence in Video Avatars via Closed-loop World Modeling

通过闭环世界建模实现视频虚拟角色的主动智能

Xuanhua He, Tianyu Yang, Ke Cao, Ruiqi Wu, Cheng Meng, Yong Zhang, Zhuoliang Kang, Xiaoming Wei, Qifeng Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学) Meituan(美团) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出ORCA框架,通过闭环世界建模和双系统架构,实现视频虚拟角色的主动智能与目标导向行为。

Comments Project Page: https://xuanhuahe.github.io/ORCA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20615 2025-12-24 cs.CV

EmoCAST: Emotional Talking Portrait via Emotive Text Description

EmoCAST:通过情感文本描述生成情感对话头

Yiguo Jiang, Xiaodong Cun, Yong Zhang, Yudian Zheng, Fan Tang, Chi-Man Pun

机构 * University of Macau(澳门大学) GVC Lab, Great Bay University(大湾大学GVC实验室) Meituan(美团) ICT-CAS Project(ICT-CAS项目)

AI总结 EmoCAST通过情感文本描述生成逼真且音频同步的情感对话头视频,结合文本引导和音频对齐模块提升表达质量。

详情

展开后加载摘要…

URL PDF HTML 收藏