arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Los Angeles(加州大学洛杉矶分校)

2025-12-29 至 2025-12-29 共收录 2
2512.21527 2025-12-29 cs.LG

Generative Actor Critic

生成性行为批判者

Aoyang Qin, Deqian Kong, Wei Wang, Ying Nian Wu, Song-Chun Zhu, Sirui Xie

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Beijing Institute of General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) Department of Statistics and Data Science, UCLA(UCLA统计与数据科学系) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Department of Computer Science, UCLA(UCLA计算机科学系)

AI总结 生成性行为批判者通过学习轨迹和回报的联合分布生成模型,实现离线预训练模型与在线经验的高效结合,提升离线到在线的改进能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08078 2025-12-29 cs.SD cs.LG

Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation

检测并缓解视频到音频生成中的插入幻觉

Liyang Chen, Hongkai Chen, Yujun Cai, Sifan Li, Qingwen Ye, Yiwei Wang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) The University of Queensland(昆士兰大学) vivo Mobile Communication Co., Ltd.(vivo移动通信有限公司) University of California, Merced(加州大学默塞德分校)

AI总结 本文提出HALCON方法,通过三阶段流程缓解视频到音频生成中的插入幻觉问题,显著降低幻觉的普遍性和持续时间,同时保持音频质量和时间同步性能。

详情

展开后加载摘要…

URL PDF HTML 收藏