Rethinking Reward Signals in Video GRPO: When Scores Become Targets
重新思考视频GRPO中的奖励信号:当分数成为目标
Rui Li, Yuanzhi Liang, Ziqi Ni, Haibin Huang, Chi Zhang, Xuelong Li
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Southeast University(东南大学)
;
Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)
From Draft to Draft-Free: One-Step Video Object Removal via Privileged Distillation and Fast Planting
从带草稿到无草稿:通过特权蒸馏和快速植入实现一步视频对象移除
Zizhao Chen, Ping Wei, Guang Dai, Jingdong Wang, Mengmeng Wang
机构
*
Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所)
;
SGIT AI Lab, State Grid Corporation of China(国家电网公司SGIT人工智能实验室)
;
Zhejiang University of Technology(浙江工业大学)
;
Baidu(百度)
机构
*
Zhejiang University of Technology(浙江工业大学)
;
University of New South Wales (UNSW Sydney)(新南威尔士大学(悉尼))
;
University of Auckland(奥克兰大学)
;
Zhejiang University(浙江大学)
机构
*
South China University of Technology(华南理工大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified Models
Lumos-Nexus: 面向视频统一模型的高效频率桥接与同质潜在空间
Jiazheng Xing, Hangjie Yuan, Lingling Cai, Xinyu Liu, Yujie Wei, Fei Du, Tao Feng, Hai Ci, Jiasheng Tang, Weihua Chen, Fan Wang, Yong Liu
机构
*
Zhejiang University(浙江大学)
;
DAMO Academy, Alibaba Group(阿里云达摩院)
;
Hupan Lab(虎扑实验室)
;
National University of Singapore(新加坡国立大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Fudan University(复旦大学)
;
Tsinghua University(清华大学)
Resonant Minds: Closed-Loop Social Avatars with Theory of Mind
共鸣心智:具备心智理论的闭环社交虚拟人
Jianxu Shangguan, Jing Xu, Hang Ye, Xiaoxuan Ma, Yizhou Wang, Jenq-Neng Hwang, Wentao Zhu
机构
*
University of Washington(华盛顿大学)
;
Peking University(北京大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Eastern Institute of Technology, Ningbo(宁波工程技术学院)