机构
*
Nanjing University of Science and Technology(南京理工大学)
;
Macquarie University(麦考瑞大学)
;
Western Sydney University(西澳大学)
;
University of Hong Kong(香港大学)
;
CSIRO’s Data61(澳大利亚CSIRO Data61)
James Evans, Benjamin Bratton, Blaise Agüera y Arcas
机构
*
Paradigms of Intelligence Team, Google(谷歌智能范式团队)
;
University of Chicago(芝加哥大学)
;
Santa Fe Institute(圣菲研究所)
;
Antikythera, Berggruen Institute(安提基特拉与伯格格林研究所)
;
University of California, San Diego(加州大学圣地亚哥分校)
Flexible Cutoff Learning: Optimizing Machine Learning Potentials After Training
灵活截断学习:训练后优化机器学习势能
Rick Oerder, Jan Hamaekers
机构
*
Institute for Numerical Simulation, University of Bonn(波恩大学数值模拟研究所)
;
Fraunhofer Institute for Algorithms and Scientific Computing SCAI(弗劳恩霍夫算法与科学计算研究所SCAI)
ADHint: Adaptive Hints with Difficulty Priors for Reinforcement Learning
ADHint: 基于难度先验的自适应提示用于强化学习
Feng Zhang, Zezhong Tan, Xinhong Ma, Ziqiang Dong, Xi Leng, Jianfei Zhao, Xin Sun, Yang Yang
机构
*
Alibaba Group(阿里巴巴集团)
;
Beijing Institute of Technology(北京理工大学)
;
Peking University(北京大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Zhongguancun Academy(中关村学院)
Journal refIn Proceedings of the 3rd International Workshop on AI for Quantum and Quantum for AI (AIQxQIA 2025), co-located with ECAI 2025, CEUR Workshop Proceedings, Vol. 4153, Paper 6, pp. 1-12, 2025
TDM-R1: Reinforcing Few-Step Diffusion Models with Non-Differentiable Reward
TDM-R1: 通过非可微奖励强化少步扩散模型
Yihong Luo, Tianyang Hu, Weijian Luo, Jing Tang
机构
*
Hong Kong University of Science and Technology(香港科技大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
hi-Lab, Xiaohongshu Inc(小红书实验室)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
机构
*
Qwen Large Model Application Team, Alibaba(阿里巴巴文勤大模型应用团队)
;
Beijing University Of Posts and Telecommunications(北京邮电大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
机构
*
University of California, San Diego(加州大学圣地亚哥分校)
;
University of Toronto(多伦多大学)
;
Adobe Research(Adobe研究)
;
The University of New South Wales(新南威尔士大学)
Commentsv2: corrected typos and improved wording; corrected Poynting loss weight; added an additional high-frequency scenario with corresponding results and discussion
From Preferences to Prejudice: The Role of Alignment Tuning in Shaping Social Bias in Video Diffusion Models
从偏好到偏见:对齐调谐在视频扩散模型中塑造社会偏见的作用
Zefan Cai, Haoyi Qiu, Haozhe Zhao, Ke Wan, Jiachen Li, Jiuxiang Gu, Wen Xiao, Nanyun Peng, Junjie Hu
机构
*
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
University of California, Santa Barbara(加州大学圣巴巴拉分校)
;
Microsoft(微软公司)
机构
*
Department of Aeronautics and Astronautics, MIT(麻省理工学院航空与宇航系)
;
Department of Statistics, University of Wisconsin--Madison(威斯康星大学麦迪逊分校统计系)
;
Department of Informatics, King's College London(伦敦国王学院信息学系)
;
Department of Computer Sciences, University of Wisconsin--Madison(威斯康星大学麦迪逊分校计算机科学系)