Alignment through Meta-Weighted Online Sampling: Bridging the Gap between Data Generation and Preference Optimization
通过元权重在线采样对齐:弥合数据生成与偏好优化之间的差距
Junming Yang, Ning Xu, Biao Liu, Shiqi Qiao, Xin Geng
机构
*
School of Computer Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院)
;
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用国家重点实验室)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)
;
DAMO Academy, Alibaba Group(阿里集团大模型学院)
;
Hupan Laboratory(华平实验室)
Context and Diversity Matter: The Emergence of In-Context Learning in World Models
上下文与多样性至关重要:世界模型中情境学习的出现
Fan Wang, Zhiyuan Chen, Yuxuan Zhong, Sunjian Zheng, Pengtao Shao, Bo Yu, Shaoshan Liu, Jianan Wang, Ning Ding, Yang Cao, Yu Kang
机构
*
Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究院)
;
University of Science and Technology of China(中国科学技术大学)
;
Anhui Province Key Laboratory of Intelligent Low-Carbon Information Technology and Equipment(安徽省智能低碳信息技术与设备重点实验室)
Veritas: Generalizable Deepfake Detection via Pattern-Aware Reasoning
Veritas:通过模式感知推理实现通用的深度伪造检测
Hao Tan, Jun Lan, Zichang Tan, Ajian Liu, Chuanbiao Song, Senyuan Shi, Huijia Zhu, Weiqiang Wang, Jun Wan, Zhen Lei
机构
*
School of Advanced Interdisciplinary Sciences (SAIS), University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)
;
Ant Group(蚂蚁集团)
;
Shenzhen Institute of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
On the Lipschitz Continuity of Set Aggregation Functions and Neural Networks for Sets
关于集合聚合函数和集合神经网络的Lipschitz连续性
Giannis Nikolentzos, Konstantinos Skianis
机构
*
Department of Informatics and Telecommunications University of Peloponnese(信息与通信技术系希腊皮洛斯大学)
;
Department of Computer Science & Engineering University of Ioannina(计算机科学与工程系伊奥尼亚大学)
REA-RL: Reflection-Aware Online Reinforcement Learning for Efficient Reasoning
REA-RL:面向高效推理的反思意识在线强化学习
Hexuan Deng, Wenxiang Jiao, Xuebo Liu, Jun Rao, Min Zhang
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能学院,哈尔滨工业大学深圳学院)
;
Zhongguancun Academy, Beijing, China(中关村学院,北京)
;
Xiaohongshu Inc.(小红书公司)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
通过通道级功能分解和流形正则化实现高效的退化无关图像恢复
Bin Ren, Yawei Li, Xu Zheng, Yuqian Fu, Danda Pani Paudel, Hong Liu, Ming-Hsuan Yang, Luc Van Gool, Nicu Sebe
机构
*
Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·泽德人工智能大学)
;
University of Trento(特伦托大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
HKUST (GZ)(香港科技大学(广州))
;
Peking University(北京大学)
;
University of California, Merced(加州大学默塞德分校)
机构
*
AIML, University of Adelaide, Australia(AIML,澳大利亚阿德莱德大学)
;
ZIP Lab, Zhejiang University, China(浙江工业大学ZIP实验室)
;
University of Sydney, Australia(悉尼大学)
;
Monash University, Australia(墨尔本大学)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)
;
National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
TIGER: Time-frequency Interleaved Gain Extraction and Reconstruction for Efficient Speech Separation
TIGER:用于高效语音分离的时间-频率交织增益提取与重建
Mohan Xu, Kai Li, Guo Chen, Xiaolin Hu
机构
*
Department of Computer Science and Technology, Institute for AI, BNRist, Tsinghua University(计算机科学与技术系、人工智能研究院、BNRist、清华大学)
;
Tsinghua Laboratory of Brain and Intelligence (THBI), IDG/McGovern Institute for Brain Research, Tsinghua University(脑智能实验室(THBI)、IDG/麦克戈文脑科学研究院、清华大学)
;
Chinese Institute for Brain Research (CIBR), Beijing(中国脑科学研究院)
The False Promise of Zero-Shot Super-Resolution in Machine-Learned Operators
机器学习算子中零样本超分辨率的虚假承诺
Mansi Sakarvadia, Kareem Hegazy, Amin Totounferoush, Kyle Chard, Yaoqing Yang, Ian Foster, Michael W. Mahoney
机构
*
University of Chicago(芝加哥大学)
;
Lawrence Berkeley National Laboratory(伯克利国家实验室)
;
University of Stuttgart(斯图加特大学)
;
Dartmouth College(达特茅斯学院)
;
International Computer Science Institute(国际计算机科学研究所)
;
University of California, Berkeley(加州大学伯克利分校)
On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification
在SFT的泛化上:从强化学习视角的奖励校正
Yongliang Wu, Yizhou Zhou, Zhou Ziheng, Yingzhe Peng, Xinyu Ye, Xinting Hu, Wenbo Zhu, Lu Qi, Ming-Hsuan Yang, Xu Yang
机构
*
Southeast University(东南大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Wuhan University(武汉大学)
;
University of California, Merced(加州大学默塞德分校)