International Conference on Machine Learning · 会议 · Machine Learning
2026-05-28 至 2026-05-28 共收录 82 篇
2605.275912026-05-28cs.LG
Gradient Transformer: Learning to Generate Updates for LLMs
梯度变换器:学习为大语言模型生成更新
Binh-Nguyen Nguyen, Khang Tran, NhatHai Phan, Issa Khalil
机构
*
Department of Data Science, New Jersey Institute of Technology, Newark, NJ, USA(数据科学系,新泽西理工学院,新泽西州诺克斯维尔)
;
Qatar Computing Research Institute, HBKU, Doha, Qatar(卡塔尔计算研究所,HBKU,多哈)
SparseOpt: Addressing Normalization-induced Gradient Skew in Sparse Training
SparseOpt:解决稀疏训练中归一化引起的梯度倾斜
Mohammed Adnan, Rohan Jain, Tom Jacobs, Ekansh Sharma, Rahul G. Krishnan, Rebekka Burkholz, Yani Ioannou
机构
*
University of Calgary(卡尔加里大学)
;
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全中心)
CommentsPresented at the proceedings of the ICML 2026 Workshop on Structured Probabilistic Inference & Generative Modeling (SPIGM)}, Seoul, South Korea. 2026
The Shape of Reasoning: Topological Analysis of Reasoning Traces in Large Language Models
推理的形状:大型语言模型中推理轨迹的拓扑分析
Xue Wen Tan, Nathaniel Tan, Galen Lee, Stanley Kok
机构
*
University of Cambridge, Department of Engineering, England(剑桥大学工程系)
;
National University of Singapore, School of Computing, Singapore(新加坡国立大学计算机学院)
机构
*
Nanyang Technological University(南洋理工大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Illinois Chicago(伊利诺伊大学香槟分校)
;
Tsinghua University(清华大学)
;
Sun Yat-sen University(中山大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management
立场:自回归Transformer的图灵完备性高度依赖于上下文管理
Guanyu Cui, Zhewei Wei, Kun He
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院)
;
DEKE Lab, Renmin University of China, Beijing, China(中国人民大学北京校区DEKE实验室)
Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds
Mind Dreamer: 通过潜在流形上的主动因果干预释放想象力
Shaojun Xu, Xiaoling Zhou, Yihan Lin, Yapeng Meng, Xinglong Ji, Luping Shi, Rong Zhao
机构
*
Center for Brain-Inspired Computing Research, Department of Precision Instrument, Tsinghua University, Beijing, China(脑启发计算研究中心,精密仪器系,清华大学,北京,中国)
;
College of Computer Science and Technology, Zhejiang University, Hangzhou, China(计算机科学与技术学院,浙江大学,杭州,中国)
;
Pen-Tung Sah Institute of Micro-Nano Science and Technology, Xiamen University, Xiamen, China(彭途萨微纳米科学与技术研究院,厦门大学,厦门,中国)
Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination
VLMs 是在看还是只是在说?揭示视觉重新检查的幻觉
Chufan Shi, Cheng Yang, Yaokang Wu, Linghao Jin, Bo Shui, Taylor Berg-Kirkpatrick, Xuezhe Ma
机构
*
University of Southern California(南加州大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
XTransfer: Modality-Agnostic Few-Shot Model Transfer for Human Sensing at the Edge
XTransfer: 面向边缘人体感知的模态无关小样本模型迁移
Yu Zhang, Xi Zhang, Hualin Zhou, Xinyuan Chen, Shang Gao, Hong Jia, Jianfei Yang, Yuankai Qi, Tao Gu
机构
*
Macquarie University, Sydney, NSW, Australia(麦考瑞大学,悉尼,新南威尔士州,澳大利亚)
;
Nanyang Technological University, Singapore(南洋理工大学,新加坡)
;
The University of Auckland, Auckland, New Zealand(奥克兰大学,奥克兰,新西兰)
Smoothing Slot Attention Iterations and Recurrences
平滑槽注意力迭代与循环
Rongzhen Zhao, Wenyan Yang, Juho Kannala, Joni Pajarinen
机构
*
Department of Electrical Engineering and Automation, Aalto University, Espoo, Finland(电气工程与自动化系,阿alto大学,埃斯波,芬兰)
;
Department of Computer Science, Aalto University, Espoo, Finland(计算机科学系,阿alto大学,埃斯波,芬兰)
;
Center for Machine Vision and Signal Analysis, University of Oulu, Oulu, Finland(机器视觉与信号分析中心,奥卢大学,奥卢,芬兰)
Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
解耦推理与置信度:在可验证奖励的强化学习中恢复校准
Zhengzhao Ma, Xueru Wen, Boxi Cao, Yaojie Lu, Hongyu Lin, Jinglin Yang, Min He, Xianpei Han, Le Sun
机构
*
Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所信息处理实验室)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学)
;
Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学网络安全学院)
;
National Computer Network Emergency Response Technical Team/Coordination Center of China, Beijing, China(中国国家计算机网络应急技术配合中心)
LASER: Learning Active Sensing for Continuum Field Reconstruction
LASER: 用于连续场重建的学习主动感知
Huayu Deng, Jinghui Zhong, Xiangming Zhu, Yunbo Wang, Xiaokang Yang
机构
*
MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, Shanghai Jiao Tong University(人工智能MOE重点实验室、人工智能研究院、计算机科学学院、上海交通大学)
Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models
流形上的推理:扩散语言模型中用于自我验证的双向一致性
Jiaoyang Ruan, Xin Gao, Yinda Chen, Hengyu Zeng, Liang Du, Guanghao Li, Jie Fu, Jian Pu
机构
*
Institute of Science and Technology for Brain-Inspired Intelligence(脑启发智能科学与技术研究院)
;
Fudan University(复旦大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
IEG, Tencent Inc.(腾讯IEG)
Conditionally Site-Independent Neural Evolution of Antibody Sequences
抗体序列的条件性位点无关神经进化
Stephen Zhewen Lu, Aakarsh Vermani, Kohei Sanno, Jiarui Lu, Frederick A Matsen, Milind Jagota, Yun S. Song
机构
*
University of California, Berkeley
;
Columbia University
;
Mila - Qu \'e bec AI Institute
;
Fred Hutchinson Cancer Research Center
;
University of Washington
;
Howard Hughes Medical Institute