arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 11753
2602.11749 2026-06-23 cs.AI 版本更新

AIR: Improving Agent Safety through Incident Response

AIR:通过事件响应提升智能体安全性

Zibo Xiao, Jun Sun, Junjie Chen

机构 * Tianjin University(天津大学) Singapore Management University(新加坡国立管理学院)

AI总结 提出首个面向LLM智能体系统的事件响应框架AIR,通过语义检测、自动遏制恢复和规则合成,在三个典型智能体上实现超90%的检测、修复和根除成功率。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06776 2026-06-23 cs.GT cs.LG 版本更新

Fair Transit Stop Placement: A Clustering Perspective and Beyond

公平公交站点布局:聚类视角及其超越

Haris Aziz, Ling Gai, Yuhang Guo, Jeremy Vollen

机构 * UNSW Sydney(新南威尔士大学悉尼分校) University of Shanghai for Science and Technology(上海科学技术大学) Northwestern University(西北大学)

AI总结 研究一般度量空间中公交站点布局问题的公平性,通过正当代表性和核心概念揭示与公平聚类的结构对应,提出参数化算法实现可调权衡。

Comments To appear in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22100 2026-06-23 cs.LG 版本更新

Boosting CVaR Policy Optimization with Quantile Gradients

利用分位数梯度提升CVaR策略优化

Yudong Luo, Erick Delage

机构 * GERAD \& Department of Decision Sciences, HEC Montreal, Canada Mila - Quebec AI Institute, Canada

AI总结 针对CVaR策略优化样本效率低的问题,引入期望分位数项,利用动态规划充分利用所有采样数据,在马尔可夫策略类中显著提升性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04548 2026-06-23 cs.LG stat.ML 版本更新

Gradient Flow Through Diagram Expansions: Learning Regimes and Explicit Solutions

通过图展开的梯度流:学习机制与显式解

Dmitry Yarotsky, Eugene Golikov, Yaroslav Gusev

机构 * Applied AI Institute(应用人工智能研究所) Steklov Mathematical Institute of Russian Academy of Sciences(俄罗斯科学院斯捷克洛夫数学研究所)

AI总结 提出一种数学框架,通过费曼图展开分析大规模学习问题中梯度流的缩放机制,揭示不同学习阶段并得到非线性梯度流的显式解,应用于高阶张量的CP分解。

Comments 51 pages, ICML'2026 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07532 2026-06-23 cs.LG cs.AI 版本更新

Neural Concept Verifier: Scaling Prover-Verifier Games via Concept Encodings

神经概念验证器:通过概念编码扩展证明者-验证者博弈

Berkant Turan, Suhrab Asadulla, David Steinmann, Kristian Kersting, Wolfgang Stammer, Sebastian Pokutta

机构 * Zuse Institute Berlin, Germany AI \& ML Lab, Computer Science Department, TU Darmstadt Hessian Center for AI (hessian.AI) Lab1141 German Research Center for AI (DFKI) Institute of Mathematics, Technische Universit\"at Berlin, Germany Max Planck Institute for Informatics, SIC

AI总结 提出神经概念验证器(NCV)框架,结合概念编码与证明者-验证者博弈,实现高维输入的可验证分类,优于传统方法并缓解捷径行为。

Comments 28 pages, 5 figures, 12 tables, revised references. An earlier version of this work was presented at the ICML 2025 Workshop on Actionable Interpretability

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07855 2026-06-23 cs.LG cs.AI cs.CL 版本更新

DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)

DPO 解绑:你的训练算法在人类选择理论中实际上是解耦的(且其损失函数的凸性并非必需)

Wenxuan Zhou, Shujian Zhang, Brice Magdalou, John Lambert, Ehsan Amid, Richard Nock, Andrew Hard

机构 * Google Research(谷歌研究) Google DeepMind(谷歌DeepMind) Work done while at Google DeepMind(在谷歌深Mind的工作) CEE-M, Univ Montpellier, CNRS, INRAE, Institut Agro(CEE-M,蒙彼利埃大学,CNRS,INRAE,农业研究所)

AI总结 本文揭示了DPO与人类选择理论的深层联系,证明其损失函数凸性并非必需,并扩展了非凸损失、任意人类选择模型嵌入等新特性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03389 2026-06-23 cs.LG cs.AI 版本更新

Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL

Chain-of-Goals 分层策略用于长视界离线目标条件强化学习

Jinwoo Choi, Sang-Hyun Lee, Seung-Woo Seo

机构 * Department of Electrical and Computer Engineering, Seoul National University, Seoul, South Korea(首尔国立大学电气与计算机工程系) Department of Automotive Engineering, Ajou University, Gyeonggi-do, South Korea(全州大学汽车工程系)

AI总结 提出 Chain-of-Goals 分层策略 (CoGHP),通过自回归生成潜在子目标序列,利用 MLP-Mixer 统一架构建模层次决策,在长视界任务中优于离线基线方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02056 2026-06-23 cs.AR cs.LG cs.SY eess.SY stat.ML 版本更新

Ultrafast On-Chip Online Learning via Spline Locality in Kolmogorov-Arnold Networks

基于Kolmogorov-Arnold网络中样条局部性的超快片上在线学习

Duc Hoang, Aarush Gupta, Philip Harris

机构 * MIT(麻省理工学院)

AI总结 针对量子计算和核聚变控制等高频系统对亚微秒级在线学习的需求,提出利用Kolmogorov-Arnold网络的B样条局部性实现稀疏更新和固定点量化鲁棒性,在FPGA上实现比MLP更高效、更具表达力的超快在线学习。

Comments Forty-Third International Conference on Machine Learning (ICML'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01624 2026-06-23 cs.CV 版本更新

PISCES: Annotation-free Text-to-Video Post-Training via Optimal Transport-Aligned Rewards

PISCES: 基于最优传输对齐奖励的无标注文本到视频后训练

Minh-Quan Le, Gaurav Mittal, Cheng Zhao, David Gu, Dimitris Samaras, Mei Chen

机构 * Microsoft(微软) Stony Brook University(石溪大学)

AI总结 提出PISCES算法,通过双重最优传输对齐奖励模块,无需人工标注即可提升文本生成视频的质量和语义对齐,在VBench上超越现有方法。

Comments Accepted to ICML 2026. Project page and code: https://roar-ai.github.io/pisces/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23124 2026-06-23 math.ST stat.TH 版本更新

Semi-knockoffs: a model-agnostic conditional independence testing method with finite-sample guarantees

半敲除:一种具有有限样本保证的模型无关条件独立性检验方法

Angel Reyero-Lobo, Bertrand Thirion, Pierre Neuvial

AI总结 提出半敲除方法,利用预训练模型避免训练-测试分割,在高维设置下提供有效p值和FDR控制,仅需连续变量的条件期望,并证明了稳定性和双重稳健性。

Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML 2026), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22969 2026-06-23 cs.LG 版本更新

Improved Algorithms for Nash Welfare in Linear Bandits

线性赌博机中纳什福利的改进算法

Dhruv Sarkar, Nishant Pandey, Sayak Ray Chowdhury

机构 * Indian Institute of Technology Kharagpur(印度理工学院克哈格普尔学院) Indian Institute of Technology Kanpur(印度理工学院坎普尔学院)

AI总结 针对线性赌博机中纳什遗憾的次优性,提出新分析工具实现阶最优界,并引入p-均值遗憾统一框架,设计元算法FairLinBandit,在真实数据集上优于现有方法。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22446 2026-06-23 cs.AI 版本更新

Anytime Safe PAC Efficient Reasoning

任意时间安全PAC高效推理

Chengyao Yu, Hao Zeng, Youxin Zhu, Jianguo Huang, Huajun Zeng, Bingyi Jing

机构 * Department of Statistics and Data Science(统计与数据科学系) Department of Statistics(统计系) Data Science, Southern University of Science(数据科学,南方科技大学) College of Computing(计算学院) College of Computing and Data Science(计算与数据科学学院) School of Statistics(统计学系) School of Statistics and Data Science(统计与数据科学系) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 针对大型推理模型计算成本高的问题,提出B-PAC推理方法,利用逆倾向评分估计构建测试超鞅,动态调整路由阈值,在部分反馈下实现任意时间安全高效推理,理论保证性能损失控制,实验减少思考模型使用达81.01%。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00310 2026-06-23 cs.LG stat.ML 版本更新

Parametrized Power-Iteration Clustering for Directed Graphs

有向图的参数化幂迭代聚类

Gwendal Debaussart-Joniec, Harry Sevi, Matthieu Jonckheere, Argyris Kalogeratos

机构 * Universit\'e Paris-Saclay, ENS Paris-Saclay, Centre Borelli, CNRS, France. CNRS, LAAS, France

AI总结 针对有向图顶点聚类问题,提出基于参数化可逆随机游走的ParPIC方法,通过自动调优扩散时间和高效截断嵌入,在保持聚类精度的同时提升可扩展性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10999 2026-06-23 cs.CL 版本更新

KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering

KBQA-R1:强化大语言模型用于知识库问答

Xin Sun, Zhongqi Chen, Xing Zheng, Qiang Liu, Shu Wu, Bowen Song, Zilei Wang, Weiqiang Wang, Liang Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出KBQA-R1框架,通过强化学习(GRPO)将知识库问答建模为多轮决策过程,并引入参考拒绝采样(RRS)解决冷启动问题,在多个基准上取得最优性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10324 2026-06-23 cs.CV 版本更新

EchoingPixels: Aliasing-Resistant Joint Token Reduction for Audio-Visual LLMs

EchoingPixels: 抗混叠的音频-视觉联合令牌缩减方法

Chao Gong, Depeng Wang, Zhipeng Wei, Ya Guo, Huijia Zhu, Jingjing Chen

机构 * Fudan University(复旦大学)

AI总结 针对音频-视觉大语言模型中令牌冗余和位置混叠问题,提出EchoingPixels框架,通过跨模态语义筛和Sync-RoPE实现抗混叠的联合令牌缩减,仅用5-20%令牌达到全模型性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03136 2026-06-23 cs.MA cs.GT 版本更新

Distributionally Robust Markov Games with Average Reward

平均奖励的分布鲁棒马尔可夫博弈

Zachary Roch, Yue Wang

AI总结 提出平均奖励准则下的分布鲁棒马尔可夫博弈(DR-MG)框架,通过鲁棒贝尔曼方程证明平稳纳什均衡存在性,设计两种收敛算法,并证明折扣因子趋近1时均衡可近似。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00918 2026-06-23 cs.AI 版本更新

Sparse Neuron Ablation Triggers Catastrophic Collapse of the Language Core in Large Vision-Language Models

稀疏神经元消融引发大型视觉-语言模型中语言核心的灾难性崩溃

Cen Lu, Yung-Chen Tang, Andrea Cavallaro

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士洛桑联邦理工学院) Idiap Research Institute(日内瓦研究所)

AI总结 提出渐进式神经元消融方法CAN,发现消融极少量(如LLaVA-1.5-7b中仅4个)位于语言模型下投影层的神经元即可导致LVLM灾难性崩溃,揭示功能依赖语言骨干中的稀疏神经元子集。

Comments Accepted to ICML 2026 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09898 2026-06-23 cs.LG cs.AI 版本更新

Learning Bug Context for PyTorch-to-JAX Translation with LLMs

学习 PyTorch 到 JAX 翻译中的 Bug 上下文

Hung Phan, Son Vu, Tuan Dinh, Nesreen Ahmed, Ali Payani, Ali Jannesari

机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(Iowa State大学计算机科学系) Department of Human Science, Iowa State University, Ames, IA, USA(Iowa State大学人类科学系) Cisco AI Research, Outshift, San Jose, CA, USA(Cisco AI研究,Outshift,San Jose,加利福尼亚州,美国)

AI总结 针对 LLM 在 PyTorch 到 JAX 代码翻译中易出错的问题,构建 T2J 基准(含 bug 及修复),通过上下文学习使弱 LLM 翻译质量提升达 20%。

Comments ICML Deep Learning for Code (DL4C) workshop, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09597 2026-06-23 cs.LG cs.AI cs.CV 版本更新

Graph Alignment via Dual-Pass Spectral Encoding and Latent Space Communication

通过双通道谱编码和潜在空间通信的图对齐

Maysam Behmanesh, Erkan Turan, Maks Ovsjanikov

机构 * LIX, Ecole Polytechnique, IP Paris(LIX,巴黎高等师范学院,IP巴黎)

AI总结 提出双通道编码器增强节点区分性,结合几何感知功能映射对齐潜在空间,解决图对齐中节点区分性下降和潜在空间错位问题。

Comments 27 pages

Journal ref Proceedings of ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12462 2026-06-23 cs.LG stat.ML 版本更新

Model-Free Robust Average-Reward Reinforcement Learning with Sample Complexity Analysis

无模型鲁棒平均奖励强化学习及样本复杂度分析

Zachary Roch, George Atia, Yue Wang

机构 * Department of Electrical and Computer Engineering, University of Central Florida, Orlando, Florida, USA(电气与计算机工程系,中央佛罗里达大学,奥兰多,佛罗里达州,美国) Department of Computer Science, University of Central Florida, Orlando, Florida, USA(计算机科学系,中央佛罗里达大学,奥兰多,佛罗里达州,美国)

AI总结 提出无模型算法RHI,基于黑箱采样或acles和K阶多级蒙特卡洛估计器,在生成模型下实现ε-最优鲁棒策略,样本复杂度为Õ(SAH²/ε^(2+o(1)))。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20206 2026-06-19 stat.ML cs.LG 新提交

Off-Policy Evaluation for Missingness-Aware Policies in MDPs with Rewards Missing Not at Random

马尔可夫决策过程中奖励非随机缺失的缺失感知策略的离线评估

Ziheng Wei, Annie Qu, Rui Miao

机构 * Department of Statistics, University of Michigan at Ann Arbor(密歇根大学安娜堡分校统计学系) Department of Statistics(统计学系) Applied Probability, University of California at Santa Barbara(加州大学圣巴巴拉分校应用概率系) Department of Mathematical Sciences, University of Texas at Dallas(德克萨斯大学达拉斯分校数学科学系)

AI总结 针对奖励非随机缺失的离线强化学习问题,提出基于未来状态作为影子变量的识别方法,并利用桥函数和min-max估计器恢复条件均值奖励,实现缺失感知策略的离线评估。

Comments Accepted at ICML 2026. 31 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19587 2026-06-19 stat.ML cs.LG 新提交

A Solver-Free Training Method for Predict-then-Optimize

一种无求解器的预测后优化训练方法

Beichen Wan, Mo Liu

机构 * Department of Statistics and Operations Research, University of North Carolina at Chapel Hill, NC, USA(统计与运筹学系,北卡罗来纳大学教堂山分校)

AI总结 提出一种基于测度变换的决策聚焦学习管道,通过无求解器代理损失实现预测后优化中预测模型的高效训练,理论保证Fisher一致性,训练时间降低数个数量级。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20544 2026-06-19 cs.AI cs.LG 新提交

Toward Calibrated Mixture-of-Experts Under Distribution Shift

面向分布偏移下的校准混合专家模型

Gina Wong, Drew Prinster, Suchi Saria, Rama Chellappa, Anqi Liu

机构 * Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究混合专家模型在分布偏移下的校准问题,提出对抗性重加权方法以改善路由聚合的校准误差,提升准确率-校准权衡。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20538 2026-06-19 cs.LG 新提交

Multi-Task Bayesian In-Context Learning

多任务贝叶斯上下文学习

Qingyang Zhu, Eric Karl Oermann, Kyunghyun Cho

机构 * New York University(纽约大学)

AI总结 提出多任务上下文学习框架,通过将先验信息表示为上下文数据集前缀,训练Transformer实现分层贝叶斯预测推理,在多种分布偏移下匹配最优贝叶斯性能且速度提升数个数量级。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20527 2026-06-19 cs.CL cs.CV 新提交

StylisticBias: A Few Human Visual Cues Drive Most Social Biases in MLLMs

StylisticBias: 少数人类视觉线索驱动多模态大语言模型中的大部分社会偏见

Shaghayegh Kolli, Timo Cavelius, Nafiseh Nikeghbal, Samantha Dalal, Jana Diesner

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Princeton Center for Information and Technology Policy(普林斯顿信息与技术政策中心)

AI总结 提出StylisticBias基准,通过控制单一视觉属性变化,发现年龄和体型主导身份层面偏见,而时尚风格等约15个属性解释近80%的偏见变化,偏见集中于少数视觉线索。

Comments Accepted to the non-archival workshops AI4Good and Culture x AI at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20084 2026-06-19 cs.AI 新提交

Residual-Space Evolutionary Optimization via Flow-based Generative Models

基于流生成模型的残差空间进化优化

Zhuo Cao, Lena Krieger, Fernanda Nader, Xuan Zhao, Hanno Scharr, Ira Assent

机构 * LMU Munich, Munich Center for Machine Learning (MCML), Germany(慕尼黑大学,慕尼黑机器学习中心(MCML),德国) Department of Computer Science, Aarhus University, Denmark(丹麦奥胡斯大学计算机科学系)

AI总结 提出残差空间进化优化框架,结合流生成编辑与进化算法,在残差空间分离局部利用与全局探索,用于非可微黑盒目标的数据编辑。

Comments Accepted by ICML 2026 Workshop SPIGM, 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20044 2026-06-19 cs.CV 新提交

FUSE: Frequency-domain Unification and Spectral Energy Alignment for Multi-modal Object Re-Identification

FUSE:面向多模态目标重识别的频域统一与频谱能量对齐

Xuanhao Qi, Tom H. Luan, Yukang Zhang, Jinkai Zheng, Zhou Su, Shuwei Li, Lei Tan

机构 * School of Cyber Science and Engineering, Xi'an Jiaotong University(西安交通大学网络空间安全学院) School of Informatics, Xiamen University(厦门大学信息学院) National University of Singapore(新加坡国立大学)

AI总结 提出频域框架FUSE,通过频谱解耦和能量对齐两阶段处理,解决多模态重识别中低频偏置问题,在三个数据集上mAP提升9.1%。

Comments Accepted in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19993 2026-06-19 cs.LG 新提交

Activation- and Influence-Aware Ranks (AIR): Function-Preserving SVD Compression for LLMs

激活与影响感知秩 (AIR):保持功能的SVD压缩用于大语言模型

Nico Harder, Daniel Becking, Karsten Mueller, Wojciech Samek

机构 * Fraunhofer HHI(弗劳恩霍夫研究所)

AI总结 提出AIR框架,基于SVD和反向信号影响度量,通过单次交替最小二乘扫描实现权重矩阵的低秩近似,在参数保留≤60%时困惑度比SVD-LLM(W)改善>18%,并减少90%校准数据。

Comments Accepted at the ICML 2026 Workshop on Resource-Adaptive Foundation Model Inference (AdaptFM), Seoul, South Korea (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19992 2026-06-19 cs.SE cs.AI 新提交

Beyond Static Endpoints: Tool Programs as an Interface for Flexible Agentic Web Services

超越静态端点:工具程序作为灵活智能体网络服务的接口

Mugeng Liu, Shuoqi Li, Yixuan Zhang, Yun Ma

机构 * School of Computer Science, Peking University, Beijing, China School of Software \& Microelectronics, Peking University, Beijing, China Institute for Artificial Intelligence, Peking University, Beijing, China

AI总结 提出ToolPro,将工具意图表示为可执行程序,通过约束引导构建、效应感知重放和策略决策,在MCP服务上实现最高53.4%的延迟降低和96.1%的流量减少。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19932 2026-06-19 cs.CV cs.AI 新提交

Spatial-Aware Reduction Framework: Towards Efficient and Faithful Visual State Space Models

空间感知缩减框架:迈向高效且忠实的视觉状态空间模型

Jindi Lv, Aoyu Li, Yuhao Zhou, Zheng Zhu, Xiaofeng Wang, Qing Ye, Yueqi Duan, Wentao Feng, Jiancheng Lv

机构 * Sichuan University(四川大学) Tsinghua University(清华大学)

AI总结 提出STORM框架,通过保持空间结构完整性解决视觉Mamba模型在token缩减时的性能崩溃问题,无需训练即可实现高精度剪枝。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏