arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-06-09 至 2026-06-09 共收录 53
2606.09762 2026-06-09 cs.LG cs.AI 新提交

Preserving Plasticity in Continual Learning via Dynamical Isometry

通过动态等距保持持续学习中的可塑性

Andries Rosseau, Robert Müller, Ann Nowé

机构 * University of Amsterdam(阿姆斯特丹大学) ETH Zurich(苏黎世联邦理工学院)

AI总结 本文通过动态等距机制保持深度神经网络在持续学习中的可塑性,提出等距正则化方法和AdamO优化器,在多个基准上匹配或超越现有方法。

Comments ICML26

Journal ref Forty-Third International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09748 2026-06-09 cs.AI cs.CL cs.LG 新提交

Multi-Turn Evaluation of Deep Research Agents Under Process-Level Feedback

深度研究智能体在过程级反馈下的多轮评估

Rishabh Sabharwal, Hongru Wang, Amos Storkey, Jeff Z. Pan

机构 * Google DeepMind(谷歌DeepMind) OpenAI Perplexity AI LangChain AI

AI总结 针对深度研究智能体(DRA)在单轮输出评估的不足,提出研究缺口推断(RGI)方法提供过程级反馈,发现单轮过程反馈可提升8-15分,但多轮改进因回归问题难以持续。

Comments Published as a workshop paper at SCALE - ICML 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09718 2026-06-09 cs.LG cs.CV 新提交

Evaluating the Representation Space of Diffusion Models via Self-Supervised Principles

通过自监督原则评估扩散模型的表示空间

Xiao Li, Yixuan Jia, Zekai Zhang, Xiang Li, Lianghe Shi, Jinxin Zhou, Zhihui Zhu, Liyue Shen, Qing Qu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 受自监督学习启发,提出基于Fisher信息的度量ICR,分解特征为不变和残差成分,用于联合评估扩散模型的表示与生成能力,发现中间噪声水平下不变性最强且分类性能最佳,ICR可敏感检测训练中的记忆化。

Comments First two authors contributed equally. Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09551 2026-06-09 cs.CR cs.AI 新提交

FuseFSS: Efficient Secure LLM Inference with Function Secret Sharing

FuseFSS:基于函数秘密共享的高效安全LLM推理

Yuhan Ma, Yong Li, Stefan Schmid

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出FuseFSS编译器,通过统一编译流水线替代逐算子协议设计,实现安全推理中非线性与辅助操作的高效处理,在BERT和GPT模型上取得1.24-1.50倍加速并减少通信与预处理开销。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09409 2026-06-09 cs.AI cs.CL cs.LG 新提交

Correct Looks Better: Pairwise Comparisons Reveal Accuracy Rankings

正确看起来更好:成对比较揭示准确性排名

Mina Remeli, Moritz Hardt

机构 * Max Planck Institute for Intelligent Systems, Tübingen, Germany(马克斯·普朗克智能系统研究所,蒂宾根,德国) Tübingen AI Center(蒂宾根人工智能中心)

AI总结 本文通过将基准测试转化为生成式评估,发现成对比较结合Elo方法得到的模型排名与基于真实准确率的排名高度一致(Spearman相关系数>0.9),且风格和裁判偏见影响较小,但答案重复(echo)是裁判偏好的因果驱动因素。

Comments Accepted at ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09248 2026-06-09 cs.CV 新提交

Temporal-Aware Reasoning Optimization for Video Temporal Grounding

时间感知推理优化用于视频时间定位

Minghang Zheng, Zihao Yin, Yi Yang, Yuxin Peng, Yang Liu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出TaRO框架,通过构造性推理探索和时间敏感性奖励,增强多模态大模型在视频时间定位中的时间感知推理能力,实现最先进性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09165 2026-06-09 cs.AI 新提交

Reliable to Expressive: A Curriculum for Rubric-Following Safety Judges

从可靠到表达:面向遵循评分标准的安全评判员的课程学习

Yongtaek Lim, Hyeji Choi, Minwoo Kim

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出一种结合动态评分标准和从可靠到表达的课程学习策略,训练安全评判员在多种评分标准下稳定评估,12B模型准确率达94.12-94.88%,跨标准方差仅0.76。

Comments Accepted to ICML 2026 Workshop on AIWILDS

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09154 2026-06-09 cs.LG 新提交

Improved Convergence Analysis of Topology Dependence in Decentralized SGD

去中心化SGD中拓扑依赖性的改进收敛分析

Yuki Takezawa, Anastasia Koloskova, Sebastian U. Stich

机构 * University of Washington(华盛顿大学)

AI总结 提出更紧的收敛分析,揭示混合矩阵所有特征值影响收敛速率,并通过实验验证比仅用谱间隙的分析更准确。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09145 2026-06-09 cs.CR 新提交

PrivCode++: Latent-Conditioned Differentially Private Code Generation for Comprehensive Guarantees

PrivCode++: 潜在条件差分隐私代码生成以实现全面保障

Zheng Liu, Chen Gong, Terry Yue Zhuo, Zhou Yang, Kecen Li, Wenlong Meng, Xinwen Hou, Yu Liu, Xiaochen Li

AI总结 针对指令-代码对微调的大语言模型可能泄露敏感数据的问题,提出PrivCode-Plus,首个在微调中同时保护提示和代码的差分隐私代码生成方法,通过两阶段DP框架和无隐私潜在条件模块实现高效合成。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09115 2026-06-09 cs.LG 新提交

Counterfactual Transport Flows for Offline Conservative Trajectory Refinement

反事实传输流用于离线保守轨迹细化

Lena Krieger, Xuan Zhao, Zhuo Cao, Qin Wang, Hanno Scharr, Ira Assent

机构 * ETH Zürich(苏黎世联邦理工学院) University of Science and Technology of China(中国科学技术大学)

AI总结 提出反事实传输流框架,通过检索高反馈轨迹构建局部偏好对,实现离线决策的保守轨迹细化,在D4RL基准上提升历史回报表现。

Comments accepted at RLxF @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09092 2026-06-09 cs.LG 新提交

From Shortcuts to Reasoning: Robust Post-Training of Theory of Mind with Reinforcement Learning

从捷径到推理:基于强化学习的心理理论鲁棒后训练

Jike Zhong, Yuxiang Lai, Ming Li, Yuheng Li, Wuao Liu, Behzad Dariush, Konstantinos Psounis, Shao-Yuan Lo

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对心理理论后训练中的捷径问题,提出Thinking-RFT方法,结合可验证奖励和显式推理链,在多个无捷径数据集上显著提升推理能力,尤其在复杂高阶推理和多模态场景中表现优异。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09027 2026-06-09 cs.CL cs.AI 新提交

SafeRun: Enabling Determinism in LLM Planning for Running

SafeRun:在跑步规划中实现LLM的确定性

Meilin Chen, Zepeng Zhai, Jiaxuan Zhao, Yuan Lu

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 针对LLM在跑步规划中因概率性导致安全违规的问题,提出SafeRun框架,通过解耦架构将LLM的软解释与确定性求解器的硬约束分离,实现100%安全评分。

Comments Workshop on Planning in the Era of LLMs (LM4Plan) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09009 2026-06-09 cs.CV 新提交

Scaling by Diversified Experience for Vision-Language-Action Models

通过多样化经验扩展视觉-语言-动作模型

Leiyu Wang, Zhaofengnian Wang, Xueqi Li, Luoyi Fan, Cewu Lu, Nanyang Ye

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出SyVLA模型,通过意图解耦算法和相似样本引导的强化学习管道,解决视觉-语言-动作模型在推理与控制耦合及策略优化不稳定问题,在真实机器人任务中取得更高成功率和泛化能力。

Comments ICML 2026, SyVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08980 2026-06-09 cs.CV 新提交

EPS3D: End-to-End Feed-Forward 3D Panoptic Segmentation

EPS3D: 端到端前馈式3D全景分割

Runsong Zhu, Jiaxin Guo, Xiaoyang Guo, Zhengzhe Liu, Ka-Hei Hui, Wei Yin, Kai Chen, Wei Chen, Weiqiang Ren, Yunhui Liu, Pheng-Ann Heng, Chi-Wing Fu

机构 * Nanyang Technological University(南洋理工大学)

AI总结 提出端到端前馈框架EPS3D,通过蒸馏训练和多视图图像预测3D感知特征,结合互增强模块实现语义-实例一致性,在Replica上语义mIoU提升13%,每场景仅需1秒。

Comments ICML 2026. The code is publicly available at \href{https://github.com/Runsong123/EPS3D}{https://github.com/Runsong123/EPS3D}

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08977 2026-06-09 cs.LG cs.DS 新提交

Online Learning with Recency: Algorithms for Sliding-window Streaming Multi-armed Bandits

在线学习中的近因效应:滑动窗口流式多臂老虎机算法

Vladimir Braverman, Chen Wang, Liudeng Wang, Samson Zhou

机构 * Johns Hopkins University(约翰霍普金斯大学) Rensselaer Polytechnic Institute(伦斯勒理工学院) Texas A&M University(德克萨斯农工大学)

AI总结 针对在线学习中的近因效应,研究单遍滑动窗口流式多臂老虎机问题,提出纯探索和遗憾最小化算法,并给出记忆-遗憾权衡。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08814 2026-06-09 cs.AI cs.LG 新提交

STAR: Rethinking MoE Routing as Structure-Aware Subspace Learning

STAR: 将MoE路由重新思考为结构感知的子空间学习

Sumin Park, Noseong Park

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出STAR方法,通过广义Hebbian算法学习主子空间来增强路由对输入结构的感知,实现专家稳定专业化,在合成数据和语言视觉任务上提升路由质量和下游性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08804 2026-06-09 cs.AI cs.LG 新提交

Q-Delta: Beyond Key-Value Associative State Evolution

Q-Delta:超越键值关联状态演化

Sumin Park, Seojin Kim, Noseong Park

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出Q-Delta,一种查询感知的delta规则,将混合键-查询预测误差融入状态演化,实现联合校正动态,在语言建模和长上下文检索任务上优于强基线。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08768 2026-06-09 cs.LG 新提交

Understanding the Parameter Space Geometry of Transformers Encoding Boolean Functions

理解编码布尔函数的Transformer参数空间几何

Blanka Köver, Alexandra Butoi, Anej Svete, Michael Hahn, Ryan Cotterell

机构 * Machine Learning, ICML(机器学习,ICML)

AI总结 针对Transformer无法学习某些简单布尔函数(如奇偶函数)的问题,通过分析参数空间几何,证明敏感函数在参数空间中占据极小区域,随机初始化几乎必然错过,从而解释了可表达但不可学习的现象。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08687 2026-06-09 cs.CV 新提交

Shift-Dependent Asymmetry: Orthogonal Inverse Low-Rank Adaptation for Federated Medical Segmentation

移位依赖的不对称性:面向联邦医学分割的正交逆低秩适应

Xingyue Zhao, Wenke Huang, Linghao Zhuang, Haoran Wu, Anwen Jiang, Zhifeng Wang, Wenwen He, Ming Feng, Mang Ye, Bo Xu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对联邦医学分割中编码器与解码器的不对称性(编码器受外观移位主导,解码器受监督变化主导),提出逆不对称调优(IAT)方法,通过个性化模块特定组件并引入子空间正交正则化器防止泄露,实现跨站点泛化提升。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08681 2026-06-09 cs.CR 新提交

Asymptotic Optimality of the High-Dimensional Gaussian Mechanism and Improved Low-Dimensional Mechanisms for Differential Privacy

高维高斯机制的渐近最优性与差分隐私的改进低维机制

Yu Wei, Alexander Bienstock, Antigoni Polychroniadou

AI总结 本文证明高维下高斯机制在强隐私设置中渐近最优,并提出球面广义伽马机制族,在低维场景中优于高斯和ℓ2机制,且实现紧致组合。

Comments 32 pages, 3 figures, 2 tables. Accepted at ICML 2026

Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08656 2026-06-09 cs.CL 新提交

From Player to Master: Enhancing Test-Time Learning of LLM Agents via Reinforcement Learning over Memory

从玩家到大师:通过基于记忆的强化学习增强LLM代理的测试时学习

Yishuo Cai, Xingyu Guo, Xuancheng Huang, Jinhua Du, Can Huang, Wenxuan Huang, Wenhan Ma, Yuyang Hu, Aohan Zeng, Jie Tang, Xu Sun

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出Memopilot,一种通过多轮GRPO训练记忆更新过程来优化冻结LLM代理在测试时学习的方法,在多人博弈中显著提升Elo评分。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08573 2026-06-09 cs.LG cs.CL 新提交

Titans-as-a-Layer: Test-Time Memory for Conversational Speech Emotion Recognition

Titans-as-a-Layer:对话语音情感识别的测试时记忆

Daniel Chen, Qicong Hu, Yang Xiao, Ting Dang, Hong Jia

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出Memory-as-a-Layer (MAL)适配器,利用测试时神经记忆为对话语音情感识别提供上下文,在不修改大型音频语言模型的前提下提升性能。

Comments ICML 2026 Workshop on Machine Learning for Audio

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08571 2026-06-09 cs.CL cs.AI cs.LG 新提交

Calibration of Structured Ignorance Certificates for Diagnosing Unknown Unknowns in Reasoning Models

用于诊断推理模型中未知未知的结构化无知证书的校准

Subramanyam Sahoo

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出结构化无知证书(SICs)输出格式,通过GRPO微调14B模型,使模型在无法回答时明确承认知识缺失并生成检索查询,在未知未知问题上实现99.46%的JSON有效性和0.967的证书特异性分数。

Comments Accepted in ICML 2026 Workshop: Epistemic Intelligence in Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08491 2026-06-09 cs.AI 新提交

What Makes a Desired Graph for Relational Deep Learning?

什么构成了关系深度学习的理想图?

Yao Cheng, Siqiang Luo

机构 * Nanyang Technological University, College of Computing and Data Science(南洋理工大学计算机与数据科学学院)

AI总结 研究发现,从数据库模式直接导出的图存在信息过载和语义碎片化问题,通过过滤和注入操作平衡可提升性能,并开发了自动优化器。

Comments This article has been accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08460 2026-06-09 stat.ML cs.LG 新提交

LOTTERY: Learning from Reference-Only Samples in Two-Sample Testing under Size Asymmetry

LOTTERY: 在样本量不对称下的双样本检验中仅从参考样本学习

Xunye Tian, Zhijian Zhou, Liuhua Peng, Feng Liu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对参考样本丰富而查询样本极少的双样本检验问题,提出利用参考样本学习依赖参考的表示并自适应加权,实现置换检验的I类错误控制和一致性。

Comments 16 pages, 1 figure

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08403 2026-06-09 cs.CR cs.AI 新提交

Hiding in Plain Floats: Steganographic Carriers for Indirect Prompt and Content Injection

隐藏在普通浮点数中:用于间接提示和内容注入的隐写载体

Mudit Sinha, Sanika Chavan

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 研究结构化浮点参数作为隐写载体绕过文本检测器实现LLM间接提示/内容注入,实验显示在最强防御下泄露ASR达94.3%。

Comments Accepted as a poster at FAGEN@ICML 2026. 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08259 2026-06-09 cs.LG 新提交

Differentially Private Synthetic Data via APIs 4: Tabular Data

通过API实现差分隐私合成数据 4: 表格数据

Toan Tran, Arturs Backurs, Zinan Lin, Victor Reis, Li Xiong, Sergey Yekhanin

机构 * Microsoft(微软)

AI总结 提出Tab-PE算法,将Private Evolution框架扩展至表格数据,通过启发式算子迭代优化候选数据集,在保持差分隐私的同时高效处理高阶相关性,相比基线AIM分类准确率提升最高10%,速度提升28倍。

Comments ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08200 2026-06-09 cs.AI cs.LG 新提交

Online Agent-as-a-Judge: Situation-Generating Evaluation for Interactive Agents

在线智能体作为裁判:面向交互式智能体的情境生成评估

Hyogon Ryu, Jeonghwan Kim, Yewon Lim, Chaeun Lee, Jeongwook Kim, Donghoon Ham

机构 * KAIST(韩国科学技术院)

AI总结 提出在线智能体作为裁判框架,通过部署环境内评估智能体主动生成相关情境,以评估交互式社交智能体的能力,提高标准覆盖率和与人类标签的一致性。

Comments ICML 2026 Workshop on Trustworthy AI for Good

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08063 2026-06-09 cs.CV cs.AI cs.CL 新提交

Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding?

Robust-U1: MLLMs能否自我恢复受损视觉内容以实现鲁棒理解?

Jiaqi Tang, Jianmin Chen, Youyang Zhai, Wei Wei, Runtao Liu, Mengjie Zhao, Xiangyu Wu, Qingfa Xiao, Qifeng Chen

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出Robust-U1框架,通过监督微调、强化学习和多模态推理,使多模态大模型具备显式视觉自恢复能力,在真实和对抗性损坏下达到最先进鲁棒性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08031 2026-06-09 cs.CV 新提交

Vision-Language Asymmetry in Bistable Image Captioning

双稳态图像描述中的视觉-语言不对称性

Arohan Agate

机构 * Arohan Agate

AI总结 通过83个双稳态刺激的行为基线和稀疏自编码器分析,发现视觉塔中同时激活两种解释,但因果干预仅能翻转默认主导刺激的描述,揭示视觉表征与语言承诺之间的不对称性。

Comments Accepted at ICML 2026 Workshop on Philosophy of Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏