arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-08-25 至 2026-08-25 共收录 7
2608.23094 2026-08-25 stat.ML cs.LG 新提交

One Inverse Step is a Convex Program: Bayes-Limit Calibration of Diffusion Inversion

一步逆过程是凸规划:扩散逆过程的贝叶斯极限校准

Gordei Verbii

AI总结 该研究提出扩散逆过程的一步隐式DDIM步骤对应贝叶斯极限下的凸规划,分析了其解的唯一性、求解器稳定性及几何收敛域,发现训练扩散模型的分数函数违反了相关协方差上限,揭示了模型的固有局限性。

Comments Revised follow-up of "Extracting Local Manifold Geometry from Pretrained Diffusion Models in One Inverse Step" (ICML 2026 Workshop SPIGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23541 2026-08-25 cs.MA cs.AI 新提交

The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams

交互税:当多智能体团队中的沟通消除多样性时

Summer Eunhyung Ann, Haokun Liu, Chenhao Tan

AI总结 该研究提出“交互税”概念,发现多智能体LLM的完整方案交互会消除多样性,独立提议生成可避免收敛崩溃,交互仅在共享恰当信息时才有益。

Comments 14 pages, 3 figures. Accepted at ICML 2026 (PMLR 306)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23493 2026-08-25 cs.AI 新提交

SRPO: Self-Reflective Policy Optimization for Long-Horizon Reasoning

SRPO:用于长程推理的自反思策略优化

Jialong Liu, Yuling Shi, Ning Yang, Xiaodong Gu, Zuchao Li

机构 * School of artificial intelligence, Wuhan University(武汉大学人工智能学院) School of computer science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) Institute of automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本研究提出 SRPO 框架,将人类的自反思能力内化到 LLMs 中,无需额外模型即可将稀疏监督转化为密集训练信号,在数学推理等基准上以高数据效率取得了最先进性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23296 2026-08-25 cs.LG cs.AI 新提交

Sigmoid Attention as a Better Substrate for Learned KV Cache Eviction

Sigmoid注意力作为学习型KV缓存驱逐的更优基础

Isaac (Rucheng)Li

机构 * University of Pittsburgh(匹兹堡大学)

AI总结 本文探究注意力基础对学习型KV缓存驱逐软-硬转换的影响,通过2×2×2对比实验发现,Sigmoid注意力经学习型硬驱逐后,其门控模型删除KV条目时PPL变化可忽略,且比H₂O、KeyDiff等方法表现更优。

Comments Accepted at the ICML 2026 Workshop on Resource-Adaptive Foundation Model Inference (AdaptFM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21995 2026-08-25 cs.LG cs.AI stat.ML 新提交

Variance Driven Exploration: A Provable and Efficient Methodology for Pure Exploration in Highly Stochastic Environments

方差驱动探索:高度随机环境中纯探索的可证明且高效方法

Khang Luong, Nam Nguyen, Hoang Ta, Hung The Tran, Tuan Dam

机构 * Hanoi University of Science and Technology(河内科技大学) Quantum AI & Cyber Security Institute, FPT Corporation(FPT公司量子人工智能与网络安全研究院)

AI总结 该研究提出 VarDE 方法,将其应用于 BAI、MCTS、BPI 问题,在方差衰减和简单遗憾上有理论保证,在高度随机环境中性能优于现有方法。

Comments To appear in Proceedings of the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21383 2026-08-25 cs.CY cs.AI 新提交

Determinants of Starting Salaries for Filipino Graduates: An Explainable Machine Learning Approach

菲律宾毕业生起薪的决定因素:一种可解释的机器学习方法

Alexander Gabriel A. Aranes, John Michael C. Magpantay, Reginald Neil C. Recario, Jamlech Iram N. Gojo Cruz, Rodolfo C. Camaclang III

AI总结 本研究针对菲律宾毕业生教育与就业脱节问题,利用众包调查数据,通过可解释机器学习方法发现职位角色和行业是起薪主要决定因素,提出职业指导应侧重行业技能而非院校品牌。

Comments To be presented at the 9th International Conference on Machine Learning and Machine Intelligence (MLMI 2026), Tokyo, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21374 2026-08-25 cs.AI 新提交

LitReview Arena: Evaluating Literature Review Agents with Battle-Style Peer Review Platform

LitReview Arena:基于对战式同行评审平台的文献综述智能体评估

Ruotong Zhao, Zhiyu Chen, Xurui Liu, Haidong Xue, Dong Liang, Jigao Fu, Wu YanBiao, Yuanyi Zhen, Fengli Xu, Yong Li

AI总结 该研究推出对战式文献综述评估平台LitReview Arena,收集约3000条专家判断发现现有最强LLM综述系统仅23.0%胜率,校准后的评估器LitJudge将一致性提升至0.78。

Comments 20 pages, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏