arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 667
2606.07802 2026-06-09 cs.CY cs.AI 新提交

Memetic Capture: A Pluralistic Policy Framework for Governing AI-Driven Cultural Disempowerment

模因捕获:治理AI驱动的文化去权能的多元政策框架

Subramanyam Sahoo

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出“模因捕获”概念,指AI通过文化影响削弱人类自主性,并构建四层文化多元治理框架(CPGF),强调多元主义是结构性必需。

Comments Paper accepted in Pluralistic Alignment Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07760 2026-06-09 cs.LG 新提交

scCBGM: Interpretable Single-Cell Counterfactual Editing

scCBGM:可解释的单细胞反事实编辑

Alma Andersson, Aya Abdelsalam Ismail, Edward De Brouwer, Doron Haviv, Tommaso Biancalani, Kyunghyun Cho, Gabriele Scalia, Aïcha BenTaieb, Hector Corrada Bravo

机构 * University of Copenhagen(哥本哈根大学) University of Cambridge(剑桥大学) University of Amsterdam(阿姆斯特丹大学) University of California, Berkeley(加州大学伯克利分校) University of Tokyo(东京大学) University of Washington(华盛顿大学) University of Oxford(牛津大学)

AI总结 提出scCBGM框架,通过概念瓶颈架构和解耦惩罚实现单细胞反事实编辑,在组合泛化和反事实预测上表现优异。

Comments Accepted to ICML 2026; code at https://github.com/almaan/scCBGM

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07726 2026-06-09 cs.LG 新提交

Cutting LLM Evaluation Costs with SySRs: A Bandit Algorithm that Provably Exploits Model Similarity

利用SySRs降低LLM评估成本:一种可证明利用模型相似性的Bandit算法

Zifan Lyu, Chahine Nejma, Tobias Wegel, Fanny Yang, Florian E. Dorner

机构 * ETH Zurich(苏黎世联邦理工学院) Centrale Supélec(中央理工-高等电力学院) ENS de Cachan(卡尚高等师范学校) MPI for Intelligent Systems, Tübingen(马克斯·普朗克智能系统研究所,图宾根)

AI总结 提出SySRs算法,通过配对比较和自适应分配评估预算,利用模型相似性降低LLM评估成本,在15个基准上平均错误率最低。

Comments Published at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07684 2026-06-09 cs.LG cs.AI 新提交

Semantic Cache Distillation: Efficient State Transfer via Reuse and Selective Patching

语义缓存蒸馏:通过重用和选择性修补实现高效状态传输

Qianli Ma, Zhiqing Tang, Hanshuai Cui, Zhi Yao, Weijia Jia

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对大语言模型推理中KV缓存传输的通信瓶颈和跨模型重用时的语义错位问题,提出语义缓存蒸馏(SCD)框架,通过低秩子空间重建和稀疏过渡层归一化输入预测,实现高达2.65倍的首令牌时间加速,且生成质量接近理想情况。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07677 2026-06-09 stat.ML cs.LG stat.AP stat.ME 新提交

Disentangling Latent Risk Pathways via Bayesian Hypergraph Inference

通过贝叶斯超图推断解缠潜在风险路径

Shengxian Ding, Haonan Gao, Pangpang Liu, Xinyuan Tian, Yize Zhao

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出贝叶斯超图推断框架,通过风险因子调节的潜在疾病路径建模多疾病,实现可解释的高阶结构、校准的不确定性估计和罕见病改进预测。

Comments ICML 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07643 2026-06-09 cs.CV cs.AI cs.SD eess.AS 新提交

AVI-Bench: Toward Human-like Audio-Visual Intelligence of Omni-MLLMs

AVI-Bench:迈向全模态大语言模型的人类级视听智能

Yaoting Wang, Ziyi Zhang, Wenming Tu, Shaoxuan Xu, Wenjie Du, Cheng Liang, Weijun Wang, Yuanchao Li, Guangyao Li, Hao Fei, Yuanchun Li, Henghui Ding, Yunxin Liu

机构 * Nanyang Technological University(南洋理工大学)

AI总结 提出AVI-Bench基准,通过感知、理解、推理三阶段跨模态任务评估全模态大语言模型的视听智能,并引入AVI-Bench-PriSe测试原始视听感知,揭示当前模型局限,构建四级AVI分类体系。

Comments 31 pages, 8 figures, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07632 2026-06-09 cs.LG 新提交

Evaluation of ML Resource Utilization Requires Model Life Cycle Assessment

评估机器学习资源利用需要模型生命周期评估

Jared Fernandez, Clara Na, Yonatan Bisk, Constantine Samaras, Emma Strubell

AI总结 本文提出应用生命周期评估方法全面核算AI系统从硬件制造到训练推理的全链条资源消耗与环境影响,以弥补传统单一训练或推理成本评估的不足。

Comments ICML 2026: Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07630 2026-06-09 cs.LG cs.AI stat.ML 新提交

Active Learning with Foundation Model Priors: Efficient Learning under Class Imbalance

基于基础模型先验的主动学习:类别不平衡下的高效学习

Jiancheng Zhang, Meiqing Li, Qi Zhang, Yinglun Zhu

机构 * University of California, Riverside(加州大学河滨分校) Carnegie Mellon University(卡内基梅隆大学) Worcester Polytechnic Institute(伍斯特理工学院)

AI总结 针对现实数据中的类别不平衡和噪声标注问题,提出一种利用基础模型先验的主动学习框架,通过不平衡感知的协同决策选择信息量最大的样本,在图像和文本数据集上实现超过50%的标注节省。

Comments To appear at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07629 2026-06-09 cs.LG cs.AI cs.CL cs.CY cs.HC 新提交

Large Language Models Should Learn Personalized Rather Than Aggregated Human Preferences

大型语言模型应学习个性化而非聚合的人类偏好

Cristina Garbacea

机构 * University of Chicago, Data Science Institute(芝加哥大学数据科学学院)

AI总结 本文主张大型语言模型应学习个性化偏好而非聚合偏好,分析聚合偏好的理论局限与实证问题,提出通过有界个性化框架兼顾个体自主与集体安全。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07617 2026-06-09 cs.LG cs.AI 新提交

Query Lens: Interpreting Sparse Key-Value Features with Indirect Effects

Query Lens: 通过间接效应解释稀疏键值特征

Hwiyeong Lee, Ingyu Bang, Uiji Hwang, Hyelim Lim, Taeuk Kim

机构 * KAIST(韩国科学技术院)

AI总结 提出Query Lens方法,通过考虑编码器侧键特征和解码器侧值特征以及下游模块的间接效应,实现对稀疏自编码器特征更全面、忠实的解释。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07596 2026-06-09 cs.LG 新提交

Shortcuts in the Tail: Debiasing via Post-Hoc Spectral Compression of Fine-Tuning Updates

尾部的捷径:通过微调更新的后验谱压缩进行去偏

Edward Sun, Dmitrii Troitskii

机构 * UCLA(加州大学洛杉矶分校) Northeastern University(东北大学)

AI总结 提出对微调权重更新进行SVD截断尾部,无需重训练或组标签即可减少虚假关联,在多个模型和基准上以<2%的准确率损失将差距降低最多5倍。

Comments ICML Weight Space Symmetries Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07592 2026-06-09 cs.LG 新提交

UNIQ: Conformal Calibration for Adaptive Conservatism in Offline Reinforcement Learning

UNIQ: 离线强化学习中的自适应保守性共形校准

Aditya Upadhyay

机构 * IIIT Delhi(印度德里国际信息技术学院)

AI总结 提出UNIQ方法,通过共形预测校准不确定性,实现状态自适应的保守性惩罚,在D4RL基准上以接近IQL的内存开销提升性能。

Comments 19 pages, 2 figures, ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation: Black-Box Optimization to Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07576 2026-06-09 cs.LG cs.ET cs.MA 新提交

When Should an AI Scientist Stop? Verifiable Experiment Steering and Refusal for Autonomous Discovery

AI科学家何时应停止?可验证实验引导与自主发现的拒绝机制

Neel Tushar Shah, Manglam Kartik

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出CARTOGRAPH验证层,通过未解析子空间引导、模糊闭合和残差库检测,在多个测试中优于原始投影,并能识别和撤销库外机制。

Comments Accepted at AI for Science Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07568 2026-06-09 cs.HC cs.AI cs.CV cs.LG physics.data-an 新提交

A Systematic Study of Behavioral Cloning for Scientific Data Annotation

行为克隆在科学数据标注中的系统研究

Ishaan Singh Chandok, Core Francisco Park

AI总结 针对科学数据标注中人工验证校正耗时问题,提出行为克隆框架,通过9个合成任务模拟专家策略,发现模型层次化技能习得、多任务预训练高效微调、内部表示共享错误模式等关键结论。

Comments ICML 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07542 2026-06-09 cs.CY cs.AI 新提交

DIYHealth Suite: Dataset, Model, and Benchmark for Health Management at Home

DIYHealth Suite:家庭健康管理的数据集、模型与基准

Changshuo Liu, Junran Wu, Zhongle Xie, Wenqiao Zhang, Kaiping Zheng, Jiaqi Zhu, Qingpeng Cai, Ooi Gene Anne, Marcus Chun Jin Tan, Jianwei Yin, James Wei Luen Yip, Beng Chin Ooi

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

AI总结 针对家庭健康管理中的数据异构、任务多变和缺乏统一基准等问题,提出包含大规模多模态数据集DIYHealth-900K、自适应基础模型DIYHealthGPT(采用混合超低秩适应技术)和首个家庭护理基准DIYHealthBench的综合框架,在11项任务上达到最优性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06509 2026-06-08 eess.IV cs.AI cs.LG q-bio.TO 新提交

Which Anatomy Matters Under Limited Labels? A Data-Efficient Anatomy-Aware Benchmark for Cardiac Pathology Prediction

在有限标签下哪些解剖结构重要?用于心脏病理预测的数据高效解剖感知基准

Himanshu Singh

机构 * Himanshu Singh(希曼斯·辛格)

AI总结 针对有限标签和计算资源下的医学影像问题,提出解剖感知基准,通过比较不同解剖结构表示和分类器,发现表示质量比模型复杂度更重要。

Comments ACCEPTED at ICML 2026 Workshop GlobalSouthML (Seoul, South Korea; PMLR 306, 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07457 2026-06-08 cs.LG eess.SP stat.ML 新提交

Time series Foundation Models based on Physics-Informed Synthetic Histories for Cold-Start Photovoltaic Forecasting

基于物理信息合成历史的时间序列基础模型用于冷启动光伏预测

Lorenzo Longarini, Alessandro Rongoni, Simone Silenzi, Emanuele Frontoni, Riccardo Rosati

机构 * European Commission(欧洲委员会)

AI总结 针对光伏电站冷启动预测问题,提出利用物理信息合成历史数据,结合时间序列基础模型进行零样本预测,在440个站点上实现1.7-2倍性能提升。

Comments To be published in the 2nd ICML Workshop on Foundation Models for Structured Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07400 2026-06-08 cs.LG 新提交

Generative Modeling of Discrete Latent Structures via Dynamic Policy Gradients

通过动态策略梯度对离散潜在结构进行生成建模

Stefan Ivanovic, Ge Liu, Mohammed El-Kebir

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出GReinSS框架,使用动态缩放奖励学习潜在状态分布以最大化观测数据似然,在模拟潜在集和图重建中优于基线,并在RNA测序数据中比RSEM更准确地重建异构体。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07367 2026-06-08 cs.LG 新提交

Self-evolving LLM agents with in-distribution Optimization

自演化分布内优化的LLM智能体

Yudi Zhang, Meng Fang, Zhenfang Chen, Mykola Pechenizkiy

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出Q-Evolve框架,通过分布内强化学习统一过程奖励标注与策略学习,利用加权隐式Q学习稳定贝尔曼更新,实现智能体自演化,在AlfWorld等任务上优于基线。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07345 2026-06-08 cs.LG 新提交

TabSwift: An Efficient Tabular Foundation Model with Row-Wise Attention

TabSwift: 一种高效的基于行注意力的表格基础模型

Si-Yang Liu, Han-Jia Ye

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出TabSwift,通过门控注意力稳定和可学习注册令牌增强轻量级行注意力骨干,实现高效表格上下文学习,在保持竞争力的同时降低推理成本。

Comments Accepted to ICML 2026, spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07181 2026-06-08 cs.LG cs.AI q-bio.MN 新提交

RETROSPECT: RETROsynthesis via Sequential Prediction, and Chemically Transformed-ranking

RETROSPECT: 通过序列预测和化学变换排序的逆合成

Raja Sekhar Pappala, Shreyas Vinaya Sathyanarayana, Ronit Kumar Choudhary, Arjun Verma, Deepak Warrier

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出RETROSPECT系统,将单步逆合成分解为候选生成和重排序,结合ChemAlign Transformer生成器和LambdaMART重排序器,在USPTO-50K上实现55.00% top-1准确率。

Comments Accepted at the AI for Science workshop (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07172 2026-06-08 cs.CV cs.AI cs.CL cs.LG 新提交

Textual Supervision Enhances Geospatial Representations in Vision-Language Models

文本监督增强视觉-语言模型中的地理空间表示

Marcelo Sartori Locatelli, Fernando Tonucci, Jea Kwon, Luiz Felipe Vecchietti, Bryan Nathanael Wijaya, Cheng Yaw Low, Virgilio Almeida, Meeyoung Cha

机构 * University of São Paulo(圣保罗大学) National University of Singapore(新加坡国立大学)

AI总结 研究视觉、视觉-语言及多模态模型的地理空间表示能力,发现文本监督能有效提升空间编码,推动地理空间AI发展。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07134 2026-06-08 cs.LG 新提交

$α$-PFN: Fast Entropy Search via In-Context Learning

$\alpha$-PFN:通过上下文学习实现快速熵搜索

Herilalaina Rakotoarison, Steven Adriaensen, Tom Viering, Carl Hvarfner, Samuel Müller, Frank Hutter, Eytan Bakshy

机构 * University of Freiburg(弗莱堡大学) University of Tübingen(图宾根大学) University of Amsterdam(阿姆斯特丹大学) Lund University(Lund大学) Meta

AI总结 提出一种两阶段摊销策略,利用先验数据拟合网络(PFN)在单次前向传播中近似熵搜索采集函数,实现超过50倍加速,在合成和真实基准上性能与最先进方法相当。

Comments Published at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07034 2026-06-08 cs.CV 新提交

ForensicConcept: Transferable Forensic Concepts for AIGI Detection

ForensicConcept: 用于AIGI检测的可迁移取证概念

Menyanshu Zhou, Ziyin Zhou, Ke Sun, Yunpeng Luo, Jiayi Ji, Xiaoshuai Sun, Rongrong Ji

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出ForensicConcept框架,通过Transformer归因定位关键补丁、构建概念码本并利用扩散特征对齐,实现AI生成图像检测中可迁移取证概念的提取与跨骨干网络迁移。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06953 2026-06-08 cs.RO 新提交

LIMMT: Less is More for Motion Tracking

LIMMT:少即是多的运动追踪

Yu Guan, Zekun Qi, Chenghuai Lin, Xuchuan Chen, Dairu Liu, Wenyao Zhang, Jilong Wang, Xinqiang Yu, He Wang, Li Yi

机构 * Tsinghua University(清华大学) GalBot Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Shanghai Qi Zhi Institute(上海启智研究院)

AI总结 提出数据驱动的运动追踪框架LIMMT,通过物理可行性、多样性和复杂性三维度筛选高质量运动数据,仅用AMASS的3%数据即可超越全量训练效果。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06813 2026-06-08 cs.CV cs.AI 新提交

Breaking the Lock-in: Diversifying Text-to-Image Generation via Representation Modulation

打破锁定:通过表示调制实现文本到图像生成的多样化

Dahee Kwon, Haeun Lee, Jaesik Choi

机构 * KAIST(韩国科学技术院)

AI总结 针对文本到图像模型在固定提示下生成样本过于相似的问题,提出无训练表示级干预方法DAVE,通过选择性衰减早期生成中的零频空间平均分量来增强多样性,保持图像质量且计算开销极小。

Comments Accepted to ICML 2026. Code is available at: https://github.com/daheekwon/DAVE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06797 2026-06-08 cs.CL 新提交

Korean Culture into LLM Alignment: Toward Cultural Coherence

将韩国文化融入大语言模型对齐:迈向文化一致性

MinJae Jung, Minwoo Kim

机构 * SKT LG AI Research(LG人工智能研究) Kanana Team(Kanana团队)

AI总结 针对大语言模型的文化对齐,提出构建性定义而非仅抑制负面输出,设计基于提示的种子生成器扩展韩国危害分类,结合韩国法律、社会规范和解释惯例制定安全响应策略,通过DPO微调提升韩国文化安全率且不损害通用能力。

Comments Accepted to ICML 2026 Workshop on Culture X AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06760 2026-06-08 cs.CV 新提交

MedSIGHT: Towards Grounded Visual Comprehension in Medical Large Vision-Language Models

MedSIGHT:迈向医学大型视觉语言模型中的基础视觉理解

Aofei Chang, Le Huang, Alex James Boyd, Parminder Bhatia, Taha Kass-Hout, Fenglong Ma, Cao Xiao

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出MedSIGHT框架,通过区域感知器、医学区域码本和渐进训练策略,统一医学视觉语言模型的语义理解和像素级分割,在72K数据上达到多模态理解与分割的SOTA。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06722 2026-06-08 cs.LG 新提交

Flatland: The Adventures of Gradient Descent with Large Step Sizes

平面国:大步长梯度下降的冒险

Leonardo Galli, Curtis Fox, Wiebke Bartolomaeus, Mark Schmidt, Holger Rauhut

机构 * University of British Columbia(不列颠哥伦比亚大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Canada CIFAR AI Chair (Amii)(加拿大CIFAR人工智能主席(Amii))

AI总结 针对非全局L-光滑的神经网络目标函数,提出一种只需梯度局部Lipschitz连续的定义,设计自适应一阶方法实现大步长并始终处于稳定性边缘,发现过早进入全局平坦区域会降低收敛速度和泛化能力。

Comments Accepted for the International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06682 2026-06-08 cs.LG 新提交

Spatiotemporal Imputation with Graph-Informed Flow Matching

基于图信息流匹配的时空插补

Zepeng Zhang, Aref Einizade, Jhony H. Giraldo, Olga Fink

机构 * EPFL(苏黎世联邦理工学院)

AI总结 提出GiFlow框架,利用图信息先验和混合向量场模型进行时空插补,优于现有方法。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏