arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

共收录 9454
2603.00617 2026-03-03 cs.CY

Dial E for Ethical Enforcement: institutional VETO power as a governance primitive

为伦理执行而 Dial E:作为治理原语的机构 veto 权力

Subramanyam Sahoo, Vinija Jain, Aman Chadha, Divya Chaudhary

AI总结 本文提出机构 veto 权力作为治理原语,旨在通过正式权威阻止潜在武器化风险,推动模型去武装和伦理执行。

Comments Accepted at the AI for Peace Workshop at ICLR 2026.32 Pages and 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00590 2026-03-03 cs.AI

Fair in Mind, Fair in Action? A Synchronous Benchmark for Understanding and Generation in UMLLMs

公平在心,公平在行?一个用于理解与生成的同步基准:UMLLMs的公平性评估

Yiran Zhao, Lu Zhou, Xiaogang Xu, Zhe Liu, Jiafei Wu, Liming Fang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) The Chinese University of Hong Kong(香港中文大学) School of Software Technology, Zhejiang University(浙江大学软件学院) Ningbo Global Innovation Center, Zhejiang University(浙江大学宁波全球创新中心) Collaborative Innovation Center of Novel Software Technology and Industrialization(新型软件技术与产业化协同创新中心)

AI总结 IRIS基准通过同步评估UMLLMs的理解与生成任务公平性,揭示系统性偏见现象并提供公平性优化指导。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00587 2026-03-03 cs.LG

Unlearning Evaluation through Subset Statistical Independence

通过子集统计独立性评估机器遗忘

Chenhao Zhang, Muxing Li, Feng Liu, Weitong Chen, Miao Xu

机构 * University of Queensland(昆士兰大学) University of Melbourne(墨尔本大学) Adelaide University(阿德莱德大学) RIKEN Center for Advanced Intelligence Project(日本理化学研究所先进智能项目中心)

AI总结 本文提出基于统计独立性的子集评估框架,无需重新训练模型即可评估机器遗忘效果,通过希尔伯特-施密特独立准则判断模型输出的统计依赖性,有效区分训练内外子集及遗忘效果。

Comments 21 pages, 6 figures, to appear at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00579 2026-03-03 cs.LG cs.AI

DeepAFL: Deep Analytic Federated Learning

DeepAFL: 深度分析联邦学习

Jianheng Tang, Yajiang Huang, Kejia Fan, Feijiang Han, Jiaxu Li, Jinfeng Xu, Run He, Anfeng Liu, Houbing Herbert Song, Huiping Zhuang, Yunhuai Liu

AI总结 DeepAFL通过无梯度残差块和分层协议,在联邦学习中实现异质性不变性和表示学习的双重优势,性能优于现有方法。

Comments Accepted in the Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00568 2026-03-03 cs.LG cs.AI

Enhancing Molecular Property Predictions by Learning from Bond Modelling and Interactions

通过学习键建模和相互作用来增强分子属性预测

Yunqing Liu, Yi Zhou, Wenqi Fan

机构 * Department of Computing (COMP), The Hong Kong Polytechnic University(计算机系(COMP),香港理工大学) Department of Management and Marketing (MM), The Hong Kong Polytechnic University(管理与营销系(MM),香港理工大学)

AI总结 DeMol通过双图框架显式建模键信息和相互作用,提升分子属性预测的准确性与鲁棒性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00565 2026-03-03 cs.CV cs.AI cs.CR

MIDAS: Multi-Image Dispersion and Semantic Reconstruction for Jailbreaking MLLMs

MIDAS: 多图像分散与语义重建用于对抗多模态大语言模型

Yilian Liu, Xiaojun Jia, Guoshun Nan, Jiuyang Lyu, Zhican Chen, Tao Guan, Shuyuan Luo, Zhongyi Zhai, Yang Liu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学) Guilin University of Electronic Technology(桂林电子科技大学)

AI总结 MIDAS通过多图像分散与语义重建技术,提升对抗多模态大语言模型的劫持性能,达到81.46%的平均攻击成功率。

Journal ref The Fourteenth International Conference on Learning Representations(2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00498 2026-03-03 cs.LG

Antibody: Strengthening Defense Against Harmful Fine-Tuning for Large Language Models via Attenuating Harmful Gradient Influence

Antibody: 通过削弱有害梯度影响来加强对抗有害微调的防御

Quoc Minh Nguyen, Trung Le, Jing Wu, Anh Tuan Bui, Mehrtash Harandi

机构 * Department of Electrical and Computer Systems Engineering, Monash University, Australia(莫纳什大学电气与计算机系统工程系) Department of Data Science and AI, Monash University, Australia(莫纳什大学数据科学与人工智能系)

AI总结 Antibody通过削弱有害梯度影响,提升大型语言模型对有害微调攻击的防御能力,并增强微调性能。

Comments Published at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00418 2026-03-03 cs.CV

Station2Radar: query conditioned gaussian splatting for precipitation field

Station2Radar: 基于查询条件的高斯散射用于降水场

Doyi Kim, Minseok Seo, Changick Kim

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 Station2Radar通过融合自动天气站观测与卫星图像,实现高效、灵活的实时降水场生成,提升降水预报精度。

Comments This paper was accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13530 2026-03-03 cs.AI

REMem: Reasoning with Episodic Memory in Language Agent

REMem: 在语言代理中进行基于事件记忆的推理

Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jiménez Gutiérrez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su

机构 * The Ohio State University(俄亥俄州立大学) Intuit AI Research(Intuit AI研究)

AI总结 REMem通过两阶段框架提升语言代理的事件记忆构建与推理能力,显著优于现有系统。

Comments Accepted by The Fourteenth International Conference on Learning Representations (ICLR 2026) as poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11909 2026-03-03 cs.SD cs.LG

Echo: Towards Advanced Audio Comprehension via Audio-Interleaved Reasoning

Echo:通过音频交错推理实现高级音频理解

Daiqing Wu, Xuan Zhang, Dongbao Yang, Jiashu Yao, Longfei Chen, Qingsong Liu, Sicheng Zhao, Can Ma, Yangyang Kang, Yu Zhou

机构 * IIE, Chinese Academy of Sciences(中国科学院信息工程研究所) Zhejiang University(浙江大学) ByteDance China(字节跳动中国) VCIP & TMCC & DISSec, College of Computer Science, Nankai University(VCIP与TMCC与DISSec,南开大学计算机学院) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) Department of Psychological and Cognitive Sciences, Tsinghua University(清华大学心理学与认知科学系) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 Echo通过音频交错推理方法,提升音频理解能力,在基准测试中表现出色。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03152 2026-03-03 cs.CL

FASA: Frequency-aware Sparse Attention

FASA: 基于频率的稀疏注意力

Yifei Wang, Yueqi Wang, Zhenrui Yue, Huimin Zeng, Yong Wang, Ismini Lourentzou, Zhengzhong Tu, Xiangxiang Chu, Julian McAuley

机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP) UCSD(加州大学圣迭戈分校) UIUC(伊利诺伊大学香槟分校) Texas A&M University(德克萨斯农工大学)

AI总结 FASA通过动态预测令牌重要性,实现基于频率块的稀疏注意力机制,在长上下文任务中表现出色,达到接近全缓存性能且显著提升效率。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00971 2026-03-03 cs.CV

Unveiling the Cognitive Compass: Theory-of-Mind-Guided Multimodal Emotion Reasoning

揭示认知罗盘:基于理论of-Mind的多模态情感推理

Meng Luo, Bobo Li, Shanqing Xu, Shize Zhang, Qiuchan Chen, Menglu Han, Wenhao Chen, Yanxiang Huang, Hao Fei, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(新加坡国立大学) Huazhong University of Science and Technology(华中科技大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出HitEmotion基准和TMPO方法,通过理论of-Mind引导多模态情感推理,提升模型情感理解和认知能力。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00428 2026-03-03 cs.CL cs.AI cs.CR

When Agents "Misremember" Collectively: Exploring the Mandela Effect in LLM-based Multi-Agent Systems

当智能体“误忆”时:探索基于大语言模型的多智能体系统中的曼德拉效应

Naen Xu, Hengyu An, Shuo Shi, Jinghuai Zhang, Chunyi Zhou, Changjiang Li, Tianyu Du, Zhihui Fu, Jun Wang, Shouling Ji

机构 * Zhejiang University(浙江大学) University of California, Los Angeles(加州大学洛杉矶分校) Palo Alto Networks(帕洛阿尔托网络公司) OPPO Research Institute(OPPO研究院) Zhejiang Key Laboratory of Decision Intelligence(浙江决策智能重点实验室)

AI总结 本文研究了基于大语言模型的多智能体系统中的曼德拉效应,提出MANBENCH基准并提出缓解策略,实现74.40%的效应减少。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20069 2026-03-03 cs.LG

Domain Expansion: A Latent Space Construction Framework for Multi-Task Learning

领域扩展:一种多任务学习的潜在空间构建框架

Chi-Yao Huang, Khoa Vo, Aayush Atul Verma, Duo Lu, Yezhou Yang

机构 * Arizona State University(亚利桑那州立大学) Rider University(里德大学)

AI总结 领域扩展通过重构潜在空间防止多任务学习中的潜在表示崩溃,利用正交池化机制构建可解释的潜在空间结构。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18678 2026-03-03 cs.LG cs.CV cs.HC math.DG

Counterfactual Explanations on Robust Perceptual Geodesics

反事实解释中的鲁棒感知测地线

Eslam Zaher, Maciej Trzaskowski, Quan Nguyen, Fred Roosta

机构 * ARC Training Centre for Information Resilience (CIRES)(信息弹性培训中心(CIRES)) School of Mathematics and Physics, University of Queensland(昆士兰大学数学与物理学院) Institute for Molecular Bioscience, University of Queensland(昆士兰大学分子生物学研究院) Profenso QIMR Berghofer Medical Research Institute(QIMR伯格霍夫医学研究机构)

AI总结 本文提出感知反事实测地线方法,通过鲁棒视觉特征构建语义有效的反事实解释,提升模型鲁棒性并揭示隐藏的失败模式。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08333 2026-03-03 cs.RO cs.AI

Robust Finetuning of Vision-Language-Action Robot Policies via Parameter Merging

通过参数合并实现视觉-语言-动作机器人策略的鲁棒微调

Yajat Yadav, Zhiyuan Zhou, Andrew Wagenmaker, Karl Pertsch, Sergey Levine

机构 * UC Berkeley(伯克利大学)

AI总结 通过参数合并实现视觉-语言-动作机器人策略的鲁棒微调,使策略在保持泛化能力的同时有效学习新技能。

Journal ref The Fourteenth International Conference on Learning Representations 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01822 2026-03-03 cs.CL cs.AI cs.CV cs.LG cs.MA

InnoGym: Benchmarking the Innovation Potential of AI Agents

InnoGym:评估AI智能体创新潜力的基准测试

Jintian Zhang, Kewei Xu, Jingsheng Zheng, Zhuoyun Yu, Yuqi Zhu, Yujie Luo, Lanning Wei, Shuofei Qiao, Lun Du, Da Zheng, Shumin Deng, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(知识图谱联合实验室)

AI总结 InnoGym通过引入性能提升和新颖性两个指标,首次系统评估AI智能体的创新潜力,揭示了创造力与有效性的平衡问题。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10985 2026-03-03 cs.CL cs.AI

When Data is the Algorithm: A Systematic Study and Curation of Preference Optimization Datasets

当数据成为算法:对偏好优化数据集的系统研究与整理

Aladin Djuhera, Farhan Ahmed, Swanand Ravindra Kadhe, Syed Zawad, Heiko Ludwig, Holger Boche

机构 * Technical University Munich(慕尼黑技术大学) IBM Research(IBM研究院)

AI总结 本文系统研究并整理了多个开源DPO数据集,提出UltraMix混合数据集,通过Magpie框架进行精细标注,揭示偏好质量差异,并在关键基准上超越最佳单个数据集性能。

Journal ref The Fourteenth International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01107 2026-03-03 cs.RO cs.LG

SLAP: Shortcut Learning for Abstract Planning

SLAP:抽象规划的快捷学习

Y. Isabel Liu, Bowen Li, Benjamin Eysenbach, Tom Silver

AI总结 SLAP通过快捷学习方法自动发现抽象规划中的新选项,提升任务成功率和规划效率。

Comments Published at the International Conference on Learning Representations (ICLR) 2026. Code available at https://github.com/isabelliu0/SLAP

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00177 2026-03-03 cs.LG cs.CL

Can SAEs reveal and mitigate racial biases of LLMs in healthcare?

稀疏自编码器能否揭示并缓解LLM在医疗中的种族偏见?

Hiba Ahsan, Byron C. Wallace

机构 * Northeastern University(东北大学)

AI总结 本文研究了稀疏自编码器在揭示和缓解LLM医疗应用中种族偏见方面的作用,发现其在简单任务中有效,但在复杂任务中效果有限。

Comments camera-ready ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24711 2026-03-03 cs.CV

Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance

MoE中的路由问题:通过显式路由指导扩展扩散Transformer

Yujie Wei, Shiwei Zhang, Hangjie Yuan, Yujin Han, Zhekai Chen, Jiayu Wang, Difan Zou, Xihui Liu, Yingya Zhang, Yu Liu, Hongming Shan

机构 * Fudan University(复旦大学) Tongyi Lab, Alibaba Group(阿里云实验室,阿里巴巴集团) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) MMLab Institute of Science and Technology for Brain-inspired Intelligence, MOE Frontiers Center for Brain Science, Key Laboratory of Computational Neuroscience and Brain-Inspired Intelligence, and State Key Laboratory of Brain Function and Disorders, Fudan University(脑启发智能科学技术研究院、MOE前沿脑科学中心、计算神经科学与脑启发智能重点实验室、脑功能与疾病国家重点实验室,复旦大学)

AI总结 ProMoE通过显式路由指导提升视觉MoE性能,结合两步路由策略和原型路由机制,在ImageNet基准上优于现有方法。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21314 2026-03-03 cs.LG cs.AI stat.ML

A Convergence Analysis of Adaptive Optimizers under Floating-point Quantization

自适应优化器在浮点量化下的收敛性分析

Xuan Tang, Jichu Li, Difan Zou

AI总结 本文提出理论框架分析自适应优化器在浮点量化下的收敛性,揭示Adam和Muon在不同量化下的表现差异,通过实验验证理论结果。

Comments 68 pages, 13 figures, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19807 2026-03-03 cs.CL cs.AI cs.LG

Scaf-GRPO: Scaffolded Group Relative Policy Optimization for Enhancing LLM Reasoning

Scaf-GRPO:基于 scaffolding 的组相对策略优化以增强大语言模型推理能力

Xichen Zhang, Sitong Wu, Yinghao Zhu, Haoru Tan, Shaozuo Yu, Ziyi He, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学)

AI总结 Scaf-GRPO通过渐进式训练框架,在模型学习停滞时提供分层提示,有效提升大语言模型的数学推理能力。

Comments Code: https://github.com/JIA-Lab-research/Scaf-GRPO Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18866 2026-03-03 cs.CL cs.AI cs.CV cs.LG cs.MA

LightMem: Lightweight and Efficient Memory-Augmented Generation

LightMem: 轻量级和高效的内存增强生成

Jizhan Fang, Xinle Deng, Haoming Xu, Ziyan Jiang, Yuqi Tang, Ziwen Xu, Shumin Deng, Yunzhi Yao, Mengru Wang, Shuofei Qiao, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) State Key Lab. for Novel Software Technology, Nanjing University, P.R. China(南京大学软件新技术国家重点实验室,中国)

AI总结 LightMem通过三阶段内存系统提升LLM在动态环境中的效率和性能,实现问答准确率提升和token使用减少。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10575 2026-03-03 cs.CV

UniFlow: A Unified Pixel Flow Tokenizer for Visual Understanding and Generation

UniFlow:一种统一的像素流标记器用于视觉理解和生成

Zhengrong Yue, Haiyu Zhang, Xiangyu Zeng, Boyu Chen, Chenting Wang, Shaobin Zhuang, Lu Dong, Yi Wang, Limin Wang, Yali Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Shenzhen Key Lab of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 UniFlow是一种统一的像素流标记器,通过灵活适配视觉编码器和轻量级解码器,在视觉理解和生成任务中实现了性能的双赢。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09951 2026-03-03 q-bio.NC cs.LG

Emergence of Spatial Representation in an Actor-Critic Agent with Hippocampus-Inspired Sequence Generator

具有海马体启发序列生成器的Actor-Critic智能体中空间表示的出现

Xiao-Xiong Lin, Yuk-Hoi Yiu, Christian Leibold

机构 * Faculty of Biology & Bernstein Center Freiburg & BrainLinks-BrainTools Center University of Freiburg(生物学系及弗赖堡伯尔尼中心、BrainLinks-BrainTools中心、弗赖堡大学)

AI总结 该研究通过海马体启发的序列生成器和Actor-Critic学习者,揭示稀疏输入与序列生成动态的协同作用,为导航任务中的强化学习提供新的归纳偏置。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07959 2026-03-03 cs.LG cs.AI

DISCO: Diversifying Sample Condensation for Efficient Model Evaluation

DISCO: 通过高效样本压缩实现模型评估的多样化

Alexander Rubinstein, Benjamin Raible, Martin Gubri, Seong Joon Oh

机构 * Tübingen AI Center, University of Tübingen(图宾根人工智能中心,图宾根大学)

AI总结 DISCO通过选择模型响应多样性最高的样本,提高模型评估效率,实现更准确的性能预测。

Comments ICLR'26; arXiv v2: add camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07940 2026-03-03 cs.CV cs.AI cs.CL cs.LG cs.MM

TTOM: Test-Time Optimization and Memorization for Compositional Video Generation

TTOM:测试时优化与记忆化用于组合视频生成

Leigang Qu, Ziyang Wang, Na Zheng, Wenjie Wang, Liqiang Nie, Tat-Seng Chua

机构 * National University of Singapore(国立新加坡大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 TTOM通过测试时优化与记忆化机制,提升组合视频生成的跨模态对齐能力,实现高效且可扩展的实时生成。

Comments ICLR 2026 Camera-ready. Project page: https://ttom-t2v.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05064 2026-03-03 cs.LG

Boomerang Distillation Enables Zero-Shot Model Size Interpolation

回环蒸馏使零样本模型大小插值

Sara Kangaslahti, Nihal V. Nayak, Jonathan Geuter, Marco Fumero, Francesco Locatello, David Alvarez-Melis

机构 * Harvard University(哈佛大学) Kempner Institute(凯普纳研究所) IST Austria(IST奥地利研究院)

AI总结 回环蒸馏通过蒸馏和重构实现零样本模型大小插值,生成细粒度模型家族,降低训练成本并提升适应性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04727 2026-03-03 cs.LG

Directional Sheaf Hypergraph Networks: Unifying Learning on Directed and Undirected Hypergraphs

方向性sheaf超图网络:统一学习于有向和无向超图

Emanuele Mule, Stefano Fiorini, Antonio Purificato, Federico Siciliano, Stefano Coniglio, Fabrizio Silvestri

机构 * Sapienza University of Rome(罗马大学)

AI总结 DSHN通过结合sheaf理论与非对称关系处理,统一并泛化了现有超图学习中的拉普拉斯矩阵,提升了超图学习的性能。

Comments Camera ready revision: accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏