arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

共收录 9454
2602.00782 2026-02-03 q-bio.BM cs.AI

Controlling Repetition in Protein Language Models

控制蛋白质语言模型中的重复

Jiahao Zhang, Zeqing Zhang, Di Wang, Lijie Hu

机构 * Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed人工智能大学) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹科技大学)

AI总结 本文提出UCCS方法,通过受约束数据集引导蛋白质生成,有效减少重复并保持折叠可靠性。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00693 2026-02-03 cs.LG math.AG math.AT

Topology and Geometry of the Learning Space of ReLU Networks: Connectivity and Singularities

ReLU网络学习空间的拓扑与几何:连通性与奇点

Marco Nurisso, Pierrick Leroy, Giovanni Petri, Francesco Vaccarino

AI总结 本研究探讨了ReLU网络学习空间的拓扑与几何特性,分析了参数空间的连通性与奇点存在,揭示了DAG结构对这些性质的影响,并通过实验验证了理论结果。

Comments Accepted to ICLR 2026. 32 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00629 2026-02-03 stat.ML cs.AI cs.LG

Action-Free Offline-to-Online RL via Discretised State Policies

无需动作的离线到在线强化学习 via 离散化状态策略

Natinael Solomon Neggatu, Jeremie Houssineau, Giovanni Montana

AI总结 本文提出无需动作的离线到在线强化学习方法,通过离散化状态策略提升高维问题的收敛速度和渐近性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00579 2026-02-03 cs.CV

Bridging Degradation Discrimination and Generation for Universal Image Restoration

弥合退化鉴别与生成以实现通用图像修复

JiaKui Hu, Zhengjian Yao, Lujia Jin, Yanye Lu

机构 * Institute of Medical Technology, Peking University(北京大学医学技术学院) Biomedical Engineering Department, College of Future Technology, Peking University(北京大学未来技术学院生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心) China Mobile Research Institute(中国移动研究院)

AI总结 本文提出BDG方法,通过多角度多尺度灰度共生矩阵提升退化鉴别与生成能力,实现通用图像修复和超分辨率任务的性能提升。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00528 2026-02-03 cs.AI

How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use

LLMs距离专业扑克玩家还有多远?结合代理工具使用的博弈论推理再探

Minhua Lin, Enyan Dai, Hui Liu, Xianfeng Tang, Yuliang Yan, Zhenwei Dai, Jingying Zeng, Zhiwei Zhang, Fali Wang, Hongcheng Gao, Chen Luo, Xiang Zhang, Qi He, Suhang Wang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) HKUST (GZ)(香港科技大学) Amazon(亚马逊) Tsinghua University(清华大学) Microsoft(微软公司)

AI总结 本文提出ToolPoker框架,通过整合外部求解器和专业解释,提升LLMs在扑克博弈中的推理和游戏表现。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20765 2026-02-03 cs.LG

Less is More: Clustered Cross-Covariance Control for Offline RL

少即是多:用于离线强化学习的聚类交叉协方差控制

Nan Qiao, Sheng Yue, Shuning Wang, Yongheng Deng, Ju Ren

AI总结 本文提出了一种用于离线强化学习的聚类交叉协方差控制方法,通过分区缓冲区采样和梯度修正惩罚,减少分布偏移带来的影响,提升策略学习的稳定性和性能。

Comments accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07327 2026-02-03 cs.AI cs.CL

IterResearch: Rethinking Long-Horizon Agents with Interaction Scaling

IterResearch: 重新思考长视界智能体与交互扩展

Guoxin Chen, Zile Qiao, Xuanzhong Chen, Donglei Yu, Haotian Xu, Wayne Xin Zhao, Ruihua Song, Wenbiao Yin, Huifeng Yin, Liwen Zhang, Kuan Li, Minpeng Liao, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

AI总结 IterResearch通过交互扩展范式提升长视界推理能力,实现高效探索与稳定训练,显著提升性能并缩小与前沿系统的差距。

Comments Camera Ready version for ICLR 2026. https://github.com/Chen-GX/IterResearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03774 2026-02-03 cs.LG

Contamination Detection for VLMs using Multi-Modal Semantic Perturbation

使用多模态语义扰动检测VLMs中的污染

Jaden Park, Mu Cai, Feng Yao, Jingbo Shang, Soochahn Lee, Yong Jae Lee

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of California, San Diego(加州大学圣地亚哥分校) Kookmin University(韩国庆北大学)

AI总结 本文提出了一种基于多模态语义扰动的检测方法,用于识别和验证受污染的视觉语言模型。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14827 2026-02-03 cs.RO

NeMo-map: Neural Implicit Flow Fields for Spatio-Temporal Motion Mapping

NeMo-map:基于神经隐式流场的时空运动映射

Yufei Zhu, Shih-Min Yang, Andrey Rudenko, Tomasz P. Kucner, Achim J. Lilienthal, Martin Magnusson

机构 * Örebro University(奥雷布罗大学) Technical University of Munich(慕尼黑技术大学) Aalto University(阿alto大学)

AI总结 NeMo-map通过隐式神经函数实现连续时空动态地图,提升复杂人类运动模式建模与轨迹预测性能。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09487 2026-02-03 cs.LG

Near-Optimal Second-Order Guarantees for Model-Based Adversarial Imitation Learning

近最优的二阶保证用于基于模型的对抗模仿学习

Shangzhe Li, Dongruo Zhou, Weitong Zhang

AI总结 本文提出基于模型的对抗模仿学习算法,通过二阶样本复杂性保证,实现近最优的样本效率和理论性能。

Comments 39 pages, 4 figures, 6 tables, accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26281 2026-02-03 cs.CV cs.AI

Point2RBox-v3: Self-Bootstrapping from Point Annotations via Integrated Pseudo-Label Refinement and Utilization

Point2RBox-v3: 通过集成伪标签细化和利用实现点标注的自举学习

Teng Zhang, Ziqian Fan, Mingxin Liu, Xin Zhang, Xudong Lu, Wentong Li, Yue Zhou, Yi Yu, Xiang Li, Junchi Yan, Xue Yang

机构 * Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Nankai University(南开大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) East China Normal University(华东师范大学) Ohio State University(俄亥俄州立大学)

AI总结 Point2RBox-v3通过集成伪标签细化和利用,实现了点标注的自举学习,有效提升稀疏和密集场景下的检测性能。

Comments 19pages, 5figures, 6tables

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23909 2026-02-03 cs.CV

EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling

EditScore: 通过高保真奖励建模解锁图像编辑的在线强化学习

Xin Luo, Jiahao Wang, Chenyuan Wu, Shitao Xiao, Xiyan Jiang, Defu Lian, Jiajun Zhang, Dong Liu, Zheng liu

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Zhejiang University(浙江大学)

AI总结 EditScore通过高保真奖励建模解锁图像编辑的在线强化学习,提供从基准到奖励建模到RL训练的系统路径。

Comments Accepted to ICLR 2026. Code, models, and benchmark: https://github.com/VectorSpaceLab/EditScore

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19743 2026-02-03 cs.CV

Rectified Decoupled Dataset Distillation: A Closer Look for Fair and Comprehensive Evaluation

纠正解耦数据集蒸馏:对公平和全面评估的深入探讨

Xinhao Zhong, Shuoyang Sun, Xulin Gu, Chenyang Zhu, Bin Chen, Yaowei Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出RD$^3$,通过系统研究后评估设置对测试准确率的影响,揭示性能差异主要源于评估不一致,而非合成数据质量,同时提出改进蒸馏数据集效果的通用策略。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13181 2026-02-03 cs.LG

Spectral Bellman Method: Unifying Representation and Exploration in RL

谱贝尔曼方法:在强化学习中统一表示与探索

Ofir Nabati, Bo Dai, Shie Mannor, Guy Tennenholtz

AI总结 谱贝尔曼方法通过统一表示学习与探索,在强化学习中提出了一种基于贝尔曼误差的新框架,提升长周期任务性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11818 2026-02-03 cs.LG

SynCoGen: Synthesizable 3D Molecule Generation via Joint Reaction and Coordinate Modeling

SynCoGen: 通过联合反应和坐标建模实现可合成的3D分子生成

Andrei Rekesh, Miruna Cretu, Dmytro Shevchuk, Vignesh Ram Somnath, Pietro Liò, Robert A. Batey, Mike Tyers, Michał Koziarski, Cheng-Hao Liu

机构 * University of Toronto(多伦多大学) The Hospital for Sick Children(多伦多儿童医院) University of Cambridge(剑桥大学) ETH Zürich(苏黎世联邦理工学院) Vector Institute(向量研究所) Mila – Quebec AI Institute(魁北克AI研究所) McGill University(麦吉尔大学) Caltech(加州理工学院)

AI总结 SynCoGen通过联合反应和坐标建模实现可合成的3D分子生成,实现了分子构建块、化学反应和原子坐标的联合分布采样,在无条件小分子生成和药物发现中表现出色。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04832 2026-02-03 cs.LG

Discrete Diffusion Trajectory Alignment via Stepwise Decomposition

通过分步分解实现离散扩散轨迹对齐

Jiaqi Han, Austin Wang, Minkai Xu, Wenda Chu, Meihua Dang, Haotian Ye, Huayu Chen, Yisong Yue, Stefano Ermon

机构 * Stanford University(斯坦福大学) Caltech(加州理工学院) Tsinghua University(清华大学)

AI总结 本研究提出一种离线偏好优化方法,通过分步分解实现离散扩散模型的轨迹对齐,提升DNA序列设计和语言建模的性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02023 2026-02-03 cs.DC cond-mat.mtrl-sci cs.LG cs.PF

DistMLIP: A Distributed Inference Platform for Machine Learning Interatomic Potentials

DistMLIP:一种用于机器学习互原子势的分布式推断平台

Kevin Han, Bowen Deng, Amir Barati Farimani, Gerbrand Ceder

机构 * Carnegie Mellon University(卡内基梅隆大学) UC Berkeley(加州大学伯克利分校) LBNL(劳伦斯伯克利国家实验室)

AI总结 DistMLIP是一种基于图级并行化的分布式推断平台,可提升机器学习互原子势的模拟效率和规模。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02533 2026-02-03 cs.LG cs.AI cs.CL cs.MA

Multi-Agent Design: Optimizing Agents with Better Prompts and Topologies

多智能体设计:通过更优提示和拓扑结构优化智能体

Han Zhou, Xingchen Wan, Ruoxi Sun, Hamid Palangi, Shariq Iqbal, Ivan Vulić, Anna Korhonen, Sercan Ö. Arık

机构 * Google(谷歌) University of Cambridge(剑桥大学)

AI总结 本文提出MASS框架,通过优化提示和拓扑结构提升多智能体系统性能,并揭示了有效构建多智能体系统的原理。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08543 2026-02-03 cs.CL cs.AI

MiniLLM: On-Policy Distillation of Large Language Models

MiniLLM: 大语言模型的在线策略蒸馏

Yuxian Gu, Li Dong, Furu Wei, Minlie Huang

机构 * The CoAI Group, Tsinghua University(清华大学CoAI小组) Microsoft Research(微软研究院)

AI总结 MiniLLM通过反向KLD和在线策略优化,实现了对大语言模型的有效蒸馏,提升小型模型的生成质量和校准性能。

Comments Published as a conference paper in ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00425 2026-02-03 cs.CL

Segment-Level Attribution for Selective Learning of Long Reasoning Traces

分段属性用于长推理轨迹的选择性学习

Siyuan Wang, Yanchen Liu, Xiang Ren

机构 * University of Southern California(南加州大学)

AI总结 本文提出一种基于分段属性的选择性学习框架,通过量化标记对最终答案的影响,提升长推理轨迹学习的效率和准确性。

Comments Accepted to ICLR 2026. 16 pages, 5 figures. Code available at https://github.com/SiyuanWangw/SegmentSelectiveSFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00205 2026-02-03 cs.LG cs.CV

Reducing Class-Wise Performance Disparity via Margin Regularization

通过边缘正则化减少类别间的性能差异

Beier Zhu, Kesen Zhao, Jiequan Cui, Qianru Sun, Yuan Zhou, Xun Yang, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Hefei University of Technology(合肥工业大学) Singapore Management University(新加坡管理学院) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出MR$^2$方法,通过动态调整边缘来减少分类中类别间的性能差异,提升困难类别性能的同时不损害易类别表现。

Comments To appear in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00135 2026-02-03 cs.CV

LLaVA-FA: Learning Fourier Approximation for Compressing Large Multimodal Models

LLaVA-FA: 通过傅里叶近似压缩大型多模态模型

Pengcheng Zheng, Chaoning Zhang, Jiarong Mo, GuoHui Li, Jiaquan Zhang, Jiahao Zhang, Sihan Cao, Sheng Zheng, Caiyan Qin, Guoqing Wang, Yang Yang

AI总结 LLaVA-FA通过频域联合低秩和量化近似,实现高效压缩大型多模态模型,采用极坐标量化和对角校准方案,提升压缩效果与效率。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22917 2026-02-03 cs.CV

Learning Unified Representation of 3D Gaussian Splatting

学习统一的3D高斯散射表示

Yuelin Xin, Yuheng Liu, Xiaohui Xie, Xinke Li

机构 * UC Irvine(伊利诺伊大学厄巴纳-香槟分校) City University of Hong Kong(香港城市大学)

AI总结 本文提出了一种基于连续子流形场的3D高斯散射嵌入表示,以提升基于神经网络的3D高斯散射学习效果。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00647 2026-02-03 cs.LG

Cooperative Sheaf Neural Networks

协同sheaf神经网络

André Ribeiro, Ana Luiza Tenório, Juan Belieni, Amauri H. Souza, Diego Mesquita

机构 * Getulio Vargas Foundation(戈利亚沃斯基金会) Federal Institute of Ceará(塞阿拉联邦理工学院)

AI总结 本文提出协同sheaf神经网络,通过引入cellular sheaves概念,解决sheaf扩散中缺乏信息方向性导致无法实现协同行为的问题,并在实验中展示了更好的性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23159 2026-02-02 cs.CV

Segment Any Events with Language

通过语言进行任意事件分割

Seungjun Lee, Gim Hee Lee

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

AI总结 SEAL通过语义感知框架实现开放词汇事件实例分割,支持多粒度级别的事件分割与掩码分类,并在多个基准测试中表现出优越的性能和效率。

Comments ICLR 2026. Project Page: https://0nandon.github.io/SEAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22905 2026-02-02 cs.LG

FlexLoRA: Entropy-Guided Flexible Low-Rank Adaptation

FlexLoRA: 基于熵的灵活低秩适应

Muqing Liu, Chongjie Si, Yuheng Jia

机构 * Chien-Shiung Wu College, Southeast University(陈希ung Wu学院,东南大学) MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, Shanghai Jiao Tong University(人工智能MOE实验室,人工智能研究院,上海交通大学计算机科学学院) School of Computer Science and Engineering, Southeast University(计算机科学与工程学院,东南大学) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其跨学科应用关键实验室(东南大学),教育部,中国)

AI总结 FlexLoRA通过基于熵的灵活低秩适应框架,解决PEFT中粒度、灵活性和稳定性问题,实现性能提升。

Comments 2026 ICLR. Codes in https://github.com/Chongjie-Si/Subspace-Tuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13837 2026-02-02 cs.CV

FastGHA: Generalized Few-Shot 3D Gaussian Head Avatars with Real-Time Animation

FastGHA: 基于实时动画的通用少样本3D高斯头身像

Xinya Ji, Sebastian Weiss, Manuel Kansy, Jacek Naruniec, Xun Cao, Barbara Solenthaler, Derek Bradley

机构 * Nanjing University(南京大学) ETH Zürich(苏黎世联邦理工学院) DisneyResearch|Studios(迪士尼研究与工作室)

AI总结 FastGHA通过少样本输入图像生成高质量3D头身像,并支持实时动画,提升了推理效率和渲染质量。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05005 2026-02-02 cs.LG cs.AI cs.RO

Multi-agent Coordination via Flow Matching

通过流匹配实现多智能体协调

Dongsu Lee, Daehee Lee, Amy Zhang

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Sungkyunkwan University(松均大学)

AI总结 MAC-Flow通过流匹配方法实现多智能体协调,平衡了性能与计算效率,显著提升推理速度的同时保持良好表现。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26374 2026-02-02 cs.AI

BOTS: A Unified Framework for Bayesian Online Task Selection in LLM Reinforcement Finetuning

BOTS:一种用于LLM强化微调中贝叶斯在线任务选择的统一框架

Qianli Shen, Daoyuan Chen, Yilun Huang, Zhenqing Ling, Yaliang Li, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

AI总结 BOTS通过贝叶斯推断和汤普森采样,提高LLM强化微调中任务选择的效率和性能。

Comments Accepted as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25801 2026-02-02 cs.LG cs.AI cs.CL cs.CV

Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start

Metis-SPECS: 通过基于偏好自我蒸馏的冷启动解耦多模态学习

Kun Chen, Peng Shi, Haibo Qiu, Zhixiong Zeng, Siqi Yang, Wenji Mao, Lin Ma

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS) Meituan(美团)

AI总结 Metis-SPECS通过基于偏好的自我蒸馏冷启动框架解耦多模态学习,提升泛化能力和下游RL表现。

Comments Published as a conference paper at ICLR 2026!

详情

展开后加载摘要…

URL PDF HTML 收藏