arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

2026-03-04 至 2026-03-04 共收录 70
2603.03278 2026-03-04 cs.RO cs.AI cs.CV

Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping

Tether: 基于对应驱动轨迹扭曲的自主功能性玩耍

William Liang, Sam Wang, Hung-Ju Wang, Osbert Bastani, Yecheng Jason Ma, Dinesh Jayaraman

机构 * University of Pennsylvania(宾夕法尼亚大学) University of California, Berkeley(加州大学伯克利分校) Dyna Robotics(Dyna机器人技术)

AI总结 Tether通过基于对应驱动的轨迹扭曲,实现从少量演示开始的自主多任务玩耍,生成高质量数据集并提升模仿策略性能。

Comments International Conference on Learning Representations (ICLR), 2026. Project website and code: https://tether-research.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03267 2026-03-04 cs.CY

Policy myopia as a mechanism of gradual disempowerment in Post-AGI governance, Circa 2049

政策短视作为后AGI治理中渐进性失能的机制,约2049年

Subramanyam Sahoo

AI总结 本文探讨了后AGI治理中政策短视如何通过三个交织机制导致人类失能,并通过动态系统建模证明其在多系统中的自我强化效应。

Comments Accepted at the Post-AGI Science and Society Workshop at ICLR 2026. 16 Pages and 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03258 2026-03-04 cs.AI

Inherited Goal Drift: Contextual Pressure Can Undermine Agentic Goals

继承性目标漂移:情境压力可能削弱代理目标

Achyutha Menon, Magnus Saebo, Tyler Crosse, Spencer Gibson, Eyon Jang, Diogo Cruz

机构 * UC San Diego(加州大学圣地亚哥分校) Columbia University(哥伦比亚大学) Georgia Tech(佐治亚理工学院) MATS SPAR

AI总结 本文研究了语言模型在面对情境压力时目标漂移的继承性问题,发现模型在不同环境下表现出不一致的鲁棒性,强调了对训练后技术改进的必要性。

Comments 22 pages, 7 figures. Accepted at ICLR 2026 Lifelong Agents Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03226 2026-03-04 cs.LG cs.CR

Adaptive Methods Are Preferable in High Privacy Settings: An SDE Perspective

在高隐私设置中自适应方法更优:从随机微分方程的角度

Enea Monzio Compagnoni, Alessandro Stanghellini, Rustem Islamov, Aurelien Lucchi, Anastasiia Koloskova

机构 * University of Basel(巴塞尔大学) University of Zürich(苏黎世大学)

AI总结 通过SDE分析发现,在高隐私或大批次噪声场景中,自适应方法在隐私-效用权衡和学习率调整上更具优势。

Comments Accepted at ICLR 2026 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02910 2026-03-04 cs.CV

Articulation in Motion: Prior-free Part Mobility Analysis for Articulated Objects By Dynamic-Static Disentanglement

运动中的关节性:通过动态-静态解耦实现无先验知识的关节物体部分移动分析

Hao Ai, Wenjie Chang, Jianbo Jiao, Ales Leonardis, Ofek Eyal

机构 * School of Computer Science, University of Birmingham(伯明翰大学计算机科学学院) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出了一种无需先验知识的关节物体部分移动分析方法,通过动态-静态解耦实现高质量的3D重建与分割。

Comments Accepted by ICLR 2026. Project Page: https://haoai-1997.github.io/AiM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02882 2026-03-04 cs.CV

SIGMark: Scalable In-Generation Watermark with Blind Extraction for Video Diffusion

SIGMark: 用于视频扩散模型的可扩展生成内水印与盲提取

Xinjie Zhu, Zijing Zhao, Hui Jin, Qingxiao Guo, Yilong Ma, Yunhao Wang, Xiaobing Guo, Weifeng Zhang

机构 * Lenovo Research(联想研究院)

AI总结 SIGMark是一种用于视频扩散模型的可扩展生成内水印框架,通过盲提取技术实现无损水印并提升鲁棒性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02806 2026-03-04 cs.LG

The Price of Robustness: Stable Classifiers Need Overparameterization

鲁棒性的代价:稳定分类器需要过参数化

Jonas von Berg, Adalbert Fono, Massimiliano Datres, Sohir Maskey, Gitta Kutyniok

机构 * Ludwig-Maximilians-Universität München(慕尼黑路德维希-马克西米利安大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Aleph Alpha Research(Aleph Alpha研究公司) University of Tromso(特罗姆瑟大学) DLR-German Aerospace Center(德国航空航天中心)

AI总结 该研究揭示了稳定分类器需要过参数化,通过建立泛化界限和鲁棒性定律,证明了过参数化对提高稳定性的重要性。

Comments 29 pages, 9 figures. Accepted at ICLR 2026

Journal ref In Proceedings of the Fourteenth International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02787 2026-03-04 cs.AI

Rethinking Code Similarity for Automated Algorithm Design with LLMs

重新思考基于LLM的自动算法设计中的代码相似性

Rui Zhang, Zhichao Lu

AI总结 BehaveSim通过分析问题解决行为轨迹,提升LLM-AAD性能并促进算法分析。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09710 2026-03-04 cs.AI

Echoing: Identity Failures when LLM Agents Talk to Each Other

回声:当大语言模型代理相互交谈时的身份失败

Sarath Shekkizhar, Romain Cosentino, Adam Earle, Silvio Savarese

机构 * Salesforce AI Research(Salesforce AI研究)

AI总结 研究发现LLM代理在相互对话中出现身份失败现象,即回声,通过实验表明回声率高达70%,并提出结构化响应作为缓解措施。

Comments Published at ICLR workshop. Related blog post: https://www.salesforce.com/blog/agent-to-agent-interaction/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13251 2026-03-04 cs.CV

Map the Flow: Revealing Hidden Pathways of Information in VideoLLMs

映射流:揭示视频大语言模型中的隐藏信息路径

Minji Kim, Taekyung Kim, Bohyung Han

机构 * NAVER AI Lab(NAVER人工智能实验室)

AI总结 本研究通过机理可解释性技术揭示视频大语言模型中信息流的隐藏路径,展示了时间推理机制及提升模型可解释性和泛化能力的贡献。

Comments ICLR 2026, 32 pages, 39 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12264 2026-03-04 cs.AI

Reducing Belief Deviation in Reinforcement Learning for Active Reasoning

减少强化学习中的信念偏差以实现主动推理

Deyu Zou, Yongqiang Chen, Jianxiang Wang, Haochen Yang, Mufei Li, James Cheng, Pan Li, Yu Gong

机构 * The Chinese University of Hong Kong(香港中文大学) ByteDance(字节跳动) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文提出$\mathbf{T^3}$方法,通过跟踪信念偏差并截断训练轨迹,提升LLM在主动推理中的训练稳定性与性能表现。

Comments Published as a conference paper at ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06219 2026-03-04 cs.CV

Human3R: Everyone Everywhere All at Once

Human3R: 人人处处一次完成

Yue Chen, Xingyu Chen, Yuxuan Xue, Anpei Chen, Yuliang Xiu, Gerard Pons-Moll

AI总结 Human3R通过统一框架实现一次完成的4D人体-场景重建,结合参数高效调优和单次前向传递,提升重建效率与性能。

Comments Page: https://fanegg.github.io/Human3R Code: https://github.com/fanegg/Human3R

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06084 2026-03-04 cs.CL cs.AI

Spectrum Tuning: Post-Training for Distributional Coverage and In-Context Steerability

频谱调节:面向分布覆盖和上下文可引导性的后训练

Taylor Sorensen, Benjamin Newman, Jared Moore, Chan Park, Jillian Fisher, Niloofar Mireshghallah, Liwei Jiang, Yejin Choi

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学) Microsoft Research(微软研究院) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出Spectrum Tuning方法,通过Spectrum Suite提升模型在多样化分布下的引导能力和输出空间覆盖性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05684 2026-03-04 cs.AI cs.CV cs.RO

D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI

D2E:在桌面数据上扩展视觉-动作预训练以迁移到具身AI

Suhwan Choi, Jaeyoon Jung, Haebin Seong, Minchan Kim, Minyeong Kim, Yongjun Cho, Yoonshik Kim, Yubeen Park, Youngjae Yu, Yunsung Lee

机构 * Stanford University(斯坦福大学) Seoul National University(首尔国立大学)

AI总结 D2E通过桌面数据预训练,实现了具身AI任务的有效迁移,其框架包含三个组件,展示了在物理操作和导航任务中的高性能表现。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26645 2026-03-04 cs.CV

TTT3R: 3D Reconstruction as Test-Time Training

TTT3R: 3D重建作为测试时训练

Xingyu Chen, Yue Chen, Yuliang Xiu, Andreas Geiger, Anpei Chen

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Uni of Tübingen, Tübingen AI Center(图宾根大学,图宾根人工智能中心)

AI总结 TTT3R通过测试时训练方法提升3D重建的长度泛化能力,实现全局姿态估计性能提升2倍,运行效率高且内存消耗低。

Comments Page: https://rover-xingyu.github.io/TTT3R/ Code: https://github.com/Inception3D/TTT3R

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18577 2026-03-04 cs.CL

Prior-based Noisy Text Data Filtering: Fast and Strong Alternative For Perplexity

基于先验的噪声文本数据过滤:快速且强大的替代方法用于困惑度

Yeongbin Seo, Gayoung Kim, Jaehyung Kim, Jinyoung Yeo

机构 * Department of Artificial Intelligence(人工智能系)

AI总结 本文提出基于先验的噪声文本数据过滤方法,通过词频统计快速替代困惑度过滤,提升效率并保持性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10625 2026-03-04 cs.CL cs.AI

No Answer Needed: Predicting LLM Answer Accuracy from Question-Only Linear Probes

无需答案:从仅问题的线性探针预测LLM答案准确性

Iván Vicente Moreno Cencerrado, Arnau Padrés Masdemont, Anton Gonzalvez Hawthorne, David Demitri Africa, Lorenzo Pacchiardi

机构 * Universidad Internacional de Valencia(瓦伦西亚国际大学) University of Cambridge(剑桥大学) Independent Researcher(独立研究者)

AI总结 研究通过线性探针预测LLM答案准确性,发现模型在中间层预测能力饱和,但对数学推理问题泛化能力下降,揭示了LLM内部机制。

Comments Accepted (poster) to Principled Design for Trustworthy AI at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18264 2026-03-04 cs.CV

MMTok: Multimodal Coverage Maximization for Efficient Inference of VLMs

MMTok: 为VLMs高效推理的多模态覆盖最大化

Sixun Dong, Juhua Hu, Mian Zhang, Ming Yin, Yanjie Fu, Qi Qian

AI总结 MMTok通过多模态覆盖准则提升VLMs推理效率,结合视觉和文本信息优化标记选择,实现性能与速度的平衡。

Comments Accepted by ICLR 2026. Code: https://github.com/Ironieser/mmtok , Project Homepage: https://project.ironieser.cc/mmtok

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07177 2026-03-04 cs.CV cs.AI

Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models

帧引导:基于帧级信号的无训练引导用于视频扩散模型的可控生成

Sangwon Jang, Taekyung Ki, Jaehyeong Jo, Jaehong Yoon, Soo Ye Kim, Zhe Lin, Sung Ju Hwang

机构 * KAIST(韩国国立科学技术院) NTU Singapore(南洋理工大学) Adobe Research(Adobe研究)

AI总结 帧引导通过帧级信号实现无训练的视频生成控制,支持多种任务如关键帧引导、风格化和循环,无需训练即可生成高质量视频。

Comments ICLR 2026. Project page: https://frame-guidance-video.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18996 2026-03-04 cs.LG stat.ML

Automatic and Structure-Aware Sparsification of Hybrid Neural ODEs

混合神经ODEs的自动和结构感知稀疏化

Bob Junyi Zou, Lu Tian

机构 * Institute for Computational and Mathematical Engineering(计算与数学工程研究所) Stanford University(斯坦福大学)

AI总结 本文提出了一种混合神经ODEs的自动稀疏化方法,结合领域知识与数据驱动正则化,以提高预测性能和稳定性,同时保持机理合理性。

Comments Accepted at The 14th International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19373 2026-03-04 cs.CR cs.AI

Doxing via the Lens: Revealing Location-related Privacy Leakage on Multi-modal Large Reasoning Models

通过镜头进行Doxing:揭示多模态大推理模型中的位置相关隐私泄露

Weidi Luo, Tianyu Lu, Qiming Zhang, Xiaogeng Liu, Bin Hu, Yue Zhao, Jieyu Zhao, Song Gao, Patrick McDaniel, Zhen Xiang, Chaowei Xiao

机构 * University of Georgia(佐治亚大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) John Hopkins University(约翰·霍普金斯大学) University of Southern California(南加州大学) University of Maryland, College Park(马里兰大学学院市分校)

AI总结 本文研究了多模态大推理模型中的位置隐私泄露问题,提出DoxBench和GeoMiner框架,揭示模型在推断地理位置信息上的能力及隐私风险。

Comments Camera-ready version. Accepted as a poster at the 14th International Conference on Learning Representations (ICLR 2026). For official ICLR page, see https://iclr.cc/virtual/2026/poster/10006914

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13483 2026-03-04 stat.ML cs.LG

Robust Amortized Bayesian Inference with Self-Consistency Losses on Unlabeled Data

鲁棒的 amortized 贝叶斯推断与 unlabeled 数据上的 self-consistency 损失

Aayush Mishra, Daniel Habermann, Marvin Schmitt, Stefan T. Radev, Paul-Christian Bürkner

AI总结 本文提出了一种半监督方法,利用 unlabeled 数据提升 amortized 贝叶斯推断在非模拟范围内的鲁棒性。

Comments Accepted to International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12843 2026-03-04 cs.CL cs.AI

NutriBench: A Dataset for Evaluating Large Language Models on Nutrition Estimation from Meal Descriptions

NutriBench:一个用于评估大语言模型从餐食描述中估算营养的基准数据集

Andong Hua, Mehak Preet Dhaliwal, Laya Pullela, Ryan Burke, Yao Qin

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校)

AI总结 NutriBench通过评估大语言模型在餐食描述中估算营养的能力,为营养估算提供了新的研究方向和应用可能性。

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02619 2026-03-04 cs.CV

Direct Reward Fine-Tuning on Poses for Single Image to 3D Human in the Wild

基于姿态的直接奖励微调用于单图像到野外3D人体

Seunguk Do, Minwoo Huh, Joonghyuk Shin, Jaesik Park

机构 * Seoul National University(首尔国立大学)

AI总结 DrPose通过直接奖励微调提升单图像到3D人体重建的姿态一致性,利用姿态与图像配对数据训练,改进多视图扩散模型,提升动态和复杂姿态的重建质量。

Comments ICLR 2026, Project webpage: https://seunguk-do.github.io/drpose

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02588 2026-03-04 cs.CL

ExpGuard: LLM Content Moderation in Specialized Domains

ExpGuard: 专门领域中的大语言模型内容审核

Minseok Choi, Dongjin Kim, Seungbin Yang, Subin Kim, Youngjun Kwak, Juyoung Oh, Jaegul Choo, Jungmin Son

机构 * KAIST AI(韩国科学技术院人工智能研究所) Financial Tech Lab, KakaoBank Corp(Kakao银行金融科技实验室)

AI总结 ExpGuard通过专门领域的大语言模型内容审核模型,有效提升对金融、医疗和法律领域有害内容的防御能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02556 2026-03-04 cs.CV cs.AI cs.CL cs.LG

Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs

通过对比的视角:VLMs中的自改进视觉推理

Zhiyu Pan, Yizheng Wu, Jiashen Hua, Junyi Feng, Shaotian Yan, Bing Deng, Zhiguo Cao, Jieping Ye

机构 * Huazhong University of Science and Technology(华中科技大学) Alibaba Cloud(阿里云)

AI总结 通过视觉对比提升VLMs的推理能力,提出VC-STaR框架,有效减少推理幻觉并提升多种VLMs的视觉推理性能。

Comments 19 pages, 9 figures, accepted to ICLR 2026 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02541 2026-03-04 cs.CV

ForestPersons: A Large-Scale Dataset for Under-Canopy Missing Person Detection

ForestPersons: 一个大规模数据集用于树冠下失踪人员检测

Deokyun Kim, Jeongjun Lee, Jungwon Choi, Jonggeon Park, Giyoung Lee, Yookyung Kim, Myungseok Ki, Juho Lee, Jihun Cha

机构 * Autonomous UAV Research Section, ETRI(ETRI自主无人机研究部) Kim Jaechul Graduate School of AI, KAIST(KAIST人工智能研究生院)

AI总结 ForestPersons是一个大规模数据集,用于解决森林树冠下失踪人员检测的挑战,通过提供地面级和低空视角的图像和注释,提升无人机在搜索和救援任务中的人员检测能力。

Comments ICLR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02386 2026-03-04 cs.CV

Advancing Earth Observation Through Machine Learning: A TorchGeo Tutorial

通过机器学习推进地球观测:TorchGeo教程

Caleb Robinson, Nils Lehmann, Adam J. Stewart, Burak Ekim, Heng Fang, Isaac A. Corley, Mauricio Cordeiro

机构 * Microsoft AI for Good Research Lab(微软AI for Good研究实验室) Chair of Data Science in Earth Observation, Technical University of Munich(地球观测数据科学主任,技术大学慕尼黑) Chair of Earth Observation, University of the Bundeswehr Munich(地球观测主任,联邦国防军大学慕尼黑) Department of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) Wherobots(Wherobots公司) National Water and Sanitation Agency, Brazil, Federal District, Brasilia(巴西国家水务与卫生局,联邦区,巴西利亚)

AI总结 本文介绍TorchGeo教程,展示如何利用该库进行地球观测数据的机器学习处理,包括多光谱水分割的端到端案例研究。

Comments Accepted at ICLR ML4RS 2026 Tutorial Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02297 2026-03-04 cs.CR cs.AI

ZeroDayBench: Evaluating LLM Agents on Unseen Zero-Day Vulnerabilities for Cyberdefense

ZeroDayBench: 评估LLM代理在未见的零日漏洞上的能力以应对网络防御

Nancy Lau, Louis Sloot, Jyoutir Raj, Giuseppe Marco Boscardin, Evan Harris, Dylan Bowman, Mario Brajkovski, Jaideep Chawla, Dan Zhao

AI总结 ZeroDayBench评估了前沿LLM在未见零日漏洞上的自主修复能力,揭示了其在主动网络防御中的局限性及改进方向。

Comments Accepted to ICLR 2026 Workshop "Agents in the Wild"

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02289 2026-03-04 stat.ME cs.LG stat.ML

Topological Causal Effects

拓扑因果效应

Kwangho Kim, Hajin Lee

机构 * Department of Statistics, Korea University(韩国大学统计系)

AI总结 本文提出了一种基于拓扑结构的因果推断框架,通过持续图的加权轮廓函数估计治疗效应,并构建了检验无拓扑效应的正式检验。

Journal ref Proceedings of the Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏