arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 11791
2502.02844 2026-05-21 cs.LG cs.AI cs.CR cs.MA

Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning

狼群对抗攻击用于鲁棒多智能体强化学习

Sunwoo Lee, Jaebak Hwang, Yonghyeon Jo, Seungyul Han

机构 * Graduate School of Artificial Intelligence, UNIST, Ulsan, South Korea(人工智能研究生院,UNIST,韩国乌山)

AI总结 本文提出狼群对抗攻击框架,用于对抗多智能体强化学习中的协同对抗攻击,并引入狼群-对抗学习框架来训练鲁棒的MARL策略以防御该攻击。

Comments 9 pages main, 23 pages appendix with reference. Accepeted by ICML 2025

Journal ref Proceedings of Machine Learning Research (PMLR), ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02834 2026-05-21 cs.LG cs.AI

Task-Aware Virtual Training: Enhancing Generalization in Meta-Reinforcement Learning for Out-of-Distribution Tasks

任务感知虚拟训练:增强元强化学习在分布外任务中的泛化能力

Jeongmo Kim, Yisak Park, Minung Kim, Seungyul Han

机构 * Graduate School of Artificial Intelligence, UNIST, Ulsan, South Korea(人工智能研究生院,UNIST,韩国乌山)

AI总结 本文提出Task-Aware Virtual Training方法,通过度量学习提升元强化学习在分布外任务中的泛化能力,采用虚拟任务保持任务特征并利用状态正则化技术减少状态变化环境中的过估计误差。

Comments 9 pages main paper, 20 pages appendices with reference. Accepted to ICML 2025

Journal ref Proceedings of Machine Learning Research (PMLR), ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15822 2026-05-21 quant-ph cs.CC

Learning junta distributions, quantum junta states, and QAC$^0$ circuits

学习 junta 分布、量子 junta 状态和 QAC$^0$ 电路

Jinge Bao, Francisco Escudero-Gutiérrez

AI总结 本文研究了学习 junta 分布、量子 junta 状态和 QAC$^0$ 电路的问题,展示了这些概念与 junta 的紧密关系。对于 junta 分布,证明了可以通过 O(2^k log(n)/ε²) 个样本在总变差距离下以误差 ε 学习;对于 junta 状态,证明了可以通过 O(12^k log(n)/ε²) 个单拷贝在迹距离下学习,并给出了下界;对于 QAC$^0$ 电路,改进了 Nadimpalli 等人的结果,证明了可以通过 O(2^{O(log(s²2^a)^d)} log(n)) 个 Choi 状态样本学习大小为 s、深度为 d、辅助 qubit 数为 a 的 QAC$^0$ 电路。

Comments 20 pages. Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20396 2026-05-21 cs.LG stat.ML

Score-Based Causal Discovery of Latent Variable Causal Models

基于得分的潜在变量因果模型因果发现

Ignavier Ng, Xinshuai Dong, Haoyue Dai, Biwei Huang, Peter Spirtes, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, San Diego(加州大学圣地亚哥分校) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 本文提出了一种基于得分的方法,用于识别包含因果相关潜在变量的因果结构,并提供了可识别性保证,同时通过实验验证了方法的有效性。

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20314 2026-05-21 cs.LG cs.AI

Less Data, Faster Training: repeating smaller datasets speeds up learning via sampling biases

数据更少,训练更快:重复较小的数据集通过采样偏差加速学习

Jingwen Liu, Ezra Edelman, Surbhi Goel, Bingbin Liu

机构 * Columbia University(哥伦比亚大学) University of Pennsylvania(宾夕法尼亚大学) Harvard University(哈佛大学)

AI总结 研究探讨了'小数据与大数据差距'现象,即使用更少样本重复训练比使用更大数据集更节省计算资源,通过层间增长和采样偏差机制实现加速,为优化提供了新的归纳偏差。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20289 2026-05-21 cs.LG cs.AI

Plug-and-Play Spiking Operators: Breaking the Nonlinearity Bottleneck in Spiking Transformers

插件式脉冲运算符:突破脉冲变换器中的非线性瓶颈

Xinzhe Yuan, Xiang Peng, Bin Gu, Huan Xiong

机构 * IASM, Harbin Institute of Technology, China(哈尔滨工业大学人工智能研究所,中国) School of Artificial Intelligence, Jilin University, China(吉林大学人工智能学院,中国)

AI总结 本文提出了一种插件式框架,通过将Transformer中的非线性运算分解为三个基本算子(除法、指数和ℓ2范数),并利用LIF神经元群体和轻量级位移缩放实现脉冲友好的近似,从而在不需微调的情况下支持常见的Transformer非线性运算。

Comments Accepted to ICML 2026. 9 pages main paper, 8 pages appendix, 6 figures, 5 tables. Correspondence to Bin Gu and Huan Xiong

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20286 2026-05-21 cs.CR cs.LG

Adaptive Probe-based Steering for Robust LLM Jailbreaking

适应性探针引导用于鲁棒大语言模型劫持

Junxi Chen, Junhao Dong, Xiaohua Xie

机构 * School of Computer Science(计算机科学学院) Engineering, Sun Yat-Sen University, China(中山大学工程学院,中国) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 本文提出了一种基于模型提取的适应性探针引导方法,通过动态调整引导强度来提升大语言模型劫持的鲁棒性和有效性,无需额外对比提示或手动调参,显著提高了攻击效果。

Comments 19 pages, 13 figures, accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20187 2026-05-21 cs.LG cs.AI cs.IT math.IT

Neural Estimation of Pairwise Mutual Information in Masked Discrete Sequence Models

在遮蔽离散序列模型中神经估计成对互信息

Jai Sharma, Yifan Wang, Bryan Li

机构 * University of California, Berkeley, CA, USA(加州大学伯克利分校)

AI总结 本文提出了一种神经框架,直接从预训练的遮蔽扩散模型(MDMs)的隐藏状态中估计成对条件互信息(MI),利用模型自身条件分布计算的地面真实MI进行监督,从而捕捉模型内部对依赖结构的信念,并在单次前向传递中预测完整的MI矩阵,实现MI引导的并行解码。

Comments 6 pages, 3 figures; submitting to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18623 2026-05-21 cs.DS cs.LG

An Approximation Algorithm for Graph Label Selection

图标签选择的近似算法

Josia John, Simon Meierhans, Maximilian Probst Gutenberg

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)

AI总结 本文提出了一种新的图标签选择算法,在标准预算约束下,首次实现了O(log^{1.5}n)的近似比,解决了如何从整个图中选择少量代表性顶点以准确预测剩余顶点标签的问题。

Comments Accepted at ICML 2026. 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17396 2026-05-21 cs.CL

EpiCache: Episodic KV Cache Management for Long-Term Conversation on Resource-Constrained Environments

EpiCache: 为资源受限环境下的长对话提供 episodic KV 缓存管理

Minsoo Kim, Arnav Kundu, Han-Byul Kim, Richa Dixit, Minsik Cho

机构 * Apple(苹果公司)

AI总结 本文提出 EpiCache,一种无需训练的 KV 缓存管理框架,用于在固定内存预算下实现长对话问答(LongConvQA)。该方法通过块级预填充限制缓存增长,并通过 episodic KV 压缩保留主题相关上下文,从而在多个 LongConvQA 评估基准上提升了准确性并减少了延迟和峰值内存使用。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16950 2026-05-21 cs.CV cs.LG

LAION-C: An Out-of-Distribution Benchmark for Web-Scale Vision Models

LAION-C: 一个用于网络级视觉模型的分布外基准

Fanfei Li, Thomas Klein, Wieland Brendel, Robert Geirhos, Roland S. Zimmermann

机构 * Max Planck Institute for Intelligent Systems, Tübingen, Germany(马克斯·普朗克智能系统研究所,图宾根,德国) ELLIS Institute Tübingen(图宾根ELLIS研究所) Tübingen AI Center(图宾根人工智能中心) Google DeepMind(谷歌DeepMind)

AI总结 本文提出LAION-C作为ImageNet-C的替代基准,旨在评估网络级数据集下的分布外鲁棒性,通过引入六种新的分布外扰动类型,发现现代模型在这些扰动下的表现显著提升,甚至超过人类观察者。

Comments ICML 2025 camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20177 2026-05-20 cs.CL cs.CV

From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models

从感知到思考:解耦感知与推理提升视觉语言模型的训练

Juncheng Wu, Hardy Chen, Haoqin Tu, Xianfeng Tang, Freda Shi, Hui Liu, Hanqing Lu, Cihang Xie, Yuyin Zhou

机构 * Amazon(亚马逊) University of Waterloo(滑铁卢大学) Vector Institute, Canada CIFAR AI Chair(向量研究所,加拿大CIFAR人工智能主席)

AI总结 本研究通过解耦感知与推理,发现视觉任务性能受限于感知能力不足而非推理本身,通过分阶段训练提升模型的感知与推理能力,从而在多个视觉数学和感知任务中取得更优表现。

Comments 19 pages, 9 figures; Accepted to ICML 2026; Project Page: https://ucsc-vlaa.github.io/VLM-CapCurriculum/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20145 2026-05-20 stat.ML cs.LG stat.ME

Goal-Oriented Lower-Tail Calibration of Gaussian Processes for Bayesian Optimization

面向目标的高斯过程低尾校准用于贝叶斯优化

Aurélien Pion, Emmanuel Vazquez

机构 * Univ. Paris-Saclay, CNRS, CentraleSupélec, L2S, Gif-sur-Yvette, France(巴黎萨克雷大学,国家科学研究中心,中央超算实验室,L2S,法国吉夫-sur-伊夫特)

AI总结 本文研究了在无噪声情况下,针对低于低阈值t的标准高斯过程模型的预测分布进行面向目标的校准,提出了一种后处理方法tcGP,以校准预测分布低于t的部分,并展示了基于此的全局优化算法在设计空间中保持密集性,实验表明相较于标准高斯过程模型和全局校准高斯过程模型,改进了低尾校准和贝叶斯优化性能。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20028 2026-05-20 cs.LG physics.ao-ph

Training-Free Bayesian Filtering with Generative Emulators

无需训练的贝叶斯过滤与生成模拟器

Thomas Savary, François Rozet, Gilles Louppe

机构 * SAIL, Montefiore institute, University of Liège, Belgium(SAIL、蒙费伊尔研究所、利耶大学、比利时)

AI总结 本文提出一种无需额外训练的最优粒子滤波变种,利用基于扩散的动力学模拟器,解决了高维环境下粒子滤波的可扩展性问题,通过非线性混沌系统实验验证了其有效性。

Comments Accepted as a spotlight paper at the International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19999 2026-05-20 cs.LG cs.AI cs.CR

LLM Benchmark Datasets Should Be Contamination-Resistant

LLM基准数据集应具备抗污染性

Ali Al-Lawati, Jason Lucas, Dongwon Lee, Suhang Wang

机构 * The Pennsylvania State University, University Park, PA, USA(宾夕法尼亚州立大学)

AI总结 本文探讨了LLM基准数据集应具备抗污染性,提出通过改进数据集设计和架构来提高其可靠性和通用性。

Comments Accepted to ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19974 2026-05-20 cs.CV

SphericalDreamer: Generating Navigable Immersive 3D Worlds with Panorama Fusion

SphericalDreamer: 通过全景融合生成可导航的沉浸式3D世界

Antoine Schnepf, Karim Kassab, Flavian Vasile, Andrew Comport

机构 * Université Côte d'Azur, CNRS, I3S, France(法国蔚蓝海岸大学、国家科学研究中心、I3S研究所) Criteo AI Lab, Paris, France(法国Criteo人工智能实验室)

AI总结 本研究提出SphericalDreamer方法,通过生成多个全景图像并将其提升到3D空间中进行融合,从而生成高度细节且可导航的沉浸式3D户外环境,显著提升了尺度和可导航性。

Comments Accepted at ICML 2026. Project page available at https://sphericaldreamer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19966 2026-05-20 cs.LG cs.AI

Detecting Fluent Optimization-Based Adversarial Prompts via Sequential Entropy Changes

通过顺序熵变化检测基于优化的对抗性提示

Mohammed Alshaalan, Miguel R. D. Rodrigues

机构 * Department of Electronic and Electrical Engineering, University College London, London, United Kingdom(电子与电气工程系,伦敦大学学院,伦敦,英国)

AI总结 本文提出了一种基于在线变化点检测的对抗性后缀检测方法CPD,通过标准化用户令牌熵并应用单侧CUSUM统计量,提高了对优化基于对抗性提示的检测性能,同时在多个大型语言模型上实现了更高的F1分数和AUC性能。

Comments Accepted at ICML 2026; 20 pages, including 9 pages main text, references, and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19956 2026-05-20 cs.CV

Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models

迈向细粒度鲁棒性:面向视觉-语言模型的注意力引导测试时提示调优

Jia-Wei Hai, Yijun Wang, Xiu-Shen Wei

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications(新一代人工智能技术及其交叉应用重点实验室) Southeast University(东南大学) School of Intelligence Science and Engineering(智能科学与工程学院)

AI总结 本文提出了一种注意力引导的测试时提示调优方法(A-TPT),旨在解决视觉-语言模型在对抗攻击下的鲁棒性问题,通过改进的梯度注意力机制和空间变化的增强强度来提升模型在细粒度场景下的表现。

Comments Accepted by ICML 2026, Project Page: this https, URL Code URL: this https URL

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19779 2026-05-20 cs.AI cs.LG

Distribution-Free Uncertainty Quantification for Continuous AI Agent Evaluation

无分布不确定性量化用于连续AI代理评估

Yuxuan Gao, Megan Wang, Yi Ling Yu

机构 * University of Pennsylvania(宾夕法尼亚大学) Columbia University(哥伦比亚大学)

AI总结 本文提出了一种无分布的不确定性量化方法,用于连续AI代理评估,通过适应性符合推断(ACI)提供预测质量分数的覆盖保证,并开发了多代理管道的组合不确定性界限、成对排名的符合回避规则以及领奖台规模多重检验的FDR校正回避方法。

Comments 6 pages, 7 figures, 2 tables. Accepted at the ICML 2026 Workshop on Agentic Uncertainty Quantification (AgenticUQ) - Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17471 2026-05-20 cs.LG cs.NA math.NA math.OC

WinQ: Accelerating Quantization-Aware Training of Language Models Around Saddle Points

WinQ: 加速围绕鞍点的语言模型量化感知训练

Dongyue Li, Zechun Liu, Kai Yi, Zhenshuo Zhang, Changsheng Zhao, Raghuraman Krishnamoorthi, Harshit Khaitan, Hongyang R. Zhang, Steven Li

机构 * Northeastern University, MA(东北大学) Meta AI, CA(Meta AI)

AI总结 本文研究了量化感知训练(QAT)在低比特宽度下的收敛问题,提出WinQ算法通过重置权重和噪声注入梯度来加速训练并提升性能。

Comments 23 pages; To appear in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16447 2026-05-20 cs.LG cs.AI

Nested Spatio-Temporal Time Series Forecasting

嵌套时空时间序列预测

Yinghao Ai, Yukai Zhou, Ruoxi Jiang, Junyi An, Chao Qu, Zhijian Zhou, Shiyu Wang, Fenglei Cao, Zenglin Xu, Furao Shen, Yuan Qi

机构 * Fudan University, Shanghai(复旦大学) Department of Computer Science and Technology, Nanjing University(南京大学计算机科学与技术系) ByteDance(字节跳动)

AI总结 本文提出了一种嵌套预测框架,通过结合未来宏观区域趋势与微观历史观测,实现了精细化预测,并通过谱聚类方法构建语义连贯的区域,有效过滤系统性噪声并保留关键趋势,实验表明该方法在多个高维数据集上优于现有最先进基线。

Comments Accept by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16137 2026-05-20 cs.CV cs.RO

STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System

STABLE: 通过语义-物理双系统生成仿真准备的桌面布局

Zhen Luo, Yixuan Yang, Xudong Xu, Jinkun Hao, Zhaoyang Lyu, Feng Zheng, Jiangmiao Pang, Yanwei Fu

机构 * Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出STABLE,一种通过语义-物理双系统生成仿真准备的桌面布局的方法,通过语义推理模块生成粗略布局,物理校正模块校正布局以确保物理合理性,从而提升场景的物理有效性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17305 2026-05-20 cs.AI cs.CL cs.LG

Contrastive Reasoning Alignment: Reinforcement Learning from Hidden Representations

对比推理对齐:从隐藏表示中学习强化学习

Haozheng Luo, Yimin Wang, Jiahao Yu, Binghui Wang, Yan Chen

机构 * Northwestern University(西北大学) University of Michigan(密歇根大学) Illinois Institute of Technology(伊利诺伊理工学院)

AI总结 本文提出了一种基于对比学习和强化学习的框架CRAFT,通过优化隐藏状态空间中的目标来提升对抗攻击的鲁棒性,核心贡献是通过隐藏空间的几何结构实现推理层面的安全对齐。

Comments International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18718 2026-05-20 stat.ML cs.LG math.OC stat.CO

Stochastic Gradient Variational Inference with Price's Gradient Estimator from Bures-Wasserstein to Parameter Space

基于Bures-沃斯特斯坦空间到参数空间的随机梯度变分推断与Price梯度估计

Kyurae Kim, Qiang Fu, Yi-An Ma, Jacob R. Gardner, Trevor Campbell

机构 * University of Pennsylvania(宾夕法尼亚大学) Yale University(耶鲁大学) University of British Columbia(不列颠哥伦比亚大学) University of California San Diego(加州大学圣地亚哥分校)

AI总结 本文研究了在仅给定目标分布无规范化的对数密度时,利用随机梯度的变分推断方法。通过比较Wasserstein VI和Black-Box VI,发现WVI在使用Price梯度估计时具有更优的收敛性,本文进一步证明两者在迭代复杂度上可以达到一致的最优结果。

Comments Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14778 2026-05-20 cs.CL cs.AI cs.CY

A Geometric Analysis of Small-sized Language Model Hallucinations

小尺寸语言模型幻觉的几何分析

Emanuele Ricco, Elia Onofri, Lorenzo Cima, Stefano Cresci, Roberto Di Pietro

机构 * Engineering (CEMSE) division, King Abdullah University of Science and Technology (KAUST)(卡塔尔科技大学工程学院(CEMSE)) Istituto di Informatica e Telematica (IIT), National Research Council of Italy (CNR)(意大利国家研究理事会信息与电信研究所(IIT)) Department of Information Engineering, University of Pisa(比萨大学信息工程系)

AI总结 本文从几何角度分析小尺寸语言模型幻觉问题,提出APORIA框架,通过句子嵌入空间研究重复提示下的响应,发现真实响应比幻觉响应更紧密聚类,并通过APORIA-LP方法实现高效分类,同时发布SOCRATES-300K数据集以支持进一步研究。

Comments 30 pages, 12 figures, 14 tables, accepted as regular paper at ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03924 2026-05-20 cs.LG cs.AI physics.ao-ph

WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric Modeling

WIND:用于零样本大气建模的天气反向扩散

Michael Aich, Andreas Fürst, Florian Sestak, Carlos Ruiz-Gonzalez, Niklas Boers, Johannes Brandstetter

机构 * Munich Climate Center(慕尼黑气候中心) Earth System Modelling Group, TUM School of Engineering(地球系统建模组,技术大学工程学院) Design, Technical University of Munich, Germany(设计,慕尼黑技术大学,德国) ELLIS Unit, LIT AI Lab, Institute for Machine Learning, JKU Linz, Austria(ELLIS单元,LIT人工智能实验室,机器学习研究所,JKU林茨,奥地利) Emmi AI GmbH, Linz, Austria(Emmi AI GmbH,林茨,奥地利) Potsdam Institute for Climate Impact Research, Potsdam, Germany(波茨坦气候影响研究所,波茨坦,德国) Department of Mathematics, University of Exeter, Exeter, United Kingdom(数学系,埃克塞特大学,埃克塞特,英国)

AI总结 本文提出WIND,一种统一的预训练基础模型,能够无需任务特定微调即可替代各种任务的专用基线,通过自监督视频重建目标预训练,实现了对大气的鲁棒、任务无关的先验学习,从而解决天气和气候问题,如概率预报、空间时间降尺度、从稀疏观测重建空间场以及强制全球干空气质量守恒。

Comments Published at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24139 2026-05-20 cs.LG stat.ME

Colorful Pinball: Density-Weighted Quantile Regression for Conditional Guarantee of Conformal Prediction

Colorful Pinball:基于密度加权分位数回归的条件保证置信预测

Qianyi Chen, Bo Li

机构 * School of Economics and Management, Tsinghua University, China(清华大学经济管理学院)

AI总结 本文提出了一种基于密度加权分位数回归的条件保证置信预测方法,通过改进标准置信预测的条件覆盖性能,提供更精确的非渐近保证。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25897 2026-05-20 cs.CV cs.LG

MIRO: MultI-Reward cOnditioned pretraining improves T2I quality and efficiency

MIRO:多奖励条件预训练提升T2I质量和效率

Nicolas Dufour, Lucas Degeorge, Arijit Ghosh, Vicky Kalogeiton, David Picard

机构 * LIGM, ENPC, IP Paris, CNRS, UGE, France LIX, CNRS, \'Ecole Polytechnique, IP Paris, France

AI总结 MIRO通过在训练过程中对模型施加多个奖励,直接学习用户偏好,从而提升文本到图像生成的质量和效率,同时在GenEval组合基准和用户偏好评分上取得最佳成绩。

Comments Accepted at ICML 2026. Project page: https://nicolas-dufour.github.io/miro

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07209 2026-05-20 cs.GR cs.CV

HOI-PAGE: Zero-Shot Human-Object Interaction Generation with Part Affordance Guidance

HOI-PAGE:基于部分可及性的零样本人类-物体交互生成

Lei Li, Angela Dai

机构 * University of Virginia(弗吉尼亚大学) Technical University of Munich(慕尼黑技术大学)

AI总结 本文提出HOI-PAGE,一种通过部分可及性推理生成高保真4D人类-物体交互的零样本方法,利用大语言模型进行部分级机械推理,并通过结构化部分可及性图(PAG)引导三阶段合成,生成复杂多物体或多人物交互序列。

Comments ICML 2026. Project page: https://craigleili.github.io/projects/hoipage/ Video: https://www.youtube.com/watch?v=gwXjOffCFyk

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11628 2026-05-20 cs.CL cs.LG

Critique-Guided Distillation for Robust Reasoning via Refinement

基于批评的蒸馏用于通过细化实现稳健推理

Berkcan Kapusuzoglu, Supriyo Chakraborty, Zain Sarwar, Chia-Hsuan Lee, Sambit Sahu

机构 * University of Chicago, Department of Computer Science(芝加哥大学计算机科学系)

AI总结 该研究提出了一种基于批评的蒸馏方法,通过分离批评消费与批评生成,使模型在细调过程中根据教师的批评来细化错误响应,从而提升推理能力,相比传统蒸馏和Critique Fine-Tuning方法在数学推理基准上表现更优。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏