arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-08-27 至 2026-08-27 共收录 8
2608.25585 2026-08-27 cs.RO 新提交

RA-VLA: Retrieval-Augmented VLA for Test-Time Adaptation

RA-VLA:用于测试时自适应的检索增强视觉-语言-动作模型

Sanghwan Jang, Minjin Jeon, Minsoo Kim, Seongjin Choi, Dongha Kim, Hwanjo Yu

机构 * POSTECH(浦项科技大学) Department of Computer Science and Engineering, POSTECH(浦项科技大学计算机科学与工程学院) Graduate School of Artificial Intelligence, POSTECH(浦项科技大学人工智能研究生院)

AI总结 该研究针对VLA模型面对新任务分布时的脆弱性问题,提出RA-VLA检索增强VLA框架,在LIBERO基准和UR5e环境中验证其可提升机器人操纵的任务适应成功率与计算效率。

Comments ICML 2026. Contact: this http URL (http://s.jang) @postech. this http URL (http://ac.kr)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25370 2026-08-27 cs.IR cs.AI cs.LG 新提交

CRAMER: Control via Request-Aware Masking for Editing Recommenders

CRAMER:基于请求感知掩码的推荐模型编辑控制框架

Zhiyuan Julian Su, Naihe Feng, Zhen Luther Qin, Ga Wu

AI总结 CRAMER是一种通过请求感知掩码调制冻结骨干参数的推荐控制框架,在多个大规模数据集上优于现有基线,开销最小且可控性与跨域适配能力更强,为请求感知序列推荐建立了新范式。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24907 2026-08-27 cs.HC cs.AI cs.CL cs.LG 新提交

PA-CoT: Profile-Adaptive Chain-of-Thought for Personalized Nutritional Consulting

PA-CoT:面向个性化营养咨询的画像自适应思维链

Evgenii Garmashov, Nikita Kulin, Artur Khairullin, Viktor Zhuravlev, Daniil Sukhorukov, Mikhail Mozikov, Ilya Makarov, Sergey Muravyov

AI总结 该研究针对营养咨询提示方法缺乏画像分析步骤的缺陷,提出PA-CoT多阶段提示法,构建QPA基准并经对比实验证实,明确画像分析步骤可显著提升咨询的个性化与安全性。

Comments Accepted at the ICML 2026 Workshop on Structured Data for Health (SD4H)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25592 2026-08-27 stat.ML cs.LG 版本更新

Optimal Design for Multinomial Logit Model with Applications to Best Assortment Identification

多项Logit模型的最优设计及其在最佳组合识别中的应用

Joongkyu Lee, Min-hwan Oh

机构 * Seoul National University, Seoul, Korea(首尔国立大学)

AI总结 针对多项Logit(MNL)模型,提出计算高效的最优实验设计框架,通过混合整数线性规划和多项式时间松弛方法实现统计效率与可扩展性,并应用于线性效用和非均匀收益下的最佳组合识别。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17415 2026-08-27 cs.LG cs.AI cs.CV 版本更新

Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models

奖励分数匹配:统一流模型和扩散模型的基于奖励的微调

Jeongjae Lee, Jinho Chang, Jeongsol Kim, Jong Chul Ye

机构 * Graduate School of AI, KAIST, Korea(人工智能研究生院,韩国科学技术院)

AI总结 提出奖励分数匹配(RSM)框架,统一了多种基于奖励的微调方法,通过分数匹配与值引导目标对齐,简化了设计空间并提高了效率。

Comments 50 pages, 15 figures. Best Paper Award at SPIGM workshop, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07587 2026-08-27 cs.CV 版本更新

3DGS-HPC: Distractor-free 3D Gaussian Splatting with Hybrid Patch-wise Classification

3DGS-HPC: 无干扰的3D高斯散射与混合逐块分类

Jiahao Chen, Yipeng Qin, Ganlong Zhao, Xin Li, Wenping Wang, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Texas A&M University(德克萨斯农工大学) Cardiff University(卡迪夫大学) Centre for Perceptual and Interactive Intelligence(感知与交互智能中心)

AI总结 3DGS-HPC通过结合逐块分类策略和混合分类度量标准,有效抑制干扰因素,提升基于3DGS的新视角合成性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01990 2026-08-27 cs.LG cs.AI 版本更新

SAME: Stabilized Mixture-of-Experts for Multimodal Continual Instruction Tuning

SAME: 用于多模态持续指令调优的稳定混合专家模型

Zhen-Hao Xie, Jun-Tao Tang, Yu-Cheng Shi, Han-Jia Ye, De-Chuan Zhan, Da-Wei Zhou

机构 * State Key Laboratory of Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院)

AI总结 针对多模态持续指令调优中专家路由漂移和专家漂移问题,提出稳定混合专家模型(SAME),通过正交子空间分解路由动态和曲率感知缩放更新专家,实现无重放的状态最优性能。

Comments Accepted to ICML 2026. Code is available at this https URL (https://github.com/LAMDA-CL/Prism)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02764 2026-08-27 cs.IR cs.AI 版本更新

Netflix Artwork Personalization via LLM Post-training

通过LLM后训练实现Netflix作品个性化

Hyunji Nam, Sejoon Oh, Emma Kong, Yesu Feng, Moumita Bhattacharya

机构 * Stanford University(斯坦福大学)

AI总结 通过LLM后训练实现Netflix作品个性化推荐,提升用户满意度和参与度。

Comments Pluralistic Alignment @ ICML 2026 Workshop; 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏