arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Transactions on Machine Learning Research · 期刊 · Machine Learning

2026-05-11 至 2026-05-11 共收录 4
2605.07993 2026-05-11 cs.LG stat.ME

Bayesian Sensitivity of Causal Inference Estimators under Evidence-Based Priors

基于证据先验的因果推断估计的贝叶斯敏感性

Nikita Dhawan, Daniel Shen, Leonardo Cotta, Chris J. Maddison

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) University of Waterloo(滑铁卢大学)

AI总结 本文提出贝叶斯敏感性值(BSV)框架,用于评估因果推断估计在假设违反下的稳健性,通过实证研究展示其在糖尿病治疗与体重损失关系中的应用。

Comments TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16559 2026-05-11 cs.LG q-bio.QM

Synergistic Benefits of Joint Molecule Generation and Property Prediction

联合分子生成与性质预测的协同效益

Adam Izdebski, Jan Olszewski, Pankhil Gawade, Krzysztof Koras, Serra Korkmaz, Valentin Rauscher, Jakub M. Tomczak, Ewa Szczurek

机构 * Institute of AI for Health, Helmholtz Zentrum Munchen(人工智能与健康研究所,海德堡中心) Technical University of Munich(慕尼黑技术大学) School of Computation, Information and Technology(计算、信息与技术学院) Faculty of Mathematics, Informatics and Mechanics, University of Warsaw(数学、信息学与力学学院,华沙大学) Ardigen SA(Ardigen公司) Eindhoven University of Technology(埃因霍温理工大学)

AI总结 本文提出Hyformer模型,通过交替注意力机制和联合预训练方案,实现分子生成与性质预测的协同优化,提升了条件采样、异常分布预测和表征学习性能。

Comments 17 pages, 4 figures

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12285 2026-05-11 cs.LG cs.AI cs.GT cs.SY eess.SY stat.ML

A Resilience Framework for Bi-Criteria Combinatorial Optimization with Bandit Feedback

双目标组合优化的鲁棒框架与带反馈机制

Vaneet Aggarwal, Shweta Jain, Subham Pokhriyal, Christopher John Quinn

机构 * Purdue University(普渡大学) IIT Ropar(罗帕尔理工学院) Iowa State University(爱荷华州立大学)

AI总结 本文提出双目标组合优化的鲁棒框架,通过带反馈机制将离线算法转化为在线算法,实现子线性遗憾和约束违反的渐近最优。

Journal ref Transactions on Machine Learning Research, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15134 2026-05-11 cs.LG cs.AI

Proximal Policy Distillation

近端策略蒸馏

Giacomo Spigler

机构 * AI for Robotics Lab (AIR-Lab)(人工智能机器人实验室) Department of Cognitive Science and Artificial Intelligence(认知科学与人工智能系) Tilburg University(蒂尔堡大学)

AI总结 本文提出PPD方法,结合学生驱动蒸馏和近端策略优化,提升样本效率并利用学生策略在蒸馏过程中收集的额外奖励。在多种强化学习环境中验证了其有效性。

Journal ref Transactions on Machine Learning Research, ISSN 2835-8856 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏