arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

期刊&会议

NeurIPS

Conference on Neural Information Processing Systems · 会议 · Machine Learning

2026-03-18 至 2026-03-18 共收录 6
2603.15871 2026-03-18 cs.LG cs.AI

Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement Learning

对抗式强化学习:为高效和可扩展的深度强化学习重新思考核心原理

Ezgi Korkmaz

机构 * Ezgi Korkmaz

AI总结 本文提出基于对抗性行动经验的理论新范式,解决高维MDP中状态空间爆炸导致的计算复杂性与策略成功率矛盾,通过实验验证方法在高维环境中的高效性和样本效率。

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15563 2026-03-18 cs.LG cs.AI

The PokeAgent Challenge: Competitive and Long-Context Learning at Scale

PokeAgent挑战:在大规模中实现竞争性和长上下文学习

Seth Karten, Jake Grigsby, Tersoo Upaa, Junik Bae, Seonghun Hong, Hyunyoung Jeong, Jaeyoon Jung, Kun Kerdthaisong, Gyungbo Kim, Hyeokgi Kim, Yujin Kim, Eunju Kwon, Dongyu Liu, Patrick Mariglia, Sangyeon Park, Benedikt Schink, Xianwei Shi, Anthony Sistilli, Joseph Twin, Arian Urdu, Matin Urdu, Qiao Wang, Ling Wu, Wenli Zhang, Kunsheng Zhou, Stephanie Milani, Kiran Vodrahalli, Amy Zhang, Fei Fang, Yuke Zhu, Chi Jin

机构 * Princeton(普林斯顿大学) UT-Austin(得克萨斯大学奥斯汀分校) CMU(卡内基梅隆大学) NYU(纽约大学) Google DeepMind(谷歌DeepMind) Team Heatz(团队Heatz) Team PA-Agent(团队PA-Agent) Team FoulPlay(团队FoulPlay) Team 4thLesson(团队4thLesson) Team Q(团队Q) Team Anthonys(团队Anthonys) Team Hamburg(团队Hamburg) Team Porygon2AI(团队Porygon2AI) Team Deepest(团队Deepest) Team August(团队August)

AI总结 PokeAgent挑战通过两个互补赛道,解决部分可观测性、博弈推理和长周期规划问题,提供大规模基准测试和首个RPG速run评估框架,揭示通用(LLM)、专业(RL)和精英人类表现间的差距。

Comments 41 pages, 26 figures, 5 tables. NeurIPS 2025 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20644 2026-03-18 cs.LG cs.IT math.IT

Connecting Jensen-Shannon and Kullback-Leibler Divergences: A New Bound for Representation Learning

连接Jensen-Shannon和Kullback-Leibler散度:表示学习中的新界限

Reuben Dorent, Polina Golland, William Wells

机构 * Inria(法国国家信息与自动化研究所)

AI总结 本文通过推导JSD与KLD之间的新下界,揭示了JSD基于信息最大化与互信息之间的关系,并展示了其在表示学习中的应用和有效性。

Comments Accepted at NeurIPS 2025. This revised version provides a proof of Lemma B.5, previously stated as a conjecture in the original submission. Code available at https://github.com/ReubenDo/JSDlowerbound/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20606 2026-03-18 cs.GT cs.CY cs.LG econ.TH

Strategic Costs of Perceived Bias in Fair Selection

公平选拔中的感知偏见战略成本

L. Elisa Celis, Lingxiao Huang, Milind Sohoni, Nisheeth K. Vishnoi

机构 * Yale University(耶鲁大学) Nanjing University(南京大学) IIT Bombay(印度理工学院班加罗尔分校)

AI总结 本文通过博弈论模型分析不同社会经济群体在感知后选择价值差异下的努力分配,揭示这种差异如何影响代表性、社会福利和效用,提出成本敏感优化框架以减少不平等。

Comments The paper has been accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18546 2026-03-18 cs.RO cs.AI

EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval

EfficientNav: 面向设备端目标物体导航的导航地图缓存与检索

Zebin Yang, Sunjian Zheng, Tong Xie, Tianshi Xu, Bo Yu, Fan Wang, Jie Tang, Shaoshan Liu, Meng Li

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Integrated Circuits, Peking University(北京大学集成电路学院) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进制造创新中心)

AI总结 本文提出EfficientNav,通过语义感知记忆检索和离散记忆缓存技术,在设备端实现零样本目标物体导航,提升成功率并降低规划延迟。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17533 2026-03-18 math.HO cs.AI cs.CL math.NT

From Euler to AI: Unifying Formulas for Mathematical Constants

从欧拉到人工智能:数学常数的统一公式

Tomer Raz, Michael Shalyt, Elyasheev Leibtag, Rotem Kalisch, Shachar Weinbaum, Yaron Hadad, Ido Kaminer

机构 * Technion – Israel Institute of Technology(技术ion理工学院)

AI总结 本文提出自动化框架统一数学公式,通过LLM和符号算法处理455,500篇论文,验证385个π公式并证明其中94%的关系,揭示数学常数间的深层联系。

Comments Final version for NeurIPS2025. Published at https://neurips.cc/virtual/2025/loc/san-diego/poster/117099

详情

展开后加载摘要…

URL PDF HTML 收藏