arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

NeurIPS

Conference on Neural Information Processing Systems · 会议 · Machine Learning

共收录 17318
2502.07514 2026-01-05 cs.LG

A Near-optimal, Scalable and Parallelizable Framework for Stochastic Bandits Robust to Adversarial Corruptions and Beyond

一种近优、可扩展且可并行化的随机带老虎机框架,具有对抗性破坏的鲁棒性及更广泛的适用性

Zicheng Hu, Cheng Chen

机构 * MoE Engineering Research Center of Hardware/Software Co-design Technology and Application(硬件/软件协同设计技术与应用的MoE工程研究中心) East China Normal University(东华大学)

AI总结 本文提出了一种改进的随机老虎机框架BARBAT,通过消除K因子实现最优悔恨界,并扩展至多种设置,提升并行化能力与计算效率。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25023 2026-01-01 cs.LG

ResponseRank: Data-Efficient Reward Modeling through Preference Strength Learning

ResponseRank: 通过偏好强度学习实现数据高效的奖励建模

Timo Kaufmann, Yannick Metz, Daniel Keim, Eyke Hüllermeier

AI总结 ResponseRank通过本地有效相对强度信号稳健学习偏好强度,提升样本效率和鲁棒性,引入Pearson距离相关性度量。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03688 2026-01-01 stat.ML cs.LG

Learning quadratic neural networks in high dimensions: SGD dynamics and scaling laws

在高维空间中学习二次神经网络:SGD动态与缩放定律

Gérard Ben Arous, Murat A. Erdogdu, Nuri Mert Vural, Denny Wu

AI总结 本文研究了高维空间中两层二次神经网络的SGD动态及缩放规律,通过分析矩阵Riccati微分方程和单调性论证,推导了预测风险的缩放定律。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24842 2026-01-01 cs.CL stat.ML

Triangulation as an Acceptance Rule for Multilingual Mechanistic Interpretability

三角化作为多语言机制可解释性的接受规则

Yanan Long

机构 * StickFlux Labs(StickFlux实验室)

AI总结 本文提出三角化作为多语言机制可解释性的接受规则,通过因果标准验证模型行为的必要性、充分性和不变性,以提高跨语言解释的可靠性。

Comments NeurIPS 2025 Workshop Evaluating the Evolving LLM Lifecycle: Benchmarks, Emergent Abilities, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24695 2026-01-01 cs.LG cs.AI

Nested Learning: The Illusion of Deep Learning Architectures

嵌套学习:深度学习架构的幻觉

Ali Behrouz, Meisam Razaviyayn, Peilin Zhong, Vahab Mirrokni

AI总结 本文提出嵌套学习范式,通过多级优化问题设计更高效的学习算法,展示持续学习模块Hope在语言建模等任务中的表现。

Comments A version of this work is published at Neural Information Processing Systems (NeurIPS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24323 2026-01-01 cs.CV

Robust Egocentric Referring Video Object Segmentation via Dual-Modal Causal Intervention

通过双模态因果干预实现鲁棒的自我参照视频目标分割

Haijing Liu, Zhiyuan Song, Hefeng Wu, Tao Pu, Keze Wang, Liang Lin

机构 * Sun Yat-sen University(中山大学)

AI总结 CERES通过双模态因果干预方法,在自我参照视频中实现鲁棒的目标分割,提升对快速运动和遮挡的鲁棒性。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23947 2026-01-01 cs.LG stat.ML

Improved Balanced Classification with Theoretically Grounded Loss Functions

改进的平衡分类:基于理论的损失函数

Corinna Cortes, Mehryar Mohri, Yutao Zhong

AI总结 本文提出两种改进的平衡分类损失函数,通过理论分析和实验验证,证明其在类别不平衡场景下具有更强的理论保证和更好的性能表现。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25138 2026-01-01 cs.RO

Learning Spatial-Aware Manipulation Ordering

学习空间感知的操作顺序

Yuxiang Yan, Zhiyuan Zhou, Xin Gao, Guanghao Li, Shenglin Li, Jiaqi Chen, Qunyan Pu, Jian Pu

机构 * Fudan University(复旦大学) Shanghai YinCheng Intelligent CO., LTD(上海英成智能有限公司) Stanford University(斯坦福大学)

AI总结 OrderMind通过空间感知学习在杂乱环境中实现高效鲁棒操作的统一框架。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22693 2026-01-01 cs.CV

VADTree: Explainable Training-Free Video Anomaly Detection via Hierarchical Granularity-Aware Tree

VADTree: 通过分层粒度感知树实现可解释的无训练视频异常检测

Wenlong Li, Yifei Xu, Yuan Rao, Zhenhua Wang, Shuiguang Deng

机构 * School of Software, Xi’an Jiaotong University(西安交通大学软件学院) China Railway Xi’an Group(中国铁路西安集团) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 VADTree通过分层粒度感知树结构实现无训练视频异常检测,利用预训练模型知识和多维先验提升异常感知与推理能力。

Comments NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21128 2026-01-01 cs.DS cs.CC cs.DM cs.LG

A Unified Approach to Submodular Maximization Under Noise

在噪声下子模函数最大化的一种统一方法

Kshipra Bhawalkar, Yang Cai, Zhe Feng, Christopher Liaw, Tao Lin

机构 * Google Mountain View, CA(谷歌山景城) Yale University(耶鲁大学) Harvard University(哈佛大学)

AI总结 本文提出了一种统一方法,在噪声环境下实现子模函数最大化,通过 meta 算法将稳健算法转换为噪声环境下的算法,获得不同约束下的近似结果。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23361 2026-01-01 cs.CV

OmniVCus: Feedforward Subject-driven Video Customization with Multimodal Control Conditions

OmniVCus: 基于多模态控制条件的前馈主体驱动视频定制

Yuanhao Cai, He Zhang, Xi Chen, Jinbo Xing, Yiwei Hu, Yuqian Zhou, Kai Zhang, Zhifei Zhang, Soo Ye Kim, Tianyu Wang, Yulun Zhang, Xiaokang Yang, Zhe Lin, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学) Adobe Research(Adobe研究) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 OmniVCus通过多模态控制条件和改进的嵌入机制实现高效的多主体视频定制。

Comments NeurIPS 2025; A data construction pipeline and a diffusion Transformer framework for controllable subject-driven video customization

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06970 2026-01-01 cs.CV

Guiding Cross-Modal Representations with MLLM Priors via Preference Alignment

通过偏好对齐引导跨模态表示

Pengfei Zhao, Rongbo Luan, Wei Zhang, Peng Wu, Sifeng He

机构 * Apple(苹果公司)

AI总结 MAPLE通过利用多模态大语言模型的细粒度对齐先验,引导跨模态表示学习,提升细粒度检索性能。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09395 2026-01-01 cs.LG

Adjusted Count Quantification Learning on Graphs

图上的调整计数量化学习

Clemens Damke, Eyke Hüllermeier

AI总结 本文提出结构重要性采样和邻域感知ACC方法,解决图量化中的协变量偏移问题,并在多个任务中验证了有效性。

Comments 19 pages, presented at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09384 2026-01-01 cs.LG

Revisiting Agnostic Boosting

重新审视无偏提升

Arthur da Cunha, Mikael Møller Høgsgaard, Andrea Paudice, Yuxin Sun

AI总结 本文提出了一种改进的无偏提升算法,通过还原到可实现情况并结合边界的过滤,显著提升了样本复杂度,并证明了样本复杂度的下界。

Comments Camera-ready version: NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15241 2026-01-01 cs.CL cs.AI cs.IR

Quantifying Positional Biases in Text Embedding Models

量化文本嵌入模型中的位置偏差

Reagan J. Lee, Samarth Goel, Kannan Ramchandran

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本研究量化了文本嵌入模型中位置偏差的影响,发现模型倾向于优先处理输入开头部分,且位置越远离开头,句子重要性越低。

Comments 13 pages, 11 figures, NeurIPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18508 2026-01-01 cs.LG

Orchid: Flexible and Data-Dependent Convolution for Sequence Modeling

Orchid: 灵活且数据依赖的卷积用于序列建模

Mahdi Karami, Ali Ghodsi

机构 * Google Research(谷歌研究) School of Computer Science University of Waterloo(计算机科学学院)

AI总结 Orchid提出了一种灵活且数据依赖的卷积架构,用于提升序列建模的效率和可扩展性。

Journal ref Advances in Neural Information Processing Systems 37 (2024): 76991-77022

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11450 2026-01-01 cs.LG cs.DS

Optimal Approximation -- Smoothness Tradeoffs for Soft-Max Functions

最优近似——软最大函数的平滑性权衡

Alessandro Epasto, Mohammad Mahdian, Vahab Mirrokni, Manolis Zampetakis

机构 * Google Research(谷歌研究) Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出分段线性和功率机制,分别在最坏情况加性近似与ℓq-范数平滑度、期望乘法近似与Rényi散度平滑度之间实现最优权衡,适用于机器学习和机制设计领域。

Comments Accepted for spotlight presentation at NeurIPS 2020. The updated version fixes a technical gap in the proof of Theorem 4.4

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23858 2026-01-01 cs.LG cs.PL

Yggdrasil: Bridging Dynamic Speculation and Static Runtime for Latency-Optimal Tree-Based LLM Decoding

Yggdrasil:连接动态推测与静态运行时以实现延迟最优的树基LLM解码

Yue Guan, Changming Yu, Shihan Fang, Weiming Hu, Zaifeng Pan, Zheng Wang, Zihan Liu, Yangjie Zhou, Yufei Ding, Minyi Guo, Jingwen Leng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Qizhi Institute(上海启智研究院) University of California, San Diego(加州大学圣地亚哥分校)

AI总结 Yggdrasil通过上下文感知的树起草和编译友好的执行,实现延迟最优的树基LLM解码,支持未经修改的LLM并在多种硬件上实现3.98倍速度提升。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23853 2026-01-01 cs.LG

Flow Matching Neural Processes

流匹配神经过程

Hussen Abu Hamad, Dan Rosenbaum

机构 * Department of Computer Science University of Haifa(计算机科学系海法大学)

AI总结 基于流匹配的神经过程模型,通过ODE求解器实现高效条件采样,提升精度与运行时间的可控权衡。

Comments NeurIPS 2025. For code, see https://github.com/danrsm/flowNP

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23722 2026-01-01 cs.CL

Emergent World Beliefs: Exploring Transformers in Stochastic Games

涌现的世界信念:探索变换器在随机游戏中的应用

Adam Kamel, Tanish Rastogi, Michael Ma, Kailash Ranganathan, Kevin Zhu

机构 * University of Waterloo(多伦多大学) University of California, Berkeley(加州大学伯克利分校) Algoverse AI Research(Algoverse人工智能研究)

AI总结 本文研究了LLMs在扑克等信息不完全领域中学习随机环境表示的能力,通过预训练和内部激活探测,展示了模型能自主学习确定性和随机性特征。

Comments Accepted at NeurIPS 2025 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17609 2026-01-01 cs.SD cs.LG

Audio Super-Resolution with Latent Bridge Models

基于潜在桥模型的音频超分辨率

Chang Li, Zehua Chen, Liyuan Wang, Jun Zhu

机构 * Department of CST, Tsinghua University, Beijing, China(计算机科学与技术系,清华大学,北京,中国) Shengshu AI, Beijing, China(盛舒人工智能,北京,中国) USTC, Hefei, China(中国科学技术大学,合肥,中国)

AI总结 本文提出基于潜在桥模型的音频超分辨率方法,通过压缩音频到潜在空间并设计桥模型,实现高质量的任意到48kHz和192kHz音频上采样。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04245 2026-01-01 cs.AI cs.CL cs.LG

Contextual Integrity in LLMs via Reasoning and Reinforcement Learning

通过推理和强化学习实现大语言模型中的上下文完整性

Guangchen Lan, Huseyin A. Inan, Sahar Abdelnabi, Janardhan Kulkarni, Lukas Wutschitz, Reza Shokri, Christopher G. Brinton, Robert Sim

机构 * Purdue University(普渡大学) Microsoft(微软) National Univ of Singapore(新加坡国立大学)

AI总结 本文通过推理和强化学习方法,提升大语言模型在执行任务时的信息披露合理性,减少不适当信息泄露,同时保持任务性能。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15272 2026-01-01 cs.CL cs.AI cs.CV

OmniBench: Towards The Future of Universal Omni-Language Models

OmniBench: 向通用多语言模型的未来迈进

Yizhi Li, Yinghao Ma, Ge Zhang, Ruibin Yuan, Kang Zhu, Hangyu Guo, Yiming Liang, Jiaheng Liu, Zekun Wang, Jian Yang, Siwei Wu, Xingwei Qu, Jinjie Shi, Xinyue Zhang, Zhenzhu Yang, Yidan Wen, Yanghai Wang, Shihao Li, Zhaoxiang Zhang, Zachary Liu, Emmanouil Benetos, Wenhao Huang, Chenghua Lin

机构 * University of Manchester(曼彻斯特大学) Queen Mary University of London(伦敦大学玛丽女王学院) Hongkong University of Science and Technology(香港科学与技术大学) Nanjing University(南京大学) Dartmouth College(达特茅斯学院)

AI总结 OmniBench提出了一种评估通用多语言模型三模态处理能力的基准,揭示了现有模型在多模态推理中的不足,并提出OmniInstruct数据集以改进训练方法。

Comments Accepted by The Thirty-Ninth Annual Conference on Neural Information Processing Systems (NeurIPS2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23691 2025-12-30 astro-ph.IM astro-ph.GA

Galaxy Zoo Evo: 1 million human-annotated images of galaxies

Galaxy Zoo Evo: 100万张人类标注的星系图像

Mike Walmsley, Steven Bamford, Hugh Dickinson, Tobias Géron, Alexander J. Gordon, Annette M. N. Ferguson, Lucy Fortson, Sandor Kruk, Natalie Lines, Chris J. Lintott, Karen L. Masters, Robert G. Mann, James Pearson, Hayley Roberts, Anna M. M. Scaife, Stefan Schuldt, Brooke Simmons, Rebecca Smethurst, Josh Speagle, Kyle Willett

AI总结 Galaxy Zoo Evo提供100万张人类标注的星系图像,用于构建和评估天文基础模型,支持领域适应和不确定性学习,助力未来天文研究。

Comments Submitted to NeurIPS Datasets and Benchmarks 2025. Positive reviews but rejected by AC; see OpenReview

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23427 2025-12-30 cs.CV cs.LG

Towards Integrating Uncertainty for Domain-Agnostic Segmentation

迈向领域无关分割的不确定性整合

Jesse Brouwers, Xiaoyan Xing, Alexander Timans

机构 * UvA-Bosch Delta Lab, University of Amsterdam(阿姆斯特丹大学)

AI总结 本文提出UncertSAM基准测试,评估不确定性量化对分割模型在领域无关场景下的泛化能力提升效果。

Comments Public code at https://github.com/JesseBrouw/UncertSAM | published at the 2nd Workshop on Frontiers in Probabilistic Inference (NeurIPS 2025) | 12 pages, 8 figures (incl. Appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23419 2025-12-30 cs.AI

The World Is Bigger! A Computationally-Embedded Perspective on the Big World Hypothesis

世界更大!一个计算嵌入视角下的大世界假说

Alex Lewandowski, Adtiya A. Ramesh, Edan Meyer, Dale Schuurmans, Marlos C. Machado

机构 * University of Alberta(阿尔伯塔大学) Amii The Swiss AI Lab IDSIA, USI & SUPSI(瑞士AI实验室IDSIA、USI与SUPSI) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Google DeepMind(谷歌DeepMind)

AI总结 本文提出了一种计算嵌入视角下的持续学习方法,通过交互性目标评估智能体在无限状态空间中的适应能力,发现深度线性网络在扩展能力时表现更优。

Comments NeurIPS 2025 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14376 2025-12-30 cs.LG cs.AI

Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels

分块式Flash线性注意力:更高效的线性RNN和xLSTM内核

Maximilian Beck, Korbinian Pöppel, Phillip Lippe, Sepp Hochreiter

机构 * ELLIS Unit, LIT AI Lab, Institute for Machine Learning, JKU Linz(ELLIS单位、LIT人工智能实验室、机器学习研究所、JKU林茨) NXAI GmbH(NXAI公司)

AI总结 TFLA通过引入序列并行化提升线性RNN和xLSTM内核效率,实现更高算术强度和更优长上下文序列建模性能。

Comments Accepted at NeurIPS 2025. Code available at: https://github.com/NX-AI/mlstm_kernels

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03427 2025-12-30 cs.AI

TPTU: Large Language Model-based AI Agents for Task Planning and Tool Usage

TPTU:基于大型语言模型的AI代理用于任务规划和工具使用

Jingqing Ruan, Yihong Chen, Bin Zhang, Zhiwei Xu, Tianpeng Bao, Guoqing Du, Shiwei Shi, Hangyu Mao, Ziyue Li, Xingyu Zeng, Rui Zhao

机构 * University of Chinese Academy of Sciences(中国科学院大学) SenseTime Research(商汤科技研究院) HKUST(香港科技大学)

AI总结 本文提出基于大型语言模型的AI代理框架,设计两种代理类型以提升任务规划和工具使用能力,并通过实验验证其在复杂任务中的有效性。

Comments Accepted in NeurIPS-2023 Workshop on Foundation Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22629 2025-12-30 cs.AI cs.IR

DICE: Discrete Interpretable Comparative Evaluation with Probabilistic Scoring for Retrieval-Augmented Generation

DICE:基于概率评分的离散可解释比较评估用于检索增强生成

Shiyan Liu, Jian Ma, Rui Qu

机构 * School of Computer Science and Technology(计算机科学与技术学院) Huazhong University of Science and Technology(华中科技大学)

AI总结 DICE提出一种基于概率评分的两阶段框架,提升RAG评估的可解释性和稳健性,通过透明判断和系统性错误诊断,实现高效且可信的评估。

Comments Accepted at ResponsibleFM @ NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22550 2025-12-30 cs.LG cs.AI

TimePerceiver: An Encoder-Decoder Framework for Generalized Time-Series Forecasting

TimePerceiver: 一个用于通用时间序列预测的编码器-解码器框架

Jaebin Lee, Hankook Lee

机构 * Sungkyunkwan University(顺天大学)

AI总结 TimePerceiver提出了一种统一的编码器-解码器框架,通过灵活感知时间序列位置,实现多种预测任务的泛化,显著提升预测性能。

Comments Accepted to NeurIPS 2025. The code is available at https://github.com/efficient-learning-lab/TimePerceiver

详情

展开后加载摘要…

URL PDF HTML 收藏