arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence

共收录 9565
2512.03994 2026-01-21 cs.LG

Training-Free Policy Violation Detection via Activation-Space Whitening in LLMs

无需训练的策略违规检测:通过激活空间白化在大语言模型中

Oren Rachmil, Avishag Shapira, Roy Betser, Itay Gershon, Omer Hofman, Asaf Shabtai, Yuval Elovici, Roman Vainshtein

机构 * Fujitsu Research of Europe(富士通欧洲研究机构) Ben-Gurion University of the Negev(贝内杰尔大学)

AI总结 本文提出一种无需训练的策略违规检测方法,通过激活空间白化技术在大语言模型中实现高效检测。

Comments Accepted to the AAAI 2026 Deployable AI (DAI) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00332 2026-01-21 cs.AI cs.CE

When Hallucination Costs Millions: Benchmarking AI Agents in High-Stakes Adversarial Financial Markets

当幻觉成本百万:在高风险对抗性金融市场中基准测试AI代理

Zeshi Dai, Zimo Peng, Zerui Cheng, Ryan Yihe Li

机构 * Surf AI, Cybertino Lab(Surf AI,Cybertino 实验室) Princeton University(普林斯顿大学)

AI总结 CAIA基准测试揭示了AI在对抗性金融市场中的能力缺口,指出当前模型在面对虚假信息和不可逆决策时表现不佳,强调对抗鲁棒性对可信AI的重要性。

Comments 15 pages, 5 figures, 4 tables; Accepted to AAAI 2026 (AI-4-Finance Workshop - Oral, top 10%); In submission to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18260 2026-01-21 cs.CL

MIRAGE: Scaling Test-Time Inference with Parallel Graph-Retrieval-Augmented Reasoning Chains

MIRAGE: 通过并行图检索增强推理链实现测试时扩展

Kaiwen Wei, Rui Shan, Dongsheng Zou, Jianzhong Yang, Bi Zhao, Junnan Zhu, Jiang Zhong

AI总结 MIRAGE通过并行图检索增强推理链实现测试时扩展,提升医疗问答任务的准确性和可追溯性。

Comments 10 pages, 8 figures (including tables), plus appendix. Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13866 2026-01-21 cs.CV

SAGA: Learning Signal-Aligned Distributions for Improved Text-to-Image Generation

SAGA:学习信号对齐的分布以提高文本到图像生成

Paul Grimal, Michaël Soumm, Hervé Le Borgne, Olivier Ferret, Akihiro Sugimoto

机构 * Université Paris-Saclay, CEA, List(巴黎-萨克雷大学,CEA,List) Télécom Paris(巴黎电信学院) National Institute of Informatics, Japan(日本信息处理研究所)

AI总结 SAGA 通过学习信号对齐的分布,提高文本到图像生成的准确性与控制性,支持多种条件模式并优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04444 2026-01-21 cs.LG cs.NA math.NA stat.ML

Matrix-Free Two-to-Infinity and One-to-Two Norms Estimation

无矩阵的二到无穷范数和一到二范数估计

Askar Tsyganov, Evgeny Frolov, Sergey Samsonov, Maxim Rakhuba

AI总结 本文提出无矩阵设置下的二到无穷范数和一到二范数估计新算法,基于Hutchinson估计器的改进,并展示其在深度学习和推荐系统中的应用。

Comments AAAI-2026, camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01412 2026-01-21 cs.CL

Bias Association Discovery Framework for Open-Ended LLM Generations

面向开放型大语言模型生成的偏见关联发现框架

Jinhao Pan, Chahat Raj, Ziwei Zhu

机构 * Jinhao Pan Chahat Raj Ziwei Zhu

AI总结 本研究提出BADF框架,用于从开放型LLM生成中发现和分析人口身份与描述性概念的偏见关联。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23816 2026-01-21 cs.CL cs.LG

A Course Correction in Steerability Evaluation: Revealing Miscalibration and Side Effects in LLMs

在可转向性评估中的课程修正:揭示LLMs中的误校准与副作用

Trenton Chang, Tobias Schnabel, Adith Swaminathan, Jenna Wiens

AI总结 本文提出了一种多维目标空间框架,揭示LLMs在文本改写任务中存在意外副作用,表明现有对齐策略可能不足。

Comments 8 pages, 6 figures. 26 pages of references and supplementary material, 22 additional figures. Association for the Advancement of Artificial Intelligence Conference (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11513 2026-01-19 cs.CY

Capacity Constraints Make Admissions Processes Less Predictable

容量限制使录取过程更不具有可预测性

Evan Dong, Nikhil Garg, Sarah Dean

AI总结 容量限制使录取过程更不可预测,研究揭示了机器学习在录取决策中因容量约束导致的预测性能下降问题。

Comments This paper was accepted to the 2026 AAAI Conference on Artificial Intelligence AI for Social Impact Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12569 2026-01-19 cs.LG

Let the Void Be Void: Robust Open-Set Semi-Supervised Learning via Selective Non-Alignment

让虚空成为虚空:通过选择性非对齐实现鲁棒的开集半监督学习

You Rim Choi, Subeom Park, Seojun Heo, Eunchung Noh, Hyung-Sin Kim

AI总结 SkipAlign通过引入选择性非对齐机制,有效区分分布内和分布外样本,提升开集半监督学习中对未知分布外实例的检测能力,同时保持分布内分类精度。

Comments Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11118 2026-01-19 cs.LG

Optimized Algorithms for Text Clustering with LLM-Generated Constraints

基于LLM生成约束的文本聚类优化算法

Chaoqi Jia, Weihong Wu, Longkun Guo, Zhigang Lu, Chao Chen, Kok-Leong Ong

AI总结 本文提出了一种基于LLM生成约束的文本聚类优化算法,通过生成约束集提高效率和准确性,减少LLM查询次数20倍以上。

Comments AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11102 2026-01-19 cs.CV

Graph Smoothing for Enhanced Local Geometry Learning in Point Cloud Analysis

图平滑用于点云分析中的增强局部几何学习

Shangbo Yuan, Jie Xu, Ping Hu, Xiaofeng Zhu, Na Zhao

AI总结 本文提出一种结合图平滑和局部几何学习的方法,以提升点云分析中边界点和连接区域的处理效果。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11019 2026-01-19 cs.CL cs.AI

Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs

寻找翻译切换:在大语言模型中发现并利用任务启动特征

Xinwei Wu, Heng Liu, Xiaohu Zhao, Yuqi Ren, Linlong Xu, Longyue Wang, Deyi Xiong, Weihua Luo, Kaifu Zhang

AI总结 本研究通过发现大语言模型中的翻译启动特征,揭示其内在翻译能力,并提出基于机理困难样本的高效微调策略,提升模型鲁棒性和效率。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10945 2026-01-19 cs.CV cs.AI cs.CL

PatientVLM Meets DocVLM: Pre-Consultation Dialogue Between Vision-Language Models for Efficient Diagnosis

PatientVLM 与 DocVLM 相遇:为高效诊断的预咨询对话

K Lokesh, Abhirama Subramanyam Penamakuri, Uday Agarwal, Apoorva Challa, Shreya K Gowda, Somesh Gupta, Anand Mishra

AI总结 本文提出预咨询对话框架,通过视觉语言模型模拟医生与患者对话,利用合成症状提升诊断效率。

Comments Accepted at AAAI 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10911 2026-01-19 cs.LG

Realistic Curriculum Reinforcement Learning for Autonomous and Sustainable Marine Vessel Navigation

现实课程强化学习用于自主可持续海洋船舶导航

Zhang Xiaocai, Xiao Zhe, Liang Maohan, Liu Tao, Li Haijiang, Zhang Wenbin

AI总结 本文提出基于现实课程强化学习的框架,结合数据驱动的海洋模拟和机器学习预测模块,以实现自主且可持续的船舶导航。

Comments Present in The 40th Annual AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20004 2026-01-19 cs.LG cs.AI cs.CV

Zero-Shot Transfer Capabilities of the Sundial Foundation Model for Leaf Area Index Forecasting

Sundial基础模型在叶面积指数预测中的零样本转移能力

Peining Zhang, Hongchen Qin, Haochen Zhang, Ziqi Guo, Guiling Wang, Jinbo Bi

机构 * Sundial Foundation(Sundial基金会)

AI总结 Sundial基础模型在无需任务特定调优的情况下,能够超越专门监督模型,在遥感时间序列预测中展现强大零样本转移能力。

Comments 6 pages, 5 figures, AAAI 2026 AgriAI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19814 2026-01-19 stat.ME cs.AI

Causal Inference under Threshold Manipulation: Bayesian Mixture Modeling and Heterogeneous Treatment Effects

阈值操纵下的因果推断:贝叶斯混合建模与异质性处理效应

Kohsuke Kubota, Shonosuke Sugasawa

AI总结 本文提出了一种贝叶斯混合建模方法,用于在阈值操纵下估计因果效应,并扩展至分层贝叶斯框架以估计异质性处理效应。

Comments Paper accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01166 2026-01-19 cs.SD

Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR

听更清晰,用更少:多模态检索与选择增强的对话式LLM基于ASR

Bingshen Mu, Hexin Liu, Hongfei Xue, Kun Wei, Lei Xie

AI总结 本文提出MARS方法,通过多模态检索与选择提升对话式LLM-ASR的准确性,仅用1.5K小时数据即可超越训练于179K小时数据的顶级系统。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15055 2026-01-19 cs.CL

Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory

陷入基准?基于项目反应理论重新思考大语言模型基准测试

Hongli Zhou, Hui Huang, Ziqing Zhao, Lvyuan Han, Huicheng Wang, Kehai Chen, Muyun Yang, Wei Bao, Jian Dong, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao

AI总结 本文提出PSN-IRT框架,用于评估大语言模型基准的有效性,揭示现有基准的测量缺陷,并展示如何构建更符合人类偏好的小型基准。

Comments Accepted to AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10591 2026-01-16 cs.LG cs.AI q-fin.RM q-fin.TR

ProbFM: Probabilistic Time Series Foundation Model with Uncertainty Decomposition

ProbFM:具有不确定性分解的概率时间序列基础模型

Arundeep Chinta, Lucas Vinh Tran, Jay Katukuri

AI总结 ProbFM提出一种基于变压器的概率模型,利用深度证据回归实现理论基础的不确定性分解,提升金融预测的准确性和不确定性量化能力。

Comments Accepted for oral presentation at the AI Meets Quantitative Finance Workshop at ICAIF 2025. An enhanced version was accepted for oral presentation at the AI for Time Series Analysis Workshop at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10328 2026-01-16 cs.LG

Meta Dynamic Graph for Traffic Flow Prediction

元动态图用于交通流预测

Yiqing Zou, Hanning Yuan, Qianyu Yang, Ziqiang Yuan, Shuliang Wang, Sijie Ruan

AI总结 本文提出元动态图框架,通过动态图结构建模交通流的时空动态,解决传统方法在动态建模和异质性捕捉上的局限性。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21789 2026-01-16 cs.CL cs.AI cs.CV cs.HC

Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning

五年 SciCap:我们学到了什么以及科学图表描述的未来方向

Ting-Hao 'Kenneth' Huang, Ryan A. Rossi, Sungchul Kim, Tong Yu, Ting-Yao E. Hsu, Ho Yin, Ng, C. Lee Giles

AI总结 SciCap项目通过五年研究总结了科学图表描述领域的技术经验,并提出了未来研究的五个关键方向。

Comments Accepted to the 5th Annual AAAI Workshop on AI to Accelerate Science and Engineering (AI2ASE 2026). SciCap Website: http://scicap.ai/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14409 2026-01-16 cs.DS

Cost-Free Neutrality for the River Method

河方法的无成本中立性

Michelle Döring, Jannes Malanowski, Stefan Neubert

AI总结 河方法通过并行宇宙平局打破算法在多项式时间内计算胜者,克服了排名对方法的NP难问题,展示了河方法在结构上的优势。

Comments appears at AAAI 2026. V2 Change Notes: in the experiment section changed election generation parameter for more realistic elections, results unchanged; corrected pref_voting reference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09607 2026-01-16 cs.RO cs.CV

UrbanNav: Learning Language-Guided Urban Navigation from Web-Scale Human Trajectories

UrbanNav: 从网络级人类轨迹学习语言引导的城市导航

Yanghong Mei, Yirong Yang, Longteng Guo, Qunbo Wang, Ming-Ming Yu, Xingjian He, Wenjun Wu, Jing Liu

AI总结 UrbanNav通过大规模网络视频数据训练具身智能体,实现基于语言指令的复杂城市导航,展示了在多样城市场景中的高效导航能力。

Comments 9 pages, 5 figures, accepted to AAAI 2026. Project page:https://github.com/CASIA-IVA-Lab/UrbanNav

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20923 2026-01-16 cs.NE cs.AI

Pareto-Grid-Guided Large Language Models for Fast and High-Quality Heuristics Design in Multi-Objective Combinatorial Optimization

基于帕累托网格的大型语言模型在多目标组合优化中快速高质量启发式设计

Minh Hieu Ha, Hung Phan, Tung Duy Doan, Tung Dao, Dao Tran, Huynh Thi Thanh Binh

AI总结 基于帕累托网格的LLM改进方法,用于多目标组合优化中高效高质量启发式设计。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14375 2026-01-16 cs.LG cs.AI

Advancing Safe Mechanical Ventilation Using Offline RL With Hybrid Actions and Clinically Aligned Rewards

通过离线强化学习与混合动作和临床对齐奖励推进安全机械通气

Muhammad Hamza Yousuf, Jason Li, Sahar Vahdati, Raphael Theilen, Jakob Wittenstein, Jens Lehmann

机构 * Amazon(亚马逊)

AI总结 本文提出了一种基于离线强化学习与混合动作空间的AI方法,通过临床对齐奖励函数优化机械通气设置,提升安全性和临床效果。

Comments Accepted to AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07266 2026-01-16 cs.CV

RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation

RS2-SAM2:为指向遥感图像分割定制的SAM2

Fu Rong, Meng Lan, Qian Zhang, Lefei Zhang

AI总结 RS2-SAM2通过结合遥感特征和文本特征,改进SAM2以实现更精确的遥感图像分割。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17772 2026-01-16 cs.LG cs.CR stat.ML

An Improved Privacy and Utility Analysis of Differentially Private SGD with Bounded Domain and Smooth Losses

改进的差分隐私分析:具有有界域和光滑损失的差分隐私随机梯度下降

Hao Liang, Wanrong Zhang, Xinlei He, Kaishun Wu, Hong Xing

机构 * UST

AI总结 本文改进了差分隐私随机梯度下降的隐私和效用分析,针对有界域和光滑损失函数,揭示了隐私损失收敛机制及隐私效用权衡的理论界。

Comments 19 pages, 5 figures, accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12991 2026-01-16 cs.CE q-fin.TR

Controllable Financial Market Generation with Diffusion Guided Meta Agent

受扩散引导的元代理可控金融市场生成

Yu-Hao Huang, Chang Xu, Yang Liu, Weiqing Liu, Wu-Jun Li, Jiang Bian

AI总结 本文提出DigMA模型,通过扩散引导元代理生成可控且保真度高的金融市场,适用于高频交易任务。

Comments To appear in The Fortieth AAAI Conference on Artificial Intelligence (AAAI-26 Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.06080 2026-01-16 cs.CV

Spatial As Deep: Spatial CNN for Traffic Scene Understanding

空间作为深度:用于交通场景理解的空间CNN

Xingang Pan, Xiaohang Zhan, Jianping Shi, Ping Luo, Xiaogang Wang, Xiaoou Tang

机构 * The Chinese University of Hong Kong(香港中文大学) SenseTime Group Limited(时光集团)

AI总结 本文提出空间CNN用于交通场景理解,通过改进卷积结构提升车道检测性能,实现8.7%和4.6%的提升,并在挑战赛中取得第一名。

Comments Accepted to AAAI 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10089 2026-01-16 cs.LG

Bayesian Meta-Analyses Could Be More: A Case Study in Trial of Labor After a Cesarean-section Outcomes and Complications

贝叶斯元分析可能更:关于剖宫产术后试产结果和并发症的案例研究

Ashley Klein, Edward Raff, Marcia DesJardin

AI总结 本文提出了一种贝叶斯方法,用于分析剖宫产术后试产的结果和并发症,以确定正效应的主张是否仍然成立,并帮助医生做出更有效的临床决策。

Comments To appear in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏