arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence

2025-12-23 至 2025-12-23 共收录 24
2512.19363 2025-12-23 cs.LG

From Points to Coalitions: Hierarchical Contrastive Shapley Values for Prioritizing Data Samples

从点到联盟:用于优先级数据样本的分层对比Shapley值

Canran Xiao, Jiabao Dou, Zhiming Lin, Zong Ke, Liwei Hou

AI总结 HCDV通过分层对比方法高效评估数据样本价值,提升模型准确性并优化计算效率。

Comments AAAI'26 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19355 2025-12-23 cs.AI

First-Order Representation Languages for Goal-Conditioned RL

面向目标的强化学习中的第一阶表示语言

Simon Ståhlberg, Hector Geffner

AI总结 本文提出利用第一阶表示语言在面向目标的强化学习中学习通用策略,通过自动创建目标课程提升性能。

Comments In Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19088 2025-12-23 cs.CV

Retrieving Objects from 3D Scenes with Box-Guided Open-Vocabulary Instance Segmentation

通过框引导的开放词汇实例分割从3D场景中检索物体

Khanh Nguyen, Dasith de Silva Edirimuni, Ghulam Mubashar Hassan, Ajmal Mian

AI总结 本文提出了一种基于2D开放词汇检测器引导的3D实例分割方法,用于从RGB图像中快速准确检索稀有物体实例。

Comments Accepted to AAAI 2026 Workshop on New Frontiers in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18684 2025-12-23 cs.CV

A Study of Finetuning Video Transformers for Multi-view Geometry Tasks

对多视角几何任务进行视频变换器微调的研究

Huimin Wu, Kwang-Ting Cheng, Stephen Lin, Zhirong Wu

AI总结 本文通过微调视频基础模型,提出了一种简单有效的方法,实现了多视角几何任务如光流估计的高性能表现。

Comments AAAI 20206, Project website: geovit-aaai26.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18623 2025-12-23 cs.CL cs.AI

LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination Correction

LLM-CAS: 动态神经元扰动用于实时幻觉修正

Jensen Zhang, Ningyuan Liu, Yijia Fan, Zihao Huang, Qinglin Zeng, Kaitong Cai, Jian Wang, Keze Wang

机构 * Sun Yat-sen University(中山大学) Snap Inc(Snap公司)

AI总结 LLM-CAS通过动态神经元扰动实现实时幻觉修正,提升大型语言模型的事实准确性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16244 2025-12-23 cs.LG cs.AI

Coarse-to-Fine Open-Set Graph Node Classification with Large Language Models

粗到细的开放式图节点分类与大语言模型

Xueqi Ma, Xingjun Ma, Sarah Monazam Erfani, Danilo Mandic, James Bailey

AI总结 本文提出CFC框架,利用大语言模型实现图节点的粗到细开放式分类,提升OOD检测和分类性能。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20431 2025-12-23 cs.CV cs.RO

BRIC: Bridging Kinematic Plans and Physical Control at Test Time

BRIC: 在测试时弥合运动计划与物理控制之间的差距

Dohun Lim, Minji Kim, Jaewoon Lim, Sungchan Kim

AI总结 BRIC通过结合测试时适应与轻量级引导机制,实现长期人体运动生成的物理合理性和一致性。

Comments Accepted to AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20277 2025-12-23 cs.LG cs.AI

HVAdam: A Full-Dimension Adaptive Optimizer

HVAdam:一种全维度自适应优化器

Yiheng Zhang, Shaowu Wu, Yuanzhuo Xu, Jiajun Wu, Shang Xu, Steve Drew, Xiaoguang Niu

AI总结 HVAdam提出一种具有连续可调自适应性的新型优化器,通过增量延迟更新机制提升收敛性与鲁棒性,在多种任务中超越现有优化器。

Comments Accepted at AAAI2025

Journal ref In Proceedings of the AAAI Conference on Artificial Intelligence, volume 39, pp. 22623-22631, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17582 2025-12-23 cs.LG cs.AI

GateRA: Token-Aware Modulation for Parameter-Efficient Fine-Tuning

GateRA:基于令牌的调制用于参数高效微调

Jie Ou, Shuaihong Jiang, Yingjun Du, Cees G. M. Snoek

AI总结 GateRA通过引入令牌感知调制,实现参数高效微调中的动态更新调整,提升模型适应性和效率。

Comments Accepted by AAAI 2026

Journal ref AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13031 2025-12-23 cs.CV

Towards 3D Object-Centric Feature Learning for Semantic Scene Completion

面向语义场景补全的3D物体感知特征学习

Weihua Wang, Yubo Cui, Xiangru Lin, Zhiheng Li, Zheng Fang

AI总结 本文提出Ocean框架,通过分解场景为独立物体实例,提升语义场景补全的精度和性能。

Comments Accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08029 2025-12-23 cs.IR cs.CL

BiCA: Effective Biomedical Dense Retrieval with Citation-Aware Hard Negatives

BiCA: 基于引用感知的生物医学密集检索

Aarush Sinha, Pavan Kumar S, Roshan Balaji, Nirav Pravinbhai Bhatt

机构 * University of Copenhagen(哥本哈根大学)

AI总结 BiCA通过利用引用链接生成引用感知硬负样本,提升生物医学领域密集检索性能,实现零样本检索和长尾主题的优越表现。

Comments Accepted for oral presentation at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19121 2025-12-23 cs.CV

Preserving Topological and Geometric Embeddings for Point Cloud Recovery

保持拓扑和几何嵌入以恢复点云

Kaiyue Zhou, Zelong Tan, Hongxiao Wang, Ya-Li Li, Shengjin Wang

AI总结 本文提出TopGeoFormer架构,通过融合拓扑和几何嵌入提升点云恢复性能。

Comments Accepted to AAAI 202

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10190 2025-12-23 cs.AI cs.LO

Temporal Causal Reasoning with (Non-Recursive) Structural Equation Models

基于(非递归)结构方程模型的时序因果推理

Maksim Gladyshev, Natasha Alechina, Mehdi Dastani, Dragan Doder, Brian Logan

AI总结 本文提出了一种基于非递归结构方程模型的时序因果推理方法,引入CPLTL逻辑以处理反馈回路和相互依赖过程,并展示了其高效的模型检查能力。

Comments This is an extended version of the same title paper published in the proceeding of AAAI-25 conference (Gladyshev et al. 2025). This version contains an additional section, in which we introduce TSEMs with arbitrary long temporal delays between causal dependencies and prove that these models are equivalent to TSEMs with 1-step delays only introduced in the original version of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08971 2025-12-23 cs.CL

Structured Language Generation Model: Loss Calibration and Formatted Decoding for Robust Structure Prediction and Knowledge Retrieval

结构语言生成模型:损失校准与格式解码以实现稳健的结构预测与知识检索

Minho Lee, Junghyun Min, Yerang Kim, Woochul Lee, Yeonsoo Lee

机构 * KT Gen AI Lab(KT生成人工智能实验室) Georgetown University(乔治城大学) Korea University(韩国大学) NC AI(NC人工智能)

AI总结 SLGM通过损失校准和格式解码提升结构预测和知识检索性能,无需额外参数或数据集特定工程。

Comments 20 pages, 4 figures. FrontierIR at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18554 2025-12-23 cs.CV cs.AI

Enhancing Medical Large Vision-Language Models via Alignment Distillation

通过对齐蒸馏增强医学大视觉-语言模型

Aofei Chang, Ting Wang, Fenglong Ma

AI总结 本文提出MEDALIGN方法,通过蒸馏CLIP模型的知识提升医学大视觉-语言模型的视觉对齐和生成质量。

Comments Accepted to AAAI'2026 (Main track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18265 2025-12-23 cs.AI

Intelligent Human-Machine Partnership for Manufacturing: Enhancing Warehouse Planning through Simulation-Driven Knowledge Graphs and LLM Collaboration

智能人机协作制造:通过仿真驱动的知识图谱与大语言模型协作提升仓库规划

Himabindu Thogaru, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

AI总结 本研究提出通过仿真驱动的知识图谱与大语言模型协作,提升制造业仓库规划的智能化水平,实现人机高效协作以优化运营决策。

Comments 13 pages, 2 figures, accepted for oral presentation at AAAI Human Machine Collaboration Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18014 2025-12-23 cs.CL cs.AI cs.LG

ReGal: A First Look at PPO-based Legal AI for Judgment Prediction and Summarization in India

ReGal:基于PPO的法律AI在印度判决预测和摘要中的初步探索

Shubham Kumar Nigam, Tanuj Tyagi, Siddharth Shukla, Aditya Kumar Guru, Balaramamahanthi Deepak Patnaik, Danush Khanna, Noel Shallum, Kripabandhu Ghosh, Arnab Bhattacharya

AI总结 ReGal通过PPO结合多任务指令微调与强化学习,探索法律AI在印度判决预测和摘要中的应用,揭示了强化学习在法律文本中的挑战与潜力。

Comments Accepted in AILaw @ AAAI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18004 2025-12-23 cs.CV cs.AI cs.CL cs.LG

Seeing Justice Clearly: Handwritten Legal Document Translation with OCR and Vision-Language Models

清晰地看见正义:结合OCR和视觉-语言模型的 handwritten 法律文件翻译

Shubham Kumar Nigam, Parjanya Aditya Shukla, Noel Shallum, Arnab Bhattacharya

AI总结 本文提出利用视觉大语言模型统一OCR与机器翻译流程,以提升低资源环境下手写法律文件的翻译效率和准确性。

Comments Accepted in AILaw @ AAAI 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17946 2025-12-23 cs.SD cs.AI cs.MM

Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion Recognition

让模型学会感受:基于模式的音调注入用于符号音乐情感识别

Haiying Xia, Zhongyi Huang, Yumei Tan, Shuxiang Song

AI总结 本文提出模式引导的音调注入方法,通过引入心理模式见解提升符号音乐情感识别的准确率。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01701 2025-12-23 cs.CV

SSR: Semantic and Spatial Rectification for CLIP-based Weakly Supervised Segmentation

SSR:基于CLIP的弱监督分割的语义与空间校正

Xiuli Bi, Die Xiao, Junchao Fan, Bin Xiao

AI总结 本文提出SSR方法,通过语义与空间校正提升CLIP在弱监督分割中的性能,实现更高的mIoU分数。

Comments Accepted in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13524 2025-12-23 cs.AI cs.HC

FreeAskWorld: An Interactive and Closed-Loop Simulator for Human-Centric Embodied AI

FreeAskWorld: 一种面向人类的交互式闭环模拟器用于具身人工智能

Yuhang Peng, Yizhou Pan, Xinning He, Jihaoyu Yang, Xinyu Yin, Han Wang, Xiaoji Zheng, Chao Gao, Jiangtao Gong

AI总结 FreeAskWorld通过整合大语言模型和交互式闭环模拟,提升具身人工智能在复杂社会行为和自然交互中的表现。

Comments 9 pages, 4 figures

Journal ref AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09854 2025-12-23 cs.CL

TermGPT: Multi-Level Contrastive Fine-Tuning for Terminology Adaptation in Legal and Financial Domain

TermGPT:面向法律和金融领域术语适应的多级对比微调

Yidan Sun, Mengying Zhu, Feiyue Chen, Yangyang Wu, Xiaolei Dan, Mengyuan Yang, Xiaolin Zheng, Shenglin Ben

AI总结 TermGPT通过多级对比微调提升法律和金融领域术语区分能力,构建首个金融术语数据集并优于现有基线。

Comments 13 pages, 4 figures, AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04939 2025-12-23 cs.CV

Verb Mirage: Unveiling and Assessing Verb Concept Hallucinations in Multimodal Large Language Models

动词幻觉:揭示和评估多模态大语言模型中的动词概念幻觉

Zehao Wang, Xinpeng Liu, Yudonglin Zhang, Xiaoqian Wu, Zhou Fang, Yifan Fang, Junfu Pu, Cewu Lu, Yong-Lu Li

AI总结 本文首次揭示多模态大语言模型中的动词概念幻觉问题,并提出基于丰富动词知识的调优方法以有效缓解该问题。

Comments Accepted by AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏