arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence

共收录 9565
2512.11239 2025-12-30 cs.CV

Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition

跨模态提示用于平衡不完整多模态情绪识别

Wen-Jue He, Xiaofeng Zhu, Zheng Zhang

AI总结 本文提出跨模态提示方法,通过增强模态特定特征和动态加权提升多模态情绪识别的准确性和鲁棒性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21921 2025-12-29 cs.CV cs.IR cs.LG

AutoPP: Towards Automated Product Poster Generation and Optimization

AutoPP:迈向自动化产品海报生成与优化

Jiahao Fan, Yuxin Qin, Wei Feng, Yanyin Chen, Yaoyu Li, Ao Ma, Yixiu Li, Li Zhuang, Haoyi Bian, Zheng Zhang, Jingjing Lv, Junjie Shen, Ching Law

机构 * Project Leader and Corresponding Author(项目负责人及通讯作者)

AI总结 AutoPP 通过自动化流程生成和优化产品海报,利用统一设计模块和元素渲染模块,结合在线反馈提升点击通过率,实现高质量的海报生成与优化。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21871 2025-12-29 cs.CL cs.AI cs.CR cs.CY

Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?

弥合版权鸿沟:大型视觉-语言模型是否能识别并尊重受版权保护的内容?

Naen Xu, Jinghuai Zhang, Changjiang Li, Hengyu An, Chunyi Zhou, Jun Wang, Boyu Xu, Yuyuan Li, Tianyu Du, Shouling Ji

AI总结 本文研究大型视觉-语言模型在处理受版权保护内容时的合规性问题,提出了一种新的工具增强防御框架以降低侵权风险。

Comments AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21859 2025-12-29 cs.CL

TimeBill: Time-Budgeted Inference for Large Language Models

TimeBill: 为大语言模型设计的时间预算推理方法

Qi Fan, An Zou, Yehan Ma

AI总结 TimeBill提出了一种时间预算推理框架,通过细粒度响应长度预测和执行时间估计,提升大语言模型在时间敏感任务中的效率和响应性能。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18286 2025-12-29 cs.CV

RoadSceneVQA: Benchmarking Visual Question Answering in Roadside Perception Systems for Intelligent Transportation System

RoadSceneVQA: 用于智能交通系统 roadside 系统的视觉问答基准测试

Runwei Guan, Rongsheng Hu, Shangshu Chen, Ningyuan Xiao, Xue Xia, Jiayang Liu, Beibei Chen, Ziren Tang, Ningwei Ouyang, Shaofeng Liang, Yuxuan Fan, Wanjie Sun, Yutao Yue

AI总结 RoadSceneVQA 通过大规模标注数据和 CogniAnchor 融合模块,提升多模态大语言模型在交通感知与推理任务中的性能。

Comments 10 pages, 6 figures, accepted by AAAI 2026. The model is also called Dream, to the other me in the world forever

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21855 2025-12-29 cs.AI cs.CL cs.LG cs.MA

SIGN: Schema-Induced Games for Naming

SIGN:基于模式的命名游戏

Ryan Zhang, Herbert Woisetschläger

AI总结 SIGN通过引入轻量结构引导惯例形成,提升了多代理协调效率,其在命名游戏中展示了更高的收敛速度和一致性。

Comments AAAI 2026 Student Abstract (Oral). Code available ar https://github.com/ryanzhangofficial/schema-induced-games-for-naming

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04440 2025-12-29 cs.CL cs.AI cs.LG

StepFun-Formalizer: Unlocking the Autoformalization Potential of LLMs through Knowledge-Reasoning Fusion

StepFun-Formalizer: 通过知识推理融合解锁大语言模型的自动形式化潜力

Yutong Wu, Di Huang, Ruosi Wan, Yue Peng, Shijie Shang, Chenrui Cao, Lei Qi, Rui Zhang, Zidong Du, Jie Yan, Xing Hu

AI总结 StepFun-Formalizer通过知识推理融合提升大语言模型的自动形式化能力,在FormalMATH-Lite和ProverBench上取得最佳成绩。

Comments AAAI 2026 Oral. Extended version with full appendix, 25 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21707 2025-12-29 cs.CV

Spatiotemporal-Untrammelled Mixture of Experts for Multi-Person Motion Prediction

时空无约束专家混合模型用于多人动作预测

Zheng Yin, Chengjian Li, Xiangbo Shu, Meiqi Cao, Rui Yan, Jinhui Tang

AI总结 本文提出ST-MoE模型,通过引入双向时空Mamba专家,有效捕捉多人动作的复杂时空依赖,提升预测精度并降低计算成本。

Comments 12 pages, 7 figures, Accepted by AAAI 2026 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21613 2025-12-29 cs.AI

AMS-IO-Bench and AMS-IO-Agent: Benchmarking and Structured Reasoning for Analog and Mixed-Signal Integrated Circuit Input/Output Design

AMS-IO-Bench 和 AMS-IO-Agent:用于模拟和混合信号集成电路输入/输出设计的基准测试与结构化推理

Zhishuai Zhang, Xintian Li, Shilong Liu, Aodong Zhang, Lu Jie, Nan Sun

AI总结 本文提出 AMS-IO-Agent 和 AMS-IO-Bench,通过结构化推理提升模拟和混合信号集成电路输入/输出设计效率,实现高通过率和缩短设计周期。

Comments 8 pages, 5 figures. Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21562 2025-12-29 cs.CV cs.AI

Exploration of Reproducible Generated Image Detection

可重复生成图像检测探索

Yihang Duan

AI总结 本研究通过重现AIGC检测方法,揭示了可重复性差的根本原因,并为提高检测技术的可重复性和泛化能力提供了实证依据。

Comments AAAI workshop RAI accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21542 2025-12-29 cs.CV

Vision Transformers are Circulant Attention Learners

视觉Transformer是循环注意力学习者

Dongchen Han, Tianyu Li, Ziyi Wang, Gao Huang

AI总结 本文提出循环注意力机制,通过利用自注意力的内在高效模式,实现O(N log N)的计算复杂度并保持标准自注意力的容量,为视觉Transformer提供新的高效替代方案。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21354 2025-12-29 cs.CR cs.AI cs.SE

Reflection-Driven Control for Trustworthy Code Agents

基于反射的可信代码代理控制

Bin Wang, Jiazheng Quan, Xingrui Yu, Hansen Hu, Yuhao, Ivor Tsang

AI总结 本文提出反射驱动控制方法,通过内部反思循环提升代码生成的安全性和合规性,实现自主、安全且可审计的AI代码代理。

Comments Accepted to AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23022 2025-12-29 cs.CV

Copyright Infringement Detection in Text-to-Image Diffusion Models via Differential Privacy

通过差分隐私在文本到图像扩散模型中检测版权侵权

Xiafeng Man, Zhipeng Wei, Jingjing Chen

AI总结 本文提出DPM框架,通过差分隐私概念检测文本到图像扩散模型中的版权侵权,无需原始数据集即可实现可靠检测。

Comments AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21019 2025-12-29 cs.CV

Phased One-Step Adversarial Equilibrium for Video Diffusion Models

相位单步对抗均衡用于视频扩散模型

Jiaxiang Cheng, Bing Ma, Xuhua Ren, Hongyi Henry Jin, Kai Yu, Peng Zhang, Wenyue Li, Yuan Zhou, Tianxiang Zheng, Qinglin Lu

AI总结 V-PAE通过相位单步对抗均衡方法提升大规模视频模型的生成质量与效率,实现高质量视频生成并显著降低扩散延迟。

Comments Accepted by AAAI 2026. Project Page: https://v-pae.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02227 2025-12-29 cs.LG

PhysicsCorrect: A Training-Free Approach for Stable Neural PDE Simulations

PhysicsCorrect: 一种无需训练的稳定神经PDE模拟方法

Xinquan Huang, Paris Perdikaris

AI总结 PhysicsCorrect通过无需训练的修正框架,有效减少神经PDE模拟中的预测误差,提升稳定性与物理准确性。

Comments AAAI 2026 Oral

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21241 2025-12-25 cs.LG cs.AI cs.CR cs.CV

Improving the Convergence Rate of Ray Search Optimization for Query-Efficient Hard-Label Attacks

提升查询效率的射线搜索优化在硬标签攻击中的收敛速度

Xinjie Xu, Shuyu Cheng, Dongwei Xu, Qi Xuan, Chen Ma

AI总结 本文提出ARS-OPT和PARS-OPT算法,通过优化射线搜索方向提升硬标签攻击的收敛速度和查询效率。

Comments Published at AAAI 2026 (Oral). This version corresponds to the conference proceedings; v2 will include the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21215 2025-12-25 eess.AS

USE: A Unified Model for Universal Sound Separation and Extraction

USE: 一种统一的通用声音分离与提取模型

Hongyu Wang, Chenda Li, Xin Zhou, Shuai Wang, Yanmin Qian

AI总结 本文提出USE模型,通过统一框架结合声音分离与目标声音提取,提升两者性能,实验显示在SS和TSE任务中分别取得1.4 dB SDR提升和86%准确率。

Comments Accepted as an oral presentation by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21104 2025-12-25 cs.CV

FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting

FreeInpaint: 图像修复中无调优的提示对齐与视觉合理性增强

Chao Gong, Dong Li, Yingwei Pan, Jingjing Chen, Ting Yao, Tao Mei

AI总结 FreeInpaint通过无调优的扩散潜在特征优化方法,提升图像修复的提示对齐和视觉合理性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21021 2025-12-25 cs.IR cs.LG

Towards Better Search with Domain-Aware Text Embeddings for C2C Marketplaces

面向C2C市场向更好搜索的领域感知文本嵌入

Andre Rusli, Miao Cao, Shoma Ishimoto, Sho Akiyama, Max Frenzel

AI总结 本文提出领域感知的文本嵌入方法,通过优化C2C市场places的搜索质量,提升相关性和效率,为更丰富的LLM时代搜索体验奠定基础。

Comments 5 pages, AAAI 2026 Workshop on New Frontiers in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20921 2025-12-25 cs.CV

Self-supervised Multiplex Consensus Mamba for General Image Fusion

自监督多乘共识Mamba用于通用图像融合

Yingying Wang, Rongjin Zhuang, Hui Zheng, Xuanhua He, Ke Cao, Xiaotong Tu, Xinghao Ding

AI总结 SMC-Mamba通过自监督多乘共识机制提升通用图像融合性能,有效整合多模态信息并优化下游任务表现。

Comments Accepted by AAAI 2026, 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20781 2025-12-25 cs.IR

Soft Filtering: Guiding Zero-shot Composed Image Retrieval with Prescriptive and Proscriptive Constraints

软过滤:通过规劝性与禁止性约束指导零样本复合图像检索

Youjin Jung, Seongwoo Cho, Hyun-seok Min, Sungchul Choi

AI总结 本文提出SoFT方法,通过规劝性和禁止性约束提升零样本复合图像检索的准确性与鲁棒性。

Comments Accepted to AAAI 2026 Workshop on New Frontiers in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17129 2025-12-25 cs.CL cs.AI

Learning to Compress: Unlocking the Potential of Large Language Models for Text Representation

学习压缩:解锁大型语言模型在文本表示中的潜力

Yeqin Zhang, Yizheng Zhao, Chen Hu, Binxing Jiao, Daxin Jiang, Ruihang Miao, Cam-Tu Nguyen

AI总结 本文提出通过上下文压缩作为预训练任务来提升大型语言模型的文本表示能力,实验表明其在多种任务中优于传统方法。

Comments Accepted by AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14368 2025-12-25 cs.CV cs.CL cs.LG

O3SLM: Open Weight, Open Data, and Open Vocabulary Sketch-Language Model

O3SLM:开放权重、开放数据和开放词汇草图-语言模型

Rishi Gupta, Mukilan Karuppasamy, Shyam Marjit, Aditay Tripathi, Anirban Chakraborty

机构 * IISc(印度理工学院)

AI总结 O3SLM通过构建大规模图像-草图-指令三元组数据集和训练模型,实现了对草图理解和推理的突破性进展。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11767 2025-12-25 cs.LG cs.CY

Learning Fair Representations with Kolmogorov-Arnold Networks

利用柯尔莫戈罗夫-阿诺尔德网络学习公平表示

Amisha Priyadarshini, Sergio Gago-Masague

AI总结 本文提出利用柯尔莫戈罗夫-阿诺尔德网络在公平对抗学习框架中实现公平表示,通过理论分析和实证研究提升公平性与预测准确性的平衡。

Comments This article has been accepted at AAAI-26 (The 40th Annual AAAI Conference on Artificial Intelligence)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09141 2025-12-25 cs.RO

RGMP: Recurrent Geometric-prior Multimodal Policy for Generalizable Humanoid Robot Manipulation

RGMP: 基于几何先验的多模态策略用于通用人形机器人操作

Xuetao Li, Wenke Huang, Nengyuan Pan, Kaiyan Zhao, Songhua Yang, Yiming Wang, Mengde Li, Mang Ye, Jifeng Xuan, Miao Li

AI总结 RGMP通过结合几何-语义推理与递归高斯适应,实现了高效的人形机器人多模态操作控制。

Journal ref Proceedings of the AAAI conference on artificial intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18736 2025-12-25 cs.CV

Rethinking Direct Preference Optimization in Diffusion Models

重新思考扩散模型中的直接偏好优化

Junyong Kang, Seohyun Lim, Kyungjune Baek, Hyunjung Shim

AI总结 本文提出了一种改进扩散模型偏好优化的方法,通过稳定参考模型更新和时间步感知训练策略,提升模型在人类偏好评估中的性能。

Comments Accepted by SPIGM@NeurIPS 2025 and AAAI-26 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20185 2025-12-25 cs.CY cs.LG

AI Supply Chains: An Emerging Ecosystem of AI Actors, Products, and Services

AI供应链:人工智能行为者、产品和服务的新兴生态系统

Aspen Hopkins, Sarah H. Cen, Andrew Ilyas, Isabella Struckman, Luis Videgaray, Aleksander Mądry

AI总结 本文研究了人工智能供应链的形成与影响,通过案例分析揭示了供应链中信息传递的不完善及上游设计对下游的连锁影响。

Comments 27 pages, 8 figures

Journal ref Proc. AAAI/ACM Conf. AI Ethics Soc. (AIES), 8(2), 1266-1277 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20572 2025-12-24 cs.LO

The Limitations and Power of NP-Oracle-Based Functional Synthesis Techniques

基于NP预言机的功能合成技术的局限性与能力

Brendan Juba, Kuldeep S. Meel

AI总结 本文研究了基于NP预言机的功能合成技术的理论局限性与能力,证明了NP预言机对于高效合成的必要性,并展示了在特定规范下合成小斯科伦函数的可行性。

Comments The conference version of the paper will appear in Proceedings of AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20292 2025-12-24 cs.CL cs.AI cs.MM

SlideTailor: Personalized Presentation Slide Generation for Scientific Papers

SlideTailor: 科学论文个性化演示文稿生成

Wenzheng Zeng, Mingyu Ouyang, Langyuan Cui, Hwee Tou Ng

AI总结 SlideTailor通过用户指定的偏好生成个性化科学论文演示文稿,结合人类行为启发的代理框架和语音链机制,提升生成质量与应用效果。

Comments AAAI 2026 (with appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20026 2025-12-24 cs.CV

MAPI-GNN: Multi-Activation Plane Interaction Graph Neural Network for Multimodal Medical Diagnosis

MAPI-GNN:多激活平面交互图神经网络用于多模态医学诊断

Ziwei Qin, Xuhui Song, Deqing Huang, Na Qin, Jun Li

机构 * Ziwei Qin(独立研究者) Xuhui Song(独立研究者) Deqing Huang(独立研究者) Na Qin(独立研究者) Jun Li(独立研究者)

AI总结 MAPI-GNN通过多激活平面交互机制,有效建模患者特异性病理关系,提升多模态医学诊断的准确性。

Comments Accepted by Proceedings of the AAAI Conference on Artificial Intelligence 40 (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏