Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition
跨模态提示用于平衡不完整多模态情绪识别
AI总结 本文提出跨模态提示方法,通过增强模态特定特征和动态加权提升多模态情绪识别的准确性和鲁棒性。
Comments Accepted by AAAI 2026
期刊&会议
AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence
跨模态提示用于平衡不完整多模态情绪识别
AI总结 本文提出跨模态提示方法,通过增强模态特定特征和动态加权提升多模态情绪识别的准确性和鲁棒性。
Comments Accepted by AAAI 2026
AutoPP:迈向自动化产品海报生成与优化
机构 * Project Leader and Corresponding Author(项目负责人及通讯作者)
AI总结 AutoPP 通过自动化流程生成和优化产品海报,利用统一设计模块和元素渲染模块,结合在线反馈提升点击通过率,实现高质量的海报生成与优化。
Comments Accepted to AAAI 2026
弥合版权鸿沟:大型视觉-语言模型是否能识别并尊重受版权保护的内容?
AI总结 本文研究大型视觉-语言模型在处理受版权保护内容时的合规性问题,提出了一种新的工具增强防御框架以降低侵权风险。
Comments AAAI 2026 (Oral)
TimeBill: 为大语言模型设计的时间预算推理方法
AI总结 TimeBill提出了一种时间预算推理框架,通过细粒度响应长度预测和执行时间估计,提升大语言模型在时间敏感任务中的效率和响应性能。
Comments Accepted to AAAI 2026
RoadSceneVQA: 用于智能交通系统 roadside 系统的视觉问答基准测试
AI总结 RoadSceneVQA 通过大规模标注数据和 CogniAnchor 融合模块,提升多模态大语言模型在交通感知与推理任务中的性能。
Comments 10 pages, 6 figures, accepted by AAAI 2026. The model is also called Dream, to the other me in the world forever
SIGN:基于模式的命名游戏
AI总结 SIGN通过引入轻量结构引导惯例形成,提升了多代理协调效率,其在命名游戏中展示了更高的收敛速度和一致性。
Comments AAAI 2026 Student Abstract (Oral). Code available ar https://github.com/ryanzhangofficial/schema-induced-games-for-naming
StepFun-Formalizer: 通过知识推理融合解锁大语言模型的自动形式化潜力
AI总结 StepFun-Formalizer通过知识推理融合提升大语言模型的自动形式化能力,在FormalMATH-Lite和ProverBench上取得最佳成绩。
Comments AAAI 2026 Oral. Extended version with full appendix, 25 pages, 17 figures
时空无约束专家混合模型用于多人动作预测
AI总结 本文提出ST-MoE模型,通过引入双向时空Mamba专家,有效捕捉多人动作的复杂时空依赖,提升预测精度并降低计算成本。
Comments 12 pages, 7 figures, Accepted by AAAI 2026 (oral)
AMS-IO-Bench 和 AMS-IO-Agent:用于模拟和混合信号集成电路输入/输出设计的基准测试与结构化推理
AI总结 本文提出 AMS-IO-Agent 和 AMS-IO-Bench,通过结构化推理提升模拟和混合信号集成电路输入/输出设计效率,实现高通过率和缩短设计周期。
Comments 8 pages, 5 figures. Accepted to AAAI 2026
可重复生成图像检测探索
AI总结 本研究通过重现AIGC检测方法,揭示了可重复性差的根本原因,并为提高检测技术的可重复性和泛化能力提供了实证依据。
Comments AAAI workshop RAI accepted
视觉Transformer是循环注意力学习者
AI总结 本文提出循环注意力机制,通过利用自注意力的内在高效模式,实现O(N log N)的计算复杂度并保持标准自注意力的容量,为视觉Transformer提供新的高效替代方案。
Comments AAAI 2026
基于反射的可信代码代理控制
AI总结 本文提出反射驱动控制方法,通过内部反思循环提升代码生成的安全性和合规性,实现自主、安全且可审计的AI代码代理。
Comments Accepted to AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)
通过差分隐私在文本到图像扩散模型中检测版权侵权
AI总结 本文提出DPM框架,通过差分隐私概念检测文本到图像扩散模型中的版权侵权,无需原始数据集即可实现可靠检测。
Comments AAAI 2026 (Oral)
相位单步对抗均衡用于视频扩散模型
AI总结 V-PAE通过相位单步对抗均衡方法提升大规模视频模型的生成质量与效率,实现高质量视频生成并显著降低扩散延迟。
Comments Accepted by AAAI 2026. Project Page: https://v-pae.github.io/
PhysicsCorrect: 一种无需训练的稳定神经PDE模拟方法
AI总结 PhysicsCorrect通过无需训练的修正框架,有效减少神经PDE模拟中的预测误差,提升稳定性与物理准确性。
Comments AAAI 2026 Oral
Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 2026
提升查询效率的射线搜索优化在硬标签攻击中的收敛速度
AI总结 本文提出ARS-OPT和PARS-OPT算法,通过优化射线搜索方向提升硬标签攻击的收敛速度和查询效率。
Comments Published at AAAI 2026 (Oral). This version corresponds to the conference proceedings; v2 will include the appendix
USE: 一种统一的通用声音分离与提取模型
AI总结 本文提出USE模型,通过统一框架结合声音分离与目标声音提取,提升两者性能,实验显示在SS和TSE任务中分别取得1.4 dB SDR提升和86%准确率。
Comments Accepted as an oral presentation by AAAI 2026
FreeInpaint: 图像修复中无调优的提示对齐与视觉合理性增强
AI总结 FreeInpaint通过无调优的扩散潜在特征优化方法,提升图像修复的提示对齐和视觉合理性。
Comments Accepted by AAAI 2026
面向C2C市场向更好搜索的领域感知文本嵌入
AI总结 本文提出领域感知的文本嵌入方法,通过优化C2C市场places的搜索质量,提升相关性和效率,为更丰富的LLM时代搜索体验奠定基础。
Comments 5 pages, AAAI 2026 Workshop on New Frontiers in Information Retrieval
自监督多乘共识Mamba用于通用图像融合
AI总结 SMC-Mamba通过自监督多乘共识机制提升通用图像融合性能,有效整合多模态信息并优化下游任务表现。
Comments Accepted by AAAI 2026, 9 pages, 4 figures
软过滤:通过规劝性与禁止性约束指导零样本复合图像检索
AI总结 本文提出SoFT方法,通过规劝性和禁止性约束提升零样本复合图像检索的准确性与鲁棒性。
Comments Accepted to AAAI 2026 Workshop on New Frontiers in Information Retrieval
学习压缩:解锁大型语言模型在文本表示中的潜力
AI总结 本文提出通过上下文压缩作为预训练任务来提升大型语言模型的文本表示能力,实验表明其在多种任务中优于传统方法。
Comments Accepted by AAAI'26
O3SLM:开放权重、开放数据和开放词汇草图-语言模型
机构 * IISc(印度理工学院)
AI总结 O3SLM通过构建大规模图像-草图-指令三元组数据集和训练模型,实现了对草图理解和推理的突破性进展。
Comments Accepted to AAAI 2026
利用柯尔莫戈罗夫-阿诺尔德网络学习公平表示
AI总结 本文提出利用柯尔莫戈罗夫-阿诺尔德网络在公平对抗学习框架中实现公平表示,通过理论分析和实证研究提升公平性与预测准确性的平衡。
Comments This article has been accepted at AAAI-26 (The 40th Annual AAAI Conference on Artificial Intelligence)
RGMP: 基于几何先验的多模态策略用于通用人形机器人操作
AI总结 RGMP通过结合几何-语义推理与递归高斯适应,实现了高效的人形机器人多模态操作控制。
Journal ref Proceedings of the AAAI conference on artificial intelligence, 2026
重新思考扩散模型中的直接偏好优化
AI总结 本文提出了一种改进扩散模型偏好优化的方法,通过稳定参考模型更新和时间步感知训练策略,提升模型在人类偏好评估中的性能。
Comments Accepted by SPIGM@NeurIPS 2025 and AAAI-26 (Oral)
AI供应链:人工智能行为者、产品和服务的新兴生态系统
AI总结 本文研究了人工智能供应链的形成与影响,通过案例分析揭示了供应链中信息传递的不完善及上游设计对下游的连锁影响。
Comments 27 pages, 8 figures
Journal ref Proc. AAAI/ACM Conf. AI Ethics Soc. (AIES), 8(2), 1266-1277 (2025)
基于NP预言机的功能合成技术的局限性与能力
AI总结 本文研究了基于NP预言机的功能合成技术的理论局限性与能力,证明了NP预言机对于高效合成的必要性,并展示了在特定规范下合成小斯科伦函数的可行性。
Comments The conference version of the paper will appear in Proceedings of AAAI 2026
SlideTailor: 科学论文个性化演示文稿生成
AI总结 SlideTailor通过用户指定的偏好生成个性化科学论文演示文稿,结合人类行为启发的代理框架和语音链机制,提升生成质量与应用效果。
Comments AAAI 2026 (with appendix)
MAPI-GNN:多激活平面交互图神经网络用于多模态医学诊断
机构 * Ziwei Qin(独立研究者) ; Xuhui Song(独立研究者) ; Deqing Huang(独立研究者) ; Na Qin(独立研究者) ; Jun Li(独立研究者)
AI总结 MAPI-GNN通过多激活平面交互机制,有效建模患者特异性病理关系,提升多模态医学诊断的准确性。
Comments Accepted by Proceedings of the AAAI Conference on Artificial Intelligence 40 (AAAI-26)