arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5035 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 5035 篇

2510.23010 2026-01-13 cs.SE 50%

TALM: Dynamic Tree-Structured Multi-Agent Framework with Long-Term Memory for Scalable Code Generation

TALM:具有长期记忆的动态树结构多智能体框架用于可扩展的代码生成

Ming-Tung Shen, Yuh-Jzer Joung

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 TALM通过动态树结构多智能体框架结合长期记忆机制,提升复杂代码生成任务中的推理性能和令牌效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05688 2026-01-12 cs.CV 50%

SketchVL: Policy Optimization via Fine-Grained Credit Assignment for Chart Understanding and More

SketchVL:通过细粒度信用分配进行政策优化以实现图表理解和更多

Muye Huang, Lingling Zhang, Yifei Li, Yaqiang Wu, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University, China(计算机科学与技术学院,西安交通大学) MOE KLINNS Lab, Xi’an Jiaotong University, China(教育部KLINNS实验室,西安交通大学) Zhongguancun Academy, Beijing, China(中关村学院,北京)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 SketchVL通过细粒度信用分配优化,提升多模态大语言模型在图表理解和多领域推理中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02559 2026-01-07 cs.SE cs.HC 50%

PerspectiveCoach: Exploring LLMs for Developer Reflection

PerspectiveCoach:探索LLM在开发者反思中的应用

Lauren Olson, Emitzá Guzmán, Florian Kunneman

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 PerspectiveCoach通过LLM帮助开发者反思软件设计对边缘化社区的影响,提升伦理意识和用户视角理解。

Comments 48th International Conference of Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00882 2026-01-06 cs.PL 50%

BALI: Branch-Aware Loop Invariant Inference with Large Language Models

BALI: 基于分支的循环不变式推断与大语言模型

Mingxiu Wang, Jiawei Wang, Xiao Cheng

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 BALI通过结合大语言模型和分支感知分析,提升循环不变式的推断和验证精度,实现更高效和自动化的不变式发现。

Comments 4 pages, 1 figure, AAAI-26 Bridge Program B10: Making Embodied AI Reliable with Testing and Formal Verification

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22386 2026-01-01 cs.IR 50%

OxygenREC: An Instruction-Following Generative Framework for E-commerce Recommendation

OxygenREC: 一种用于电商推荐的指令遵循生成框架

Xuegang Hao, Ming Zhang, Alex Li, Xiangyu Qian, Zhi Ma, Yanlong Zang, Shijie Yang, Zhongxuan Han, Xiaolong Ma, Jinguang Liu, Zhen Li, Zhida Jiang, Shusheng Wang, Ning Tang, Yanchen Qiao, Chenxiang Yang, Chen Sun, Jincheng Yuan, Chunhua Peng, Heng Hu, Peijun Yang, Baopeng Yuan, Caiyun Qiu, Zhaolong Xing, Haofei Yuan, Haipeng Zhang, Yuzhang Guo, Weijie Ding, Jiahua Gao, Hao Huang, Zhen Chen, Tongxuan Liu, Pinghua Gong

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 OxygenREC通过快慢思考架构和语义对齐机制,实现低延迟多场景的深度推荐推理。

Comments 37 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00741 2025-12-29 cond-mat.mtrl-sci 50%

Accelerated Inorganic Materials Design with Generative AI Agents

利用生成式AI代理加速无机材料设计

Izumi Takahara, Teruyasu Mizoguchi, Bang Liu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 MatAgent通过结合生成模型和预测模型,利用大语言模型的推理能力,实现高效、可解释的无机材料设计与发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20986 2025-12-25 cs.CR 50%

AegisAgent: An Autonomous Defense Agent Against Prompt Injection Attacks in LLM-HARs

AegisAgent:一种对抗LLM-HAR中提示注入攻击的自主防御代理

Yihan Wang, Huanqi Yang, Shantanu Pal, Weitao Xu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 AegisAgent通过自主推理和验证机制,有效降低LLM-HAR系统中提示注入攻击的成功率,提升系统安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20166 2025-12-24 cs.RO 50%

LoLA: Long Horizon Latent Action Learning for General Robot Manipulation

LoLA:面向通用机器人操作的长周期隐式动作学习

Xiaofan Wang, Xingyu Gao, Jianlong Fu, Zuolei Li, Dean Fortier, Galen Mullins, Andrey Kolobov, Baining Guo

机构 * Institute of Microelectronics, Chinese Academy of Sciences(中国科学院微电子研究所) University of Chinese Academy of Sciences(中国科学院大学) Microsoft Research(微软研究院)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 LoLA通过整合长期多视角观察和机器人本体感觉,实现长周期、语言引导的机器人操作任务,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00908 2025-12-23 cs.CV cs.GR 50%

GraphGeo: Multi-Agent Debate Framework for Visual Geo-localization with Heterogeneous Graph Neural Networks

GraphGeo: 多智能体辩论框架用于具有异构图神经网络的视觉地定位

Heng Zheng, Yuling Shi, Xiaodong Gu, Haochen You, Zijian Zhang, Lubin Gan, Hao Zhang, Wenjun Huang, Jin Huang

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 GraphGeo通过异构图神经网络的多智能体辩论框架,提升视觉地定位的准确性与鲁棒性。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16302 2025-12-19 cs.RO 50%

ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation

ManiLong-Shot:交互感知的一次学习方法用于长周期操控

Zixuan Chen, Chongkai Gao, Lin Shao, Jieqi Shi, Jing Huo, Yang Gao

机构 * National University of Singapore(新加坡国立大学)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 ManiLong-Shot通过交互感知原语分解实现长周期操控任务的一次学习,有效提升机器人任务执行能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00981 2025-12-17 cs.CV 50%

VesSAM: Efficient Multi-Prompting for Segmenting Complex Vessel

VesSAM: 高效多提示分割复杂血管

Suzhong Fu, Rui Sun, Xuan Ding, Jingqi Dong, Yiming Yang, Yao Zhu, Min Chang Jordan Ren, Delin Deng, Angelica Aviles-Rivero, Shuguang Cui, Zhen Li

机构 * FNii-Shenzhen, CUHK-Shenzhen(FNii-Shenzhen,CUHK-Shenzhen) School of Science and Engineering, CUHK-Shenzhen(CUHK-Shenzhen科学与工程学院) Zhejiang University(浙江大学) Boston University(波士顿大学) Vanderbilt University(范德比大学) Tsinghua University(清华大学)

专题命中 复杂问题求解 :planning(abstract)

AI总结 VesSAM通过多提示编码器和轻量级解码器提升血管分割性能,实现比现有方法更高的Dice和IoU指标,同时参数更少且泛化能力更强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09554 2025-12-17 cs.IR 50%

Mixture-of-RAG: Integrating Text and Tables with Large Language Models

混合RAG:利用大语言模型整合文本和表格

Chi Zhang, Qiyang Chen, Mengqi Zhang

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 MixRAG通过三阶段框架整合文本和表格,提升异构文档检索性能,实现混合模态文档接地的最新成果。

Comments Accepted to SIGKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12957 2025-12-16 cs.DB cs.LO 50%

Database Research needs an Abstract Relational Query Language

数据库研究需要一种抽象关系查询语言

Wolfgang Gatterbauer, Diandre Miguel Sabale

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 本文提出了一种抽象关系查询语言(ARQL),旨在通过分离查询意图与语法,提供统一的语义框架,以支持机器生成查询与人类验证调试的交互需求。

Comments CIDR 2026. 16th Annual Conference on Innovative Data Systems Research (CIDR '26). January 18-21, 2026, Chaminade, USA. 16 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12707 2025-12-16 cs.CY 50%

From Linear Risk to Emergent Harm: Complexity as the Missing Core of AI Governance

从线性风险到涌现危害:复杂性作为AI治理的缺失核心

Hugo Roger Paz

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 本文提出基于复杂性的AI治理框架,强调通过动态系统映射和因果推理应对AI治理中的不确定性与涌现危害。

Comments White Paper / Policy Brief (Working Paper). Published version available at: https://doi.org/10.5281/zenodo.17929014

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20427 2025-12-11 cs.CV 50%

Seedream 4.0: Toward Next-generation Multimodal Image Generation

Seedream 4.0:迈向下一代多模态图像生成

Team Seedream, :, Yunpeng Chen, Yu Gao, Lixue Gong, Meng Guo, Qiushan Guo, Zhiyao Guo, Xiaoxia Hou, Weilin Huang, Yixuan Huang, Xiaowen Jian, Huafeng Kuang, Zhichao Lai, Fanshi Li, Liang Li, Xiaochen Lian, Chao Liao, Liyang Liu, Wei Liu, Yanzuo Lu, Zhengxiong Luo, Tongtong Ou, Guang Shi, Yichun Shi, Shiqi Sun, Yu Tian, Zhi Tian, Peng Wang, Rui Wang, Xun Wang, Ye Wang, Guofeng Wu, Jie Wu, Wenxu Wu, Yonghui Wu, Xin Xia, Xuefeng Xiao, Shuang Xu, Xin Yan, Ceyuan Yang, Jianchao Yang, Zhonghua Zhai, Chenlin Zhang, Heng Zhang, Qi Zhang, Xinyu Zhang, Yuwei Zhang, Shijia Zhao, Wenliang Zhao, Wenjia Zhu

机构 * ByteDance(字节跳动)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 Seedream 4.0通过高效多模态框架实现文本到图像生成、图像编辑和多图像组合,展示卓越的多模态能力与高效推理性能。

Comments Seedream 4.0/4.5 Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07871 2025-12-10 cs.CV 50%

CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning

CATP:面向高效增强多模态上下文学习的上下文自适应令牌剪枝

Yanshu Li, Jianjiang Yang, Zhennan Shen, Ligong Han, Haoyan Xu, Ruixiang Tang

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 CATP通过上下文自适应令牌剪枝方法,提升多模态上下文学习的效率和性能,减少冗余令牌带来的影响。

Comments 14 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06328 2025-12-09 cs.CV 50%

ReCAD: Reinforcement Learning Enhanced Parametric CAD Model Generation with Vision-Language Models

ReCAD: 基于强化学习的参数化CAD模型生成增强框架

Jiahao Li, Yusheng Luo, Yunzhong Lou, Xiangdong Zhou

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 ReCAD通过强化学习增强参数化CAD模型生成,利用预训练模型生成高精度CAD模型,显著提升几何精度和语义保真度。

Comments Accepted as an Oral presentation at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04380 2025-12-05 cs.NI 50%

Vision and Causal Learning Based Channel Estimation for THz Communications

基于视觉与因果学习的太赫兹通信信道估计

Kitae Kim, Yan Kyaw Tun, Md. Shirajum Munir, Chirsto Kurisummoottil Thomas, Walid Saad, Choong Seon Hong

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 本文提出一种结合视觉与因果学习的信道估计方法,通过分析城市环境实时图像,提升THz通信信道估计的准确性和鲁棒性。

Comments Submitted to IEEE Transactions on Mobile Computing on Mar. 20, 2025 (18 pages, 9 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04222 2025-12-05 cs.CV 50%

ReasonX: MLLM-Guided Intrinsic Image Decomposition

ReasonX: 基于多模态大语言模型的内在图像分解

Alara Dirik, Tuanfeng Wang, Duygu Ceylan, Stefanos Zafeiriou, Anna Frühstück

机构 * Imperial College London(伦敦帝国学院) Adobe Research(Adobe研究院)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 ReasonX通过多模态大语言模型提供相对比较监督,提升内在图像分解的泛化能力与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09060 2025-12-04 cs.DB 50%

GenRewrite: Query Rewriting via Large Language Models

GenRewrite: 通过大语言模型实现查询重写

Jie Liu, Barzan Mozafari

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 GenRewrite 利用大语言模型实现查询重写,通过自然语言重写规则和反例引导技术提升查询优化效率。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22544 2025-12-02 cs.CV 50%

HyCoVAD: A Hybrid SSL-LLM Model for Complex Video Anomaly Detection

HyCoVAD:一种用于复杂视频异常检测的混合SSL-LLM模型

Mohammad Mahdi Hemmatyar, Mahdi Jafari, Mohammad Amin Yousefi, Mohammad Reza Nemati, Mobin Azadani, Hamid Reza Rastad, Amirmohammad Akbari

机构 * Department of Computer(计算机系) Sharif University of Technology(谢赫·伊斯兰技术大学) School of Electrical and Computer Engineering(电气与计算机工程学院) University of Tehran(德黑兰大学) School of Computer Engineering(计算机工程学院) Iran University of Science and Technology(伊朗科学技术大学)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 HyCoVAD通过结合SSL与LLM,有效提升复杂视频异常检测的准确率与效率。

Comments 25 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19278 2025-11-27 cs.CV 50%

ReMatch: Boosting Representation through Matching for Multimodal Retrieval

ReMatch: 通过匹配提升表示以实现多模态检索

Qianying Liu, Xiao Liang, Zhiqiang Zhang, Zhongfei Qing, Fengfan Zhou, Yibo Chen, Xu Tang, Yao Hu, Paul Henderson

机构 * University of Glasgow(格拉斯哥大学) Xiaohongshu Inc.(小红书公司) Huazhong University of Science and Technology(华中科技大学)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 ReMatch通过生成匹配阶段提升多模态检索的表示能力,利用端到端训练和细粒度嵌入生成,在MMEB基准上取得新突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06283 2025-11-27 cs.CV 50%

TinyChemVL: Advancing Chemical Vision-Language Models via Efficient Visual Token Reduction and Complex Reaction Tasks

TinyChemVL:通过高效视觉标记减少和复杂反应任务推进化学视觉-语言模型

Xuanle Zhao, Shuxin Zeng, Xinyuan Cai, Xiang Cheng, Duzhen Zhang, Xiuyi Chen, Bo Xu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 TinyChemVL通过高效视觉标记减少和复杂反应任务提升化学视觉-语言模型的效率和推理能力,实现更高效的化学任务处理。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18534 2025-11-25 cs.CV 50%

HiFi-MambaV2: Hierarchical Shared-Routed MoE for High-Fidelity MRI Reconstruction

HiFi-MambaV2:分层共享路由MoE用于高保真MRI重建

Pengcheng Fang, Hongli Chen, Guangzhen Yao, Jian Shi, Fangfang Tang, Xiaohao Cai, Shanshan Shan, Feng Liu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 HiFi-MambaV2通过分层共享路由MoE和频率一致拉普拉斯金字塔,实现高保真MRI重建,优于多种基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11255 2025-11-25 cs.IR 50%

Align$^3$GR: Unified Multi-Level Alignment for LLM-based Generative Recommendation

Align$^3$GR: 基于大语言模型的生成推荐系统统一多级对齐

Wencai Ye, Mingjie Sun, Shuhang Chen, Wenjin Wu, Peng Jiang

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 Align$^3$GR通过统一多级对齐方法,提升大语言模型在生成推荐系统中的性能,实验显示在Recall@10和NDCG@10指标上均取得显著提升。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26213 2025-11-25 cs.CV 50%

OmniDocLayout: Towards Diverse Document Layout Generation via Coarse-to-Fine LLM Learning

OmniDocLayout: 通过粗到细的LLM学习实现多样化的文档布局生成

Hengrui Kang, Zhuangcheng Gu, Zhiyuan Zhao, Zichen Wen, Bin Wang, Weijia Li, Conghui He

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Sun Yat-sen University(中山大学)

专题命中 复杂问题求解 :planning(abstract)

AI总结 OmniDocLayout通过粗到细的LLM学习方法,生成多样化文档布局,解决现有布局生成中多样性和复杂性不足的问题。

Comments TL;DR: With the proposed OmniDocLayout-1M dataset and the LLM-based coarse-to-fine learning strategy, we enable diverse and complex document layout generation that achieves both strong condition consistency and adherence to fundamental aesthetic principles

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18001 2025-11-25 cs.SE 50%

Enhancing Automated Program Repair via Faulty Token Localization and Quality-Aware Patch Refinement

通过故障性令牌定位和质量感知补丁细化增强自动程序修复

Jiaolong Kong, Xiaofei Xie, Yiheng Xiong, Yuekun Wang, Jian Wang

专题命中 复杂问题求解 :chain-of-thought(abstract)

AI总结 TokenRepair通过内部反思定位潜在故障令牌并结合质量感知的外部反馈,提升自动程序修复的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11313 2025-11-24 cs.CV 50%

DocSLM: A Small Vision-Language Model for Long Multimodal Document Understanding

DocSLM:一种用于长多模态文档理解的小型视觉-语言模型

Tanveer Hannan, Dimitrios Mallios, Parth Pathak, Faegheh Sardari, Thomas Seidl, Gedas Bertasius, Mohsen Fayyaz, Sunando Sengupta

机构 * Microsoft(微软公司) LMU Munich(慕尼黑大学) MCML FAIR Meta(Meta FAIR) UNC Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 DocSLM通过高效的小型视觉-语言模型,在受限内存下实现长多模态文档理解,使用更少的资源达到与先进方法相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10596 2025-11-20 eess.SY cs.SY eess.SP 50%

Artifacts Are Not Noise: Embodied Resonance and the 70% Signal Loss in Conventional EEG

Ahmed Gamal Eldin

专题命中 复杂问题求解 :reasoning(abstract)

Comments v3: Major revision. Adds ICA vs. raw data comparison. Finds artifact rejection masks the core correlation (r=0.59 -> r=0.19), supporting an embodied cognition framework. R vs. ITC comparison added to main text. Expanded discussion on methodology, embodied resonance, & AI. Abstract & theory updated based on new data & feedback

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09611 2025-11-19 cs.CV 50%

MMaDA-Parallel: Multimodal Large Diffusion Language Models for Thinking-Aware Editing and Generation

Ye Tian, Ling Yang, Jiongfan Yang, Anran Wang, Yu Tian, Jiani Zheng, Haochen Wang, Zhiyang Teng, Zhuochen Wang, Yinjie Wang, Yunhai Tong, Mengdi Wang, Xiangtai Li

机构 * Peking University(北京大学) ByteDance(字节跳动) Princeton University(普林斯顿大学) CASIA(中国科学院自动化研究所) The University of Chicago(芝加哥大学)

专题命中 复杂问题求解 :reasoning(abstract)

Comments Project Page: https://tyfeld.github.io/mmadaparellel.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏