arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5001 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 5001 篇

2512.06350 2025-12-09 cs.CY cs.AI cs.CL 62%

Why They Disagree: Decoding Differences in Opinions about AI Risk on the Lex Fridman Podcast

为何他们意见分歧:解码对人工智能风险意见差异的Lex Fridman播客讨论

Nghi Truong, Phanish Puranam, Özgecan Koçak

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过分析Lex Fridman播客中关于人工智能风险的分歧,揭示了不同观点在定义、事实和因果前提上的差异,提出使用LLMs解析文本数据以识别关键争议点的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06196 2025-12-09 cs.AI cs.CL 62%

ARCANE: A Multi-Agent Framework for Interpretable and Configurable Alignment

ARCANE:一种多智能体框架,用于可解释和可配置的对齐

Charlie Masters, Marta Grześkiewicz, Stefano V. Albrecht

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 ARCANE是一种多智能体框架,通过动态规则生成实现可解释和可配置的对齐,适用于复杂长期任务。

Comments Accepted to the AAAI 2026 LLAMAS Workshop (Large Language Model Agents for Multi-Agent Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03916 2025-12-08 cs.CL cs.AI 62%

Experiments with Large Language Models on Retrieval-Augmented Generation for Closed-Source Simulation Software

在闭源仿真软件上使用检索增强生成进行大型语言模型实验

Andreas Baumann, Peter Eberhard

机构 * Institute of Engineering and Computational Mechanics, University of Stuttgart(工程与计算力学研究所,斯图加特大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本研究测试了RAG系统在闭源仿真软件Pasimodo中的表现,发现定制信息提供能显著提升响应质量,凸显了改进闭源仿真模型信息检索的重要性。

Comments 16 pages, 6 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04923 2025-12-05 cs.AI cs.CL 62%

Algorithmic Thinking Theory

算法思维理论

MohammadHossein Bateni, Vincent Cohen-Addad, Yuzhou Gu, Silvio Lattanzi, Simon Meierhans, Christopher Mohri

机构 * Google(谷歌) NYU(纽约大学) ETH Zurich(苏黎世联邦理工学院) Stanford(斯坦福大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种算法思维理论框架,用于分析和设计更强大的推理方法,通过概率 oracle 实现迭代改进和答案聚合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02720 2025-12-03 cs.AI cs.LG 62%

StockMem: An Event-Reflection Memory Framework for Stock Forecasting

StockMem: 一种用于股票预测的事件反射内存框架

He Wang, Wenyilin Xiao, Songqiao Han, Hailiang Huang

机构 * Shanghai University of Finance and Economics(上海金融学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 StockMem通过事件反射双层内存框架,有效整合事件信息与价格动态,提升股票预测的可解释性和透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02228 2025-12-03 cs.AI cs.LG 62%

STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls

STRIDE:一种选择AI模态的系统框架——代理AI、AI助手或LLM调用

Shubhi Asthana, Bing Zhang, Chad DeLuca, Ruchi Mahindru, Hima Patel

机构 * IBM Research – Almaden(IBM阿尔马登研究实验室) IBM Research – Yorktown(IBM约克镇研究实验室) IBM Research – India(IBM印度研究实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 STRIDE提供了一种系统框架,帮助选择AI模态,通过评估任务动态性决定是否使用自主代理,提升效率并降低成本。

Comments 10 pages, 4 Figures, 5 Tables Paper presented at NeurIPS 2025 LAW workshop: Bridging Language, Agent, and World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22307 2025-12-03 cs.AI cs.LG 62%

Enhanced Conditional Generation of Double Perovskite by Knowledge-Guided Language Model Feedback

通过知识引导语言模型反馈增强双钙钛矿的条件生成

Inhyo Lee, Junhyeong Lee, Jongwon Park, KyungTae Lim, Seunghwa Ryu

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种多智能体框架,通过知识引导的文本梯度提升双钙钛矿生成的稳定性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00504 2025-12-02 cs.CL cs.AI 62%

G-KV: Decoding-Time KV Cache Eviction with Global Attention

G-KV:基于全局注意力的解码时间KV缓存淘汰

Mengqi Liao, Lu Wang, Chaoyun Zhang, Zekai Shen, Xiaowei Mao, Si Qin, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang, Huaiyu Wan

机构 * School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学) MicroSoft(微软) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence(北京交通数据挖掘与具身智能重点实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 G-KV通过结合局部和历史注意力分数的全局评分机制,改进KV缓存淘汰,提升大语言模型的推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22232 2025-12-01 cs.CV cs.AI cs.CL 62%

From Compound Figures to Composite Understanding: Developing a Multi-Modal LLM from Biomedical Literature with Medical Multiple-Image Benchmarking and Validation

从复合图形到综合理解:开发一种从生物医学文献中基于医疗多图像基准测试和验证的多模态大语言模型

Zhen Chen, Yihang Fu, Gabriel Madera, Mauro Giuffre, Serina Applebaum, Hyunjae Kim, Hua Xu, Qingyu Chen

机构 * Department of Biomedical Informatics and Data Science, Yale School of Medicine, Yale University, New Haven, CT 06510, USA(耶鲁医学院生物医学信息学与数据科学系,耶鲁大学,新 Haven,CT 06510,USA) School of Medicine, University of Puerto Rico, San Juan, PR 00921, USA(波多黎各大学医学院,波多黎各,San Juan,PR 00921,USA)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出M3LLM,一种基于生物医学文献中复合图像的多模态大语言模型,通过分而治之策略提升多图像理解能力,实验证明其在多图像、单图像等场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10068 2025-12-01 cs.CV cs.AI cs.CL 62%

Mavors: Multi-granularity Video Representation for Multimodal Large Language Model

Mavors:多粒度视频表示用于多模态大语言模型

Yang Shi, Jiaheng Liu, Yushuo Guan, Zhenhua Wu, Yuanxing Zhang, Zihao Wang, Weihong Lin, Jingyun Hua, Zekun Wang, Xinlong Chen, Bohan Zeng, Wentao Zhang, Fuzheng Zhang, Wenjing Yang, Di Zhang

机构 * Peking University(北京大学) Kling Team(Kling团队) Nanjing University(南京大学) CASIA(中国科学院自动化研究所)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 Mavors通过多粒度视频表示方法,提升多模态大语言模型在长视频理解中的时空模式保留与计算效率平衡能力。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13380 2025-11-27 cs.CL cs.IR cs.LG 62%

The Structure-Content Trade-off in Knowledge Graph Retrieval

知识图谱检索中的结构与内容权衡

Valentin Six, Evan Dufraisse, Gaël de Chalendar

机构 * Université Paris-Saclay - CEA Palaiseau - France(巴黎-萨克雷大学-CEA帕莱索-法国)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文研究了知识图谱检索中结构与内容的权衡,通过混合检索函数发现平衡两者可提升LLM的推理效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17854 2025-11-25 cs.CL cs.AI cs.CY cs.HC cs.MA 62%

A superpersuasive autonomous policy debating system

一种超级有说服力的自主辩论系统

Allen Roush, Devin Gonier, John Hines, Judah Goldfeder, Philippe Martin Wyder, Sanjay Basu, Ravid Shwartz Ziv

专题命中 复杂问题求解 :self-correction(abstract);分类 cs.CL、cs.AI

AI总结 DeepDebater是一种能够自主参与并赢得完整政策辩论的AI系统,通过多智能体协作生成高质量论证并战胜人类对手。

Comments Accepted to CLIP workshop at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04427 2025-11-25 cs.AI cs.CL 62%

Plugging Schema Graph into Multi-Table QA: A Human-Guided Framework for Reducing LLM Reliance

将模式图嵌入多表问答:一种减少大语言模型依赖的人工引导框架

Xixi Wang, Miguel Costa, Jordanka Kovaceva, Shuai Wang, Francisco C. Pereira

机构 * Chalmers University of Technology(查尔姆斯理工大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于图的框架,利用人工整理的关系知识减少对大语言模型的依赖,有效解决多表问答中复杂表格模式链接的问题。

Comments Accepted to EMNLP 2025 findings

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10819 2025-11-21 cs.AI cs.LG 62%

PoE-World: Compositional World Modeling with Products of Programmatic Experts

PoE-World: 通过程序专家的乘积进行组合世界建模

Wasu Top Piriyakulkij, Yichao Liang, Hao Tang, Adrian Weller, Marta Kryven, Kevin Ellis

机构 * Cornell University(康奈尔大学) University of Cambridge(剑桥大学) The Alan Turing Institute(艾伦·图灵研究所) Dalhousie University(达尔豪斯大学)

专题命中 复杂问题求解 :planning(abstract);分类 cs.AI、cs.LG

AI总结 PoE-World通过程序专家的乘积有效建模复杂非网格世界领域,利用LLMs学习世界模型并实现高效泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13378 2025-11-18 cs.DL cs.AI cs.LG cs.MM 62%

Moving Pictures of Thought: Extracting Visual Knowledge in Charles S. Peirce's Manuscripts with Vision-Language Models

Carlo Teo Pedretti, Davide Picca, Dario Rodighiero

机构 * Department of Classics, University Sapienza of Rome(罗马大学萨皮恩扎文学院) Department of Language and Communication Sciences, University of Lausanne(洛桑大学语言与沟通科学系) Campus Fryslân, University of Groningen(格罗宁根大学弗里斯兰校区)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06261 2025-11-18 cs.LG cs.CL 62%

Hogwild! Inference: Parallel LLM Generation via Concurrent Attention

Gleb Rodionov, Roman Garipov, Alina Shutova, George Yakushev, Erik Schultheis, Vage Egiazarian, Anton Sinitsin, Denis Kuznedelev, Dan Alistarh

机构 * Yandex HSE University(俄罗斯高等经济大学) IST Austria(国际研究所)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11933 2025-11-18 cs.CL cs.LG 62%

InData: Towards Secure Multi-Step, Tool-Based Data Analysis

Karthikeyan K, Raghuveer Thirukovalluru, Bhuwan Dhingra, David Edwin Carlson

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11324 2025-11-17 cs.CL cs.AI 62%

NOVA: An Agentic Framework for Automated Histopathology Analysis and Discovery

Anurag J. Vaidya, Felix Meissen, Daniel C. Castro, Shruthi Bannur, Tristan Lazard, Drew F. K. Williamson, Faisal Mahmood, Javier Alvarez-Valle, Stephanie L. Hyland, Kenza Bouzid

机构 * Mass General Brigham(麻省总医院) Microsoft Health Futures(微软健康未来) Emory University(埃默里大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17506 2025-11-17 cs.LG cs.AI 62%

RAG-Enhanced Collaborative LLM Agents for Drug Discovery

Namkyeong Lee, Edward De Brouwer, Ehsan Hajiramezanali, Tommaso Biancalani, Chanyoung Park, Gabriele Scalia

机构 * Genentech(基因泰克)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Machine Learning, Drug Discovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16657 2025-11-17 cs.CV cs.AI cs.CL 62%

DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation

Zun Wang, Jialu Li, Han Lin, Jaehong Yoon, Mohit Bansal

专题命中 复杂问题求解 :planning(abstract);分类 cs.CL、cs.AI

Comments AAAI 2026, Project website: https://zunwang1.github.io/DreamRunner

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10583 2025-11-14 cs.CL cs.AI 62%

Evaluating Prompting Strategies with MedGemma for Medical Order Extraction

Abhinand Balachandran, Bavana Durgapraveen, Gowsikkan Sikkan Sudhagar, Vidhya Varshany J S, Sriram Rajkumar

机构 * EXL Health AI Lab at MEDIQA-OE 2025(EXL健康AI实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 2 figures 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09030 2025-11-13 cs.AI cs.CL cs.MA 62%

Solving a Million-Step LLM Task with Zero Errors

Elliot Meyerson, Giuseppe Paolo, Roberto Dailey, Hormoz Shahrzad, Olivier Francon, Conor F. Hayes, Xin Qiu, Babak Hodjat, Risto Miikkulainen

机构 * Cognizant AI Lab(Cognizant AI实验室) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Main paper: 14 pages, 29 pages with references and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00229 2025-11-13 cs.AI cs.LG 62%

AgentFlux: Decoupled Fine-Tuning & Inference for On-Device Agentic Systems

Rohan Kadekodi, Zhan Jin, Keisuke Kamahori, Yile Gu, Sean Khatiri, Noah H. Bayindirli, Sergey Gorbunov, Baris Kasikci

机构 * University of Washington(华盛顿大学) Peking University(北京大学) University of Waterloo(滑铁卢大学) Interop Labs(Interop实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06859 2025-11-11 cs.LG cs.AI 62%

TuckA: Hierarchical Compact Tensor Experts for Efficient Fine-Tuning

Qifeng Lei, Zhiyong Yang, Qianqian Xu, Cong Hua, Peisong Wen, Qingming Huang

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06776 2025-11-11 cs.LG cs.AI 62%

Data Trajectory Alignment for LLM Domain Adaptation: A Two-Phase Synthesis Framework for Telecommunications Mathematics

Zhicheng Zhou, Jing Li, Suming Qiu, Junjie Huang, Linyuan Qiu, Zhijie Sun

机构 * Global Technical Service (GTS) Huawei Technologies Co., Ltd(华为技术有限公司全球技术服务部)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01934 2025-11-11 cs.LG cs.AI 62%

Tool Zero: Training Tool-Augmented LLMs via Pure RL from Scratch

Yirong Zeng, Xiao Ding, Yutai Hou, Yuxian Wang, Li Du, Juyi Dai, Qiuyang Ding, Duyu Tang, Dandan Tu, Weiwen Liu, Bing Qin, Ting Liu

机构 * Harbin Institute of Technology SCIR Lab(哈尔滨工业大学SCIR实验室) Huawei Technologies Co., Ltd(华为技术有限公司) Shanghai Jiao Tong University(上海交通大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2025 finding

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12477 2025-11-11 cs.AI cs.CL cs.HC 62%

Towards Conversational AI for Human-Machine Collaborative MLOps

George Fatouros, Georgios Makridis, George Kousiouris, John Soldatos, Anargyros Tsadimas, Dimosthenis Kyriazis

机构 * Innov-Acts Ltd(Innov-Acts公司) Dept. of Digital Systems(数字系统系) University of Piraeus(比雷埃克斯大学) Dept. of Informatics and Telematics(信息与电信学系) Harokopio University(哈罗科比奥大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 5 figures

Journal ref 2025 21st International Conference on Distributed Computing in Smart Systems and the Internet of Things (DCOSS-IoT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06344 2025-11-11 cs.CL cs.AI 62%

TimeSense:Making Large Language Models Proficient in Time-Series Analysis

Zhirui Zhang, Changhua Pei, Tianyi Gao, Zhe Xie, Yibo Hao, Zhaoyang Yu, Longlong Xu, Tong Xiao, Jing Han, Dan Pei

机构 * Tsinghua University(清华大学) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) ZTE Corporation(中兴通讯)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05636 2025-11-10 cs.LG cs.AI 62%

Graph Learning

Feng Xia, Ciyuan Peng, Jing Ren, Falih Gozi Febrinanto, Renqiang Luo, Vidya Saikrishna, Shuo Yu, Xiangjie Kong

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 185 pages

Journal ref Foundations and Trends in Signal Processing, Vol. 19, No. 4, pp 371-551. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10641 2025-11-07 cs.LG cs.AI 62%

Test-Time Warmup for Multimodal Large Language Models

Nikita Rajaneesh, Thomas Zollo, Richard Zemel

机构 * Columbia University(哥伦比亚大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏