arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11167 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11167 篇

2512.05403 2025-12-08 cs.LG 57%

RevoNAD: Reflective Evolutionary Exploration for Neural Architecture Design

RevoNAD:基于反射的进化探索用于神经架构设计

Gyusam Chang, Jeongyoon Yoon, Shin han yi, JaeHyeok Lee, Sujin Jang, Sangpil Kim

机构 * Korea University(韩国大学) Samsung AI Center(三星人工智能中心)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 RevoNAD通过多轮多专家共识、自适应反射探索和帕累托引导的进化选择,实现了基于LLM的神经架构设计的高效优化与可靠生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05336 2025-12-08 cs.LG 57%

PathFinder: MCTS and LLM Feedback-based Path Selection for Multi-Hop Question Answering

PathFinder: 基于MCTS和LLM反馈的多跳问答路径选择

Durga Prasad Maram, Kalpa Gunaratna, Vijay Srinivasan, Haris Jeelani, Srinivas Chappidi

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 PATHFINDER通过MCTS和LLM反馈优化多跳问答的路径选择,提升训练数据质量与推理准确性。

Comments 5 PAGES, 3 IMAGES

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04785 2025-12-05 cs.AI cs.CR 57%

ASTRIDE: A Security Threat Modeling Platform for Agentic-AI Applications

ASTRIDE:面向智能体AI应用的安全威胁建模平台

Eranga Bandara, Amin Hass, Ross Gore, Sachin Shetty, Ravi Mukkamala, Safdar H. Bouk, Xueping Liang, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(老奥布里恩大学) Accenture Technology Labs(埃森哲技术实验室) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 ASTRIDE是首个专为AI智能体应用设计的自动化威胁建模平台,通过扩展STRIDE框架并结合微调的视觉语言模型与推理LLM,实现基于图的威胁建模自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09080 2025-12-05 cs.AI 57%

BioAnalyst: A Foundation Model for Biodiversity

BioAnalyst: 一种用于生物多样性的基础模型

Athanasios Trantas, Martino Mensio, Stylianos Stasinos, Sebastian Gribincea, Taimur Khan, Damian Podareanu, Aliene van der Veen

机构 * Nederlandse Organisatie voor Toegepast Natuurwetenschappelijk Onderzoek – TNO(荷兰应用自然科学研究院 – TNO) Eindhoven University of Technology(埃因霍温理工大学) Amazon(亚马逊) University of Groningen(格罗宁根大学) Helmholtz Center for Environmental Research – UFZ(环境研究赫尔姆霍茨中心 – UFZ) SURF

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 BioAnalyst是一种针对生物多样性分析和保护规划的多模态基础模型,通过预训练和微调实现物种分布建模和生态预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04492 2025-12-05 cs.CL 57%

MSME: A Multi-Stage Multi-Expert Framework for Zero-Shot Stance Detection

MSME: 一种多阶段多专家框架用于零样本立场检测

Yuanshuo Zhang, Aohua Li, Bo Chen, Jingbo Sun, Xiaobing Zhao

机构 * footnotemark: 1(机构1)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 MSME提出了一种多阶段多专家框架,通过知识准备、专家推理和决策聚合三个阶段,提升零样本立场检测的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03737 2025-12-04 cs.CL cs.IR 57%

AR-Med: Automated Relevance Enhancement in Medical Search via LLM-Driven Information Augmentation

AR-Med: 通过LLM驱动的信息增强实现医疗搜索的自动化相关性增强

Chuyue Wang, Jie Feng, Yuxi Wu, Hang Zhang, Zhiguo Fan, Bing Cheng, Wei Lin

机构 * Meituan Inc.(美团公司) Tsinghua University(清华大学) Independent Researcher(独立研究者)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 AR-Med通过LLM驱动的信息增强,实现医疗搜索的自动化相关性提升,提高了准确性和用户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09245 2025-12-04 cs.AI 57%

Jupiter: Enhancing LLM Data Analysis Capabilities via Notebook and Inference-Time Value-Guided Search

木星:通过笔记本和推理时的价值引导搜索增强大语言模型的数据分析能力

Shuocheng Li, Yihao Liu, Silin Du, Wenxuan Zeng, Zhe Xu, Mengyu Zhou, Yeye He, Haoyu Dong, Shi Han, Dongmei Zhang

机构 * Microsoft(微软)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 Jupiter通过将数据分析建模为搜索问题,并结合价值模型和节点访问次数,提升大语言模型在多步推理和工具使用方面的性能。

Comments Accepted to AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03549 2025-12-04 cs.AI 57%

PARC: An Autonomous Self-Reflective Coding Agent for Robust Execution of Long-Horizon Tasks

PARC:一种自主自反思编码代理,用于稳健执行长周期任务

Yuki Orimo, Iori Kurata, Hodaka Mori, Ryuhei Okuno, Ryohto Sawada, Daisuke Okanohara

机构 * PARC

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 PARC是一种自主自反思编码代理,通过自我评估和反馈机制实现长周期任务的稳健执行,展示了AI在自主科学分析中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03293 2025-12-04 cs.AI q-bio.NC 57%

Prior preferences in active inference agents: soft, hard, and goal shaping

主动推断代理中的先验偏好:软、硬和目标塑造

Filippo Torresan, Ryota Kanai, Manuel Baltieri

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文研究了主动推断代理中偏好分布的定义方式,探讨了硬/软目标和目标塑造对导航任务性能的影响。

Comments 41 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00882 2025-12-04 cs.CV cs.AI 57%

Look, Recite, Then Answer: Enhancing VLM Performance via Self-Generated Knowledge Hints

看、复述、然后回答:通过自动生成的知识提示提升VLM性能

Xisheng Feng

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 通过自动生成的知识提示提升VLM性能,采用模块化设计减少幻觉,实现精准农业中杂草识别准确率的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01155 2025-12-03 cs.SE cs.AI 57%

Beyond Greenfield: The D3 Framework for AI-Driven Productivity in Brownfield Engineering

超越Greenfield:面向Brownfield工程的D3框架:AI驱动的生产力框架

Krishna Kumaar Sharma

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出D3框架,通过双代理提示架构提升Brownfield工程中LLM的应用效果,实验证明在遗留系统探索、文档重建等任务中,AI辅助显著提升生产力和减少认知负荷。

Comments 53 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02660 2025-12-03 cs.AI cs.AR 57%

Hey AI, Generate Me a Hardware Code! Agentic AI-based Hardware Design & Verification

嘿,AI,为我生成一段硬件代码!基于代理的AI硬件设计与验证

Deepak Narayan Gadde, Keerthan Kopparam Radhakrishna, Vaisakh Naduvodi Viswambharan, Aman Kumar, Djones Lettnin, Wolfgang Kunz, Sebastian Simon

机构 * 1 Infineon Technologies Dresden GmbH \& Co. KG, Germany 2 Infineon Technologies India Pvt. Ltd., India 3 Infineon Technologies AG, Germany 4 Rheinland-Pf \"a lzische Technische Universit \"a t Kaiserslautern-Landau, Germany

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于代理的AI方法,用于硬件设计验证,通过与人类在环的协作,实现动态迭代和自我反思,提升设计覆盖率并减少验证时间。

Comments To appear at the 38th SBC/SBMicro/IEEE Symposium on Integrated Circuits and Systems Design (SBCCI), August 25-29, 2025, Manaus, BRAZIL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19686 2025-12-03 cs.AI 57%

From Memories to Maps: Mechanisms of In-Context Reinforcement Learning in Transformers

从记忆到地图:变换器中上下文强化学习的机制

Ching Fang, Kanaka Rajan

机构 * Harvard Medical School(哈佛医学院) Harvard University(哈佛大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究通过变换器模型探索上下文强化学习的机制,发现记忆在存储经验与缓存计算中扮演关键角色,支持灵活行为。

Comments Revised to around 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02485 2025-12-03 cs.CV cs.AI 57%

UCAgents: Unidirectional Convergence for Visual Evidence Anchored Multi-Agent Medical Decision-Making

UCAgents: 视觉证据锚定的多智能体医学决策收敛

Qianhan Feng, Zhongzhen Huang, Yakun Zhu, Xiaofan Zhang, Qi Dou

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 UCAgents通过结构化证据审计和单向收敛机制,在医疗视觉问答中提升准确率并降低计算成本,平衡视觉证据揭示与文本干扰避免。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02358 2025-12-03 cs.AI 57%

Beyond Playtesting: A Generative Multi-Agent Simulation System for Massively Multiplayer Online Games

超越试玩:一种生成式多智能体仿真系统用于大规模多人在线游戏

Ran Zhang, Kun Ouyang, Tiancheng Ma, Yida Yang, Dong Fang

机构 * independent researcher(独立研究者)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种基于生成式多智能体仿真的系统,利用大型语言模型优化大规模多人在线游戏的数值设计,提升玩家体验并提高优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07226 2025-12-03 cs.RO cs.AI 57%

Large Language Models for Robotics: A Survey

大语言模型在机器人中的应用:综述

Fanlong Zeng, Wensheng Gan, Zezheng Huai, Lichao Sun, Hechang Chen, Yongheng Wang, Ning Liu, Philip S. Yu

机构 * School of Intelligent Systems Science and Engineering(智能系统科学与工程学院) Jinan University(济南大学) School of Artificial Intelligence(人工智能学院) Jilin University(吉林大学) Shanghai Innovation Institute(上海创新研究院) Lehigh University(莱文斯顿大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文综述了大语言模型在机器人领域的应用,探讨了其在机器人控制、感知、决策和规划等方面的影响与挑战。

Comments Preprint. 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01958 2025-12-02 cs.AI 57%

Learned-Rule-Augmented Large Language Model Evaluators

学习规则增强的大语言模型评估器

Jie Meng, Jin Mao

机构 * Wuhan University(武汉大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出规则增强的LLM评估器,通过规则蒸馏和强化学习提升评估器的泛化能力与一致性,适用于多种评估场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01452 2025-12-02 cs.AI 57%

Automated Risk-of-Bias Assessment of Randomized Controlled Trials: A First Look at a GEPA-trained Programmatic Prompting Framework

随机对照试验风险偏误自动评估:一种基于GEPA训练的程序化提示框架初探

Lingbo Li, Anuradha Mathrani, Teo Susnjak

机构 * School of Mathematical and Computational Sciences(数学与计算科学学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 GEPA通过结构化优化生成一致的提示,提升随机对照试验偏误风险评估的自动化与可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00772 2025-12-02 cs.IR cs.AI cs.DL 57%

SHRAG: AFrameworkfor Combining Human-Inspired Search with RAG

SHRAG:一种结合人类启发式搜索与RAG的框架

Hyunseok Ryu, Wonjune Shin, Hyun Park

机构 * Peoples' Friendship University of Russia (RUDN University)(俄罗斯人民友谊大学) Joint Institute for Nuclear Research(联合核子研究中心) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Skövde(斯德哥尔摩大学) Department of AI Convergence(人工智能融合部门) College of Information Computing(信息计算学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 SHRAG结合人类启发式搜索与RAG,提升检索精度与生成可靠性,实现多语言高效问答。

Comments 10 pages, 4 figures, 1 table, 1 algorithm, 3 prompts

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22969 2025-12-02 cs.AI cs.MA 57%

Multi-Agent Conditional Diffusion Model with Mean Field Communication as Wireless Resource Allocation Planner

多智能体条件扩散模型与均场通信作为无线资源分配规划器

Kechen Meng, Sinuo Zhang, Rongpeng Li, Xiangming Meng, Yansha Deng, Chan Wang, Ming Lei, Zhifeng Zhao

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang University-University of Illinois Urbana-Champaign (ZJU-UIUC) Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Department of Engineering, King’s College London(伦敦国王学院工程系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 多智能体条件扩散模型与均场通信用于无线资源分配规划,通过扩散模型和逆动态模型提升样本效率与策略可扩展性,理论保证收敛稳定性,实验显示在无线网络优化中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17655 2025-12-02 cs.RO cs.AI cs.MA 57%

AssistantX: An LLM-Powered Proactive Assistant in Collaborative Human-Populated Environment

AssistantX: 一种基于大语言模型的协作人类 populated 环境中的主动助手

Nan Sun, Bo Mao, Yongchang Li, Di Guo, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 AssistantX 是一种基于大语言模型的主动助手,通过多代理框架实现自主操作,具备高级推理能力和协作意识,能有效响应用户指令并主动寻求帮助以完成任务。

Comments 8 pages, 10 figures, 6 tables

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00194 2025-12-02 cs.CV cs.LG eess.IV q-bio.QM 57%

AutocleanEEG ICVision: Automated ICA Artifact Classification Using Vision-Language AI

AutocleanEEG ICVision:利用视觉-语言AI实现自动化ICA噪声分类

Zag ElSayed, Grace Westerkamp, Gavin Gammoh, Yanchen Liu, Peyton Siekierski, Craig Erickson, Ernest Pedapati

机构 * School of Information Technology University of Cincinnati Ohio, USA(信息科技学院 奥地利辛辛那提大学 美国俄亥俄州)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 ICVision通过视觉-语言AI实现自动化EEG ICA噪声分类,达到专家级准确度并提供可解释结果。

Comments 6 pages, 8 figures

Journal ref Conference ICMI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00069 2025-12-02 cs.RO cs.AI 57%

Enhancing Cognitive Robotics with Commonsense through LLM-Generated Preconditions and Subgoals

通过LLM生成的先决条件和子目标增强认知机器人

Ohad Bachner, Bar Gamliel

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本研究通过结合大型语言模型与符号规划,利用LLM生成的先决条件和子目标提升机器人任务完成的可靠性与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00048 2025-12-02 cs.RO cs.AI 57%

Causal Reinforcement Learning based Agent-Patient Interaction with Clinical Domain Knowledge

基于因果强化学习的Agent-患者交互与临床领域知识

Wenzheng Zhao, Ran Zhang, Ruth Palan Lopez, Shu-Fen Wung, Fengpei Yuan

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于因果强化学习的Agent-患者交互框架,通过整合因果发现与推理提升医疗场景中的决策可解释性和适应性。

Comments Accepted by AAAI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03543 2025-12-02 cs.AI cs.CY cs.MA 57%

CogniPair: From LLM Chatbots to Conscious AI Agents -- GNWT-Based Multi-Agent Digital Twins for Social Pairing -- Dating & Hiring Applications

CogniPair: 从LLM聊天机器人到有意识的AI代理 -- 基于GNWT的多智能体数字孪生用于社交配对 -- dating与招聘应用

Wanghao Ye, Sihan Chen, Yiting Wang, Shwai He, Bowei Tian, Guoheng Sun, Ziyi Wang, Ziyao Wang, Yexiao He, Zheyu Shen, Meng Liu, Yuning Zhang, Meng Feng, Yang Wang, Siyuan Peng, Yilong Dai, Zhenle Duan, Lang Xiong, Joshua Liu, Hanzhang Qin, Ang Li

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 CogniPair基于GNWT理论,通过整合人类认知架构,创建多智能体数字孪生系统,用于社交配对,提升LLM代理的心理真实性,并应用于约会和招聘场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22737 2025-12-01 cs.AI cs.HC 57%

Agentic AI Framework for Individuals with Disabilities and Neurodivergence: A Multi-Agent System for Healthy Eating, Daily Routines, and Inclusive Well-Being

具有残疾和神经多样性个体的代理AI框架:一个用于健康饮食、日常习惯和包容性福祉的多代理系统

Salman Jan, Toqeer Ali Syed, Gohar Ali, Ali Akarma, Mohammad Riyaz Belgaum, Ahmad Ali

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种多代理系统,通过个性化营养、适应性调度、食品指导和生理监测等代理,为残疾和神经多样性个体提供健康饮食、日常习惯和包容性福祉的AI框架。

Comments Presented at International Conference on Business and Digital Technology, Bahrain, Springer Nature, 27 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05408 2025-12-01 cs.CR cs.AI cs.CY 57%

Frontier AI's Impact on the Cybersecurity Landscape

前沿人工智能对网络安全领域的冲击

Yujin Potter, Wenbo Guo, Zhun Wang, Tianneng Shi, Hongwei Li, Andy Zhang, Patrick Gage Kelley, Kurt Thomas, Dawn Song

机构 * UC Berkeley(加州大学伯克利分校) UC Santa Barbara(加州大学圣芭芭拉分校) Google(谷歌)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文研究了前沿人工智能在网络安全中的影响,指出人工智能在攻击中的能力已超过防御,呼吁构建新基准、开发防御代理等以缓解风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20322 2025-11-28 cs.AI 57%

Artificial Intelligence In Patent And Market Intelligence: A New Paradigm For Technology Scouting

人工智能在专利与市场情报中的应用:技术 scouting 的新范式

Manish Verma, Vivek Sharma, Vishal Singh

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种基于人工智能的平台,利用大型语言模型提升技术 scouting 和解决方案发现的效率与准确性。

Comments arXiv admin note: This version has been removed by arXiv administrators as the submitter did not have the right to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20940 2025-11-27 cs.CL 57%

Chatty-KG: A Multi-Agent AI System for On-Demand Conversational Question Answering over Knowledge Graphs

Chatty-KG:一种用于基于知识图谱的按需对话问答的多智能体AI系统

Reham Omar, Abdelghny Orogat, Ibrahim Abdelaziz, Omij Mangukiya, Panos Kalnis, Essam Mansour

机构 * Concordia University(康科德大学) IBM Research(IBM研究院)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 Chatty-KG通过多智能体系统实现基于知识图谱的对话问答,结合RAG检索与结构化执行,提升多轮问答的准确性和效率。

Comments This paper is accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20695 2025-11-27 cs.AI cs.CY physics.med-ph 57%

A Brief History of Digital Twin Technology

数字孪生技术简史

Yunqi Zhang, Kuangyu Shi, Biao Li

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 数字孪生技术通过整合医疗数据和模型,推动医疗从反应性向预测性和个性化转变,面临互操作性、隐私和模型精度等挑战。

Comments 21 pages, 1 figure, 1 table

Journal ref PET Clin. 2026 Jan;21(1):143-151. Epub 2025 Oct 21

详情

展开后加载摘要…

URL PDF HTML 收藏