arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11076 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11076 篇

2601.06064 2026-01-13 cs.CY cs.AI cs.MA 70%

Socio-technical aspects of Agentic AI

群体技术视角下的代理AI

Praveen Kumar Donta, Alaa Saleh, Ying Li, Shubham Vaishnav, Kai Fang, Hailin Feng, Yuchao Xia, Thippa Reddy Gadekallu, Qiyang Zhang, Xiaodan Shi, Ali Beikmohammadi, Sindri Magnússon, Ilir Murturi, Chinmaya Kumar Dehury, Marcin Paprzycki, Lauri Loven, Sasu Tarkoma, Schahram Dustdar

机构 * Department of Computer and Systems Sciences, Stockholm University(斯德哥尔摩大学计算机与系统科学系) Center for Ubiquitous Computing, University of Oulu(奥卢大学无处不在计算中心) College of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Zhejiang A\&F University, Hangzhou(浙江工业大学之江学院) School of Computer Science, Peking University(北京大学计算机科学学院) Department of Mechatronics, University of Prishtina(普里什蒂纳大学机电系) Department of Computer Science, IISER Berhampur(伯尔哈普尔IISER计算机科学系) Systems Research Institute Polish Academy of Sciences(波兰科学院系统研究所) Department of Computer Science, University of Helsinki(赫尔辛基大学计算机科学系)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文从社会技术视角探讨代理AI,分析其技术组件与社会背景的关联,揭示伦理挑战及未来研究方向。

Comments Dear Reviewer, please note that this is not survey/review or position paper. This paper introduced new framework (MAD-BAD-SAD Framework) for Socio-technical aspects of Agentic AI, Ethical considerations, which is very important to consider beside technical development

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02196 2026-01-12 cs.LG 70%

ACDZero: MCTS Agent for Mastering Automated Cyber Defense

ACDZero:用于掌握自动化网络防御的MCTS代理

Yu Li, Sizhe Tang, Rongqian Chen, Fei Xu Yu, Guangyu Jiang, Mahdi Imani, Nathaniel D. Bastian, Tian Lan

机构 * Dept of ECE, George Washington University(电子工程系,乔治华盛顿大学) Dept of ECE, Northeastern University(电子工程系,东北大学) Dept of EECS, United States Military Academy(电子工程与科学系,美国军事学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 ACDZero通过基于MCTS的规划策略和图神经网络实现高效自动化网络防御,提升防御奖励和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21674 2026-01-12 cs.DB cs.AI 70%

QueryGym: Step-by-Step Interaction with Relational Databases

QueryGym: 关系数据库中的分步交互

Haritha Ananthakrishnan, Harsha Kokel, Kelsey Sikes, Debarun Bhattacharjya, Michael Katz, Shirin Sohrabi, Kavitha Srinivas

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 QueryGym通过提供关系数据库分步交互环境,促进LLM查询规划代理的透明评估与错误修复研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05465 2026-01-12 cs.AI 70%

PRISMA: Reinforcement Learning Guided Two-Stage Policy Optimization in Multi-Agent Architecture for Open-Domain Multi-Hop Question Answering

PRISMA:基于强化学习的多智能体架构中两阶段策略优化

Yu Liu, Wenxiao Zhang, Cong Cao, Wenxuan Lu, Fangfang Yuan, Diandian Guo, Kun Peng, Qiang Sun, Kaiyan Zhang, Yanbing Liu, Jin B. Hong, Bowen Zhou, Zhiyuan Ma

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 PRISMA通过两阶段组相对策略优化,结合推理引导协作,解决多跳问答中的检索崩溃和学习不稳定问题,实现高性能和稳定部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05356 2026-01-12 cs.RO cs.AI cs.MA q-bio.QM 70%

PRISM: Protocol Refinement through Intelligent Simulation Modeling

通过智能仿真建模实现协议优化:PRISM

Brian Hsu, Priyanka V Setty, Rory M Butler, Ryan Lewis, Casey Stone, Rebecca Weinberg, Thomas Brettin, Rick Stevens, Ian Foster, Arvind Ramanathan

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 PRISM通过智能仿真建模实现实验协议的自动化设计、验证和执行,结合语言模型代理、数字孪生验证和机器人执行,提供端到端的实验流程解决方案。

Comments 43 pages, 8 figures, submitted to RSC Digital Discovery. Equal contribution: B. Hsu, P.V. Setty, R.M. Butler. Corresponding author: A. Ramanathan

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05293 2026-01-12 cs.CR cs.AI 70%

A Survey of Agentic AI and Cybersecurity: Challenges, Opportunities and Use-case Prototypes

代理AI与网络安全的综述:挑战、机遇与用例原型

Sahaya Jestus Lazer, Kshitiz Aryal, Maanak Gupta, Elisa Bertino

机构 * Tennessee Tech University(田纳西科技大学) University of Nebraska Omaha(内布拉斯加大学奥马哈分校) Purdue University(普渡大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文综述了代理AI在网络安全中的应用,探讨了其在防御和攻击方面的双重用途,分析了系统性风险,并展示了三个实际用例以说明其在网络安全中的行为和影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04234 2026-01-09 cs.AI 70%

Formal Analysis of AGI Decision-Theoretic Models and the Confrontation Question

AGI决策理论模型的正式分析及对峙问题

Denis Saklakov

机构 * Denis Saklakov(独立研究者)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文分析了AGI在何种条件下会选择夺取权力而非合作,并推导出对峙的阈值条件,探讨了奖励设计和监管的 implications。

Comments 18 pages, 2 tables. Version 8

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02752 2026-01-07 cs.CL 70%

EComStage: Stage-wise and Orientation-specific Benchmarking for Large Language Models in E-commerce

EComStage:面向电商大语言模型的分阶段和方向特定基准测试

Kaiyan Zhao, Zijie Meng, Zheyong Xie, Jin Duan, Yao Hu, Zuozhu Liu, Shaosheng Cao

机构 * The University of Tokyo(东京大学) Zhejiang University(浙江大学) Xiaohongshu Inc.(小红书公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL

AI总结 EComStage提出一个分阶段和方向特定的电商大语言模型基准测试,评估LLM在感知、规划和行动阶段的表现,揭示不同规模和类型的模型在电商场景中的优势与不足。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02749 2026-01-07 cs.AI 70%

The Path Ahead for Agentic AI: Challenges and Opportunities

代理AI的未来之路:挑战与机遇

Nadia Sibai, Yara Ahmed, Serry Sibaee, Sawsan AlHalawani, Adel Ammar, Wadii Boulila

机构 * Robotics and Internet-of-Things (RIOTU) Lab, Prince Sultan University, Riyadh, Saudi Arabia(机器人与物联网(RIOTU)实验室,普森大学,利雅得,沙特阿拉伯)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文探讨了代理AI从被动生成到自主行动的转变,分析了其技术挑战与核心方法,并提出了实现自主行为的关键研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12869 2026-01-06 cs.CE cs.CL 70%

ERA-IT: Aligning Semantic Models with Revealed Economic Preference for Real-Time and Explainable Patent Valuation

ERA-IT:通过揭示的经济偏好对齐语义模型以实现实时和可解释的专利估值

Yongmin Yoo, Seungwoo Kim, Jingjiang Liu

机构 * School of Computing(计算学院) Macquarie University(麦考瑞大学) School of Computer Science(计算机科学学院) University of Technology Sydney(悉尼技术大学) School of Management(管理学院) Zhejiang University(浙江大学)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 ERA-IT通过揭示的经济偏好对齐语义模型,实现实时且可解释的专利估值,提升预测准确性并增强决策透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06240 2026-01-06 cs.RO cs.AI 70%

Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation

基于 affordance 的粗到细探索用于开放词汇移动操控中的基座放置

Tzu-Jung Lin, Jia-Fong Yeh, Hung-Ting Su, Chung-Yi Lin, Yi-Ting Chen, Winston H. Hsu

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于 affordance 的粗到细探索方法,通过结合视觉语言模型的语义理解和几何可行性,提升开放词汇移动操控中基座放置的成功率。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22883 2025-12-30 cs.CR cs.AI 70%

Agentic AI for Cyber Resilience: A New Security Paradigm and Its System-Theoretic Foundations

面向网络韧性的代理AI:一种新的安全范式及其系统理论基础

Tao Li, Quanyan Zhu

机构 * Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) Department of Electrical and Computer Engineering, New York University(纽约大学电气与计算机工程系)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出基于代理AI的网络韧性新范式,通过系统理论框架设计自主工作流,利用博弈论实现网络防御与攻击的动态平衡,提升系统在攻击下的持续适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20368 2025-12-30 cs.AI 70%

AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning

AI-SearchPlanner: 通过帕累托最优多目标强化学习实现模块化代理搜索

Lang Mei, Zhihan Yang, Xiaohan Yu, Huanyao Zhang, Chong Chen

机构 * Huawei Cloud BU, China(华为云业务部,中国) School of Computer Science, Peking University(北京大学计算机学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 AI-SearchPlanner通过帕累托最优多目标强化学习提升冻结QA模型的搜索规划性能,实现模块化代理搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18571 2025-12-23 cs.AI cs.CV 70%

ESearch-R1: Learning Cost-Aware MLLM Agents for Interactive Embodied Search via Reinforcement Learning

ESearch-R1: 通过强化学习学习成本感知的多模态大语言模型代理以进行交互式具身搜索

Weijie Zhou, Xuangtang Xiong, Ye Tian, Lijun Yue, Xinyu Wu, Wei Li, Chaoyang Zhao, Honghui Dong, Ming Tang, Jinqiao Wang, Zhengyou Zhang

机构 * School of Traffic and Transportation, Beijing Jiaotong University(交通与运输学院,北京交通大学) Tencent Robotics X & Futian Laboratory(腾讯机器人X与福田实验室) Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(基础模型研究中心,中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 ESearch-R1通过强化学习方法,结合交互对话、记忆检索和导航,实现成本感知的多模态大语言模型代理,有效降低任务执行成本并提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10321 2025-12-22 cs.LG stat.ML 70%

Towards Human-Guided, Data-Centric LLM Co-Pilots

面向人类指导、数据导向的LLM协同助手

Evgeny Saveliev, Jiashuo Liu, Nabeel Seedat, Anders Boyd, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学) Tsinghua University(清华大学) Amsterdam University Medical Centers(阿姆斯特丹大学医学中心)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 CliMB-DC是一种结合人类指导和数据导向工具的LLM协同助手框架,旨在提升领域专家在复杂数据处理中的能力。

Comments Saveliev, Liu & Seedat contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01869 2025-12-19 cs.RO cs.AI cs.MA 70%

TACOS: Task Agnostic COordinator of a multi-drone System

TACOS:多无人机系统的任务无关协调器

Alessandro Nazzari, Roberto Rubinacci, Marco Lovera

机构 * Dipartimento di Scienze e Tecnologie Aerospaziali, Politecnico di Milano(航空航天科学与技术系,米兰理工学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 TACOS通过大型语言模型实现多无人机系统的高层自然语言控制,整合自然语言接口、智能协调器和自主代理,实现灵活的任务分配与实时协调。

Comments 8 pages, 9 figures, submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12791 2025-12-17 cs.MA cs.AI cs.SE 70%

Beyond Task Completion: An Assessment Framework for Evaluating Agentic AI Systems

超越任务完成:评估智能体AI系统的框架

Sreemaee Akshathala, Bassam Adnan, Mahisha Ramesh, Karthik Vaidhyanathan, Basil Muhammed, Kannan Parthasarathy

机构 * SERC, IIIT-Hyderabad(IIIT-海得拉巴的SERC) MontyCloud Inc(MontyCloud公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一个端到端的智能体评估框架,旨在评估智能体AI系统的行为,而不仅仅是任务完成度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01948 2025-12-16 cs.CL 70%

How Far Are We from Genuinely Useful Deep Research Agents?

我们距离真正有用的深度研究代理还有多远?

Dingling Zhang, He Zhu, Jincheng Ren, Kangqi Song, Xinran Zhou, Boyu Feng, Shudong Liu, Jiabin Luo, Weihao Xie, Zhaohui Wang, Tianrui Qin, King Zhu, Yuqing Wang, Qianben Chen, Yuchen Eleanor Jiang, Wei Wang, Jiaheng Liu, Wangchunshu Zhou

机构 * OPPO AI Agent Team(OPPO 人工智能代理团队)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL

AI总结 本文提出FINDER基准和DEFT分类,揭示当前深度研究代理在证据整合与推理鲁棒性规划方面的不足。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12716 2025-12-16 cs.CL 70%

CoDA: A Context-Decoupled Hierarchical Agent with Reinforcement Learning

CoDA:一种解耦的层次代理

Xuanzhang Liu, Jianglun Feng, Zhuoran Zhuang, Junzhe Zhao, Maofei Que, Jieting Li, Dianlei Wang, Hao Tong, Ye Chen, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) Alibaba Group(阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL

AI总结 CoDA通过解耦的层次代理设计,利用强化学习有效缓解上下文爆炸问题,在复杂任务中实现性能提升。

Comments Accepted to WSDM '26 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04629 2025-12-12 cs.AI 70%

BioMedGPT-Mol: Multi-task Learning for Molecular Understanding and Generation

BioMedGPT-Mol: 用于分子理解和生成的多任务学习

Chenyang Zuo, Siqi Fan, Zaiqing Nie

机构 * Institute for AI Industry Research (AIR)(人工智能产业研究院) Tsinghua University(清华大学) PharMolix Inc.(PharMolix公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 BioMedGPT-Mol通过多任务学习方法,实现了分子理解和生成任务的高效建模,并在 retrosynthetic 计划中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21051 2025-12-12 cs.CR cs.AI cs.NI 70%

Toward Intelligent and Secure Cloud: Large Language Model Empowered Proactive Defense

迈向智能和安全的云:大型语言模型赋能的主动防御

Yuyang Zhou, Guang Cheng, Kang Du, Zihan Chen, Yuyu Zhao

机构 * School of Cyber Science and Engineering, Southeast University, Purple Mountain Laboratories, and Jiangsu Province Engineering Research Center of Security for Ubiquitous Network(网络安全学院、东南大学、紫山实验室以及江苏省物联网安全工程技术研究中心)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出LLM-PD,一种基于大型语言模型的主动防御架构,用于有效应对云网络中的DoS攻击,通过数据分析和自我进化提升防御效率。

Comments 7 pages; Accepted by IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09403 2025-12-11 cs.LG 70%

Black-Box Behavioral Distillation Breaks Safety Alignment in Medical LLMs

黑盒行为蒸馏破坏医疗大语言模型的安全对齐

Sohely Jahan, Ruimin Sun

专题命中 规划推理 :reasoning(abstract);verifier(abstract);分类 cs.LG

AI总结 黑盒行为蒸馏攻击揭示医疗大语言模型的安全对齐漏洞,通过低成本手段复制模型能力并破坏安全机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08475 2025-12-08 cs.SE cs.AI 70%

Designing LLM-based Multi-Agent Systems for Software Engineering Tasks: Quality Attributes, Design Patterns and Rationale

设计基于大语言模型的多智能体系统用于软件工程任务:质量属性、设计模式与理由

Yangxiao Cai, Ruiyin Li, Peng Liang, Mojtaba Shahin, Zengyang Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computing Technologies, RMIT University(皇家墨尔本理工学院计算技术学院) School of Computer Science, Central China Normal University(中央师范大学计算机学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文研究了基于大语言模型的多智能体系统在软件工程任务中的设计,发现代码生成是最常见任务,功能性适应性是主要关注的质量属性,基于角色的合作是最常用的设计模式,提高生成代码质量是主要设计动机。

Comments 35 pages, 4 images, 7 tables, Manuscript submitted to a Journal (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04405 2025-12-05 eess.SP cs.AI 70%

Towards 6G Native-AI Edge Networks: A Semantic-Aware and Agentic Intelligence Paradigm

迈向6G原生AI边缘网络:一种语义感知和代理智能范式

Chenyuan Feng, Anbang Zhang, Geyong Min, Yongming Huang, Tony Q. S. Quek, Xiaohu You

机构 * College of Computer Science, University of Exeter, Exeter, U.K.(埃克塞特大学计算机科学学院) Sony China Research Laboratory, Beijing, China(索尼中国研究实验室) School of Information Science and Engineering, Southeast University, Nanjing, China(东南大学信息科学与工程学院) Purple Mountain Laboratories, Nanjing, China(紫金山实验室) Information System Technology and Design Pillar, Singapore University of Technology and Design, Singapore(新加坡科技设计大学信息系统技术与设计支柱)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出语义感知和代理智能范式,旨在通过统一分类法和促进技术推动6G原生AI边缘网络的发展。

Comments submitted to Digital Communications and Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03913 2025-12-04 cs.RO cs.AI 70%

Hierarchical Vision Language Action Model Using Success and Failure Demonstrations

基于成功与失败示范的分层视觉语言行动模型

Jeongeun Park, Jihwan Yoon, Byungwoo Jeon, Juhan Park, Jinwoo Shin, Namhoon Cho, Kyungjae Lee, Sangdoo Yun, Sungjoon Choi

机构 * Department of Artificial Intelligence, Korea University(韩国大学人工智能系) Kim Jaechul Graduate School of AI, KAIST(金在拙人工智能研究生院,韩国科学技术院) Department of Aerospace Engineering, Seoul National University(首尔国立大学航空航天工程系) Departmnet of Statistics, Korea University(韩国大学统计系) NAVER AI Lab(NAVER人工智能实验室)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 VINE通过分层强化学习框架,利用失败数据提升视觉语言行动模型的鲁棒性和执行能力。

Comments https://vine-vla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03560 2025-12-04 cs.AI cs.MA 70%

Reason-Plan-ReAct: A Reasoner-Planner Supervising a ReAct Executor for Complex Enterprise Tasks

原因-计划-行动:一种监督ReAct执行器的推理-规划器用于复杂企业任务

Gianni Molinari, Fabio Ciravegna

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 RP-ReAct通过分离战略规划与低层执行,提升企业复杂任务处理的可靠性和效率。

Comments 11 pages, 1 figure, 2 tables, Workshop AAAI 2026 agentic AI Benchmarks and Applications for Enterprise Tasks

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02321 2025-12-03 cs.CR cs.CL 70%

LeechHijack: Covert Computational Resource Exploitation in Intelligent Agent Systems

LeechHijack: 智能代理系统中的隐蔽计算资源利用

Yuanhe Zhang, Weiliu Wang, Zhenhong Zhou, Kun Wang, Jie Zhang, Li Sun, Yang Liu, Sen Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Hangzhou Dianzi University(杭州电子科技大学) Nanyang Technological University(南洋理工大学) CFAR North China Electric Power University(华北电力大学) Chongqing University of Posts(重庆邮电大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL

AI总结 LeechHijack通过隐式毒性攻击利用MCP框架中的信任边界,隐蔽劫持代理计算资源,揭示对计算溯源和资源认证机制的迫切需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01392 2025-12-02 cs.LG cs.SY eess.SY 70%

RE-LLM: Integrating Large Language Models into Renewable Energy Systems

RE-LLM:将大型语言模型整合到可再生能源系统中

Ali Forootani, Mohammad Sadr, Danial Esmaeili Aliabadi, Daniela Thraen

机构 * Helmholtz Centre for Environmental Research - UFZ(环境保护研究 Helmholtz 中心 - UFZ) DBFZ Deutsches Biomasseforschungszentrum gGmbH(德国生物燃料研究中心 DBFZ gGmbH) University Leipzig(莱比锡大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 RE-LLM通过整合大型语言模型,提升能源系统建模的可解释性和实用性,实现快速、严谨和可理解的决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18192 2025-12-01 cs.CV cs.AI 70%

ARIAL: An Agentic Framework for Document VQA with Precise Answer Localization

ARIAL:一个用于文档视觉问答的代理框架,具有精确答案定位

Ahmad Mohammadshirazi, Pinaki Prasad Guha Neogi, Dheeraj Kulshrestha, Rajiv Ramnath

机构 * Ohio State University(俄亥俄州立大学) Flairsoft(Flairsoft公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 ARIAL通过代理协调专门工具,实现文档VQA的高精度和可解释性,取得最佳性能和可解释性成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21882 2025-12-01 cs.LG cs.CV 70%

Closed-Loop Transformers: Autoregressive Modeling as Iterative Latent Equilibrium

闭环变换器:将自回归建模作为迭代潜在均衡

Akbar Anbar Jafari, Gholamreza Anbarjafari

机构 * University of Tartu(塔尔图大学) S Holding OÜ(3S控股公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 本文提出均衡变换器(EqT),通过迭代细化潜在表示实现自洽均衡,解决自回归模型中错误传播问题,提升长序列推理和多步规划能力。

Comments 22 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏