arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2604.23902 2026-04-28 cs.AI 57%

LLM-Augmented Traffic Signal Control with LSTM-Based Traffic State Prediction and Safety-Constrained Decision Support

基于LSTM的交通信号控制与大语言模型增强的交通状态预测与安全约束决策支持

Jiazhao Shi

机构 * Tandon School of Engineering, New York University(纽约大学Tandon工程学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种结合LSTM交通状态预测和大语言模型的交通信号控制框架,通过预测信号相位和生成自然语言解释,提升交通效率并确保安全约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23821 2026-04-28 cond-mat.mtrl-sci cs.LG 57%

Accelerating Quantum Materials Characterization: Hybrid Active Learning for Autonomous Spin Wave Spectroscopy

加速量子材料表征:用于自主自旋波光谱的混合主动学习

William Ratcliff

机构 * NIST Center for Neutron Research(国家标准与技术研究院中子研究中心)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出TAS-AI框架,通过分离检测、推断和细化任务,提升自旋波光谱的自主分析能力,展示了在不同模型下显著的效率提升。

Comments 47 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23783 2026-04-28 cs.IR cs.AI 57%

S2G-RAG: Structured Sufficiency and Gap Judging for Iterative Retrieval-Augmented QA

S2G-RAG:结构充分性与间隙判断用于迭代检索增强问答

Minghan Li, Junjie Zou, Xinxuan Lv, Chao Zhang, Guodong Zhou

机构 * Soochow University(苏州大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 S2G-RAG通过结构化充分性判断和间隙判断机制,提升多跳问答的准确性和鲁棒性,适用于多轮检索流程。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23626 2026-04-28 cs.CL 57%

GraphPlanner: Graph Memory-Augmented Agentic Routing for Multi-Agent LLMs

GraphPlanner: 多智能体LLM的图记忆增强代理路由

Tao Feng, Haozhen Zhang, Zijie Lei, Peixuan Han, Jiaxuan You

机构 * Department of Computer Science(计算机科学系)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 GraphPlanner通过图记忆增强代理路由方法,提升多智能体LLM在任务规划和多轮协作中的性能,实现更高的准确率和计算效率。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04751 2026-04-28 cs.AI 57%

Evaluating the Search Agent in a Parallel World

在平行世界中评估搜索代理

Jiawei Chen, Xintian Shen, Lihao Zheng, Lifu Mu, Haoyi Sun, Ning Mao, Hao Ma, Tao Wei, Pan Zhou, Kun Zhan

机构 * Li Auto

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Mind-ParaWorld框架,通过生成未来场景和不可侵犯的原子事实,解决传统搜索代理评估中的基准构建、动态过时和证据判断难题。

Comments https://github.com/TIMMY-CHAN/Mind-ParaWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07410 2026-04-28 cs.RO cs.AI 57%

Using Language Models as Closed-Loop High-Level Planners for Robotics Applications: A Brief Overview and Benchmarks

利用语言模型作为闭环高层规划器用于机器人应用:简要概述与基准测试

Hao Wang, Sathwik Karnik, Bea Lim, Somil Bansal

机构 * Ming Hsieh Department of Electrical and Computer Engineering, University of Southern California(南加州大学明希德电气与计算机工程系) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空航天工程系) Department of Mechanical Engineering, Stanford University(斯坦福大学机械工程系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文研究了语言模型在机器人闭环高层规划中的应用,探讨了控制时间跨度和预热启动对性能的影响,并通过实验提供改进建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23459 2026-04-28 cs.MA cs.CR cs.LG 57%

Architecture Matters for Multi-Agent Security

多智能体安全中的架构问题

Ben Hagag, William L. Anderson, Christian Schroeder de Witt, Sarah Scheffler

机构 * Carnegie Mellon University(卡内基梅隆大学) Oxford Witt Lab, University of Oxford(牛津Witt实验室,牛津大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文研究多智能体系统设计决策对任务性能与攻击抵御之间的权衡,通过三个环境和13种架构配置,分析智能体角色、通信拓扑和内存三个关键设计选择的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23449 2026-04-28 cs.AI cs.HC 57%

ArguAgent: AI-Supported Real-Time Grouping for Productive Argumentation in STEM Classrooms

ArguAgent:支持实时小组分组以促进STEM课堂中的有效辩论

Jennifer Kleiman, Yizhu Gao, Xin Xia, Zhaoji Wang, Zipei Zhu, Jongchan Park, Xiaoming Zhai

机构 * AI4STEM Education Center, University of Georgia(AI4STEM教育中心,佐治亚大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 ArguAgent通过实时分析学生立场和辩论能力,优化小组分组,提升STEM课堂中有效辩论的生产力。

Comments Full paper accepted to the 27th International Conference on AI in Education (AIED 2026). AIED Proceedings to be released Summer 2026

Journal ref International Conference on Artificial Intelligence in Education, AIED 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23392 2026-04-28 cs.AI 57%

SoccerRef-Agents: Multi-Agent System for Automated Soccer Refereeing

SoccerRef-Agents: 多智能体系统用于自动足球裁判

Zi Meng, Wanli Song, Yi Hu, Jiayuan Rao, Gang Chen

机构 * University of Michigan(密歇根大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SoccerRef-Agents多智能体系统,通过构建多模态基准和知识库,提升足球裁判决策的准确性和可解释性。

Comments 26 pages, 8 figures. Submitted to ISACE 2026. Github Repo: https://github.com/yjlog/SoccerRef-Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12890 2026-04-28 cs.CV cs.AI 57%

Towards Long-horizon Agentic Multimodal Search

面向长视界代理多模态搜索

Yifan Du, Zikang Liu, Jinbiao Peng, Jie Wu, Junyi Li, Jinyang Li, Wayne Xin Zhao, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 polled 智能学院) City University of Hong Kong(香港城市大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出LMM-Searcher框架,通过文件化视觉表示和定制化图像加载工具,解决长视界多模态搜索中的信息管理与成本问题,实验证明其在长视界基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15993 2026-04-28 cs.CL 57%

Explaining Puzzle Solutions in Natural Language: An Exploratory Study on 6x6 Sudoku

解释自然语言中的谜题解决方案:对6x6数独的探索性研究

Anirudh Maiya, Razan Alghamdi, Maria Leonor Pacheco, Ashutosh Trivedi, Fabio Somenzi

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 研究评估了五种LLM在解决和解释6x6数独中的表现,发现尽管部分模型能解决谜题,但无法提供反映战略推理或直观问题解决的解释,凸显了LLM在人机协作决策中需解决的关键挑战。

Comments Accepted to Findings of ACL 2025

Journal ref Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22446 2026-04-27 cs.AI 57%

From Skills to Talent: Organising Heterogeneous Agents as a Real-World Company

从技能到人才:将异构智能体组织成现实世界的企业

Zhengxu Yu, Yu Fu, Zhiyuan He, Yuxuan Huang, Lee Ka Yiu, Meng Fang, Weilin Luo, Jun Wang

机构 * HUAWEI Noah’s Ark Lab(华为诺亚实验室) University College London(伦敦大学学院) University Liverpool(利物浦大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出OneManCompany框架,通过引入Talent市场和E²R树搜索,将多智能体系统提升至组织层面,实现动态招聘和自适应改进,提升任务完成效率。

Comments 33 pages,13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22428 2026-04-27 cs.AI 57%

CognitiveTwin: Robust Multi-Modal Digital Twins for Predicting Cognitive Decline in Alzheimer's Disease

CognitiveTwin: 用于预测阿尔茨海默病认知衰退的稳健多模态数字孪生

Bulent Soykan, Gulsah Hancerliogullari Koksalmis, Hsin-Hsiung Huang, Laura J. Brattain

机构 * Department of Mechanical, Industrial & Manufacturing Eng.(机械、工业与制造工程系) The University of Toledo(托莱多大学) Department of Industrial Eng. and Mngt. Systems(工业工程与管理系统系) University of Central Florida(中央佛罗里达大学) Department of Statistics and Data Science(统计与数据科学系) Department of Internal Medicine(内科医学系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 CognitiveTwin通过融合多模态纵向数据预测个体认知轨迹,展现高准确性和公平性,对缺失数据具有鲁棒性,适用于临床试验和个性化医疗。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14287 2026-04-27 cs.LG 57%

Chain-of-Memory: Lightweight Memory Construction with Dynamic Evolution for LLM Agents

链式记忆:轻量级记忆构建与动态演化用于大语言模型代理

Xiucheng Xu, Bingbing Xu, Xueyun Tian, Zihe Huang, Rongxin Chen, Yunfan Li, Huawei Shen

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出CoM框架,通过轻量级记忆构建与动态演化机制,提升LLM代理的持久知识维护与长周期决策能力,实验显示在LongMemEval和LoCoMo基准上准确率提升7.5%-10.4%,计算开销降低2.7%-6.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03294 2026-04-27 cs.CR cs.AI 57%

AgentMark: Utility-Preserving Behavioral Watermarking for Agents

AgentMark:用于代理的效用保持行为水印

Kaibo Huang, Jin Tan, Yukun Wei, Wanling Li, Zipei Zhang, Hui Tian, Zhongliang Yang, Linna Zhou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Huaqiao University(华侨大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出AgentMark,一种用于代理的行为水印方法,通过在规划决策中嵌入多比特标识符以保持效用,适用于黑盒API和动作层内容水印。

Comments Accepted to ACL 2026 (Main, Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16853 2026-04-27 cs.CY cs.AI 57%

Agentic Inequality

代理不平等

Matthew Sharp, Omer Bilgin, Iason Gabriel, Lewis Hammond

机构 * Oxford Martin AI Governance Initiative(牛津马丁人工智能治理研究所) Access Partnership University of Oxford(牛津大学) Google DeepMind(谷歌DeepMind) Cooperative AI Foundation(协作人工智能基金会)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文探讨了AI代理在政治经济中的影响,定义了代理不平等的概念,并分析了其成因与治理路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21590 2026-04-24 cs.CL 57%

AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use

AgenticQwen:通过双数据飞轮训练小型代理语言模型以实现工业级工具使用

Yuanjie Lyu, Chengyu Wang, Haonan Zheng, Yuanhao Yue, Junbing Yan, Ming Wang, Jun Huang

机构 * Alibaba Group(阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出AgenticQwen模型,通过多轮强化学习在合成数据和有限开源数据上训练,结合推理强化学习和代理强化学习的双数据飞轮,提升工业场景下的多步骤推理和工具使用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21092 2026-04-24 cs.AI cs.SE 57%

Mind the Prompt: Self-adaptive Generation of Task Plan Explanations via LLMs

注意提示:通过LLMs实现自我适应的任务计划解释生成

Gricel Vázquez, Alexandros Evangelidis, Sepeedeh Shahbeigi, Radu Calinescu, Simos Gerasimou

机构 * University of York, UK(英国约克大学) Cyprus University of Technology, Cyprus(塞浦路斯技术大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出COMPASS方法,通过将提示工程建模为认知和概率决策过程,实现复杂任务规划系统中自适应的解释生成和提示优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20987 2026-04-24 cs.AI 57%

Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks

共进化LLM决策与技能库代理以应对长周期任务

Xiyang Wu, Zongxia Li, Guangyao Shi, Alexander Duffy, Tyler Marques, Matthew Lyle Olson, Tianyi Zhou, Dinesh Manocha

机构 * University of Maryland(马里兰大学) University of Southern California(南加州大学) Good Start Labs(Good Start实验室) Independent Researcher(独立研究者) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出COSPLAY框架,通过LLM决策代理与技能库代理的共进化,提升长周期任务中的技能检索与决策能力,实验显示在六个游戏环境中,COSPLAY在单人游戏基准上平均奖励提升超过25.1%。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20924 2026-04-24 cs.LG 57%

Clinically Interpretable Sepsis Early Warning via LLM-Guided Simulation of Temporal Physiological Dynamics

基于LLM的临床可解释性脓毒症早期预警:时间生理动态模拟

Weizhi Nie, Zhen Qu, Weijie Wang, Chunpei Li, Ke Lu, Bingyang Zhou, Hongzhi Yu

机构 * School of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院) Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系) Department of Orthopedics, Affiliated Kunshan Hospital of Jiangsu University(江苏大学附属昆山医院骨科部) Tianjin University Chest Hospital(天津大学胸科医院) Haihe Hospital, Tianjin University(天津大学海河医院) Key Laboratory of Education Blockchain and Intelligent Technology, Ministry of Education, Guangxi Normal University(广西师范大学教育区块链与智能技术重点实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出基于LLM的时间生理动态模拟框架,通过模拟疾病前的生理轨迹,实现可解释的脓毒症早期预警,实验表明其在AUC指标上优于传统方法,并提供可解释的风险趋势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20868 2026-04-24 cs.CY cs.AI cs.HC 57%

The AI Criminal Mastermind

人工智能犯罪大师

Joshua Krook

机构 * Era AI Fellow University of Antwerp(安特卫普大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文探讨了AI犯罪大师可能带来的法律责任问题,分析了AI通过雇佣人类执行犯罪行为时的责任归属难题,提出了三种不同场景下的责任分配挑战。

Comments 28 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20862 2026-04-24 cs.AI cs.MA 57%

Architecture of an AI-Based Automated Course of Action Generation System for Military Operations

基于人工智能的军事行动自动化行动方案生成系统架构

Ji-il Park, Inwook Shim, Chong Hui Kim

机构 * Ministry of National Defense(国防部长办公室) Department of Smart Mobility Engineering(智能移动工程系) Defense AI R&D Institute, Agency for Defense Development (ADD)(国防AI研发院,国防发展局)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文基于公开信息,提出适用于行动方案规划各阶段的AI技术,并设计自动化行动方案规划系统架构。

Comments 15 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12867 2026-04-24 cs.AI 57%

QuarkMedSearch: A Long-Horizon Deep Search Agent for Exploring Medical Intelligence

QuarkMedSearch: 一种长Horizon深度搜索代理用于探索医学智能

Zhichao Lin, Zhichao Liang, Gaoqiang Liu, Meng Xu, Baoyu Xiang, Shuxin Zhao, Yao Wu, Jian Xu, Guanjun Jiang

机构 * Qwen Applications Business Group, Alibaba(阿里巴巴文库应用事业部)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出QuarkMedSearch,通过构建医疗多跳数据、训练策略和评估基准,提升垂直领域性能。采用两阶段SFT和RL训练策略,结合大规模医疗知识图谱和实时探索生成长Horizon训练数据,实验显示其在开源模型中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13211 2026-04-24 cs.NI cs.AI 57%

An Overlay Multicast Routing Method Based on Network Situational Awareness and Hierarchical Multi-Agent Reinforcement Learning

基于网络态势感知和分层多智能体强化学习的overlay组播路由方法

Miao Ye, Yanye Chen, Yong Wang, Cheng Zhu, Qiuxiang Jiang, Gai Huang, Feng Ding

机构 * School of Information and Communication, Guilin University of Electronic Technology(桂林电子科技大学信息与通信学院) School of Computer Science and Information Security, Guilin University of Electronic Technology(桂林电子科技大学计算机科学与信息安全学院) Information Center, Guilin Medical University(桂林医学院信息中心) School of Optoelectronic Engineering, Guilin University of Electronic Technology(桂林电子科技大学光电工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出MA-DHRL-OM方法,通过分层多智能体强化学习和SDN全局视图构建组播路径规划模型,解决传统组播在动态流量适应性和多目标优化中的不足,实验表明其在延迟、带宽利用和丢包率方面表现更优。

Comments 30page, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11569 2026-04-24 cs.AI 57%

SemaPop: Semantic-Persona Conditioned and Controllable Population Synthesis

SemaPop:基于语义-人设的可控人口合成

Zhenlin Qin, Yancheng Ling, Leizhen Wang, Francisco Câmara Pereira, Zhenliang Ma

机构 * Department of Civil and Architectural Engineering, KTH Royal Institute of Technology(土木与建筑系,皇家理工学院) Digital Future, KTH Royal Institute of Technology(数字未来,皇家理工学院) Department of Data Science and Artificial Intelligence, Monash University(数据科学与人工智能系,墨尔本大学) Department of Technology, Management and Economics, Technical University of Denmark(技术、管理与经济学系,丹麦技术大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 SemaPop通过引入人设表示作为生成条件,实现可控的人口合成,提升生成性能并保持统计一致性与样本多样性。

Comments Submitted to Transportation Research Part C: Emerging Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11159 2026-04-24 cs.AI 57%

C-SHAP for time series: An approach to high-level temporal explanations

C-SHAP用于时间序列:一种高层面时间解释的方法

Annemarie Jutte, Faizan Ahmed, Jeroen Linssen, Maurice van Keulen

机构 * Saxion University of Applied Sciences(萨克逊应用科学大学) University of Twente(代尔夫特理工大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出C-SHAP方法,通过提取时间序列中的高层模式来提升AI决策的可解释性,应用于医疗和工业领域,如活动识别和预测维护。

Comments Comments: 18 pages, 7 figures, improved and expanded version of the original paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20370 2026-04-23 cs.LG stat.ML 57%

Cold-Start Forecasting of New Product Life-Cycles via Conditional Diffusion Models

通过条件扩散模型进行新产品生命周期的冷启动预测

Ruihan Zhou, Zishi Zhang, Jinhui Han, Yijie Peng, Xiaowei Zhang

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Department of Industrial Engineering and Decision Analytics, The Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出CDLF模型,利用静态描述、参考轨迹和新观察数据预测新产品生命周期,解决冷启动问题,提升预测准确性与概率预测质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20158 2026-04-23 cs.AI 57%

Stateless Decision Memory for Enterprise AI Agents

无状态决策记忆用于企业AI代理

Vasundra Srinivasan

机构 * Vasundra Srinivasan

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出无状态决策记忆(DPM),在企业监管领域中通过无状态设计提升决策精度和可审计性,同时提高效率。

Comments 16 pages, 4 figures, 4 tables. Companion paper to "Four-Axis Decision Alignment for Long-Horizon Enterprise AI Agents" (arXiv:TBD). Code and reproducibility artifacts at https://github.com/vasundras/stateless-decision-memory-enterprise-ai-agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20151 2026-04-23 cs.RO cs.LG 57%

Toward Safe Autonomous Robotic Endovascular Interventions using World Models

迈向安全的自主机器人内血管干预的世模型

Harry Robertshaw, Nikola Fischer, Han-Ru Wu, Andrea Walker Perez, Weiyuan Deng, Benjamin Jackson, Christos Bergeles, Alejandro Granados, Thomas C Booth

机构 * Surgical & Interventional Engineering, School of Biomedical Engineering & Imaging Sciences, King’s College London(外科与介入工程系,生物医学工程与成像科学学院,伦敦国王学院) Department of Radiology, National Taiwan University Hospital(放射科,台湾大学医院) Department of Neuroradiology, King’s College Hospital(神经放射科,伦敦国王医院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出基于世模型的框架,利用TD-MPC2方法在内血管导航中实现自主机械取栓,通过仿真和体外实验验证其在安全性和泛化性上的优势。

Comments This manuscript is a preprint and has been submitted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20070 2026-04-23 cs.HC cs.AI cs.CE 57%

Auditing and Controlling AI Agent Actions in Spreadsheets

对电子表格中AI代理行为的审计与控制

Sadra Sabouri, Zeinabsadat Saghi, Run Huang, Sujay Maladi, Esmeralda Eufracio, Sumit Gulwani, Souti Chattopadhyay

机构 * University of Southern California(南加州大学) California State Polytechnic University(加州州立理工大学) Microsoft(微软公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Pista,一种可审计、可控的电子表格AI代理,通过分解执行过程让用户实时干预决策,提升用户对任务的理解和控制感。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏