arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93944 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35728 篇

2606.23079 2026-06-23 cs.RO cs.AI 新提交 79%

AdaReP:Adaptive Re-Planning under Model Mismatch for Neural World-Model Predictive Control

AdaReP:模型失配下的自适应重规划用于神经世界模型预测控制

Yutian Cheng, Xiaojian Ma, Xianhao Wang, Min Yang, Rongpeng Su, Hangxin Liu, Xi Chen, Shuai Li, Qing Li

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对神经世界模型预测控制中重规划计算开销大的问题,提出AdaReP方法,通过在线自适应调整重规划容忍度,在保持任务性能的同时大幅减少规划器计算量。

Comments Accepted at ICANN 2026. This arXiv version contains supplementary materials and appendices that are omitted from the conference version due to space limitations

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22488 2026-06-23 cs.AI 新提交 79%

SCOPE: Evolving Symbolic World for Planning in Open-Ended Environments

SCOPE:面向开放环境规划的演化符号世界

Yundaichuan Zhan, Minghe Gao, Zhongqi Yue, Wendong Bu, Wenqiao Zhang, Guoming Wang, Jisheng Dang, Juncheng Li, Siliang Tang, Yueting Zhuang

机构 * Zhejiang University(浙江大学) Chalmers University of Technology(查尔姆斯理工大学) Lanzhou University(兰州大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出SCOPE框架,通过符号执行模拟器和自适应符号记忆模块,在开放环境中演化符号世界表示,提升规划完整性和鲁棒性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22143 2026-06-23 cs.RO cs.GT cs.LG 新提交 79%

Physics-Informed Eikonal Caging for Whole-Arm Manipulation Planning

基于物理信息的Eikonal笼形约束的全臂操作规划

Yan Zhang, Yiming Li, Yifei Dong, Florian T. Pokorny, Sylvain Calinon

机构 * Idiap Research Institute(Idiap 研究所) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院) KTH Royal Institute of Technology(瑞典皇家理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出将笼形约束重新表述为最小时间逃逸问题,利用物理信息神经网络近似满足Eikonal方程的逃逸时间场,实现全臂操作规划中的鲁棒性提升。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21971 2026-06-23 cs.AI 新提交 79%

REBA: A Revealed Belief Automaton Framework for Online Planning in Continuous POMDPs

REBA:一种用于连续POMDP在线规划的揭示信念自动机框架

Xiangwei Chen, Lingling Fang, Andreas Holzinger, Liming Chen

机构 * School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) School of Computer Science and Artificial Intelligence, Liaoning Normal University(辽宁师范大学计算机科学与人工智能学院) Human-Centered AI Lab, Department of Ecosystem Management, Climate and Biodiversity, BOKU University(BOKU大学生态系统管理与气候生物多样性系人本人工智能实验室) Institute of Human-Centered Computing, Graz University of Technology(格拉茨技术大学人本计算研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出REBA框架,通过信息论门在线分析连续信念空间并建立可靠锚点,构建有限信念自动机,结合ω-正则规范实现无需预定义离散抽象的在线规划,在巡逻和导航任务中性能提升17%-47.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21955 2026-06-23 cs.NI cs.AI 新提交 79%

From RAN Control to Agentic Intelligence: Architecture and Vision for Energy Efficient AI-RAN

从RAN控制到智能体智能:节能AI-RAN的架构与愿景

Sabrine Aroua, Alexis I. Aravanis, Ilias Chatzistefanidis, Hamza Abbar, Anh-Khoa Dang, Anastasios Giovanidis, Salah-Eddine El Ayoubi, Stephane Senecal, Martha Vlachou Konchylaki, Navid Nikaein

机构 * Ericsson Research(爱立信研究) Laboratory of Signals and Systems (L2S)(信号与系统实验室) Universite Paris-Saclay(巴黎-萨克雷大学) CentraleSupelec(中央超导大学) CNRS(国家科学研究中心) BubbleRAN Orange Innovation(Orange创新)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出一种智能体AI原生RAN架构,结合语义意图抽象和大语言模型驱动协调,实现异构工作负载的自适应编排和节能多目标优化,以降低6G网络能耗。

Comments preprint under review at IEEE Network Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21792 2026-06-23 cs.RO cs.AI 新提交 79%

THREAD: Trajectory Planning for Hybrid Rigid-Soft Manipulators with Environment-Aware Diffusion

THREAD: 面向混合刚柔机械臂的环境感知扩散轨迹规划

Shivani Kamtikar, Pranav Asthana, Naveen Kumar Uppalapati, Girish Krishnan, Girish Chowdhary

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Maryland College Park(马里兰大学帕克分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出首个基于扩散的混合刚柔机械臂轨迹规划器THREAD,通过物理启发损失联合约束刚柔段,实现狭窄环境穿行,任务成功率92.4%,碰撞减少5倍。

Comments Project Page: https://robot-thread.github.io, IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21169 2026-06-23 cs.AI 新提交 79%

Trip+: Benchmarking Agents in Personalized Interactive Travel Planning

Trip+: 个性化交互式旅行规划中的智能体基准测试

Junle Chen, Wei Chen, Yehong Xu, Zhengjun Huang, Yuqian Wu, Zhoujin Tian, Kai Wang, Lei Wang, Xiaofang Zhou

机构 * HKUST(香港科技大学) Tencent Hy(腾讯Hy) HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出Trip+基准,通过多轮交互和分钟级行程生成与修订,评估智能体在个性化旅行规划中的可行性、偏好匹配及主观体验(如疲劳度),发现现有模型倾向于技术可行但耗时的行程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20699 2026-06-23 cs.MA cs.AI cs.CY 新提交 79%

Structural Distinguishability of Static and Adaptive Policy Regimes in Agent-Based Regulatory Simulation

基于智能体的监管模拟中静态与自适应政策机制的结构可区分性

Roberto Garrone

机构 * Open University of Cyprus(塞浦路斯开放大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文通过可配置的排放监管ABM基准,比较四种政策-智能体机制,揭示自适应政策与智能体交互导致监管结论差异,提出机制可区分性评估方法。

Comments 19 pages, 4 figures, 9 tables. Simulation-based methodological study

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20142 2026-06-19 cs.AI cs.MA 新提交 79%

RACL: Reasoning-Agent Control Layers for Continuous Metaheuristic Learning

RACL:用于连续元启发式学习的推理代理控制层

Antón Asla Manzárraga

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 提出RACL方法,在元启发式优化器之上添加推理代理,通过观察、推理和干预控制搜索行为,在车辆路径问题上平均成本降低0.641%-8.337%。

Comments 10 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19899 2026-06-19 cs.CY cs.AI 新提交 79%

Measuring Biological Capabilities and Risks of AI Agents

测量AI代理的生物能力与风险

Patricia Paskov, Jeffrey Lee, Kyle Brady, Alyssa Worland

机构 * PATRICIA PASKOV, JEFFREY LEE, KYLE BRADY, ALYSSA WORLAND(PATRICIA PASKOV、JEFFREY LEE、KYLE BRADY、ALYSSA WORLAND)

专题命中 规划决策 :AI agent(title);agentic(abstract);分类 cs.AI

AI总结 针对AI科学家等自主执行多步科学任务的代理系统,本文提出生物代理评估作为解释性工具,并基于实践经验给出定义、设计、运行、评分和记录评估的考量,以帮助决策者谨慎解读结果并指导投资。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19659 2026-06-19 cs.CL 新提交 79%

SAGE-OPD: Selective Agent-Guided Intervention for Multi-Turn On-Policy Distillation

SAGE-OPD:面向多轮在策略蒸馏的选择性智能体引导干预

Yuhang Zhou, Lizhu Zhang, Yifan Wu, Mingyi Wang, Bo Peng, Jiayi Liu, Xiangjun Fan, Zhuokai Zhao

机构 * Meta AI

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 提出SAGE-OPD框架,通过环境反馈和教师判断选择性干预学生响应,结合置信度加权和损失归一化,解决多轮在策略蒸馏中的错误累积问题,在ALFWorld任务中取得13.3%的相对提升。

Comments 21 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19602 2026-06-19 cs.AI 新提交 79%

Configurable Clinical Information Extraction with Agentic RAG: What Works, What Breaks, and Why

可配置的临床信息提取与智能体RAG:什么有效、什么失效及原因

Osman Alperen Çinar-Koraş, Marie Bauer, Sameh Khattab, Merlin Engelke, Moon Kim, Stephan Settelmeier, Shigeyasu Sugawara, Fabian Freisleben, Felix Nensa, Jens Kleesiek

机构 * Institute for Artificial Intelligence in Medicine (IKIM), University Medicine Essen(埃森大学医学院人工智能医学研究所) Faculty of Computer Science, University of Duisburg-Essen(杜伊斯堡-埃森大学计算机科学学院) Department of Physics, TU Dortmund University(多特蒙德工业大学物理系) Lamarr Institute for Machine Learning and Artificial Intelligence, TU Dortmund University(多特蒙德工业大学拉马尔机器学习和人工智能研究所) Advanced Clinical Research Center, Fukushima Medical University(福岛医科大学先进临床研究中心) Department of Cardiology and Vascular Medicine, University Hospital Essen(埃森大学医院心血管内科)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 针对临床文档元数据缺失问题,提出基于智能体RAG的ACIE系统,在埃森大学医学中心部署,通过完整患者上下文推理和源引用验证,在7326次临床判断中实现96.5%的提取接受率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18105 2026-06-18 cs.NI cs.LG 新提交 79%

OmniPlan: An Adaptive Framework for Timely and Near-Optimal Network Planning Optimization

OmniPlan:一种用于及时且近乎最优的网络规划优化的自适应框架

Longlong Zhu, Jiashuo Yu, Zedi Chen, Yuhan Wu, Zhifan Jiang, Yuchen Xian, Yimeng Liu, Jiajie Su, Shaopeng Zhou, Xingyuan Li, Hongyan Liu, Xuan Liu, Dong Zhang, Chunming Wu, Xiang Chen

机构 * Zhejiang University(浙江大学) Fuzhou University(福州市大学) Yangzhou University(扬州大学) The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) College of Computer Science and Technology(计算机科学与技术学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出OmniPlan自适应框架,利用大语言模型解析用户意图,通过混合专家架构动态选择MIP求解器、启发式算法或深度强化学习模型,实现网络规划优化的及时性与近乎最优性,在分布式机器学习推理卸载任务中延迟降低97.8%,资源消耗降低11.5%。

Comments Accepted by ACM KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29649 2026-06-18 cs.AI 版本更新 79%

LLM-Evolved Domain-Independent Heuristics for Symbolic AI Planning

LLM进化的符号AI规划领域无关启发式

Elliot Gestrin, Jendrik Seipp

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文使用进化搜索让大语言模型生成领域无关的启发式函数,在未见测试域上超越手工最优启发式,并首次系统评估了启发式的信息性-速度权衡。

Comments Accepted at the LM4Plan workshop at ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03208 2026-06-18 cs.LG 版本更新 79%

Hierarchical Planning with Latent World Models

基于潜在世界模型的分层规划

Wancong Zhang, Basile Terver, Artem Zholus, Soham Chitnis, Harsh Sutaria, Mido Assran, Randall Balestriero, Amir Bar, Adrien Bardes, Yann LeCun, Nicolas Ballas

机构 * FAIR at Meta(Meta旗下的FAIR) New York University(纽约大学) Mila - Québec AI Institute(魁北克AI研究院) Brown University(布朗大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出HWM架构,通过多时间尺度潜在世界模型和潜在匹配实现分层模型预测控制,解决长时域任务中单层规划失败和计算爆炸问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18154 2026-06-17 cs.AI 新提交 79%

Learning Cardiac Electrophysiology Digital Twins Through Agentic Discovery of Hybrid Structure

通过智能体发现混合结构学习心脏电生理数字孪生

Ziqi Zhou, Yubo Ye, Sumeet Atul Vadhavka, Linwei Wang, Zhiqiang Tao

机构 * Rochester Institute of Technology(罗彻斯特理工学院)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出LEADS框架,利用LLM智能体在结构化动作空间中迭代发现混合物理-神经模型,实现个性化心脏电生理数字孪生构建,优于人工设计和其他LLM方法。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17628 2026-06-17 cs.CL 新提交 79%

OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation

OPD-Evolver:通过在线策略蒸馏培养整体智能体进化器

Guibin Zhang, Xun Xu, Yanwei Yue, Zikun Su, Wangchunshu Zhou, Xiaobin Hu, Shuicheng Yan

机构 * LV-NUS Lab(林文实验室) FDU(福建大学) PKU(北京大学) Bytedance Inc.(字节跳动公司)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 提出OPD-Evolver框架,通过快慢双循环和在线策略自蒸馏,使智能体学会选择、使用、编写和维护经验,在多个基准上超越现有方法,并让小模型挑战大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17082 2026-06-17 cs.RO cs.AI 新提交 79%

ParkingTransformer: LLM-Enhanced End-to-End Trajectory Planning for Autonomous Parking

ParkingTransformer: 基于大语言模型增强的端到端自主泊车轨迹规划

Hauteng Wu, Xu Li, Dong Kong, Zihang Wang, Xieyuanli Chen, Benwu Wang, Wenkai Zhu

机构 * School of Instrument Science and Engineering, Southeast University(东南大学仪器科学与工程学院) School of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) College of Transportation, Shandong University of Science and Technology(山东科技大学交通学院) National University of Defense Technology(国防科技大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出ParkingTransformer框架,利用多视角感知和大语言模型场景理解能力,结合轨迹查询与隐状态特征,直接输出规划轨迹,无需密集BEV表示,通过3D位置编码、固定窗口流机制和粗到细解码策略提升性能,在CARLA和实车实验中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16562 2026-06-16 cs.LG 新提交 79%

MIRAGE: Auditing Anti-Muslim Bias in Frontier LLMs Across Reasoning, Agentic, and Time-Coupled Conditions

MIRAGE: 审计前沿大语言模型在推理、智能体与时间耦合条件下的反穆斯林偏见

Noor Islam S. Mohammad, Tamim Sheikh

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 提出MIRAGE基准,包含1200个提示,覆盖直接完成、思维链推理和模拟智能体决策三种部署场景,发现思维链放大偏见、智能体决策存在不对称性、偏见与检索新闻时间耦合,现有缓解措施效果有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16480 2026-06-16 cs.RO cs.AI cs.SY eess.SY 新提交 79%

HOLO-MPPI: Multi-Scenario Motion Planning via Hierarchical Policy Optimization

HOLO-MPPI:通过分层策略优化的多场景运动规划

Youngjae Min, Jovin D'sa, Faizan M. Tariq, David Isele, Navid Azizan, Sangjae Bae

机构 * Massachusetts Institute of Technology(麻省理工学院) Honda Research Institute, USA(本田研究所(美国))

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出HOLO-MPPI框架,结合离线高层策略学习与在线低层随机最优控制,实现多场景运动规划,无需针对每个场景重新调整参数,在自动驾驶中优于MPPI和端到端RL基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15359 2026-06-16 cs.LG 新提交 79%

DiRecT: Safe Diffusion-Based Planning via Receding-Horizon Denoising

DiRecT:基于滚动去噪的安全扩散规划

Paolo Giaretta, Zeyang Li, Navid Azizan

机构 * MIT(麻省理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出DiRecT算法,通过随机最优控制仅在最终干净轨迹上施加约束,避免中间去噪步骤过度约束,实现安全扩散规划,提升安全性和任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15107 2026-06-16 cs.AI 新提交 79%

Towards Verifiable Agentic Data Science: Solving Irregular TSQA Via Tool-Grounded Reasoning

迈向可验证的自主数据科学:通过基于工具的推理解决不规则时间序列问答

Sanhorn Chen, Xiaoyang Chen, Boyu Liu, Roy Zhao

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agentic(title);AI agent(abstract);分类 cs.AI

AI总结 针对现实世界时间序列数据的不规则性,提出IRTS-ToolBench基准(1700个问题,10种任务类型,13个领域),通过标准化输入和可复现评估协议,研究LLM和AI代理在不规则条件下的表现。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14816 2026-06-16 cs.CR cs.AI 新提交 79%

A Security Analysis of Long-Horizon Agentic AI Systems: Threats, Evaluation, and Framework Development

长周期自主AI系统的安全分析:威胁、评估与框架开发

Ahmed Mohammed Almalki, Mehedi Masud

机构 * Department of Computer Science, College of Computers and Information Technology, Taif University, KSA (Summer 2026)(计算机科学系,计算机与信息科技学院,泰夫大学,沙特阿拉伯(2026年夏季))

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文系统分析长周期自主AI系统的安全挑战,提出威胁分类和攻击传播分析框架,以支持该领域未来研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25006 2026-06-16 cs.RO cs.LG cs.NE 79%

Convex-Neural RRT*: Fast and Reliable Learning-Guided Sampling for High-Quality Robot Path Planning

Convex-Neural RRT*: 快速可靠的基于学习引导的高质量机器人路径规划采样

Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui, Bara J. Emran

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出Convex-Neural RRT*算法,通过神经网络预测高质量路径附近的凸候选区域来引导采样,在多种环境中相比神经引导变体减少30-75%计算时间,路径长度平均减少约5%,成功率超99%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14674 2026-06-15 cs.CL 新提交 79%

AgentSpec: Understanding Embodied Agent Scaffolds Through Controlled Composition

AgentSpec: 通过受控组合理解具身智能体脚手架

Jixuan Chen, Jianzhi Shen, Haoqiang Kang, Zhi Hong, Qingyi Jiang, Soham Bose, Yiming Zhang, Leon Leng, Amit Vyas, Lingjun Mao, Siru Ouyang, Kun Zhou, Lianhui Qin

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校) Johns Hopkins University(约翰霍普金斯大学) University of Washington(华盛顿大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 提出AgentSpec模块化规范框架,将具身智能体表示为可复用策略组件的类型化组合,通过标准化接口实现受控组件替换与重组,揭示脚手架兼容性和交互效应对性能的主导作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14302 2026-06-15 cs.CL 新提交 79%

Retrospective Progress-Aware Self-Refinement for LLM Agent Training

回顾性进度感知的LLM智能体训练自我精炼

Xinbei Ma, Congmin Zheng, Jiyang Qiu, Jiale Hong, Yao Yao, Xiangmou Qu, Jiaxin Yin, Xingyu Lou, Jun Wang, Weiwen Liu, Weinan Zhang, Zhuosheng Zhang, Hai Zhao

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 提出RePro框架,通过前向-反思滚动范式训练智能体自我生成进度信号,无需持续外部监督,在WebShop等任务上提升Qwen系列性能高达12%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12910 2026-06-15 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 79%

Bounding Boxes as Goals: Language-Conditioned Grasping via Neuro-Symbolic Planning

边界框作为目标:通过神经符号规划实现语言条件抓取

Allison Andreyev, Landon Eum, Nestor Tiglao, Romel Gomez

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出GRASP框架,利用预训练VLM将自然语言查询转化为神经符号目标状态,通过边界框检测实现零样本桌面操作,无需任务特定训练。

Comments Project website: https://allisonandreyev.github.io/grasp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00845 2026-06-15 cs.AI 版本更新 79%

Optimizing Agentic Reasoning with Retrieval via Synthetic Semantic Information Gain Reward

通过合成语义信息增益奖励优化基于检索的智能推理

Senkang Hu, Yong Dai, Yuzhi Zhao, Yihang Tao, Yu Guo, Zhengru Fang, Sam Tak Wu Kwong, Yuguang Fang

机构 * Hong Kong JC STEM Lab of Smart City.(香港JC STEM实验室) City University of Hong Kong.(香港城市大学) Lingnan University(岭南大学) Fudan University.(复旦大学) Huazhong University of Science and Technology.(华中科技大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出InfoReasoner框架,利用合成语义信息增益奖励优化检索过程,通过GRPO训练策略,在七个问答基准上平均准确率提升5.4%。

Comments Accepted by ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13673 2026-06-12 cs.CV cs.AI 新提交 79%

SpatialClaw: Rethinking Action Interface for Agentic Spatial Reasoning

SpatialClaw:重新思考智能体空间推理的动作接口

Seokju Cho, Ryo Hachiuma, Abhishek Badki, Hang Su, Byung-Kwan Lee, Chan Hee Song, Sifei Liu, Subhashree Radhakrishnan, Seungryong Kim, Yu-Chiang Frank Wang, Min-Hung Chen

机构 * KAIST(韩国科学技术院) NVIDIA(英伟达)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出SpatialClaw框架,以代码作为动作接口,通过状态化Python内核和感知几何原语,使VLM智能体逐步执行并灵活组合中间结果,在20个3D/4D空间推理基准上平均准确率59.9%,比现有方法高11.2个百分点。

Comments Project page: https://spatialclaw.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12882 2026-06-12 cs.AI 新提交 79%

HarnessBridge: Learnable Bidirectional Controller for LLM Agent Harness

HarnessBridge: 用于LLM智能体框架的可学习双向控制器

Xiaoxuan Wang, Haixin Wang, Alexander Taylor, Jason Cong, Yizhou Sun, Wei Wang

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 提出HarnessBridge,一种轻量级可学习框架控制器,通过双向投影参数化智能体-环境接口,减少令牌使用和轨迹长度,并泛化到更大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏