arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-24 至 2026-02-24 共收录 195 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 72 篇

2602.19980 2026-02-24 cs.LG 79%

Discrete Diffusion Models Exploit Asymmetry to Solve Lookahead Planning Tasks

离散扩散模型利用不对称性解决前瞻规划任务

Itamar Trainin, Shauli Ravfogel, Omri Abend, Amir Feder

机构 * Hebrew University of Jerusalem(耶路撒冷希伯来大学) New York University(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 离散扩散模型通过反向生成机制在无需复杂遍历机制的情况下解决前瞻规划任务,相比自回归模型更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22147 2026-02-24 cs.AI 79%

Lifted Forward Planning in Relational Factored Markov Decision Processes with Concurrent Actions

关系因式马尔可夫决策过程中的提升前向规划

Florian Andreas Marwitz, Tanya Braun, Ralf Möller, Marcel Gehrke

机构 * University of Hamburg(汉堡大学) University of Münster(穆尔斯特大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出Foreplan,一种高效的关联前向规划器,通过一阶表示方法解决大规模对象下的策略计算问题,并提供近似版本以保证误差可控。

Comments Accepted at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18857 2026-02-24 cs.LG 79%

VariBASed: Variational Bayes-Adaptive Sequential Monte-Carlo Planning for Deep Reinforcement Learning

VariBASed: 变分贝叶斯自适应序列蒙特卡洛规划用于深度强化学习

Joery A. de Vries, Jinke He, Yaniv Oren, Pascal R. van der Vaart, Mathijs M. de Weerdt, Matthijs T. J. Spaan

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出VariBASeD方法,通过融合变分信念学习、序列蒙特卡洛规划和元强化学习,提升深度强化学习中探索与利用的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18773 2026-02-24 cs.AI 79%

LAMMI-Pathology: A Tool-Centric Bottom-Up LVLM-Agent Framework for Molecularly Informed Medical Intelligence in Pathology

LAMMI-Pathology: 一种以工具为中心的自下而上LVLM-智能体框架用于分子信息引导的病理学智能

Haoyang Su, Shaoting Zhang, Xiaosong Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 LAMMI-Pathology提出了一种以工具为中心的自下而上智能体框架,通过分子信息引导的病理学智能提升病理图像分析的证据驱动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18700 2026-02-24 cs.CR cs.CL 79%

Watermarking LLM Agent Trajectories

对LLM代理轨迹进行水印标记

Wenlong Meng, Chen Gong, Terry Yue Zhuo, Fan Zhang, Kecen Li, Zheng Liu, Zhou Yang, Chengkun Wei, Wenzhi Chen

机构 * Zhejiang University, China(浙江大学) University of Virginia, USA(弗吉尼亚大学) Alibaba Qwen, China(阿里巴巴通义实验室) University of Alberta, Canada(阿尔伯塔大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 本文提出ActHook,一种针对LLM代理轨迹数据集的水印方法,通过在决策点插入钩子动作实现可靠的黑盒检测,实验显示其在数学推理等任务中具有高检测精度且性能影响小。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18460 2026-02-24 cs.CY cs.AI cs.HC 79%

The Doctor Will (Still) See You Now: On the Structural Limits of Agentic AI in Healthcare

医生还会见你:论代理AI在医疗领域的结构性限制

Gabriela Aránguiz Dias, Kiana Jafari, Allie Griffith, Carolina Aránguiz Dias, Grace Ra Kim, Lana Saadeddin, Mykel J. Kochenderfer

机构 * Stanford University(斯坦福大学) University of Florida(佛罗里达大学) Montclair State University(蒙特克莱尔州立大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文探讨了代理AI在医疗领域应用中的结构性限制,指出技术期望、商业激励和临床约束的交汇对患者安全和责任归属产生实质性影响。

Comments 17 pages, 3 pages of appendix, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24243 2026-02-24 cs.RO cs.AI 79%

SafeFlowMatcher: Safe and Fast Planning using Flow Matching with Control Barrier Functions

SafeFlowMatcher: 基于流匹配与控制屏障函数的安全且快速规划

Jeongyong Yang, Seunghwan Jang, SooJean Han

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SafeFlowMatcher通过结合流匹配与控制屏障函数,实现安全且高效的路径规划,在多个机器人任务中表现出更快、更平滑和更安全的性能。

Comments ICLR 2026(poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10604 2026-02-24 cs.CL cs.AI 79%

Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

步骤3.5 Flash:通过11B活跃参数实现前沿级智能

Ailin Huang, Ang Li, Aobo Kong, Bin Wang, Binxing Jiao, Bo Dong, Bojun Wang, Boyu Chen, Brian Li, Buyun Ma, Chang Su, Changxin Miao, Changyi Wan, Chao Lou, Chen Hu, Chen Xu, Chenfeng Yu, Chengting Feng, Chengyuan Yao, Chunrui Han, Dan Ma, Dapeng Shi, Daxin Jiang, Dehua Ma, Deshan Sun, Di Qi, Enle Liu, Fajie Zhang, Fanqi Wan, Guanzhe Huang, Gulin Yan, Guoliang Cao, Guopeng Li, Han Cheng, Hangyu Guo, Hanshan Zhang, Hao Nie, Haonan Jia, Haoran Lv, Hebin Zhou, Hekun Lv, Heng Wang, Heung-Yeung Shum, Hongbo Huang, Hongbo Peng, Hongyu Zhou, Hongyuan Wang, Houyong Chen, Huangxi Zhu, Huimin Wu, Huiyong Guo, Jia Wang, Jian Zhou, Jianjian Sun, Jiaoren Wu, Jiaran Zhang, Jiashu Lv, Jiashuo Liu, Jiayi Fu, Jiayu Liu, Jie Cheng, Jie Luo, Jie Yang, Jie Zhou, Jieyi Hou, Jing Bai, Jingcheng Hu, Jingjing Xie, Jingwei Wu, Jingyang Zhang, Jishi Zhou, Junfeng Liu, Junzhe Lin, Ka Man Lo, Kai Liang, Kaibo Liu, Kaijun Tan, Kaiwen Yan, Kaixiang Li, Kang An, Kangheng Lin, Lei Yang, Liang Lv, Liang Zhao, Liangyu Chen, Lieyu Shi, Liguo Tan, Lin Lin, Lina Chen, Luck Ma, Mengqiang Ren, Michael Li, Ming Li, Mingliang Li, Mingming Zhang, Mingrui Chen, Mitt Huang, Na Wang, Peng Liu, Qi Han, Qian Zhao, Qinglin He, Qinxin Du, Qiuping Wu, Quan Sun, Rongqiu Yang, Ruihang Miao, Ruixin Han, Ruosi Wan, Ruyan Guo, Shan Wang, Shaoliang Pang, Shaowen Yang, Shengjie Fan, Shijie Shang, Shiliang Yang, Shiwei Li, Shuangshuang Tian, Siqi Liu, Siye Wu, Siyu Chen, Song Yuan, Tiancheng Cao, Tianchi Yue, Tianhao Cheng, Tianning Li, Tingdan Luo, Wang You, Wei Ji, Wei Yuan, Wei Zhang, Weibo Wu, Weihao Xie, Wen Sun, Wenjin Deng, Wenzhen Zheng, Wuxun Xie, Xiangfeng Wang, Xiangwen Kong, Xiangyu Liu, Xiangyu Zhang, Xiaobo Yang, Xiaojia Liu, Xiaolan Yuan, Xiaoran Jiao, Xiaoxiao Ren, Xiaoyun Zhang, Xin Li, Xin Liu, Xin Wu, Xing Chen, Xingping Yang, Xinran Wang, Xu Zhao, Xuan He, Xuanti Feng, Xuedan Cai, Xuqiang Zhou, Yanbo Yu, Yang Li, Yang Xu, Yanlin Lai, Yanming Xu, Yaoyu Wang, Yeqing Shen, Yibo Zhu, Yichen Lv, Yicheng Cao, Yifeng Gong, Yijing Yang, Yikun Yang, Yin Zhao, Yingxiu Zhao, Yinmin Zhang, Yitong Zhang, Yixuan Zhang, Yiyang Chen, Yongchi Zhao, Yongshen Long, Yongyao Wang, Yousong Guan, Yu Zhou, Yuang Peng, Yuanhao Ding, Yuantao Fan, Yuanwei Lu, Yuanzhen Yang, Yuchu Luo, Yudi Zhao, Yue Peng, Yueqiang Lin, Yufan Lu, Yuling Zhao, Yunzhou Ju, Yurong Zhang, Yusheng Li, Yuxiang Yang, Yuyang Chen, Yuzhu Cai, Zejia Weng, Zetao Hong, Zexi Li, Zhe Xie, Zheng Ge, Zheng Gong, Zheng Zeng, Zhenyi Lu, Zhewei Huang, Zhichao Chang, Zhiguo Huang, Zhiheng Hu, Zidong Yang, Zili Wang, Ziqi Ren, Zixin Zhang, Zixuan Wang

机构 * StepFun Team(StepFun团队)

专题命中 规划决策 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 Step 3.5 Flash通过11B活跃参数实现前沿级智能,结合高效推理与多任务表现,提升代理在数学、代码等领域的性能。

Comments Technical report for Step 3.5 Flash

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00403 2026-02-24 cs.LG cs.AI cs.CV 79%

SelfAI: A self-directed framework for long-horizon scientific discovery

SelfAI: 一种用于长周期科学发现的自导向框架

Xiao Wu, Ting-Zhu Huang, Liang-Jian Deng, Xiaobing Yu, Yu Zhong, Shangqi Deng, Ufaq Khan, Jianghao Wu, Xiaofeng Liu, Imran Razzak, Xiaojun Chang, Yutong Xie

机构 * University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Xian Jiaotong University(西安交通大学) Yale University(耶鲁大学) Washington University in St. Louis(圣路易斯华盛顿大学) Monash University(莫纳什大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 SelfAI是一种自导向的多智能体系统,通过自动化科学探索的策略性轨迹决策,实现高效、可重复的长周期科学发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25232 2026-02-24 cs.AI cs.CL 79%

From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity

从医疗记录到诊断对话:一种基于临床的途径和数据集用于精神疾病共病

Tianxi Wan, Jiaming Luo, Siyuan Chen, Kunyao Lan, Jianhua Chen, Haiyang Geng, Mengyue Wu

机构 * X - LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai Mental Health Center, SJTU School of Medicine, China(上海精神卫生中心,上海交通大学医学院) Chen Frontier Lab for AI and Mental Health, Tianqiao and Chrissy Chen Institute, Shanghai, China(陈前沿人工智能与心理健康实验室,田青和克里斯蒂娜·陈研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种基于临床的途径和数据集,用于生成支持精神疾病共病的多轮诊断对话,通过合成患者电子医疗记录和多智能体对话生成技术,构建了首个大规模对话数据集PsyCoTalk,提升了诊断准确性和治疗计划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19518 2026-02-24 cs.RO 78%

Anticipate, Adapt, Act: A Hybrid Framework for Task Planning

预见、适应、行动:一项任务规划的混合框架

Nabanita Dash, Ayush Kaura, Shivam Singh, Ramandeep Singh, Snehasis Banerjee, Mohan Sridharan, K. Madhava Krishna

机构 * Robotics Research Center, IIIT Hyderabad, India(IIIT海得拉巴机器人研究中心) TCS Research, Tata Consultancy Services, India(塔塔咨询公司研究部) School of Informatics, University of Edinburgh, UK(爱丁堡大学信息学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种混合框架,结合LLM的预测能力和关系动态影响图语言的决策能力,用于任务规划中的失败预测与应对。

Comments Accepted at IEEE European Conference on Mobile Robots (ECMR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19062 2026-02-24 cs.RO 78%

Path planning for unmanned surface vehicle based on predictive artificial potential field. International Journal of Advanced Robotic Systems

基于预测人工势场的无人水面车辆路径规划

Jia Song, Ce Hao, Jiangcheng Su

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种结合时间信息和预测势场的改进方法,用于提升无人水面车辆路径规划的效率和避障能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12441 2026-02-24 cs.NI 78%

Automatic Network Planning with Digital Radio Twin

基于数字无线电孪生的自动网络规划

Xiaomeng Li, Yuru Zhang, Qiang Liu, Mehmet Can Vuran, Nathan Huynh, Li Zhao, Mizan Rahman, Eren Erman Ozguven

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出AutoPlan框架,利用数字无线电孪生技术实现自动网络规划,通过贝叶斯优化算法高效优化基站部署参数,在低计算成本下实现与穷举搜索相当的性能。

Comments This paper is accepted by IEEE ICC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18729 2026-02-24 cs.CV 78%

GuideFlow: Constraint-Guided Flow Matching for Planning in End-to-End Autonomous Driving

GuideFlow: 基于约束的流匹配用于端到端自动驾驶中的规划

Lin Liu, Caiyan Jia, Guanyi Yu, Ziying Song, JunQiao Li, Feiyang Jia, Peiliang Wu, Xiaoshuai Hao, Yadan Luo

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence(北京交通大数据挖掘与具身智能重点实验室) Qcraft Yanshan University(燕山大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) The University of Queensland(昆士兰大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 GuideFlow通过约束流匹配技术,在端到端自动驾驶中实现高效规划,直接强制显式约束并提升物理约束满足能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23038 2026-02-24 cs.CL cs.AI cs.LG 78%

Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning

通过工具集成强化学习激励LLM裁判的代理推理

Ran Xu, Jingjing Chen, Jiayu Ye, Yu Wu, Jun Yan, Carl Yang, Hongkun Yu

机构 * Emory University(埃默里大学) Google(谷歌) Google Cloud AI Research(谷歌云人工智能研究)

专题命中 规划决策 :agentic(title);分类 cs.AI、cs.CL、cs.LG

AI总结 TIR-Judge通过工具集成强化学习提升LLM裁判的推理能力,在多个基准测试中取得显著成效。

Comments ICLR 2026

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19516 2026-02-24 cs.CE 75%

Pixel2Phys: Distilling Governing Laws from Visual Dynamics

Pixel2Phys: 从视觉动态中提炼 governing laws

Ruikun Li, Jun Yao, Yingfan Hua, Shixiang Tang, Biqing Qi, Bin Liu, Wanli Ouyang, Yan Lu

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract)

AI总结 Pixel2Phys通过协作多智能体框架从视觉动态中自动提炼物理定律,实现从高维数据到简洁可解释方程的转化。

Comments CVPR2026 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19225 2026-02-24 cs.AI 74%

Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training

基于接近性的多轮优化:LLM代理训练中的实用信用分配

Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chang Liu, Peilin Zhao

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) Peking University(北京大学) Lanzhou University(兰州大学) Tencent Inc.(腾讯公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title);分类 cs.AI

AI总结 ProxMO通过动态调整梯度强度和连续语义加权,提升LLM代理在多轮训练中的信用分配效率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27623 2026-02-24 cs.AI cs.CL cs.CV 73%

BEAT: Visual Backdoor Attacks on VLM-based Embodied Agents via Contrastive Trigger Learning

BEAT:通过对比触发学习对基于VLM的具身代理进行视觉后门攻击

Qiusi Zhan, Hyeonjeong Ha, Rui Yang, Sirui Xu, Hanyang Chen, Liang-Yan Gui, Yu-Xiong Wang, Huan Zhang, Heng Ji, Daniel Kang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 BEAT通过对比触发学习在基于VLM的具身代理中实现视觉后门攻击,提升后门激活精度至39%。

Comments ICLR 2026. Project Page: https://zqs1943.github.io/BEAT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18450 2026-02-24 cs.CL cs.IT cs.LG math.IT 73%

Asymptotic Semantic Collapse in Hierarchical Optimization

层次优化中的渐近语义崩溃

Faruk Alpay, Bugra Kilictas

机构 * Department of Computer Engineering, Bahçeşehir University(计算机工程系,巴切希尔大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 研究揭示了层次优化中语义逐渐趋同的现象,通过数学模型和实验验证了语义状态收敛及信息熵消失的特性。

Comments 23 pages, 2 figures. Includes a dataset-free benchmark with full metric reporting

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19697 2026-02-24 cs.CV cs.GR cs.RO 71%

BayesFusion-SDF: Probabilistic Signed Distance Fusion with View Planning on CPU

BayesFusion-SDF:基于CPU的概率签名距离融合与视点规划

Soumya Mazumdar, Vineet Kumar Rakesh, Tapas Samanta

机构 * Department of Computer Science and Business Systems(计算机科学与商业系统系) Gargi Memorial Institute of Technology(加里纪念技术学院) Computer and Informatics Group(计算机与信息组) Variable Energy Cyclotron Centre(变能回旋加速器中心) Engineering Sciences, Homi Bhabha National Institute Training School Complex(工程科学,霍米·巴布哈国家研究所培训学校复合体)

专题命中 规划决策 :planning(title)

AI总结 BayesFusion-SDF是一种基于CPU的概率签名距离融合方法,通过异方差贝叶斯公式和稀疏线性代数实现高效的几何重建与不确定性估计,适用于主动传感和视点规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19303 2026-02-24 cs.HC 71%

The Path to Conversational AI Tutors: Integrating Tutoring Best Practices and Targeted Technologies to Produce Scalable AI Agents

对话式AI助教的路径:整合辅导最佳实践和定向技术以产生可扩展的AI代理

Kirk Vanacore, Ryan S. Baker, Avery H. Closser, Jeremy Roschelle

专题命中 规划决策 :AI agent(title)

AI总结 本文探讨了通过整合辅导最佳实践和生成式AI技术,开发可扩展且有效的对话式AI助教的研究路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19389 2026-02-24 physics.soc-ph econ.GN q-fin.EC 67%

Extension of the fusion power plant costing standard

融合电力植物成本标准的扩展

Simon Woodruff, Alicia Durham, Alex Higginbottom, Chris Raastad

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 本文扩展了聚变电力植物成本标准,通过引入概率成本层、安全导向成本计算及价值度量模块,提升聚变能源成本分析的透明性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19672 2026-02-24 cs.AI cs.LG 62%

SkillOrchestra: Learning to Route Agents via Skill Transfer

SkillOrchestra: 通过技能迁移学习路由代理

Jiayu Wang, Yifei Ming, Zixuan Ke, Shafiq Joty, Aws Albarghouthi, Frederic Sala

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 SkillOrchestra通过技能迁移学习实现高效的代理协调,相比传统方法在性能和学习成本上均有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18806 2026-02-24 cs.CL cs.AI 62%

Think$^{2}$: Grounded Metacognitive Reasoning in Large Language Models

Think$^{2}$: 大语言模型中的 grounded 元认知推理

Abraham Paul Elenjical, Vivek Hruday Kavuri, Vasudeva Varma

机构 * IIIT Hyderabad(IIIT海得拉尔)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 Think$^{2}$通过引入基于心理理论的元认知框架,提升大语言模型的自我诊断与纠正能力,显著提高推理准确性和可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18493 2026-02-24 cs.LG cs.AI 62%

Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning

学习记忆:为长上下文推理端到端训练记忆代理

Kehao Zhang, Shangtong Gui, Sheng Yang, Wei Chen, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Li Auto Inc.(利亚德公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 UMA通过端到端强化学习框架,整合记忆操作与问答,提升长上下文推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20066 2026-02-24 cs.CV cs.AI 57%

HeatPrompt: Zero-Shot Vision-Language Modeling of Urban Heat Demand from Satellite Images

HeatPrompt: 从卫星图像进行零样本的城市热需求视觉-语言建模

Kundan Thota, Xuanhao Mu, Thorsten Schlachter, Veit Hagenmeyer

机构 * Institute for Automation and Applied Informatics (IAI), Karlsruhe Institute of Technology (KIT), Germany(自动化与应用信息研究所(IAI)、卡尔斯鲁厄理工学院(KIT))

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 HeatPrompt通过卫星图像和地理信息数据,利用零样本视觉语言模型估算城市热需求,提升预测精度并支持数据稀缺地区的热规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16547 2026-02-24 cs.RO cs.AI 57%

Find the Fruit: Zero-Shot Sim2Real RL for Occlusion-Aware Plant Manipulation

寻找水果:面向遮挡感知植物操作的零样本仿真到现实强化学习

Nitesh Subedi, Hsin-Jung Yang, Devesh K. Jha, Soumik Sarkar

机构 * Department of Mechanical Engineering, Iowa State University, USA(爱荷华州立大学机械工程系) Mitsubishi Electric Research Laboratories, USA(三菱电机研究实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种零样本仿真到现实强化学习框架,用于解决遮挡感知的植物操作问题,通过解耦高层规划与低层控制,实现对不同植物的高效采摘操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19698 2026-02-24 cs.DL cs.AI cs.CV cs.IR 57%

Iconographic Classification and Content-Based Recommendation for Digitized Artworks

图标分类与基于内容的数字艺术作品推荐

Krzysztof Kutt, Maciej Baczyński

机构 * Department of Human-Centered Artificial Intelligence(人中心人工智能系) Institute of Applied Computer Science(应用计算机科学研究所) Faculty of Physics, Astronomy and Applied Computer Science(物理、天文学与应用计算机科学学院) Jagiellonian University(雅盖隆大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本文提出利用Iconclass词汇和AI方法,实现数字化艺术作品的图标分类与基于内容的推荐,通过四阶段工作流提升文化遗产库的导航效率。

Comments 14 pages, 7 figures; submitted to ICCS 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19407 2026-02-24 cs.SE 57%

Multi-CoLoR: Context-Aware Localization and Reasoning across Multi-Language Codebases

多语言代码库中的上下文感知定位与推理:Multi-CoLoR

Indira Vats, Sanjukta De, Subhayan Roy, Saurabh Bodhe, Lejin Varghese, Max Kiehn, Yonas Bedasso, Marsha Chechik

专题命中 规划决策 :agent(abstract);分类 cs.SE

AI总结 Multi-CoLoR通过结合组织知识检索与图推理,提升多语言代码库中的定位准确性与效率。

Comments This paper has been accepted for publication at the 33rd IEEE International Conference on Software Analysis, Evolution and Reengineering (SANER 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19372 2026-02-24 cs.RO cs.CV cs.LG 57%

Seeing Farther and Smarter: Value-Guided Multi-Path Reflection for VLM Policy Optimization

看得更远且更聪明:基于价值引导的多路径反射用于VLM策略优化

Yanting Yang, Shenyuan Gao, Qingwen Bu, Li Chen, Dimitris N. Metaxas

机构 * Rutgers University(罗格斯大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究提出了一种基于价值引导的多路径反射方法,用于提升VLM在机器人操作任务中的策略优化性能,通过解耦状态评估与动作生成,提高决策鲁棒性并减少推理时间。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏