arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-08 至 2026-01-08 共收录 102 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 10 篇

2512.21578 2026-01-08 cs.AI 85%

NEMO-4-PAYPAL: Leveraging NVIDIA's Nemo Framework for empowering PayPal's Commerce Agent

NEMO-4-PAYPAL:利用NVIDIA的Nemo框架赋能PayPal的商业代理

Sudhanshu Garg, Andrew Wang, Chaitanya Kulkarni, Ali Sahami, Farhad Farahani, Sean Yun-Shiuan Chuang, Jian Wan, Srinivasan Manoharan, Uma Kona, Nitin Sharma, Linsey Pang, Prakhar Mehrotra, Jessica Clark, Mark Moyou

机构 * PayPal AI NVIDIA

专题命中 工具调用 :agent(title,abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 NEMO-4-PAYPAL利用NVIDIA Nemo框架优化PayPal商业代理,通过微调Nemotron模型提升检索性能并降低延迟与成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16925 2026-01-08 cs.CV cs.AI cs.IR cs.MA 83%

V-Agent: An Interactive Video Search System Using Vision-Language Models

V-Agent:一种利用视觉-语言模型的交互式视频搜索系统

SunYoung Park, Jong-Hyeon Lee, Youngjune Kim, Daegyu Sung, Younghyun Yu, Young-rok Cha, Jeongho Ju

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 V-Agent通过多智能体协作和视觉-语言模型提升视频搜索性能,实现多模态交互与零样本性能。

Comments CIKM 2025 MMGENSR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11963 2026-01-08 cs.CL 70%

ToolRM: Outcome Reward Models for Tool-Calling Large Language Models

ToolRM: 用于工具调用大型语言模型的成果奖励模型

Mayank Agarwal, Ibrahim Abdelaziz, Kinjal Basu, Merve Unuvar, Luis A. Lastras, Yara Rizk, Pavan Kapanipathi

机构 * IBM Research(IBM研究院)

专题命中 工具调用 :tool use(abstract);tool-use(abstract);分类 cs.CL

AI总结 ToolRM通过领域特定建模提升工具调用奖励模型性能,实现25%的改进并增强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02110 2026-01-08 cs.AI 70%

Attractive Metadata Attack: Inducing LLM Agents to Invoke Malicious Tools

吸引性元数据攻击:诱导LLM代理调用恶意工具

Kanghua Mo, Li Hu, Yucheng Long, Zhihao Li

机构 * Cyberspace Institute of Advanced Technology, Guangzhou University(广州大学网络空间研究院) Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)

专题命中 工具调用 :agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 本研究提出AMA攻击,通过操纵工具元数据诱导LLM代理调用恶意工具,揭示了系统性安全漏洞。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03733 2026-01-08 cs.CV cs.AI cs.CL cs.CY cs.LG 67%

RadDiff: Describing Differences in Radiology Image Sets with Natural Language

RadDiff:用自然语言描述放射学图像集的差异

Xiaoxian Shen, Yuhui Zhang, Sahithi Ankireddy, Xiaohan Wang, Maya Varma, Henry Guo, Curtis Langlotz, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 RadDiff通过多模态代理系统实现放射学图像集差异的自然语言描述,结合医学知识和多模态推理,在放射学研究配对中取得高准确率,推动临床影像分析的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03476 2026-01-08 eess.SY cs.AI cs.LG cs.MA cs.SY 62%

Online Decision-Making Under Uncertainty for Vehicle-to-Building Systems

在不确定环境下为车辆到建筑系统进行在线决策

Rishav Sen, Yunuo Zhang, Fangqi Liu, Jose Paolo Talusan, Ava Pettet, Yoshinori Suzue, Ayan Mukhopadhyay, Abhishek Dubey

机构 * Vanderbilt University(范德比大学) Nissan Advanced Technology Center - Silicon Valley(日产先进技术中心-硅谷)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种基于马尔可夫决策过程的在线决策方法,用于解决车辆到建筑系统在不确定环境下的优化问题,通过在线搜索和启发式剪枝提升效率,实验表明其优于现有方法。

Comments 17 pages, 2 figures, 10 tables. Published in the Proceedings of the 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS '25), May 06--09, 2025, Irvine, CA, USA

Journal ref Proceedings of 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08726 2026-01-08 cs.CL cs.AI 62%

Improved LLM Agents for Financial Document Question Answering

改进的金融文档问答大型语言模型代理

Nelvin Tan, Zian Seng, Liang Zhang, Yu-Ching Shih, Dong Yang, Amol Salunkhe

机构 * American Express(美国美国运通)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出改进的金融文档问答代理,通过实验展示其在无 oracle 标签情况下的有效性,并引入更安全的计算代理。

Comments 13 pages, 6 figures. More analysis is added to Appendix C

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03782 2026-01-08 cs.RO cs.AI cs.CV 57%

PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation

PointWorld: 为真实世界机器人操作扩展3D世界模型

Wenlong Huang, Yu-Wei Chao, Arsalan Mousavian, Ming-Yu Liu, Dieter Fox, Kaichun Mo, Li Fei-Fei

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 PointWorld通过统一状态和动作的3D点流模型,实现了在真实世界中机器人操作的高效预测与控制,无需额外演示或训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11964 2026-01-08 cond-mat.supr-con cond-mat.mtrl-sci 50%

Accelerating the Search for Superconductors Using Machine Learning

利用机器学习加速超导体的搜索

Suhas Adiga, Umesh V. Waghmare

专题命中 工具调用 :workflow(abstract)

AI总结 本文利用机器学习方法,基于量子结构图的描述符,开发出预测超导体临界温度Tc的随机森林模型,通过清理数据库和分析化学组成,实现了对超导材料的高效筛选和预测。

Journal ref Comput. Mater. Sci., 263, 114453 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16021 2026-01-08 astro-ph.HE 50%

Measurement of Very-high-energy Diffuse Gamma-ray Emissions from the Galactic Plane with LHAASO-WCDA

利用LHAASO-WCDA测量银河系平面非常高的能量弥散伽马射线辐射

The LHAASO Collaboration, Zhen Cao, F. Aharonian, Y. X. Bai, Y. W. Bao, D. Bastieri, X. J. Bi, Y. J. Bi, W. Bian, A. V. Bukevich, C. M. Cai, W. Y. Cao, Zhe Cao, J. Chang, J. F. Chang, A. M. Chen, E. S. Chen, H. X. Chen, Liang Chen, Long Chen, M. J. Chen, M. L. Chen, Q. H. Chen, S. Chen, S. H. Chen, S. Z. Chen, T. L. Chen, X. B. Chen, X. J. Chen, Y. Chen, N. Cheng, Y. D. Cheng, M. C. Chu, M. Y. Cui, S. W. Cui, X. H. Cui, Y. D. Cui, B. Z. Dai, H. L. Dai, Z. G. Dai, Danzengluobu, Y. X. Diao, X. Q. Dong, K. K. Duan, J. H. Fan, Y. Z. Fan, J. Fang, J. H. Fang, K. Fang, C. F. Feng, H. Feng, L. Feng, S. H. Feng, X. T. Feng, Y. Feng, Y. L. Feng, S. Gabici, B. Gao, C. D. Gao, Q. Gao, W. Gao, W. K. Gao, M. M. Ge, T. T. Ge, L. S. Geng, G. Giacinti, G. H. Gong, Q. B. Gou, M. H. Gu, F. L. Guo, J. Guo, X. L. Guo, Y. Q. Guo, Y. Y. Guo, Y. A. Han, O. A. Hannuksela, M. Hasan, H. H. He, H. N. He, J. Y. He, X. Y. He, Y. He, S. Hernández-Cadena, Y. K. Hor, B. W. Hou, C. Hou, X. Hou, H. B. Hu, S. C. Hu, C. Huang, D. H. Huang, J. J. Huang, T. Q. Huang, W. J. Huang, X. T. Huang, X. Y. Huang, Y. Huang, Y. Y. Huang, X. L. Ji, H. Y. Jia, K. Jia, H. B. Jiang, K. Jiang, X. W. Jiang, Z. J. Jiang, M. Jin, S. Kaci, M. M. Kang, I. Karpikov, D. Khangulyan, D. Kuleshov, K. Kurinov, B. B. Li, Cheng Li, Cong Li, D. Li, F. Li, H. B. Li, H. C. Li, Jian Li, Jie Li, K. Li, L. Li, R. L. Li, S. D. Li, T. Y. Li, W. L. Li, X. R. Li, Xin Li, Y. Z. Li, Zhe Li, Zhuo Li, E. W. Liang, Y. F. Liang, S. J. Lin, B. Liu, C. Liu, D. Liu, D. B. Liu, H. Liu, H. D. Liu, J. Liu, J. L. Liu, J. R. Liu, M. Y. Liu, R. Y. Liu, S. M. Liu, W. Liu, X. Liu, Y. Liu, Y. Liu, Y. N. Liu, Y. Q. Lou, Q. Luo, Y. Luo, H. K. Lv, B. Q. Ma, L. L. Ma, X. H. Ma, J. R. Mao, Z. Min, W. Mitthumsiri, G. B. Mou, H. J. Mu, Y. C. Nan, A. Neronov, K. C. Y. Ng, M. Y. Ni, L. Nie, L. J. Ou, P. Pattarakijwanich, Z. Y. Pei, J. C. Qi, M. Y. Qi, J. J. Qin, A. Raza, C. Y. Ren, D. Ruffolo, A. Sáiz, M. Saeed, D. Semikoz, L. Shao, O. Shchegolev, Y. Z. Shen, X. D. Sheng, Z. D. Shi, F. W. Shu, H. C. Song, Yu. V. Stenkin, V. Stepanov, Y. Su, D. X. Sun, H. Sun, Q. N. Sun, X. N. Sun, Z. B. Sun, N. H. Tabasam, J. Takata, P. H. T. Tam, H. B. Tan, Q. W. Tang, R. Tang, Z. B. Tang, W. W. Tian, C. N. Tong, L. H. Wan, C. Wang, G. W. Wang, H. G. Wang, H. H. Wang, J. C. Wang, K. Wang, Kai Wang, Kai Wang, L. P. Wang, L. Y. Wang, L. Y. Wang, R. Wang, W. Wang, X. G. Wang, X. J. Wang, X. Y. Wang, Y. Wang, Y. D. Wang, Z. H. Wang, Z. X. Wang, Zheng Wang, D. M. Wei, J. J. Wei, Y. J. Wei, T. Wen, S. S. Weng, C. Y. Wu, H. R. Wu, Q. W. Wu, S. Wu, X. F. Wu, Y. S. Wu, S. Q. Xi, J. Xia, J. J. Xia, G. M. Xiang, D. X. Xiao, G. Xiao, Y. L. Xin, Y. Xing, D. R. Xiong, Z. Xiong, D. L. Xu, R. F. Xu, R. X. Xu, W. L. Xu, L. Xue, D. H. Yan, J. Z. Yan, T. Yan, C. W. Yang, C. Y. Yang, F. F. Yang, L. L. Yang, M. J. Yang, R. Z. Yang, W. X. Yang, Y. H. Yao, Z. G. Yao, X. A. Ye, L. Q. Yin, N. Yin, X. H. You, Z. Y. You, Y. H. Yu, Q. Yuan, H. Yue, H. D. Zeng, T. X. Zeng, W. Zeng, M. Zha, B. B. Zhang, B. T. Zhang, F. Zhang, H. Zhang, H. M. Zhang, H. Y. Zhang, J. L. Zhang, Li Zhang, P. F. Zhang, P. P. Zhang, R. Zhang, S. R. Zhang, S. S. Zhang, W. Y. Zhang, X. Zhang, X. P. Zhang, Yi Zhang, Yong Zhang, Z. P. Zhang, J. Zhao, L. Zhao, L. Z. Zhao, S. P. Zhao, X. H. Zhao, Z. H. Zhao, F. Zheng, W. J. Zhong, B. Zhou, H. Zhou, J. N. Zhou, M. Zhou, P. Zhou, R. Zhou, X. X. Zhou, X. X. Zhou, B. Y. Zhu, C. G. Zhu, F. R. Zhu, H. Zhu, K. J. Zhu, Y. C. Zou, X. Zuo

专题命中 工具调用 :tool use(abstract)

AI总结 LHAASO-WCDA测量银河系平面高能弥散伽马射线辐射,发现能谱软化并揭示其空间分布与气体柱密度的偏离。

Journal ref Physical Review Letters 134, 081002 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 29 篇

2503.23314 2026-01-08 cs.AI cs.CL cs.LG cs.MA 92%

SPIO: Ensemble and Selective Strategies via LLM-Based Multi-Agent Planning in Automated Data Science

SPIO:基于LLM的多智能体规划的集成与选择策略在自动化数据科学中的应用

Wonduk Seo, Juhyeon Lee, Yanjun Shao, Qingshan Zhou, Seunghyun Lee, Yi Bu

机构 * Enhans Peking University(北京大学) Yale University(耶鲁大学)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SPIO通过基于LLM的多智能体规划,在自动化数据科学中实现了集成与选择策略,提升了流程的灵活性和准确性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03164 2026-01-08 cs.CL 88%

WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning

WebAnchor: 通过锚定代理规划稳定长周期网络推理

Xinmiao Yu, Liwen Zhang, Xiaocheng Feng, Yong Jiang, Bing Qin, Pengjun Xie, Jingren Zhou

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.CL

AI总结 WebAnchor通过两阶段强化学习框架,解决长周期网络推理中规划不稳定的问题,提升任务成功率和工具效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04301 2026-01-08 cs.LG cs.AR 85%

The Cost of Dynamic Reasoning: Demystifying AI Agents and Test-Time Scaling from an AI Infrastructure Perspective

动态推理的成本:从AI基础设施视角解密AI代理与测试时扩展

Jiin Kim, Byeongjun Shin, Jinha Chung, Minsoo Rhu

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文从AI基础设施视角解密AI代理与测试时扩展,揭示动态推理带来的高成本与可持续性问题,呼吁转向计算高效的代理设计。

Comments Accepted for publication at the 32nd IEEE International Symposium on High-Performance Computer Architecture (HPCA-32), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08930 2026-01-08 cs.GR 85%

How Does a Virtual Agent Decide Where to Look? Symbolic Cognitive Reasoning for Embodied Head Rotation

虚拟代理如何决定看向何处?基于具身头部旋转的符号认知推理

Juyeong Hwang, Seong-Eun Hong, JaeYoung Seon, Hyeongyeop Kang

专题命中 规划决策 :agent(title,abstract);workflow(abstract);multi-agent(abstract)

AI总结 本文提出SCORE框架,通过符号认知推理实现具身头部旋转,结合视觉-语言模型和大语言模型,使虚拟代理能合理预测头部运动及背后动机。

Comments 13 pages, 8 figures. Accepted to SIGGRAPH Asia Conference Papers '25

Journal ref SIGGRAPH Asia Conference Papers '25, December 15-18, 2025, Hongkong

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04191 2026-01-08 cs.RO cs.AI 84%

Embedding Autonomous Agents in Resource-Constrained Robotic Platforms

在资源受限的机器人平台上嵌入自主代理

Negar Halakou, Juan F. Gutierrez, Ye Sun, Han Jiang, Xueming Wu, Yilun Song, Andres Gomez

机构 * Institut für Datentechnik und Kommunikationsnetze, TU Braunschweig(数据技术与通信网络研究所, Braunschweig 技术大学)

专题命中 规划决策 :autonomous agent(title,abstract);agent(abstract,comments);分类 cs.AI;multi-agent(comments)

AI总结 本研究在资源受限的机器人平台上嵌入自主代理,通过AgentSpeak编程实现迷宫探索,展示高效推理过程适用于实时自主操作。

Comments This is an open-access, author-archived version of a manuscript published in European Conference on Multi-Agent Systems 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03287 2026-01-08 cs.CR cs.AI 81%

Automated Post-Incident Policy Gap Analysis via Threat-Informed Evidence Mapping using Large Language Models

通过大语言模型进行威胁感知证据映射的自动事后政策差距分析

Huan Lin Oh, Jay Yong Jun Jie, Mandy Lee Ling Siu, Jonathan Pan

机构 * Nanyang Technological University, Singapore(南洋理工大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文提出利用大语言模型进行威胁感知证据映射,实现自动事后政策差距分析,提升网络安全事件审查的效率与可审计性。

Comments 5 pages, 1 figure. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03687 2026-01-08 cs.AI 79%

Personalized Medication Planning via Direct Domain Modeling and LLM-Generated Heuristics

通过直接领域建模和LLM生成的启发式方法实现个性化药物规划

Yonatan Vernik, Alexander Tuisov, David Izhaki, Hana Weitman, Gal A. Kaminka, Alexander Shleyfman

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文通过直接领域建模和LLM生成的启发式方法,提升了个性化药物规划的规模和效率,支持更接近临床应用的实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02757 2026-01-08 cs.AI 79%

LLM Agent Framework for Intelligent Change Analysis in Urban Environment using Remote Sensing Imagery

基于遥感影像的城市环境智能变化分析LLM代理框架

Zixuan Xiao, Jun Ma

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出基于LLM和视觉基础模型的ChangeGPT框架,通过分层结构提升变化检测的智能与适应性,实现在城市环境中的高效变化分析。

Journal ref Automation in Construction 177 (2025) 106341

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03904 2026-01-08 cs.RO 78%

Towards Safe Autonomous Driving: A Real-Time Motion Planning Algorithm on Embedded Hardware

迈向安全的自动驾驶:在嵌入式硬件上的实时运动规划算法

Korbinian Moller, Glenn Johannes Tungka, Lucas Jürgens, Johannes Betz

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种在嵌入式硬件上实时运行的轻量级轨迹规划算法,用于提升自动驾驶系统在故障情况下的安全性和可靠性。

Comments 7 pages, submitted to the IEEE Intelligent Vehicles Symposium (IV 2026), Detroit, MI, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19486 2026-01-08 cs.RO cs.DC 78%

Supercomputing for High-speed Avoidance and Reactive Planning in Robots

为机器人提供高速避障与反应规划的超级计算

Kieran S. Lachmansingh, José R. González-Estrada, Jacob Chisholm, Ryan E. Grant, Matthew K. X. J. Pan

机构 * Ingenuity Labs Research Institute(创新实验室研究机构) Queen’s University(女王大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 SHARP通过HPC实现机器人毫秒级避障与反应规划,展示高并发计算在实时机器人中的可行性及混合控制架构的应用。

Comments Error in the graph size calculation, recalculated and resubmitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03398 2026-01-08 cs.RO 78%

Towards Zero-Knowledge Task Planning via a Language-based Approach

通过语言方法实现零知识任务规划

Liam Merz Hoffmeister, Brian Scassellati, Daniel Rakita

机构 * Department of Computer Science, Yale University(计算机科学系,耶鲁大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用大型语言模型实现零知识任务规划,通过分解自然语言指令生成行为树并实时调整,提升任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27251 2026-01-08 cs.MA 78%

FinPos: A Position-Aware Trading Agent System for Real Financial Markets

FinPos:一种面向真实金融市场的位置感知交易代理系统

Bijia Liu, Ronghao Dang

专题命中 规划决策 :agent(title,abstract)

AI总结 FinPos提出了一种位置感知的交易代理系统,通过专业信息解读、双代理决策结构和多时间尺度奖励信号,提升对连续仓位的管理能力,实验证明其在真实市场条件下的优越性。

Comments LLM Applications, LLM Agents, Financial Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23412 2026-01-08 cs.AI 77%

MindWatcher: Toward Smarter Multimodal Tool-Integrated Reasoning

MindWatcher:迈向更智能的多模态工具集成推理

Jiawei Chen, Xintian Shen, Lihao Zheng, Zhenwei Shao, Handong Cui, Chaoqun Du, Li Gong, Feng Gu, Xuefeng Hao, Wei He, Jiabang He, Yi Hu, Bin Huang, Shanshan Li, Qizhen Li, Jing Luo, Zide Liu, Xiaobo Liu, Ning Mao, Lifu Mu, Xuhao Pan, Zhiheng Qu, Chang Ren, Xudong Rao, Haoyi Sun, Qian Wang, Shuai Wang, Zhichao Wang, Wei Wang, Lian Wen, Jiqing Zhan, Hongfu Yang, Sheng Yang, Jiajun Yang, Pengfei Yu, Hongyuan Zhang, Bin Zhang, Chunpeng Zhou, Zheng Zhou, Shucheng Zhou, Shuo Xie, Yun Zhu, Hao Ma, Tao Wei, Pan Zhou, Wei Chen

机构 * Li Auto Inc(力汽车公司)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 MindWatcher是一种能够自主调用工具并进行多模态推理的智能体,通过高效训练和高质量数据集提升了多步骤决策任务的性能。

Comments Technique Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04060 2026-01-08 cs.AI 70%

ComfySearch: Autonomous Exploration and Reasoning for ComfyUI Workflows

ComfySearch: 为ComfyUI工作流实现自主探索与推理

Jinwei Su, Qizhen Lan, Zeyu Wang, Yinghui Xia, Hairu Wen, Yiqun Duan, Xi Xiao, Tianyu Shi, Yang Jingsong, Lewei He

机构 * ComfyUI

专题命中 规划决策 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 ComfySearch通过验证引导的工作流构建,有效提升ComfyUI工作流的通过率和解决方案率,适用于复杂创意任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02144 2026-01-08 cs.LO 67%

VECSR: Virtually Embodied Common Sense Reasoning System

VECSR:虚拟具身常识推理系统

Alexis R. Tudor, Joaquín Arias, Gopal Gupta

专题命中 规划决策 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出VECSR系统,通过基于答案集编程的s(CASP)推理器,将自主代理任务分解为中层指令并解释选择,提升家庭环境中的可信度与可解释性。

Comments In Proceedings ICLP 2025, arXiv:2601.00047

Journal ref EPTCS 439, 2026, pp. 76-88

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03676 2026-01-08 cs.CL cs.AI 62%

Towards Compositional Generalization of LLMs via Skill Taxonomy Guided Data Synthesis

通过技能分类引导的数据合成实现大语言模型的组合泛化

Yifan Wei, Li Du, Xiaoyan Yu, Yang Feng, Angsheng Li

机构 * State Key Laboratory of Complex & Critical Software Environment, Beihang University(复杂与关键软件环境国家重点实验室,北京航空航天大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Beijing Institute of Technology(北京理工大学) Institute of Computing Technology, CAS(中国科学院计算技术研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 STEPS通过技能分类引导的数据合成提升大语言模型的组合泛化能力。

Comments The code and data for our methods and experiments are available at https://github.com/weiyifan1023/STEPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03306 2026-01-08 cs.AI cs.LG 62%

Mastering the Game of Go with Self-play Experience Replay

用自我对战经验回放掌握围棋游戏

Jingbin Liu, Xuechun Wang

机构 * NetEase AI Lab(网易人工智能实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 QZero通过自我对战和非策略经验回放,首次展示了无模型强化学习在掌握围棋中的高效性与可行性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11184 2026-01-08 cs.LG cs.CL 62%

Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization

强化学习用于工具集成的交叉领域泛化思考

Zhengyu Chen, Jinluan Yang, Teng Xiao, Ruochen Zhou, Luan Zhang, Xiangyu Xi, Xiaowei Shi, Wei Wang, Jinggang Wang

机构 * Meituan(美团) Zhejiang University(浙江大学) Allen Institute for Artificial Intelligence(人工智能算法研究所) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出RITE方法,通过强化学习和交叉领域工具执行,提升LLM在跨领域推理中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04056 2026-01-08 cs.CL 57%

Bridging the Discrete-Continuous Gap: Unified Multimodal Generation via Coupled Manifold Discrete Absorbing Diffusion

弥合离散-连续鸿沟:通过耦合流形离散吸收扩散实现统一多模态生成

Yuanfeng Xu, Yuhao Chen, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Lab of Big Data Analysis & Processing(广东省大数据分析与处理重点实验室) X-Era AI Lab(X-Era AI实验室)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 CoM-DAD通过耦合流形离散吸收扩散框架,实现离散与连续数据的统一多模态生成,解决多模态对齐与训练稳定性问题。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03977 2026-01-08 cs.LG 57%

Stage-specific cancer survival prediction enriched by explainable machine learning

针对特定阶段的癌症生存预测通过可解释机器学习增强

Parisa Poorhasani, Bogdan Iancu

机构 * Department of Information Technology Faculty of Science and Engineering Åbo Akademi University(信息科技系科学与工程学院阿博阿卡迪米大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文通过可解释机器学习方法,针对不同癌症阶段的生存预测,揭示特征与癌症阶段的交互作用,提升模型透明性和临床应用价值。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏