arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-30 至 2025-12-30 共收录 138 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 53 篇

2512.23028 2025-12-30 cs.CV cs.AI cs.SE 62%

An Architecture-Led Hybrid Report on Body Language Detection Project

以架构为导向的混合报告:身体语言检测项目

Thomson Tong, Diba Darooneh

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.SE

AI总结 本报告分析了两种视觉-语言模型的架构特性,并探讨了其在视频到制品管道中的应用及系统限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12808 2025-12-30 cs.LG cs.AI cs.LO 62%

Expressive Temporal Specifications for Reward Monitoring

用于奖励监控的表达性时间规范

Omar Adalat, Francesco Belardinelli

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于定量线性时间逻辑的奖励监控方法,用于提升强化学习中奖励密度和训练效率。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15965 2025-12-30 cs.LG cs.AI cs.DC 62%

RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation

RLinf: 通过宏到微流转换实现灵活高效的大型强化学习

Chao Yu, Yuanqing Wang, Zhen Guo, Hao Lin, Si Xu, Hongzhi Zang, Quanlu Zhang, Yongji Wu, Chunyang Zhu, Junhao Hu, Zixiao Huang, Mingjie Wei, Yuqing Xie, Ke Yang, Bo Dai, Zhexuan Xu, Jiakun Du, Xiangyuan Wang, Xu Fu, Letong Shi, Zhihao Liu, Kang Chen, Weilin Liu, Gang Liu, Boxun Li, Jianlei Yang, Zhi Yang, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Zhongguancun Academy(中关村学院) Infinigence AI Peking University(北京大学) UC Berkeley(加州大学伯克利分校) Beihang University(北航) Shanghai Jiaotong University(上海交通大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 RLinf通过宏到微流转换范式,实现了高效灵活的大型强化学习训练系统,显著提升了训练吞吐量。

Comments GitHub Repo: https://github.com/RLinf/RLinf

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22733 2025-12-30 cs.LG cs.AI 62%

FoldAct: Efficient and Stable Context Folding for Long-Horizon Search Agents

FoldAct: 长时间 horizon 搜索代理的高效且稳定的上下文折叠

Jiaqi Shao, Yufeng Miao, Wei Zhang, Bing Luo

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Duke Kunshan University(杜克大学昆山学院) Microsoft AI(微软人工智能)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 FoldAct通过分离损失计算、全上下文一致性损失和选择性段训练,解决长时间 horizon 搜索代理中上下文折叠的非平稳观察问题,提升训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22186 2025-12-30 cs.LG cs.AI 62%

Learning Tennis Strategy Through Curriculum-Based Dueling Double Deep Q-Networks

通过基于课程的学习的对战双深Q网络学习网球策略

Vishnu Mohan

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于课程学习的对战双深Q网络,用于优化网球策略,通过模拟环境实现高胜率和高效发回球表现,但存在防守偏见问题。

Comments 27 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23495 2025-12-30 cs.DC cs.SE 57%

Decoupling Adaptive Control in TeaStore

茶店中自适应控制的解耦

Eddy Truyen

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文探讨了如何通过软件架构方法、云原生操作员模式和遗留编程技术,将自我适应控制逻辑与茶店应用解耦,以实现更灵活的自适应微服务架构。

Comments In Proceedings WACA 2025, arXiv:2512.22054

Journal ref EPTCS 438, 2025, pp. 40-57

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22899 2025-12-30 cs.AI cs.CV 57%

HiSciBench: A Hierarchical Multi-disciplinary Benchmark for Scientific Intelligence from Reading to Discovery

HiSciBench: 一个分层多学科基准,用于从阅读到发现的科学智能

Yaping Zhang, Qixuan Zhang, Xingquan Zhang, Zhiyuan Chen, Wenwen Zhuang, Yupu Liang, Lu Xiang, Yang Zhao, Jiajun Zhang, Yu Zhou, Chengqing Zong

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 HiSciBench是一个分层多学科基准,用于评估从阅读到发现的科学智能,涵盖五个层次,揭示了模型在不同科学推理阶段的能力差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14083 2025-12-30 cs.CV cs.AI q-bio.QM 57%

Fully Automated Deep Learning Based Glenoid Bone Loss Measurement and Severity Stratification on 3D CT in Shoulder Instability

基于深度学习的全自动肩关节不稳3DCT中盂唇骨丢失测量与严重程度分层

Zhonghao Liu, Hanxue Gu, Qihang Li, Michael Fox, Jay M. Levin, Maciej A. Mazurowski, Brian C. Lau

机构 * Duke University(杜克大学) Duke University Medical Center(杜克大学医学中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出了一种全自动深度学习方法,用于3DCT扫描中盂唇骨丢失的测量与严重程度分层,实现了高精度和高一致性,为肩关节不稳的术前规划提供可靠工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13927 2025-12-30 stat.AP cs.LG 57%

Long-Term Spatio-Temporal Forecasting of Monthly Rainfall in West Bengal Using Ensemble Learning Approaches

利用集成学习方法对西孟加拉邦每月降雨进行长期时空预测

Jishu Adhikary, Raju Maiti

机构 * Economic Research Unit(经济研究单位) Indian Statistical Institute(印度统计研究所)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究利用集成学习方法,通过分层建模框架对西孟加拉邦19个地区进行长期月度降雨预测,结合回归和MLP模型以捕捉时间与空间依赖性。

Comments 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00089 2025-12-30 cs.LG stat.ME 57%

A new machine learning framework for occupational accidents forecasting with safety inspections integration

一种整合安全检查的新型机器学习框架用于职业事故预测

Aho Yapi, Pierre Latouche, Arnaud Guillin, Yan Bailly

机构 * Laboratoire de Mathématique Blaise Pascal UMR 6620 CNRS, Université Clermont Auvergne(布列塔尼数学实验室(皮萨实验室))

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种整合安全检查的新型机器学习框架,用于预测职业事故,通过将安全检查数据转化为二元时间序列,实现短期风险信号的生成与评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22758 2025-12-30 cs.LG 57%

A Micro-Macro Machine Learning Framework for Predicting Childhood Obesity Risk Using NHANES and Environmental Determinants

基于NHANES和环境决定因素的微宏观机器学习框架用于预测儿童肥胖风险

Eswarasanthosh Kumar Mamillapalli, Nishtha Sharma

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究提出一个微宏观机器学习框架,整合NHANES和环境数据预测儿童肥胖风险,XGBoost模型表现最佳,构建环境脆弱性指数揭示环境因素对肥胖风险的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22408 2025-12-30 cs.RO cs.AI 57%

A Unified AI, Embedded, Simulation, and Mechanical Design Approach to an Autonomous Delivery Robot

一种整合人工智能、嵌入式系统、仿真和机械设计的自主配送机器人方法

Amro Gamar, Ahmed Abduljalil, Alargam Mohammed, Ali Elhenidy, Abeer Tawakol

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种整合人工智能、嵌入式系统、仿真和机械设计的自主配送机器人方法,通过异构计算架构和优化设计实现了高可靠性和实时控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22254 2025-12-30 cs.GT cs.LG 57%

Analyzing Skill Element in Online Fantasy Cricket

分析在线幻想板球中的技能要素

Sarthak Sarkar, Supratim Das, Purushottam Saha, Diganta Mukherjee, Tridib Mukherjee

机构 * Indian Statistical Institute, Kolkata(印度统计研究所,科拉卡)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文通过统计框架分析在线幻想板球中技能与运气的影响,提出动态锦标赛模型并验证技能要素的存在。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22244 2025-12-30 cs.SE cs.CR 57%

Failure Analysis of Safety Controllers in Autonomous Vehicles Under Object-Based LiDAR Attacks

基于目标的激光雷达攻击下自动驾驶车辆安全控制器失效分析

Daniyal Ganiuly, Nurzhau Bolatbek, Assel Smaiyl

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文研究基于目标的激光雷达攻击对自动驾驶车辆安全控制器的影响,揭示了感知鲁棒性与控制安全之间的差距,并为设计更安全的控制策略提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23635 2025-12-30 cs.CV 50%

Rethinking the Spatio-Temporal Alignment of End-to-End 3D Perception

重新思考端到端3D感知的时空对齐

Xiaoyu Li, Peidong Li, Xian Wu, Long Shi, Dedong Liu, Yitao Wu, Jiajia Fu, Dixiao Cui, Lijun Zhao, Lining Sun

专题命中 规划决策 :planning(abstract)

AI总结 HAT通过自适应解码多假设生成最优时空对齐提案,提升自动驾驶中3D感知精度和鲁棒性。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23152 2025-12-30 eess.SP math.PR 50%

Unscented and Higher-Order Linear Covariance Fidelity Checks and Measures of Non-Gaussianity

无偏和高阶线性协方差保真检查与非高斯性度量

Jackson Kulik, Braden Hastings, Keith A. LeGrand

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于高阶统计量、约束优化和无偏变换的线性协方差保真度度量方法,用于评估和改进航天器导航中非高斯性度量的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22968 2025-12-30 eess.SY cs.SY 50%

A Bezier Curve Based Approach to the Convexification of the AC Optimal Power Flow Problem

基于贝塞尔曲线的AC最优潮流问题凸化方法

Carlos Arturo Saldarriaga-Cortes, Carlos Adrian Correa-Florez, Maximiliano Bueno-Lopez, Maria Victoria Gasca-Segura

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于贝塞尔曲线的AC最优潮流问题凸化方法,通过引入辅助变量和对数变换,实现高效且准确的电力系统优化。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22800 2025-12-30 cs.CV 50%

Medical Scene Reconstruction and Segmentation based on 3D Gaussian Representation

基于3D高斯表示的医学场景重建与分割

Bin Liu, Wenyan Tian, Huangxin Fu, Zizheng Li, Zhifen He, Bo Li

机构 * Nanchang Hangkong University(南昌航空大学) Guilin University Of Electronic Technology(桂林电子科技大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于3D高斯和三平面表示的医学图像重建方法,解决传统方法在稀疏切片中的结构不连续和细节丢失问题,提升重建效率和图像质量。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03812 2025-12-30 physics.med-ph cs.NA math.NA 50%

Impact of friction force and retrieval speed on in silico mechanical thrombectomies: a sensitivity analysis

摩擦力和取栓速度对计算机机械取栓的影响:灵敏度分析

Mahesh S. Nagargoje, Virginia Fregona, Giulia Luraghi, Francesco Migliavacca, Demitria A Poulos, Bryan C Good, Jose Felix Rodriguez Matas

专题命中 规划决策 :planning(abstract)

AI总结 研究探讨了摩擦力和取栓速度对机械取栓模拟的影响,发现摩擦系数和取栓速度变化会显著影响取栓效果,强调了准确计算摩擦因子在计算机模拟中的重要性。

Journal ref Computer Methods and Programs in Biomedicine 271 (2025) 109018

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14404 2025-12-30 cs.CV 50%

ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations

ViC-Bench: 用自由式中间状态表示法对多模态大语言模型的视觉交错链式思维能力进行基准测试

Xuecheng Wu, Jiaxing Liu, Danlei Huang, Yifan Wang, Yunyun Shi, Kedi Chen, Junxiao Xue, Yang Liu, Chunlin Chen, Hairong Dong, Dingkang Yang

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Meituan Inc.(美团公司) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

专题命中 规划决策 :planning(abstract)

AI总结 ViC-Bench 通过自由式中间状态表示法,系统评估多模态大语言模型的视觉交错链式思维能力,涵盖四个任务并提出新评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01681 2025-12-30 physics.flu-dyn 50%

Large Language Model Driven Development of Turbulence Models

基于大语言模型的湍流模型开发

Zhongxin Yang, Yuanwei Bin, Yipeng Shi, Xiang I. A. Yang

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出利用大语言模型开发湍流模型,通过闭环迭代流程生成可解释且性能更优的近壁湍流模型,解决了不利压力梯度、系统旋转和表面粗糙度等问题。

Journal ref Flow (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14894 2025-12-30 cs.RO cs.SY eess.SY 50%

Never too Cocky to Cooperate: An FIM and RL-based USV-AUV Collaborative System for Underwater Tasks in Extreme Sea Conditions

从不自大合作:一种基于FIM和强化学习的USV-AUV协作系统用于极端海况下的水下任务

Jingzehua Xu, Guanwen Xie, Jiwei Tang, Yimian Ding, Weiyi Liu, Junhao Huang, Shuai Zhang, Yi Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Department of Data and Systems Engineering, The University of Hong Kong(数据与系统工程系,香港大学) School of Engineering Science, University of Chinese Academy of Sciences(工程科学学院,中国科学院大学) Department of Data Science, New Jersey Institute of Technology(数据科学系,新泽西理工学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种基于FIM和强化学习的USV-AUV协作系统,用于提升极端海况下水下任务的性能。

Comments This paper has been accepted by IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22485 2025-12-30 q-bio.NC cs.CV eess.IV 50%

JParc: Joint cortical surface parcellation with registration

JParc:联合皮层表面分割与配准

Jian Li, Karthik Gopinath, Brian L. Edlow, Adrian V. Dalca, Bruce Fischl

机构 * 1 Athinoula A. Martinos Center for Biomedical Imaging, Department of Radiology, MGH \& HMS 2 Center for Neurotechnology Neurorecovery, Department of Neurology, MGH \& HMS 3 Computer Science Artificial Intelligence Laboratory, EECS, MIT

专题命中 规划决策 :planning(abstract)

AI总结 JParc通过联合皮层配准与分割方法,利用浅层子网络优化图谱标签,实现高精度的脑皮层分割。

Comments A. V. Dalca and B. Fischl are co-senior authors with equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18850 2025-12-30 cs.RO 50%

InDRiVE: Reward-Free World-Model Pretraining for Autonomous Driving via Latent Disagreement

InDRiVE: 通过潜在分歧进行无奖励世界模型预训练以实现自动驾驶

Feeza Khan Khanzada, Jaerock Kwon

机构 * Department of Electrical and Computer Engineering, University of Michigan-Dearborn(电气与计算机工程系,密歇根大学-迪尔伯恩分校)

专题命中 规划决策 :agent(abstract)

AI总结 InDRiVE通过潜在分歧进行无奖励世界模型预训练,提升了自动驾驶在零样本迁移和少量样本适应中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17119 2025-12-30 stat.AP stat.ME 50%

Uncovering latent territorial structure in ICFES Saber 11 performance with Bayesian multilevel spatial models

利用贝叶斯多级空间模型揭示ICFES Saber 11表现中的潜在地域结构

Laura Pardo, Juan Sosa, Juan Pablo Torres-Clavijo, Andrés Felipe Arévalo-Arévalo

专题命中 规划决策 :workflow(abstract)

AI总结 本文通过贝叶斯多级空间模型分析哥伦比亚Saber 11考试表现,揭示地域结构及社会因素对教育成绩的影响。

Comments 42 pages, 14 tables, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06348 2025-12-30 quant-ph cond-mat.mes-hall cond-mat.quant-gas physics.atom-ph 50%

Quantum sensing with ultracold simulators in lattice and ensemble systems: a review

在晶格和集体系统中使用超冷模拟器进行量子传感:综述

Keshav Das Agarwal, Sayan Mondal, Ayan Sahoo, Debraj Rakshit, Aditi Sen De, Ujjwal Sen

专题命中 规划决策 :planning(abstract)

AI总结 本文综述了利用超冷模拟器在晶格和集体系统中实现量子传感的技术与方法,探讨了其在参数检测中的应用及突破标准量子极限的潜力。

Comments 31 pages, 7 figures, 1 table, review article and close to the published version

Journal ref International Journal of Modern Physics C (December 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17912 2025-12-30 eess.IV cs.CV 50%

UltraBoneUDF: Self-supervised Bone Surface Reconstruction from Ultrasound Based on Neural Unsigned Distance Functions

UltraBoneUDF: 基于神经元无符号距离函数的自监督超声骨表面重建

Luohong Wu, Matthias Seibold, Nicola A. Cavalcanti, Giuseppe Loggia, Lisa Reissner, Bastian Sigrist, Jonas Hein, Lilian Calvet, Arnd Viehöfer, Philipp Fürnstahl

专题命中 规划决策 :planning(abstract)

AI总结 UltraBoneUDF通过自监督学习和无符号距离函数,有效重建超声图像中的开放骨表面,提升了手术规划和引导的精度。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 22 篇

2510.13343 2025-12-30 cs.MA cs.AI cs.LG 90%

AOAD-MAT: Transformer-based multi-agent deep reinforcement learning model considering agents' order of action decisions

AOAD-MAT: 基于Transformer的多智能体深度强化学习模型,考虑智能体行动决策顺序

Shota Takayama, Katsuhide Fujita

机构 * Graduate School of Engineering, Tokyo University of Agriculture and Technology(东京农业与技术大学工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出AOAD-MAT模型,通过考虑智能体行动决策顺序,改进多智能体强化学习的性能。

Comments This manuscript is an extended version of the work accepted as a short paper at the 26th International Conference on Principles and Practice of Multi-Agent Systems (PRIMA 2025). The Version of Record of this contribution is published in Springer's Lecture Notes in Artificial Intelligence series (LNCS/LNAI)

Journal ref PRIMA 2025: Principles and Practice of Multi-Agent Systems, LNCS 16366, pp. 303-310 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01956 2025-12-30 cs.AI cs.LG cs.MA 90%

Scaling Clinician-Grade Feature Generation from Clinical Notes with Multi-Agent Language Models

通过多智能体语言模型实现临床笔记中临床级特征生成的扩展

Jiayi Wang, Jacqueline Jil Vallon, Nikhil V. Kotha, Neil Panjwani, Xi Ling, Margaret Redfield, Sushmita Vij, Sandy Srinivas, John Leppert, Mark K. Buyyounouski, Mohsen Bayati

机构 * Department of Management Science and Engineering, Stanford University School of Engineering(管理科学与工程系,斯坦福大学工程学院) Department of Radiation Oncology, Stanford University School of Medicine(放射肿瘤学系,斯坦福大学医学院) Operations, Information and Technology, Stanford University Graduate Business School(运营、信息与技术,斯坦福大学商学院) Graduate Business School Research Hub, Stanford University Graduate Business School(商学院研究中心,斯坦福大学商学院) Department of Medicine (Oncology), Stanford University School of Medicine(医学系(肿瘤学),斯坦福大学医学院) Department of Medicine, Stanford University School of Medicine(医学系,斯坦福大学医学院) Department of Urology, Stanford University School of Medicine(泌尿学系,斯坦福大学医学院) Veterans Affairs Palo Alto Health Care System(退伍军人事务帕洛阿尔托医疗系统) Department of Electrical Engineering, Stanford University School of Engineering(电气工程系,斯坦福大学工程学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种多智能体语言模型系统,通过自动化临床笔记特征生成,实现了与人工方法相当的预测性能,并在不同医疗场景中展示了良好的可扩展性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22336 2025-12-30 cs.AI cs.CL 90%

Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback

Agent2World: 通过自适应多智能体反馈学习生成符号世界模型

Mengkang Hu, Bowei Xia, Yuran Wu, Ailing Yu, Yude Zou, Qiguang Chen, Shijian Wang, Jiarui Jin, Kexin Li, Wenxiang Jiao, Yuan Lu, Ping Luo

机构 * The University of Hong Kong(香港大学) Xiaohongshu Inc.(小红书公司) UESTC(电子科技大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 Agent2World通过自适应多智能体反馈学习生成符号世界模型,提升推理和微调性能,实现30.95%的相对提升。

Comments 48 pages, 15 tables, 7 figures, Project page: https://agent2world.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏