机构
*
Knight Foundation School of Computing and Information Sciences, Florida International University(佛罗里达国际大学奈特基金会计算与信息科学学院)
;
SRI International(SRI国际公司)
;
University of Florida(佛罗里达大学)
;
Oak Ridge National Laboratory(橡树岭国家实验室)
;
Army Cyber Institute, United States Military Academy(美国军事学院陆军网络研究所)
;
Oakland University(奥克兰大学)
Reinforcing Multi-Turn Reasoning in LLM Agents via Fine-Grained Reward Structure and Credit Assignment
通过细粒度奖励结构与信用分配增强大语言模型智能体的多轮推理能力
Quan Wei, Siliang Zeng, Chenliang Li, Zhongruo Wang, William Brown, Oana Frunza, Wei Deng, Anderson Schneider, Yuriy Nevmyvaka, Yang Katie Zhao, Alfredo Garcia, Mingyi Hong
机构
*
University of Minnesota(明尼苏达大学)
;
Texas A&M University(德克萨斯A&M大学)
;
Prime Intellect
;
Morgan Stanley(摩根大通)
LLM-Advisor: An LLM Advisor for Cost-efficient Path Planning across Multiple Terrains
LLM-Advisor: 一种用于多地形高效路径规划的LLM基准
Ling Xiao, Toshihiko Yamasaki
机构
*
Graduate School of Information Science and Technology, Hokkaido University(弘前大学信息科学与技术研究生院)
;
Department of Information and Communication Engineering, The University of Tokyo(东京大学信息与通信工程系)