MALT: Improving Reasoning with Multi-Agent LLM Training
Sumeet Ramesh Motwani, Chandler Smith, Rocktim Jyoti Das, Rafael Rafailov, Ivan Laptev, Philip H. S. Torr, Fabio Pizzati, Ronald Clark, Christian Schroeder de Witt
机构
*
University of Oxford(牛津大学)
;
Cooperative AI Foundation(合作人工智能基金会)
;
MBZUAI(穆扎夫卡尔人工智能研究所)
;
Stanford University(斯坦福大学)
专题命中
推理与问题求解
:LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Language Agents Mirror Human Causal Reasoning Biases. How Can We Help Them Think Like Scientists?
Anthony GX-Chen, Dongyan Lin, Mandana Samiei, Doina Precup, Blake A. Richards, Rob Fergus, Kenneth Marino
机构
*
New York University(纽约大学)
;
McGill University(麦吉尔大学)
;
Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所)
;
CIFAR Learning in Machines and Brains Program(CIFAR 机器与大脑学习计划)
;
The University of Utah(犹他大学)
Energy-Conscious LLM Decoding: Impact of Text Generation Strategies on GPU Energy Consumption
Alireza Nik, Michael A. Riegler, Pål Halvorsen
机构
*
SimulaMet
专题命中
推理与问题求解
:LLM(title);large language model(abstract);language model(abstract);分类 cs.AI
CommentsUpdated version with additional models and benchmark datasets. The experimental section has been expanded with new analyses, and minor corrections and clarifications have been made throughout the text
MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
Soo Yong Kim, Suin Cho, Vincent-Daniel Yun, Gyeongyeon Hwang
机构
*
A.I.MATICS Inc(A.I.MATICS公司)
;
Boston University(波士顿大学)
;
University of Southern California(南加州大学)
;
Heuron(Heuron公司)
;
MODULABS, Open Neural Networks Research Lab(MODULABS,开放神经网络研究实验室)
Wolfgang Lehrach, Daniel Hennes, Miguel Lazaro-Gredilla, Xinghua Lou, Carter Wendelken, Zun Li, Antoine Dedieu, Jordi Grau-Moya, Marc Lanctot, Atil Iscen, John Schultz, Marcus Chiam, Ian Gemp, Piotr Zielinski, Satinder Singh, Kevin P. Murphy
机构
*
Google DeepMind(谷歌DeepMind)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
MedAgentGym: A Scalable Agentic Training Environment for Code-Centric Reasoning in Biomedical Data Science
Ran Xu, Yuchen Zhuang, Yishan Zhong, Yue Yu, Zifeng Wang, Xiangru Tang, Hang Wu, May D. Wang, Peifeng Ruan, Donghan Yang, Tao Wang, Guanghua Xiao, Xin Liu, Carl Yang, Yang Xie, Wenqi Shi
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
机构
*
Guilin University of Electronic Technology(桂林电子科技大学)
;
The Ohio State University(俄亥俄州立大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
University of California, Berkeley(加州大学伯克利分校)
Humanoid Agent via Embodied Chain-of-Action Reasoning with Multimodal Foundation Models for Zero-Shot Loco-Manipulation
Congcong Wen, Geeta Chandra Raju Bethala, Yu Hao, Niraj Pudasaini, Hao Huang, Shuaihang Yuan, Baoru Huang, Anh Nguyen, Mengyu Wang, Anthony Tzes, Yi Fang
机构
*
Embodied AI and Robotics (AIR) Lab, New York University, New York, USA and NYUAD Center for Artificial Intelligence and Robotics, New York University Abu Dhabi, Abu Dhabi, UAE(纽约大学Embodied AI和机器人实验室及纽约大学阿布扎赫尔人工智能与机器人中心)
;
Harvard AI and Robotics Lab, Harvard University, Boston, USA(哈佛大学人工智能与机器人实验室)
;
Department of Computer Science, University College London, London, UK(伦敦大学学院计算机科学系)
;
Department of Computer Science, University of Liverpool, UK(利物浦大学计算机科学系)
;
NYUAD Center for Artificial Intelligence and Robotics, New York University Abu Dhabi, Abu Dhabi, UAE(纽约大学阿布扎赫尔人工智能与机器人中心)
SeePhys: Does Seeing Help Thinking? -- Benchmarking Vision-Based Physics Reasoning
Kun Xiang, Heng Li, Terry Jingchen Zhang, Yinya Huang, Zirong Liu, Peixin Qu, Jixi He, Jiaqi Chen, Yu-Jie Yuan, Jianhua Han, Hang Xu, Hanhui Li, Mrinmaya Sachan, Xiaodan Liang
机构
*
Sun Yat-sen University(中山大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
Huawei Noah’s Ark Lab(华为诺亚实验室)
;
The University of Hong Kong(香港大学)
;
ETH AI Center(苏黎世人工智能中心)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI
Veri-R1: Toward Precise and Faithful Claim Verification via Online Reinforcement Learning
Qi He, Cheng Qian, Xiusi Chen, Bingxiang He, Yi R. Fung, Heng Ji
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Fudan University(复旦大学)
;
Tsinghua University(清华大学)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL