CommentsPrevious versions focused on clinical RCTs as an application domain, and were titled "Exploration and Incentivizing Participation in Clinical Trials" and "Incentivizing Participation in Clinical Trials" (pre-2024)
机构
*
Fudan University, Shanghai, China(复旦大学)
;
University of Southern California, Los Angeles, USA(南加州大学)
;
Australian Institute for Machine Learning, Adelaide University, Australia(澳大利亚机器学习研究所)
;
Shanghai Innovation Institute, Shanghai, China(上海创新研究院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
National University of Singapore(新加坡国立大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The University of Hong Kong(香港大学)
;
CUHK MMLab(香港中文大学MMLab)
;
Xi’an Jiaotong University(西安交通大学)
;
Nanjing University(南京大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
Learning How to Remember: A Meta-Cognitive Management Method for Structured and Transferable Agent Memory
学习如何记忆:一种用于结构化和可迁移智能体记忆的元认知管理方法
Sirui Liang, Pengfei Cao, Jian Zhao, Wenhao Teng, Xiangwen Liao, Jun Zhao, Kang Liu
机构
*
Institute of Automation, CAS(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Zhongguancun Academy(中关村学院)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究所)
;
Department of Gastrointestinal Surgery, Fujian Provincial Cancer Hospital(福建省癌症医院胃肠外科)
;
College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院)
机构
*
Xidian University(西安电子科技大学)
;
Zhejiang University(浙江大学)
;
Peking University(北京大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Renmin University of China(中国人民大学)
;
Sun Yat-sen University(中山大学)
;
University of the Chinese Academy of Sciences(中国科学院大学)
LLMs Can't Play Hangman: On the Necessity of a Private Working Memory for Language Agents
LLMs无法玩井字游戏:关于语言代理所需私人工作记忆的必要性
Davide Baldelli, Ali Parviz, Amal Zouaq, Sarath Chandar
机构
*
Mila – Quebec AI Institute(魁北克人工智能研究所)
;
Polytechnique Montréal(蒙特利尔大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
LAMA-WeST Lab(LAMA-WeST实验室)
;
Chandar Research Lab(Chandar研究实验室)
Optimal Learning Rate Schedule for Balancing Effort and Performance
平衡努力与性能的最佳学习率调度
Valentina Njaradi, Rodrigo Carrasco-Davis, Peter E. Latham, Andrew Saxe
机构
*
Gatsby Computational Neuroscience Unit University College London(Gatsby 计算神经科学单元大学学院伦敦)
;
Princeton Neuroscience Institute(普林斯顿神经科学研究所)
;
Sainsbury Wellcome Centre University College London(萨金斯韦尔科中心大学学院伦敦)
机构
*
Department of Computer Science, Brunel University London, UK(布伦埃尔大学伦敦计算机科学系)
;
Department of Computer Science, University of Reading, UK(阅读大学计算机科学系)
A Probabilistic Digital Twin of UK En Route Airspace for Training and Evaluating AI Agents for Air Traffic Control
基于英国航路空域的概率数字孪生:用于训练和评估空管AI代理
Nick Pepper, Adam Keane, Amy Hodgkin, Dewi Gould, Edward Henderson, Lynge Lauritsen, Christos Vlahos, George De Ath, Richard Everson, Richard Cannon, Alvaro Sierra Castro, John Korna, Ben Carvell, Marc Thomas
Comments18 pages, 5 figures, 8 tables. Evaluates ReAct vs Reflexion across four tool-using domains with perturbation (epsilon) and fault-injection (lambda) stress testing; 1,280 total episodes