Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
消除行动瓶颈:由令牌级能量指导的代理强化学习
Langzhou He, Junyou Zhu, Yue Zhou, Zhengyao Gu, Junhua Liu, Wei-Chieh Huang, Henry Peng Zou, David Wipf, Philip S. Yu, Qitian Wu
机构
*
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
;
Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)
;
Technical University of Berlin(柏林技术大学)
;
University of Southern California(南加州大学)
;
University of Hong Kong(香港大学)
;
Broad Institute of MIT and Harvard(MIT和哈佛大学Broad研究所)
RDMA: Cost Effective Agent-Driven Rare Disease Mining from Electronic Health Records
RDMA: 低成本的代理驱动罕见病挖掘从电子健康记录
John Wu, Adam Cross, Jimeng Sun
机构
*
Department of Computer Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系)
;
Department of Pediatrics, University of Illinois College of Medicine Peoria(伊利诺伊大学皮奥里亚医学院儿科系)
机构
*
The Aerospace Information Research Institute, Chinese Academy of Sciences, Beijing(中国科学院航空航天信息研究所,北京)
;
The School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences, Beijing(中国科学院大学电子电气与通信工程学院,北京)
;
The Department of Computer Science, City University of Hong Kong, Hong Kong, SAR, China(香港城市大学计算机科学系,香港特别行政区,中国)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
EditRefiner:一种对齐人类的代理框架用于图像编辑细化
Zitong Xu, Huiyu Duan, Yifei Nie, Mingda Du, Sijing Wu, Xiongkuo Min, Tianyi Zheng, Jian Zhang, Shusong Xu, Jinwei Chen, Bo Li, Guangtao Zhai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Vivo Mobile Communication Co., Ltd(Vivo移动通信有限公司)
;
University of Electronic Science and Technology of China(电子科学与技术大学)
Patient-Specific Optimization for Mandibular Reconstruction Planning with Enhanced Bone Union
针对增强骨愈合的颌骨重建计划的患者特异性优化
Hamidreza Aftabi, John E. Lloyd, Amanda Ding, Benedikt Sagl, Eitan Prisman, Antony Hodgson, Sidney Fels
机构
*
Department of Electrical and Computer Engineering, University of British Columbia(电气与计算机工程系,不列颠哥伦比亚大学)
;
Department of Surgery, University of British Columbia, Gordon and Leslie Diamond Health Care Centre(不列颠哥伦比亚大学外科系,戈登和莱斯利钻石医疗中心)
;
Center for Clinical Research, University Clinic of Dentistry, Medical University of Vienna(维也纳医科大学牙科学院临床研究中心)
;
Department of Mechanical Engineering, University of British Columbia(机械工程系,不列颠哥伦比亚大学)
;
Sunnybrook Research Institute, University of Toronto(多伦多大学 Sunnybrook 研究院)
机构
*
Department of Computer Science and Technology, Beijing National Research Center for Information Science and Technology, Tsinghua University(计算机科学与技术系,北京信息科学与技术国家研究中心,清华大学)
;
Department of Computer Science, University of Sydney(计算机科学系,悉尼大学)
;
Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学)
Instance-level Visual Active Tracking with Occlusion-Aware Planning
实例级视觉主动跟踪与遮挡感知规划
Haowei Sun, Kai Zhou, Hao Gao, Shiteng Zhang, Jinwu Hu, Xutao Wen, Qixiang Ye, Mingkui Tan
机构
*
South China University of Technology(南方科技大学)
;
Pazhou Laboratory(Pazhou实验室)
;
Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
机构
*
Extreme Robotics Laboratory, School of Metallurgy and Materials, University of Birmingham(极端机器人实验室,冶金与材料学院,伯明翰大学)
;
Department of Applied Artificial Intelligence and Robotics, Aston University(应用人工智能与机器人学院,阿斯顿大学)
机构
*
MAIS,Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所马克思主义学院)
;
Tsinghua University(清华大学)
;
Shanghai Theatre Academy(上海戏剧学院)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
National Cheng Kung University(国立成功大学)
;
University of Konstanz(康斯坦茨大学)
A Comparison of Reinforcement Learning and Optimal Control Methods for Path Planning
强化学习与最优控制方法在路径规划中的比较
Qiang Le, Yaguang Yang, Isaac E. Weintraub
机构
*
Department of Electrical and Computer Engineering, Hampton University(哈珀学院电气与计算机工程系)
;
Air Warfare Directorate, Air Force Research Laboratory(空军研究实验室空战 Directorate)