EasyOPD: An Easy-to-use On-Policy Distillation Framework for Large Language Models
EasyOPD:一种易于使用的大语言模型在线策略蒸馏框架
Jie Sun, Mao Zheng, Mingyang Song, Qiyong Zhong, Gengsheng Li, Zhepei Hong, Chang Wu, Pengfei Liu, Junfeng Fang, Xiang Wang
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Tencent(腾讯)
;
Shanghai Innovation Institute(上海创新研究院)
;
National University of Singapore(新加坡国立大学)
机构
*
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系)
;
Ant International, Ant Group(蚂蚁集团蚂蚁国际)
;
Shanghai Innovation Institute(上海创新研究院)
;
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)
机构
*
Department of Informatics, University of Piraeus(比雷埃克斯大学信息学院)
;
Department of Informatics and Telecommunications, University of Peloponnese(希腊佩拉索斯大学信息与电信学院)
A Tutorial on Autonomous Fault-Tolerant Control Using Knowledge-Grounded LLM Agents
基于知识接地LLM代理的自主容错控制教程
Javal Vyas, Milapji Singh Gill, Artan Markaj, Felix Gehlhoff, Mehmet Mercangöz
机构
*
Autonomous Industrial Systems Laboratory, Imperial College London(帝国理工学院自主工业系统实验室)
;
Institute of Automation Technology, Helmut Schmidt University(赫尔穆特·施密特大学自动化技术研究所)
When the Database Fails: Prompting LLM Dialogue Agents for Safe Recovery in Task-Oriented Dialogue
当数据库失败时:提示LLM对话代理在任务导向对话中安全恢复
Mohammad Alijanpour Shalmani, Alale Rezvani Boroujeni, Jiann Shiun Yuan
机构
*
College of Engineering and Computer Science, University of Central Florida(中佛罗里达大学工程与计算机科学学院)
;
Department of Marketing, University of Central Florida(中佛罗里达大学市场营销系)
Certified Speculative Execution for Untrusted AI Agents
不可信AI代理的认证推测执行
Chenyu Zhou, Qiliang Jiang, Shuning Wu, Xu Zhou
机构
*
School of Engineering, Institute of Science Tokyo, Japan(东京科学大学工学院)
;
College of Control Science and Engineering, Zhejiang University, China(浙江大学控制科学与工程学院)
;
Department of Electrical and Computer Engineering, National University of Singapore, Singapore(新加坡国立大学电气与计算机工程系)
机构
*
School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)
;
Department of Networked Intelligence, Peng Cheng Laboratory(鹏城实验室网络智能部)
;
School of Computer Science and Engineering, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与工程学院)
Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think
微调视觉-语言-动作模型所需的层数比你想象的少
Gia-Binh Nguyen, Trong-Bao Ho, Thien-Loc Ha, Khoa Vo, Philip Lund Møller, Quang T. Nguyen, Long Dinh, Tung M. Luu, Tuan Dam, Vu Duong, Trung Le, Nghi D. Q. Bui, Minh Vu, Tran Nguyen Le, An Thai Le, Ngan Le, Daniel Sonntag, James Zou, Jan Peters, Duy M. H. Nguyen, Ngo Anh Vien
机构
*
Center for AI Research, VinUniversity(VinUniversity人工智能研究中心)
;
VinRobotics
;
University of Arkansas(阿肯色大学)
;
Technical University of Denmark(丹麦技术大学)
;
Hanoi University of Science and Technology(河内科技大学)
;
KAIST(韩国科学技术院)
;
Monash University(莫纳什大学)
;
Oldenburg University(奥尔登堡大学)
;
DFKI(德国人工智能研究中心)
;
University of Stuttgart(斯图加特大学)
;
IMPRS-IS(国际马克斯·普朗克智能系统研究学院)
;
Stanford University(斯坦福大学)
;
Technische Universität Darmstadt(达姆施塔特工业大学)
Co-policy: Responsive Human-Robot Co-Creation for Musical Performances
Co-policy: 响应式人机音乐共创框架
Xuetao Li, Wenke Huang, Mang Ye, Zijian Liu, Jinhua Xie, Jifeng Xuan, Miao Li
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
School of Automation, Wuhan University of Technology(武汉理工大学自动化学院)
;
School of Geodesy and Geomatics, Wuhan University(武汉大学测绘学院)
;
School of Robotics, Wuhan University(武汉大学机器人学院)