机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
;
The 63rd Research Institute, National University of Defense Technology, Nanjing(国防科技大学第六三研究所,南京)
Beyond Self-Play and Scale: A Behavior Benchmark for Generalization in Autonomous Driving
超越自我博弈与规模:面向自动驾驶泛化的行为基准
Aron Distelzweig, Faris Janjoš, Andreas Look, Anna Rothenhäusler, Daniel Jost, Oliver Scheel, Raghu Rajan, Daphne Cornelisse, Eugene Vinitsky, Joschka Boedecker
机构
*
University of Freiburg(弗赖堡大学)
;
Bosch Center for Artificial Intelligence(博世人工智能中心)
;
Coburg University of Applied Sciences(科堡应用科学大学)
;
New York University(纽约大学)
Yuxuan Zhang, Penghui Du, Bo Li, Cong Wei, Junwen Miao, Huaisong Zhang, Songcheng Cai, Yubo Wang, Dongfu Jiang, Yuyu Zhang, Ping Nie, Wenhu Chen, Changqian Yu, Kelsey R. Allen
机构
*
University of British Columbia(不列颠哥伦比亚大学)
;
Vector Institute(向量研究所)
;
Kolors Team, Kuaishou Technology(快手团队)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Waterloo(滑铁卢大学)
;
Etude AI
;
Tsinghua University(清华大学)
;
Georgia Institute of Technology(佐治亚理工学院)
AgentCollabBench: Diagnosing When Good Agents Make Bad Collaborators
AgentCollabBench: 评估好代理为何会成为差合作者
Aritra Mazumder, Shubhashis Roy Dipta, Nusrat Jahan Lia, Tanzila Khan, Kainat Raisa Hossain, Nehaa Shri, Shubhrangshu Debsarkar, Humayra Tasnim, Gour Gupal Talukder Shawon, Debjoty Mitra, Sumaiya Ahmed Rani, Al Jami Islam Anik, Al Nafeu Khan
机构
*
University of Utah(犹他大学)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
;
University of Dhaka(达卡大学)
;
Vellore Institute of Technology(韦洛雷理工学院)
;
University of Virginia(弗吉尼亚大学)
;
Rajshahi University of Engineering and Technology(拉贾加赫尔工程与技术大学)
;
Shahjalal University of Science and Technology(沙赫jalal科学与技术大学)
;
BRAC University(BRAC大学)
;
Islamic University of Technology(伊斯兰技术大学)
;
Comilla University(科摩拉大学)
Fine-tuning a vision-language model for fracture-surface morphology recognition
对骨折表面形貌识别进行视觉-语言模型的微调
Quanliang Liu, Jungtaek Kim, Kangwook Lee, Hyunseok Oh
机构
*
Department of Materials Science & Engineering, University of Wisconsin–Madison(威斯康星大学麦迪逊分校材料科学与工程系)
;
Department of Electrical & Computer Engineering, University of Wisconsin–Madison(威斯康星大学麦迪逊分校电气与计算机工程系)
;
KRAFTON
;
Ludo Robotics
Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models
穿越不确定性:音频感知大语言模型不确定性估计的实证研究
Chun-Yi Kuan, Wei-Ping Huang, Hung-yi Lee
机构
*
Graduate Institute of Communication Engineering, National Taiwan University, Taiwan(台湾大学通讯工程研究所)
;
Artificial Intelligence Center of Research Excellence (AI-CoRE), National Taiwan University, Taiwan(台湾大学人工智能卓越研究中心)
Kyle Waters, Lucas Nuzzi, Tadhg Looram, Alessandro Tomasiello, Ariel Ghislain Kemogne Kamdoum, Bikun Li, Damien Sileo, Egor Kretov, Francesco Fournier-Facio, Georgios Soloupis, Haile Kassahun, Hew Wolff, Jiaqi Cai, Lianghui Li, Marc Roth, Mohinder Naiya, Naixu Guo, Qicheng Tang, Richard Wheeler, Samuele Sala, Serguei Popov, Steven Dillmann, Yuqi Li
机构
*
PortexAI
;
University of Milano-Bicocca(米兰-比科卡大学)
;
University of Calgary(卡尔加里大学)
;
University of Chicago(芝加哥大学)
;
Inria(法国国家信息与自动化技术研究院)
;
Fraunhofer Institute for Individualized Medical Technology IMTE(弗劳恩霍夫个性化医疗技术研究所)
;
University of Cambridge(剑桥大学)
;
Independent(独立)
;
McGill University(麦吉尔大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院)
;
Queen Mary University of London(伦敦大学玛丽女王学院)
;
Dot Ingredients
;
National University of Singapore(新加坡国立大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
University of Edinburgh(爱丁堡大学)
;
Murdoch University(墨尔本大学)
;
University of Porto(波尔图大学)
;
Stanford University(斯坦福大学)
;
Stony Brook University(史泰津布鲁克大学)
LABBench2: An Improved Benchmark for AI Systems Performing Biology Research
LABBench2:一种改进的AI系统进行生物研究的基准测试
Jon M Laurent, Albert Bou, Michael Pieler, Conor Igoe, Alex Andonian, Siddharth Narayanan, James Braza, Alexandros Sanchez Vassopoulos, Jacob L Steenwyk, Blake Lash, Andrew D White, Samuel G Rodriques
机构
*
Broad Institute, Cambridge, MA, USA(博德研究所,美国马萨诸塞州剑桥市)
Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation
让 MLLMs 失明:MLLM 内容审核中的对抗走私攻击
Zhiheng Li, Zongyang Ma, Yuntong Pan, Ziqi Zhang, Xiaolei Lv, Bo Li, Jun Gao, Jianing Zhang, Chunfeng Yuan, Bing Li, Weiming Hu
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京市多模态信息超智能安全重点实验室)
;
Hellogroup
;
University of Washington(华盛顿大学)
;
Jilin University(吉林大学)
;
ShanghaiTech University(上海科技大学)
A Systematic Study of Retrieval Pipeline Design for Retrieval-Augmented Medical Question Answering
检索增强医疗问答中检索流程设计的系统研究
Nusrat Sultana, Abdullah Muhammad Moosa, Kazi Afzalur Rahman, Sajal Chandra Banik
机构
*
Department of Mechatronics & Industrial Engineering, Chittagong University of Engineering & Technology(吉大港工程与技术大学机电与工业工程系)
;
Department of Mechanical Engineering, Chittagong University of Engineering & Technology(吉大港工程与技术大学机械工程系)