From Pixels to Prose: Advancing Multi-Modal Language Models for Remote Sensing
从像素到 prose:推进遥感多模态语言模型
Xintian Sun, Benji Peng, Charles Zhang, Fei Jin, Qian Niu, Junyu Liu, Keyu Chen, Ming Li, Pohsun Feng, Ziqian Bi, Ming Liu, Xinyuan Song, Yichao Zhang
机构
*
Simon Fraser University(西蒙弗雷泽大学)
;
University of Minnesota - Twin Cities(明尼苏达大学双城分校)
;
Kyoto University(京都大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
National Taiwan Normal University(台湾师范大学)
;
Purdue University(普渡大学)
;
Emory University(埃默里大学)
;
The University of Texas at Dallas(德克萨斯大学达拉斯分校)
机构
*
Pritzker School of Molecular Engineering, University of Chicago(芝加哥大学普利兹克分子工程学院)
;
Chemical Sciences and Engineering Division, Argonne National Laboratory(阿贡国家实验室化学科学与工程 division)
;
Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)
Multimodal Control of Manipulators: Coupling Kinematics and Vision for Self-Driving Laboratory Operations
多模态操作臂控制:结合运动学与视觉的自我驱动实验室操作
Shifa Sulaiman, Amarnath H, Simon Bogh, Naresh Marturi
机构
*
1 Department of Electronics Systems, Aalborg University, Denmark
;
3 Extreme Robotics Laboratory, School of Metallurgy \& Materials, University of Birmingham, Birmingham, United Kingdom
机构
*
The Institute of Robotics and Automatic Information System(机器人与自动信息系统研究所)
;
Tianjin Key Laboratory of Intelligent Robotics(智能机器人天津重点实验室)
;
TBI Center, Nankai University, Tianjin 300350, China(南开大学天津中心)
;
Faculty of Robot Science and Engineering, Northeastern University, Shenyang 110819, China(机器人科学与工程学院)
;
The State Key Laboratory of Internet of Things for Smart City(智能城市物联网国家重点实验室)
;
Centre for Artificial Intelligence(人工智能中心)
;
Department of Electromechanical Engineering, University of Macau, Macau SAR, China(机电工程系,澳门大学)
机构
*
Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院机械工程系)
;
Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院电气工程与计算机科学系)
;
Department of Computer Science, Technical University of Munich, Munich, Germany(慕尼黑技术大学计算机科学系)
Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation
多方面知识增强的医学视觉-语言预训练与多代理数据生成
Xieji Li, Siyuan Yan, Yingsheng Liu, H. Peter Soyer, Monika Janda, Victoria Mar, Zongyuan Ge
机构
*
Department of Data Science and AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,墨尔本大学)
;
Victorian Melanoma Service, Alfred Health(维多利亚黑色素瘤服务,阿尔弗雷德健康)
;
Frazer Institute, The University of Queensland, Dermatology Research Centre(弗雷泽研究所,昆士兰大学,皮肤科研究中心)
Learning Network Sheaves for AI-native Semantic Communication
面向AI原生语义通信的网络sheaf学习
Enrico Grimaldi, Mario Edoardo Pandolfo, Gabriele D'Acunto, Sergio Barbarossa, Paolo Di Lorenzo
机构
*
Department of Computer, Control and Management Engineering, Sapienza University of Rome, Italy(计算机、控制与管理工程系,罗马萨皮恩扎大学)
;
National Inter-University Consortium for Telecommunications (CNIT), Parma, Italy(电信国家大学联合体(CNIT),帕尔马,意大利)
;
Department of Information Engineering, Electronics, and Telecommunications, Sapienza University, Rome, Italy(信息工程、电子与电信系,罗马萨皮恩扎大学)
Evaluating Generalization Capabilities of LLM-Based Agents in Mixed-Motive Scenarios Using Concordia
利用Concordia评估基于LLM的智能体在混合动机场景中的泛化能力
Chandler Smith, Marwa Abdulhai, Manfred Diaz, Marko Tesic, Rakshit S. Trivedi, Alexander Sasha Vezhnevets, Lewis Hammond, Jesse Clifton, Minsuk Chang, Edgar A. Duéñez-Guzmán, John P. Agapiou, Jayd Matyas, Danny Karmon, Akash Kundu, Aliaksei Korshuk, Ananya Ananya, Arrasy Rahman, Avinaash Anand Kulandaivel, Bain McHale, Beining Zhang, Buyantuev Alexander, Carlos Saith Rodriguez Rojas, Caroline Wang, Chetan Talele, Chenao Liu, Chichen Lin, Diana Riazi, Di Yang Shi, Emanuel Tewolde, Elizaveta Tennant, Fangwei Zhong, Fuyang Cui, Gang Zhao, Gema Parreño Piqueras, Hyeonggeun Yun, Ilya Makarov, Jiaxun Cui, Jebish Purbey, Jim Dilkes, Jord Nguyen, Lingyun Xiao, Luis Felipe Giraldo, Manuela Chacon-Chamorro, Manuel Sebastian Rios Beltran, Marta Emili García Segura, Mengmeng Wang, Mogtaba Alim, Nicanor Quijano, Nico Schiavone, Olivia Macmillan-Scott, Oswaldo Peña, Peter Stone, Ram Mohan Rao Kadiyala, Rolando Fernandez, Ruben Manrique, Sunjia Lu, Sheila A. McIlraith, Shamika Dhuri, Shuqing Shi, Siddhant Gupta, Sneheel Sarangi, Sriram Ganapathi Subramanian, Taehun Cha, Toryn Q. Klassen, Wenming Tu, Weijian Fan, Wu Ruiyang, Xue Feng, Yali Du, Yang Liu, Yiding Wang, Yipeng Kang, Yoonchang Sung, Yuxuan Chen, Zhaowei Zhang, Zhihan Wang, Zhiqiang Wu, Ziang Chen, Zilong Zheng, Zixia Jia, Ziyan Wang, Dylan Hadfield-Menell, Natasha Jaques, Tim Baarslag, Jose Hernandez-Orallo, Joel Z. Leibo
机构
*
Cooperative AI Foundation(合作人工智能基金会)
;
University of Oxford(牛津大学)
;
UC Berkeley(伯克利大学)
;
Quebec Artificial Intelligence Institute(魁北克人工智能研究所)
;
Leverhulme Centre for the Future of Intelligence, University of Cambridge(未来智能研究中心,剑桥大学)
;
MIT(麻省理工学院)
;
Google DeepMind(谷歌DeepMind)
;
Center on Long-Term Risk(长期风险中心)
;
Google Research(谷歌研究)
;
University of Washington(华盛顿大学)
;
Centrum Wiskunde & Informatica(数学与信息研究所)
;
Utrecht University(乌得勒支大学)
;
Universitat Politècnica de València(瓦伦西亚理工大学)
;
Concordia Contest Participants with Notable Contributions(康科德比赛有显著贡献的参与者)