机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
Eastern Institute of Technology(东区技术研究所)
;
Great Bay University(大湾大学)
;
Northeast Forestry University(东北林业大学)
;
National University of Singapore(新加坡国立大学)
UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving
UniDrive-WM:面向自动驾驶的统一理解、规划和生成世界模型
Zhexiao Xiong, Xin Ye, Burhan Yaman, Sheng Cheng, Yiren Lu, Jingru Luo, Nathan Jacobs, Liu Ren
机构
*
Bosch Research North America & Bosch Center for Artificial Intelligence (BCAI)(博世北美研究院与博世人工智能中心)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Arizona State University(亚利桑那州立大学)
;
Case Western Reserve University(凯斯西储大学)
CPS4: Class Prompt driven Semi-Supervised Spine Segmentation with Class-specific Consistency Constraint
CPS4: 基于类别提示的半监督脊柱分割与类别特定一致性约束
Qingtao Pan, Hongzan Sun, Bing Ji, Shuo Li
机构
*
School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)
;
Department of Nuclear Medicine, Shengjing Hospital of China Medical University(中国医科大学附属盛京医院核医学科)
;
Department of Computer and Data Science, Case Western Reserve University(凯斯西储大学计算机与数据科学系)
;
Department of Biomedical Engineering, Case Western Reserve University(凯斯西储大学生物医学工程系)
专题命中
VLM训练与架构
:VLM(summary_cn,abstract);vision language model(abstract);分类 cs.CV
Adapting Large VLMs with Iterative and Manual Instructions for Generative Low-light Enhancement
适配大型视觉语言模型以生成低光照增强
Xiaoran Sun, Liyan Wang, Yeying Jin, Kin-man Lam, Zhixun Su, Yang Yang, Jinshan Pan, Cong Wang
机构
*
Dalian University of Technology(大连理工大学)
;
National University of Singapore(新加坡国立大学)
;
Hong Kong Polytechnic University(香港理工大学)
;
University of California, San Francisco(加州大学旧金山分校)
;
Nanjing University of Science and Technology(南京理工大学)
Simple Token-Efficient Vision-Language Model for Case-level Pathology Synoptic Report Generation
用于病例级病理学概要报告生成的简单令牌高效视觉语言模型
Zhiyuan Yang, Jiahao Cheng, Vincent Quoc-Huy Trinh, Mahdi S. Hosseini
机构
*
Department of Computer Science and Software Engineering (CSSE), Concordia University, Montreal, Canada(计算机科学与软件工程系(CSSE),康科迪亚大学,蒙特利尔,加拿大)
;
Axe Cancer, Centre de recherche du CHUM, Université de Montréal, Montreal, Canada(Axe癌症,CHUM研究中心,蒙特利尔大学,蒙特利尔,加拿大)
;
Institut de recherche en immunologie et cancérologie (IRIC), Université de Montréal(免疫学与癌症研究所(IRIC),蒙特利尔大学)
;
Mila - Quebec AI Institute, Montreal, Canada(魁北克AI研究所(Mila),蒙特利尔,加拿大)
Small Vision-Language Models Know When They Are Wrong But Cannot Say So: A Two-Model Study of Stated versus Internal Confidence Under Realistic Image Degradation
机构
*
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理国家重点实验室)
;
University of Pennsylvania(宾夕法尼亚大学)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Nanyang Technological University(南洋理工大学)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
De Artificial Intelligence Lab(德人工智能实验室)