机构
*
National University of Singapore(新加坡国立大学)
;
PuzzleLogic Pte Ltd(拼图逻辑私人有限公司)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区)
;
Peking Union Medical College Hospital(北京协和医院)
Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents
超越视频:统一视频推理与深度研究的开放世界视频智能体
Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Zeyu Wang, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Hongyi Fu, Jianxiong Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song
机构
*
Shandong University(山东大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beihang University(北京航空航天大学)
;
City University of Hong Kong(香港城市大学)
;
Nanyang Technological University(南洋理工大学)
;
Kuaishou Technology(快手科技)
;
Southern University of Science and Technology(南方科技大学)
Seeing vs. Believing: Evaluating the Language Bias of Open-Source MLLMs in Counter-Intuitive Scenes
看见 vs. 相信:评估开源多模态大模型在反直觉场景中的语言偏见
Chen Ling, Tongwei Zhang, Hanqian Li, Nai Ding
机构
*
Zhejiang University(浙江大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning
Visual-OPSD:用于高效统一多模态推理的跨模态在策略自蒸馏
Pengyu Li, Zhitao Gao, Lingling Zhang, Muye Huang, Yuanming Li, Fangzhi Xu, Jun Liu
机构
*
Xi’an Jiaotong University(西安交通大学)
;
MOE KLINNS Lab(MOE KLINNS实验室)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
Sun Yat-sen University(中山大学)
机构
*
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
NEC Laboratories America(NEC美国实验室)
;
University of Kansas(堪萨斯大学)
;
Rutgers University(罗格斯大学)
;
NEC Laboratories Japan(NEC日本实验室)
C3VDReg: A Benchmark for Local-to-Local Colonoscopic Registration toward Anatomical Localization
C3VDReg:面向解剖定位的局部-局部结肠镜配准基准
Linzhe Jiang, Jiayuan Huang, Sophia Bano, Matthew J. Clarkson, Zhehua Mao, Mobarak I. Hoque
机构
*
UCL Hawkes Institute(UCL哈维斯研究所)
;
University College London, University of London(伦敦大学学院, 伦敦大学)
;
Division of Informatics, Imaging and Data Sciences(信息学、成像与数据科学部门)
;
University of Manchester(曼彻斯特大学)
crossMoDA Challenge: Evolution of Cross-Modality Domain Adaptation Techniques for Vestibular Schwannoma and Cochlea Segmentation from 2021 to 2023
crossMoDA挑战赛:2021至2023年前庭神经鞘瘤与耳蜗分割的跨模态域自适应技术演进
Navodini Wijethilake, Reuben Dorent, Marina Ivory, Aaron Kujawa, Stefan Cornelissen, Patrick Langenhuizen, Mohamed Okasha, Anna Oviedova, Hexin Dong, Bogyeong Kang, Guillaume Sallé, Luyi Han, Ziyuan Zhao, Han Liu, Yubo Fan, Tao Yang, Shahad Hardan, Hussain Alasmawi, Santosh Sanjeev, Yuzhou Zhuang, Satoshi Kondo, Maria Baldeon Calisto, Shaikh Muhammad Uzair Noman, Cancan Chen, Ipek Oguz, Rongguo Zhang, Mina Rezaei, Susana K. Lai-Yuen, Satoshi Kasai, Yunzhi Huang, Chih-Cheng Hung, Mohammad Yaqub, Lisheng Wang, Benoit M. Dawant, Cuntai Guan, Ritse Mann, Vincent Jaouen, Tae-Eui Kam, Li Zhang, Jonathan Shapey, Tom Vercauteren
机构
*
School of BMEIS, King's College London, London, United Kingdom(伦敦国王学院生物医学工程与信息科学学院)
;
Harvard University, USA(哈佛大学)
;
Elisabeth-TweeSteden Hospital, Tilburg, Netherlands(蒂尔堡埃利斯贝特-特维德登医院)
;
King's College Hospital, London, United Kingdom(伦敦国王学院医院)
;
Center for Data Science, Peking University, Beijing, China(北京大学数据科学中心)
;
Center for Data Science in Health and Medicine, Peking University, Beijing, China(北京大学健康与医学数据科学中心)
;
Department of Artificial Intelligence, Korea University, Seoul, Republic of Korea(韩国大学人工智能系)
;
Department of Radiology and Nuclear Medicine, Radboud University Medical Center, Geert Grooteplein 10, 6525 GA, Nijmegen, The Netherlands(拉德堡德大学医学中心放射科与核医学科)
;
Department of Radiology, The Netherlands Cancer Institute, Plesmanlaan 121, 1066 CX, Amsterdam, The Netherlands(荷兰癌症研究所放射科)
;
Nanyang Technological University, Singapore(南洋理工大学)
;
Vanderbilt University, USA(范德比尔特大学)
;
Department of Automation, Shanghai Jiao Tong University, Shanghai, China(上海交通大学自动化系)
;
Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, UAE(阿布扎克穆罕默德·本·扎耶德人工智能大学)
;
School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(华中科技大学计算机科学与技术学院)
;
Center for Machine Vision and Security Research, Kennesaw State University, Marietta, MA 30060, USA(肯尼斯州立大学机器视觉与安全研究中心)
;
Muroran Institute of Technology, Hokkaido, Japan(北海道Muroran理工学院)
;
Niigata University of Health and Welfare, Niigata, Japan(Niigata健康与福利大学)
;
University of South Florida, Tampa, FL, USA(佛罗里达州立大学)
;
Infervision Advanced Research Institute, Beijing, China(北京Infervision高级研究 institutes)
;
Academy for Multidisciplinary Studies, Capital Normal University, Beijing, China(北京师范大学多学科研究学院)
;
School of Automation, Nanjing University of Information Science and Technology, Nanjing 210044, China(南京信息科学技术大学自动化学院)