机构
*
Beijing University of Technology(北京工业大学)
;
Central South University(中南大学)
;
Beijing Electronics Science & Technology Institute(北京电子科学技术研究所)
;
China Aerospace Science & Industry Corporation(中国航天科技集团)
;
Beijing Institute of Technology(北京理工大学)
;
Information Support Force Engineering University(信息支援部队工程大学)
;
Trunk Technology (Beijing) Co., Ltd.(trunk技术(北京)有限公司)
Comments18 pages, 4 figures, 2 tables. Published in the Proceedings of ASCAAD 2025
Journal refProceedings of the 13th International Conference of the Arab Society for Computation in Architecture, Art and Design (ASCAAD 2025), Riyadh, Saudi Arabia, 2025
Walkable to Whom? Capturing Subjective Variability in Walkability Perception Using Multimodal Deep Learning
对谁而言是可步行的?使用多模态深度学习捕捉步行感知中的主观变异性
Moloud Damandeh, Meead Saberi
机构
*
School of Civil and Environmental Engineering, University of New South Wales (UNSW)(新南威尔士大学土木与环境工程学院)
;
Research Centre for Integrated Transport Innovation (rCITI)(综合交通创新研究中心)
GraphVerse: A Comprehensive Visual Graph Reasoning Benchmark for Multimodal Large Language Models
GraphVerse:面向多模态大语言模型的综合性视觉图推理基准
Yuanfu Sun, Yuanhang Ren, Kang Li, Chuanhao Ji, Jiaxi Li, Jiajin Liu, Ninghao Liu, Qiaoyu Tan
机构
*
New York University(纽约大学)
;
Sensetime Research(商汤科技研究院)
;
Tsinghua University(清华大学)
;
New York University Shanghai(上海纽约大学)
;
University of Georgia(佐治亚大学)
;
The Hong Kong Polytechnic University(香港理工大学)
Loud or Silent? A Reusable Framework for Per-Modality Failure Analysis in Multimodal Clinical AI
大声还是沉默?一种用于多模态临床AI中模态级失败分析的可复用框架
Quang Bui, Shlok Jaiswal, Samuel Paik-Heintz, Kevin Zhou, Kaushik Madapati, Krittaphas Chaisutyakorn, Noah Dane Hebdon, Dimitrios Proios, Sebastián Andrés Cajas Ordóñez, Kacper Dobek, Boya Zhang, Aly Dhedhi, Ahram Han, Kushul Reddy Palakala, Rahul Gorijavolu, Jacques Kpodonu, Leo Anthony Celi
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
American International School Vienna(维也纳美国国际学校)
;
Neuqua Valley High School(纽夸谷高中)
;
North Hollywood High School(北好莱坞高中)
;
Hopewell Valley Central High School(霍普韦尔谷中央高中)
;
University of California, Berkeley(加州大学伯克利分校)
;
Siriraj Hospital(诗里拉吉医院)
;
Harvard University(哈佛大学)
;
Agency for Science, Technology and Research(新加坡科技研究局)
;
Johns Hopkins University(约翰斯·霍普金斯大学)
;
University of Geneva(日内瓦大学)
;
Poznan University of Technology(波兹南理工大学)
Explainable Multimodal AI for Adaptive Calibration of Archaeological Sensing Workflows
面向考古传感工作流自适应校准的可解释多模态人工智能
Nevio Dubbini, Daniel P. van Helden, Claudia Sciuto, Martina Naso, Arthur Leck, Clement Joubert, Heeli C. Schechter, Remy Chapoulie, Gabriele Gattiglia
CommentsAccepted to the 27th International Society for Music Information Retrieval Conference (ISMIR 2026), Abu Dhabi, UAE. Project page: https://joonhyungbae.github.io/skypiano/
Towards Reliable Stain Transfer: An Iterative Data-Model Co-Optimization Framework Based on Multimodal Expert-Guided Assessment
迈向可靠的染色转移:基于多模态专家指导评估的迭代数据-模型协同优化框架
Siyuan Xu, Yan Wang, Haofei Song, Lili Gao, Jiansheng Wang, Qing Zhang, Dan Huang, Boxiang Yun, Hongkai Xiong, Qingli Li
机构
*
East China Normal University(华东师范大学)
;
Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院)
;
Hangzhou Hyperspectral Imaging Technology Co., Ltd.(杭州高光谱成像技术有限公司)
;
Fudan University Shanghai Cancer Center(复旦大学附属肿瘤医院)
机构
*
Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所)
;
Xingchen AGI Lab, China Telecom Artificial Intelligence Technology (Beijing) Co., Ltd(星辰通用人工智能实验室,中国电信人工智能技术(北京)有限公司)
;
University of Science and Technology Beijing(北京科技大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Shanghai Jiao Tong University(上海交通大学)
机构
*
Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系)
;
Institute of Medical Intelligence and XR, The Chinese University of Hong Kong(香港中文大学医学智能与扩展现实研究所)