Multimodal Transformer for Sample-Aware Prediction of Metal-Organic Framework Properties
多模态Transformer用于金属有机框架性质的样本感知预测
Seunghee Han, Jaewoong Lee, Jihan Kim
机构
*
Department of Chemical and Biomolecular Engineering, Korea Advanced Institute of Science and Technology(化学与生物分子工程系,韩国科学技术院)
;
Department of Materials Science and Engineering, Korea Advanced Institute of Science and Technology(材料科学与工程系,韩国科学技术院)
机构
*
Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家)
;
School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)
;
East China Normal University(东华大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
University College London(伦敦大学学院)
;
Independent Researcher(独立研究者)
;
Huawei Noah’s Ark Lab(华为诺亚实验室)
ReFineVLA: Multimodal Reasoning-Aware Generalist Robotic Policies via Teacher-Guided Fine-Tuning
ReFineVLA: 通过教师引导微调实现多模态推理感知的通用机器人策略
Tuan Van Vo, Tan Q. Nguyen, Khang Nguyen, Nhat Xuan Tran, Duy H. M. Nguyen, An T. Le, Ngo Anh Vien, Minh Nhat Vu
机构
*
VinRobotics
;
University of Texas at Arlington(德克萨斯大学阿灵顿分校)
;
Max Planck Research School for Intelligent Systems (IMPRS-IS)(智能系统Max Planck研究学校)
;
Intelligent Autonomous Systems Lab(智能自主系统实验室)
;
TU Darmstadt(德累斯顿技术大学)
;
Automation & Control Institute(自动化与控制研究所)
;
TU Wien(维也纳技术大学)
;
Austrian Institute of Technology (AIT)(奥地利技术研究所)
Beyond Augmentation: Cross-Modal Transformer Fusion with Bi-directional Attention for Low-Data Aneurysm Screening
超越增强:基于双向注意力的跨模态Transformer融合用于低数据动脉瘤筛查
Antara Titikhsha, Divyanshu Tak
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Artificial Intelligence in Medicine (AIM) Program(医学人工智能(AIM)项目)
;
Mass General Brigham(马萨诸塞总医院)
;
Harvard Medical School(哈佛医学院)
;
Department of Radiation Oncology(放射肿瘤科)
;
Dana-Farber Cancer Institute(达纳-法伯癌症研究所)
;
Brigham and Women’s Hospital(布里洛妇产科医院)
机构
*
University of Notre Dame(诺丁汉大学)
;
Yale University(耶鲁大学)
;
Columbia University(哥伦比亚大学)
;
New York University(纽约大学)
;
Pennsylvania State University(宾夕法尼亚州立大学)
Schema-Adaptive Tabular Representation Learning with LLMs for Generalizable Multimodal Clinical Reasoning
基于LLM的Schema自适应表格表示学习用于通用多模态临床推理
Hongxi Mao, Wei Zhou, Mengting Jia, Tao Fang, Huan Gao, Bin Zhang, Shangyang Li
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Boston University(波士顿大学)
;
University of Southern California(南加州大学)
;
GDIIST
;
Renyixun Health Technology Co., Ltd.(仁心迅健康科技有限公司)
Search-MIND: Training-Free Multi-Modal Medical Image Registration
Search-MIND: 无需训练的多模态医学图像配准
Boya Wang, Ruizhe Li, Chao Chen, Xin Chen
机构
*
Lab for Uncertainty in Data and Decision Making (LUCID), Nottingham Biomedical Research Centre (BRC), School of Medicine, University of Nottingham, UK(英国诺丁汉大学医学院诺丁汉生物医学研究中心(BRC)数据与决策不确定性实验室(LUCID))
USCNet: Transformer-Based Multimodal Fusion with Segmentation Guidance for Urolithiasis Classification
USCNet:基于Transformer的多模态融合与分割引导的尿路结石分类
Changmiao Wang, Songqi Zhang, Yongquan Zhang, Yifei Wang, Liya Liu, Nannan Li, Xingzhi Li, Jiexin Pan, Yi Jiang, Xiang Wan, Hai Wang, Ahmed Elazab
机构
*
Shenzhen Research Institute of Big Data(深圳市大数据研究院)
;
Zhejiang University of Finance and Economics(浙江财经大学)
;
Anhui University of Finance and Economics(安徽财经大学)
;
The Second Affiliated Hospital of Chinese University of Hong Kong (Longgang District People’s Hospital of Shenzhen)(香港中文大学第二附属医院(深圳市龙岗区人民医院))
SVC 2026: the Second Multimodal Deception Detection Challenge and the First Domain Generalized Remote Physiological Measurement Challenge
SVC 2026: 第二届多模态欺骗检测挑战赛及首个领域通用远程生理测量挑战
Dongliang Zhu, Zhiyi Niu, Bo Zhao, Jiajian Huang, Shuo Ye, Xun Lin, Hui Ma, Taorui Wang, Jiayu Zhang, Chunmei Zhu, Junzhe Cao, Yingjie Ma, Rencheng Song, Albert Clapés, Sergio Escalera, Dan Guo, Zitong Yu
机构
*
Wuhan University(武汉大学)
;
Great Bay University(大湾区大学)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Sun Yat-sen University(中山大学)
;
Hefei University of Technology(合肥工业大学)
;
University of Barcelona(巴塞罗那大学)
SGANet: Semantic and Geometric Alignment for Multimodal Multi-view Anomaly Detection
SGANet:语义与几何对齐用于多模态多视角异常检测
Letian Bai, Chengyu Tao, Juan Du
机构
*
Smart Manufacturing Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)智能制造学域)
;
College of Mechanical and Vehicle Engineering, Hunan University(湖南大学机械与运载工程学院)
;
The Hong Kong University of Science and Technology(香港科技大学)
A Unified Foundation Model for All-in-One Multi-Modal Remote Sensing Image Restoration and Fusion with Language Prompting
一种统一的多模态遥感图像修复与融合的全功能基础模型 with语言提示
Yongchuan Cui, Peng Liu
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
机构
*
University of Minnesota(明尼苏达大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
North Carolina State University(北卡罗来纳州立大学)
;
National University of Singapore(新加坡国立大学)
;
Institute of High Performance Computing, Agency for Science, Technology and Research(高性能计算研究所,新加坡科技研究局)
A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models
基于补丁的跨视图正则化框架用于多模态大语言模型中的后门防御
Tianmeng Fang, Yong Wang, Zetai Kong, Zengzhen Su, Jun Wang, Chengjin Yu, Wei Wang
机构
*
Singapore Management University(新加坡管理大学)
;
China University of Mining and Technology(中国矿业大学)
;
The University of Melbourne(墨尔本大学)
;
Anhui University(安徽大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Sun Yat-sen University(中山大学)
EI: Early Intervention for Multimodal Imaging based Disease Recognition
EI:基于多模态影像的疾病识别早期干预
Qijie Wei, Hailan Lin, Xirong Li
机构
*
Renmin University of China(中国人民大学)
;
Beijing Key Laboratory for Intelligent Diagnosis of Fundus Diseases and Drug-Device R&D and Translation(眼底疾病智能诊断与药械研发转化北京市重点实验室)