Code-MIE: A Code-style Model for Multimodal Information Extraction with Scene Graph and Entity Attribute Knowledge Enhancement
Code-MIE: 一种基于代码风格的多模态信息提取模型,结合场景图和实体属性知识增强
Jiang Liu, Ge Qiu, Hao Fei, Dongdong Xie, Jinbo Li, Fei Li, Chong Teng, Donghong Ji
机构
*
Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航天信息安全部与可信计算重点实验室,教育部,武汉大学计算机科学与工程学院)
;
University of Oxford(牛津大学)
;
Wuhan Second Ship Design and Research Institute(武汉第二船舶设计研究所)
;
China United Network Communications Co., Ltd. Research Institute(中国联合网络通信有限公司研究院)
机构
*
School of Computer Science, Peking University(北京大学计算机科学系)
;
Technical University of Munich(慕尼黑技术大学)
;
Beijing Jiaotong University(北京交通大学)
;
Beijing Digital Native Digital City Research Center(北京数字原生数字城市研究院)
;
Theta Labs, Inc.(Theta Labs公司)
;
Beijing Normal University(北京师范大学)
HYDRA: Unifying Multi-modal Generation and Understanding via Representation-Harmonized Tokenization
HYDRA:通过表征协调的标记化统一多模态生成与理解
Xuerui Qiu, Yutao Cui, Guozhen Zhang, Junzhe Li, JiaKui Hu, Xiao Zhang, Yang Li, Songtao Liu, Miles Yang, Yu Shi, Zhao Zhong, Liefeng Bo
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Tencent Hunyuan(腾讯文英)
;
Zhongguancun Academy(中关村学院)
;
Nanjing University(南京大学)
;
Peking University(北京大学)
机构
*
College of Computing, City University of Hong Kong(城市大学 computing 学院)
;
School of Data Science and Artificial Intelligence, Chang’an University(长安大学数据科学与人工智能学院)
;
School of Computer Science and Engineering, Ministry of Education Key Laboratory of Information Technology, Guangdong Province Key Laboratory of Information Security Technology, Sun Yat-Sen University(中山大学计算机科学与工程学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学 computing 与数据科学学院)
;
Artificial Intelligence Lab. (Recod.ai) at the University of Campinas(坎皮纳斯大学人工智能实验室)
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)
;
Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies(广东省新型安全智能技术重点实验室)
;
The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)
;
Macau University of Science and Technology, Hong Kong, China(澳门科学技术大学)
Modeling and Measuring Redundancy in Multisource Multimodal Data for Autonomous Driving
多源多模态数据中冗余建模与测量用于自动驾驶
Yuhan Zhou, Mehri Sattari, Haihua Chen, Kewei Sha
机构
*
Dept. of Information Science University of North Texas Denton, Texas, USA(信息科学系 诺克斯维尔大学 德顿, 德克萨斯州, 美国)
;
Dept. of Data Science University of North Texas Denton, Texas, USA(数据科学系 诺克斯维尔大学 德顿, 德克萨斯州, 美国)
Longitudinal NSCLC Treatment Progression via Multimodal Generative Models
多模态生成模型用于非小细胞肺癌治疗进展的纵向预测
Massimiliano Mantegna, Elena Mulero Ayllón, Alice Natalina Caragliano, Francesco Di Feola, Claudia Tacconi, Michele Fiore, Edy Ippolito, Carlo Greco, Sara Ramella, Philippe C. Cattin, Paolo Soda, Matteo Tortora, Valerio Guarrasi
机构
*
Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma, Italy(人工智能与计算机系统单位,工程系,罗马大学生物医学学院)
;
Multi-Specialist Clinical Institute for Orthopaedic Trauma Care (COT), Messina, Italy(骨科创伤护理多学科临床研究所(COT),意大利Messina)
;
Department of Diagnostics and Intervention, Radiation Physics, Biomedical Engineering, Umeå University, Sweden(诊断与介入系,放射物理,生物医学工程,乌梅大学,瑞典)
;
Operative Research Unit of Radiation Oncology, Fondazione Policlinico Universitario Campus Bio-Medico, Rome, Italy(放射肿瘤手术研究单位,大学生物医学学院基金会,罗马,意大利)
;
Research Unit of Radiation Oncology, Department of Medicine and Surgery, Università Campus Bio-Medico di Roma, Italy(放射肿瘤研究单位,医学与外科系,罗马大学生物医学学院,意大利)
;
Department of Biomedical Engineering, University of Basel, Allschwil, Switzerland(生物医学工程系,巴塞尔大学,瑞士Allschwil)
;
Department of Naval, Electrical, Electronics and Telecommunications Engineering, University of Genoa, Italy(海军、电气、电子与电信工程系,热那亚大学,意大利)
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Sun Yat-sen University(中山大学)
;
Baidu Inc.(百度公司)
RuCL: Stratified Rubric-Based Curriculum Learning for Multimodal Large Language Model Reasoning
RuCL:基于分层评分标准的课程学习用于多模态大语言模型推理
Yukun Chen, Jiaming Li, Longze Chen, Ze Gong, Jingpeng Li, Zhen Qin, Hengyu Chang, Ancheng Xu, Zhihao Yang, Hamid Alinejad-Rokny, Qiang Qu, Bo Zheng, Min Yang
机构
*
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Alibaba Group(阿里巴巴集团)
;
School of Biomedical Engineering, UNSW Sydney(新南威尔士大学生物医学工程学院)
OSDM-MReg: Multimodal Image Registration based One Step Diffusion Model
OSDM-MReg: 基于一步扩散模型的多模态图像配准
Xiaochen Wei, Weiwei Guo, Wenxian Yu, Feiming Wei, Dongying Li
机构
*
Shanghai Key Laboratory of Intelligent Sensing and Recognition(上海智能感知与识别重点实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Center of Digital Innovation(数字创新中心)