PathMMU: A Massive Multimodal Expert-Level Benchmark for Understanding and Reasoning in Pathology
Yuxuan Sun, Hao Wu, Chenglu Zhu, Sunyi Zheng, Qizi Chen, Kai Zhang, Yunlong Zhang, Dan Wan, Xiaoxiao Lan, Mengyue Zheng, Jingxiong Li, Xinheng Lyu, Tao Lin, Lin Yang
Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models
面向生理安全临床语言模型的神经符号对齐
Abdulhady Abas Abdullah, Erik Cambria, Milena Zivkovic
机构
*
University of Kurdistan Hewlêr(库尔德斯坦大学)
;
Nanyang Technological University(南洋理工大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of Kragujevac(克拉古耶瓦茨大学)
Seeing vs. Believing: Evaluating the Language Bias of Open-Source MLLMs in Counter-Intuitive Scenes
看见 vs. 相信:评估开源多模态大模型在反直觉场景中的语言偏见
Chen Ling, Tongwei Zhang, Hanqian Li, Nai Ding
机构
*
Zhejiang University(浙江大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
SlideGen: Collaborative Multimodal Agents for Scientific Slide Generation
SlideGen:用于科学幻灯片生成的协作多模态智能体
Xin Liang, Zhilin Zhang, Xiang Zhang, Haoran Su, Yiwei Xu, Siqi Sun, Chenyu You
机构
*
Stony Brook University(石溪大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Fudan University(复旦大学)
A Modular Agent for Reliable and Auditable Spatial Relation Verification in CT Scans
用于CT扫描中可靠且可审计的空间关系验证的模块化智能体
Simon Vincent Abel, Heiko Hillenhagen, Michael Götz, Timo Ropinski, Ayhan Can Erdur, Daniel Santak Wolf
机构
*
Ulm University(乌尔姆大学)
;
Ulm University Hospital(乌尔姆大学医院)
;
Technical University of Munich (TUM)(慕尼黑工业大学(TUM))
;
TUM University Hospital(慕尼黑工业大学医院)
;
Department of Radiation Oncology, TUM University Hospital(慕尼黑工业大学医院放射肿瘤科)
OmnilingualGAIA2: Evaluating the Multilingual Gap in Frontier AI Agents
OmnilingualGAIA2:评估前沿AI智能体的多语言差距
Andrea Caciolai, Pere-Lluís Huguet Cabot, Chierh Cheng, Albert Ventayol-Boada, Gabriel Mejia Gonzalez, Christophe Ropers, Lucas Bandarkar, Sebastian Ruder, Darlene Sakakihara, Elliot Yun, Pierre Andrews, Grégoire Mialon, Romain Froger, Marta R. Costa-jussà
Med-CRAFT: An Information System for Explainable and Configurable Construction of Multimodal Medical QA Datasets
Med-CRAFT:通过知识图谱遍历自动构建可解释的多跳视频工作负载
Shenxi Liu, Kan Li, Mingyang Zhao, Yuhang Tian, Bin Li
机构
*
Beijing Institute of Technology(北京理工大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)