机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
City University of Hong Kong(城市大学)
;
Chinese University of Hong Kong(香港中文大学)
;
McGill University(麦吉尔大学)
Towards High Fidelity Face Swapping: A Comprehensive Survey and New Benchmark
迈向高保真人脸交换:全面综述与新基准
Qi Li, Weining Wang, Shuangjun Du, Bo Peng, Jing Dong, Kun Wang, Zhenan Sun, Ming-Hsuan Yang
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Nanyang Technological University(南洋理工大学)
;
Yonsei University(延世大学)
Deepfakes: we need to re-think the concept of "real" images
深度伪造:我们需要重新思考“真实”图像的概念
Janis Keuper, Margret Keuper
机构
*
Institute for Machine Learning and Analytics, Offenburg University(机器学习与分析研究所,奥芬堡大学)
;
University of Mannheim(曼海姆大学)
;
Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所,萨尔兰州信息校区)
VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation
VERTIGO:用于电影摄像机轨迹生成的视觉偏好优化
Mengtian Li, Yuwei Lu, Feifei Li, Chenqi Gan, Zhifeng Xie, Xi Wang
机构
*
Shanghai University Shanghai Engineering Research Center of Motion Picture Special Effects LIX, \'Ecole Polytechnique, CNRS, IPP magenta http://vertigo.magic-lab.tech/
MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
MICo-150K:一个多图像合成的综合数据集
Xinyu Wei, Kangrui Cen, Hongyang Wei, Zhen Guo, Kai Cui, Bairui Li, Zeqing Wang, Jinrui Zhang, Lei Zhang
机构
*
Hong Kong Polytechnic University(香港理工大学)
;
Tsinghua University(清华大学)
;
Peking University(北京大学)
;
Sun Yat-Sen University(中山大学)
;
OPPO Research Institute(OPPO研究院)
GazeVaLM: A Multi-Observer Eye-Tracking Benchmark for Evaluating Clinical Realism in AI-Generated X-Rays
GazeVaLM:一个多观察者眼动基准测试,用于评估AI生成X光片的临床真实性
David Wong, Zeynep Isik, Bin Wang, Marouane Tliba, Gorkem Durak, Elif Keles, Halil Ertugrul Aktas, Aladine Chetouani, Cagdas Topel, Nicolo Gennaro, Camila Lopes Vendrami, Tugce Agirlar Trabzonlu, Amir Ali Rahsepar, Laetitia Perronne, Matthew Antalek, Onural Ozturk, Gokcan Okur, Andrew C. Gordon, Ayis Pyrros, Frank H. Miller, Amir Borhani, Hatice Savas, Eric Hart, Elizabeth Krupinski, Ulas Bagci
机构
*
Northwestern University(西北大学)
;
Loyola University Chicago(洛约拉大学芝加哥分校)
;
DuPage Medical Group(杜佩奇医疗集团)
;
Emory University(埃默里大学)
机构
*
Kyoto University(京都大学)
;
Center for Information and Neural Networks(信息与神经网络中心)
;
National Institute of Information and Communications Technology(国立信息通信技术研究所)
;
The University of Osaka(大阪大学)
CommentsAccepted at the IMAGE'25 Workshop (PCW-11), Society of Exploration Geophysicists (SEG). Published version available at https://doi.org/10.1190/image2025-w11-03.1
From Reasoning to Pixels: Benchmarking the Alignment Gap in Unified Multimodal Models
从推理到像素:统一多模态模型中对齐差距的基准测试
Cheng Yang, Chufan Shi, Bo Shui, Yaokang Wu, Muzi Tao, Huijuan Wang, Ivan Yee Lee, Yong Liu, Xuezhe Ma, Taylor Berg-Kirkpatrick
机构
*
University of California San Diego(加利福尼亚大学圣迭戈分校)
;
University of Southern California(南加利福尼亚大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Carnegie Mellon University(卡内基梅隆大学)
机构
*
Key Laboratory of AI Safety of CAS, Institute of Computing Technology (ICT)(中国科学院人工智能安全重点实验室,计算技术研究所)
;
University of Chinese Academy of Sciences (UCAS)(中国科学院大学)
;
Peking University(北京大学)
ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos
活动取证:一种全面的基准,用于定位视频中的篡改活动
Peijun Bao, Anwei Luo, Gang Pan, Alex C. Kot, Xudong Jiang
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)
;
School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算机与人工智能学院)
;
Jiangxi Provincial Key Laboratory of Multimedia Intelligent Processing(江西省多媒体智能处理重点实验室)
;
Faculty of Engineering, Shenzhen MSU-BIT University(深圳北理莫斯科大学工程系)
;
VinUniversity