Simple Domain Generalization for Strong Pixel-Level Image Tampering Detection in Modern VLMs
现代视觉语言模型中用于强像素级图像篡改检测的简单域泛化
Yi Tang, Xinyi Shang, Jiacheng Cui, Sondos Mahmoud Bsharat, Jiacheng Liu, Xiaohan Zhao, Tran Dinh Tien, Ahmed Elhagry, Salwa K. Al Khatib, Tianjun Yao, Yonina C. Eldar, Jing-Hao Xue, Hao Li, Salman Khan, Zhiqiang Shen
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
University College London(伦敦大学学院)
;
Weizmann Institute of Science(魏茨曼科学研究所)
Text Over Image: Auditing Multimodal Robustness in Synthetic Medical Image Detection
超越视觉取证:审计多模态鲁棒性用于合成医学图像检测
Ching-Hao Chiu, Hao-Wei Chung, Gelei Xu, Xueyang Li, Pin-Yu Chen, John Kheir, Meysam Ghaffari, Carlos Morato, Ahmed Abbasi, Yiyu Shi
机构
*
University of Notre Dame(圣母大学)
;
IBM Research(IBM研究院)
;
Boston Children’s Hospital(波士顿儿童医院)
;
Harvard Medical School(哈佛医学院)
;
Optum AI, UnitedHealth Group(Optum AI, 联合健康集团)
CommentsAccepted at MICCAI 2026. Version 2 is a substantial journal extension of the MICCAI 2026 conference version, with additional provenance perturbations, paired statistical analysis, extended SAVC mitigation experiments, and broader deployment discussion. 19 pages, 3 figures, 2 tables
MemoVAD: Resource-Efficient Video Anomaly Detection via Dynamic Semantic Memory in Edge Computing Scenarios
MemoVAD: 边缘计算场景下基于动态语义记忆的资源高效视频异常检测
Guo Li, Jiandian Zeng, Yang Li, Zihao Peng, Ke Chen, Tian Wang
机构
*
Institute of Artificial Intelligence and Future Networks, Beijing Normal University(北京师范大学人工智能与未来网络研究院)
;
School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院)
;
Engineering Research Center of Cloud-Edge Intelligent Collaboration on Big Data, Ministry of Education, Beijing Normal University(北京师范大学大数据云边智能协同教育部工程研究中心)
BavGround: A Benchmark for Regional Cultural Grounding and Dialect Competence in Bavarian
BavGround:巴伐利亚区域文化接地与方言能力基准
Jophin John, Michael Hoffmann, Jan Fillies, Michael A. Hedderich, Barbara Plank
机构
*
Stanford University(斯坦福大学)
;
Freie Universität Berlin(柏林自由大学)
;
Center for Information and Language Processing, LMU Munich(慕尼黑大学信息与语言处理中心)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Leibniz Supercomputing Centre (LRZ)(莱布尼茨超级计算中心)
Comments11 pages, 4 figures. Published in the Proceedings of the 1st Workshop on Shaping Future Human Connection: Social Augmentation through XR Technologies (SAXR 2026), April 13, 2026, Barcelona, Spain
Journal refProceedings of the 1st Workshop on Shaping Future Human Connection: Social Augmentation through XR Technologies (SAXR 2026), CEUR Workshop Proceedings, Vol. 4226, pp. 252-262, 2026
机构
*
Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院智能信息处理上海市重点实验室)
;
College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)
;
Lenovo CTO Organization(联想首席技术官组织)
;
Nanyang Technological University(南洋理工大学)
;
TeleAl, China Telecom(中国电信天翼人工智能公司)
AmalthAI: An Open-Source Computer Vision Platform for Cultural Heritage
AmalthAI:面向文化遗产的开源计算机视觉平台
Christos Chatzisavvas, Stelios Alvanos, Efstratios Politis, Panagiotis Rigas, Thomas Pappas, Ioannis Giannoukos, Nikolaos Mitianoudis, Agata Ulanowska, Katarzyna Żebrowska, Nazarij Buławka, Christina Margariti, George Pavlidis, Chairi Kiourt, Anestis Koutsoudis, Vassilis Katsouros, George Ioannakis
机构
*
Democritus University of Thrace(德谟克利特色雷斯大学)
;
Athena Research Center(雅典娜研究中心)
;
National and Kapodistrian University of Athens(雅典国立卡波迪斯特里亚大学)
;
University of Warsaw(华沙大学)