ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos
活动取证:一种全面的基准,用于定位视频中的篡改活动
Peijun Bao, Anwei Luo, Gang Pan, Alex C. Kot, Xudong Jiang
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)
;
School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算机与人工智能学院)
;
Jiangxi Provincial Key Laboratory of Multimedia Intelligent Processing(江西省多媒体智能处理重点实验室)
;
Faculty of Engineering, Shenzhen MSU-BIT University(深圳北理莫斯科大学工程系)
;
VinUniversity
机构
*
Alaya Studio, Shanda AI Research Tokyo(Alaya工作室,盛大人工智能研究院东京)
;
National Taiwan University(国立台湾大学)
;
The University of Tokyo(东京大学)
;
National Yang Ming Chiao Tung University(国立阳明交通大学)
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学前沿交叉科学学院)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
FKLPRIU, School of Computer and Information Engineering, Xiamen University of Technology(厦门理工学院计算机与信息工程学院福建省模式识别与图像理解重点实验室)
机构
*
Nanyang Technological University(南洋理工大学)
;
SenseTime Research(商汤科技研究院)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
NVIDIA Research(英伟达研究院)
ShotBench: Expert-Level Cinematic Understanding in Vision-Language Models
ShotBench:视觉语言模型中的专家级电影叙事理解
Hongbo Liu, Jingwen He, Yi Jin, Dian Zheng, Yuhao Dong, Fan Zhang, Ziqi Huang, Yinan He, Yangguang Li, Weichao Chen, Yu Qiao, Wanli Ouyang, Shengjie Zhao, Ziwei Liu
机构
*
Tongji University(同济大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
S-Lab, Nanyang Technological University(南洋理工大学S-Lab)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Kling Team, Kuaishou Technology(快手科技 Kling 团队)
;
Institute of Software Chinese Academy of Sciences(中国科学院软件研究所)
机构
*
School of Computer Science and Technology, UCAS(UCAS计算机科学与技术学院)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, CASIA(复杂系统认知与决策智能重点实验室)
;
School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院)
;
State Key Laboratory of Networking and Switching Technology, BUPT(网络与交换技术国家重点实验室)
;
AMAP, Alibaba Group(阿里妈妈实验室,阿里巴巴集团)
CataractSAM-2: A Domain-Adapted Model for Anterior Segment Surgery Segmentation and Scalable Ground-Truth Annotation
白内障手术分割与可扩展地面真实标注的领域适应模型CataractSAM-2
Mohammad Eslami, Dhanvinkumar Ganeshkumar, Saber Kazeminasab, Michael G. Morley, Michael V. Boland, Michael M. Lin, John B. Miller, David S. Friedman, Nazlee Zebardast, Lucia Sobrin, Tobias Elze
机构
*
Thomas Jefferson High School for Science and Technology(托马斯·杰弗逊高中科学与技术学校)
;
Mass Eye and Ear, Harvard Medical School(麻省眼耳研究所,哈佛医学院)
;
Harvard Ophthalmology AI Lab, Schepens Eye Research Institute of Mass Eye and Ear, Harvard Medical School(哈佛眼科学人工智能实验室,麻省眼耳研究所的谢普恩斯眼研究学院,哈佛医学院)
MME-CoF-Pro: Evaluating Reasoning Coherence in Video Generative Models with Text and Visual Hints
MME-CoF-Pro:基于文本和视觉提示评估视频生成模型中的推理一致性
Yu Qi, Xinyi Xu, Ziyu Guo, Siyuan Ma, Renrui Zhang, Xinyan Chen, Ruichuan An, Ruofan Xing, Jiayi Zhang, Haojie Huang, Pheng-Ann Heng, Jonathan Tremblay, Lawson L. S. Wong
机构
*
Northeastern University(东北大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Westlake University(西湖大学)
;
ByteDance Seed(字节跳动种子)
;
Peking University(北京大学)
;
NVIDIA(英伟达)
HyperMotionX: The Dataset and Benchmark with DiT-Based Pose-Guided Human Image Animation of Complex Motions
HyperMotionX:基于DiT的Pose引导人体图像动画的Dataset和Benchmark
Shuolin Xu, Siming Zheng, Ziyi Wang, HC Yu, Jinwei Chen, Huaqi Zhang, Daquan Zhou, Tong-Yee Lee, Bo Li, Peng-Tao Jiang
机构
*
Bournemouth University(伯恩茅斯大学)
;
vivo BlueImage Lab, vivo Mobile Communication Co., Ltd(vivo 蓝影实验室,vivo 通信有限公司)
;
Peking University(北京大学)
;
National Cheng-Kung University(国立成功大学)
机构
*
Laboratory of Complex Systems Modeling and Simulation, School of Computer Science and Technology, Hangzhou Dianzi University(电子科技大学复杂系统建模与仿真实验室,计算机科学与技术学院)
;
Zhejiang Key Laboratory of Space Information Sensing and Transmission, Hangzhou Dianzi University(浙江省空间信息感知与传输重点实验室,电子科技大学)
;
Department of Psychological and Cognitive Sciences, Tsinghua University(清华大学心理与认知科学系)