Maijunxian Wang, Ruisi Wang, Juyi Lin, Ran Ji, Thaddäus Wiedemer, Qingying Gao, Dezhi Luo, Yaoyao Qian, Lianyu Huang, Zelong Hong, Jiahui Ge, Qianli Ma, Hang He, Yifan Zhou, Lingzi Guo, Lantao Mei, Jiachen Li, Hanwen Xing, Tianqi Zhao, Fengyuan Yu, Weihang Xiao, Yizheng Jiao, Jianheng Hou, Danyang Zhang, Pengcheng Xu, Boyang Zhong, Zehong Zhao, Gaoyun Fang, John Kitaoka, Yile Xu, Hua Xu, Kenton Blacutt, Tin Nguyen, Siyuan Song, Haoran Sun, Shaoyue Wen, Linyang He, Runming Wang, Yanzhi Wang, Mengyue Yang, Ziqiao Ma, Raphaël Millière, Freda Shi, Nuno Vasconcelos, Daniel Khashabi, Alan Yuille, Yilun Du, Ziming Liu, Bo Li, Dahua Lin, Ziwei Liu, Vikash Kumar, Yijiang Li, Lei Yang, Zhongang Cai, Hokin Deng
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Nanyang Technological University(南洋理工大学)
;
Northeastern University(东北大学)
;
University of Tübingen(图宾根大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Michigan(密歇根大学)
;
University of Southern California(南加州大学)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China Normal University(华东师范大学)
;
Stanford University(斯坦福大学)
;
University of Texas at Austin(得克萨斯大学奥斯汀分校)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Cornell University(康奈尔大学)
;
San Jose State University(圣何塞州立大学)
;
University of California, Irvine(加州大学尔湾分校)
;
Technical University of Munich(慕尼黑技术大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Imperial College London(伦敦帝国学院)
;
University of Wisconsin--Madison(威斯康星大学麦迪逊分校)
;
University of Edinburgh(爱丁堡大学)
;
Hong Kong University of Science(香港科学大学)
;
New York University(纽约大学)
;
Auburn University(阿伯丁大学)
;
Columbia University(哥伦比亚大学)
;
University of Bristol(布里斯托大学)
;
University of Waterloo(滑铁卢大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Oxford(牛津大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
CommentsProject page with all the artifacts - https://ruchitrawal.github.io/cinepile/. Updated version with adversarial refinement pipeline and more model evaluations
I Seek You in Videos: Identity-Conditioned Queries for Person-Centric Video Reasoning
我在视频中寻找你:面向以人为中心的视频推理的身份条件查询
Shibo Gao, Chongxiao Wang, Chenglong Huang, Jie Ma, Haolin Shi, Fei Ding, Jing Li, Qiang Lyu, Yangyang Liu, Yang Liu, Jun Liu, Linlin Huang, Peipei Yang
机构
*
Beijing Jiaotong University(北京交通大学)
;
HUJING Digital Media & Entertainment Group(汇晶数字媒体与娱乐集团)
;
MAIS Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)
CycliST: A Video Language Model Benchmark for Reasoning on Cyclical State Transitions
CycliST:用于循环状态转换推理的视频语言模型基准
Simon Kohaut, Daniel Ochs, Shun Zhang, Benedict Flade, Julian Eggert, Kristian Kersting, Devendra Singh Dhami
机构
*
Artificial Intelligence and Machine Learning Lab, TU Darmstadt(人工智能与机器学习实验室,图腾斯达特技术大学)
;
Konrad Zuse School of Excellence in Learning and Intelligent Systems (ELIZA)(Konrad Zuse 学校(ELIZA))
;
Honda Research Institute Europe GmbH, Offenbach, Germany(本田欧洲研究院,奥芬巴赫,德国)
;
Uncertainty in Artificial Intelligence Group, TU Eindhoven(人工智能不确定性小组,埃因霍温技术大学)
;
Hessian Center for AI (hessian.AI)(黑森人工智能中心(hessian.AI))
;
Center for Cognitive Science(认知科学中心)
;
German Center for Artificial Intelligence (DFKI)(德国人工智能中心(DFKI))
专题命中
视频数据与评测
:video language model(title,abstract);分类 cs.CV
机构
*
Peking University(北京大学)
;
Zhongguancun Academy(中关村学院)
;
Beijing Key Laboratory of Data Intelligence (Peking University)(北京市数据智能重点实验室(北京大学))
;
Ant Group(蚂蚁集团)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Huazhong University of Science and Technology(华中科技大学)
Know-Show: Benchmarking Video-Language Models on Spatio-Temporal Grounded Reasoning
Know-Show:在时空 grounded 推理上评估视频语言模型的基准测试
Chinthani Sugandhika, Chen Li, Deepu Rajan, Basura Fernando
机构
*
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
Institute of High-Performance Computing, Agency for Science, Technology and Research(新加坡科技研究局高性能计算研究所)
;
Centre for Frontier AI Research, Agency for Science, Technology and Research(新加坡科技研究局前沿人工智能研究中心)
APPO: Attention-guided Perception Policy Optimization for Video Reasoning
APPO:基于注意力的视频推理感知策略优化
Henghui Du, Chang Zhou, Xi Chen, Di Hu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing(中国人民大学北京校区人工智能学院)
;
AI Technology Center, Online Video Business Unit, Tencent PCG(腾讯PCG人工智能技术中心)
机构
*
Fudan University(复旦大学)
;
NJU-LINK Team, Nanjing University(南京大学NJU-LINK团队)
;
University of Science and Technology of China(中国科学技术大学)
;
Kuaishou Technology(快手科技)
Ego-EXTRA: video-language Egocentric Dataset for EXpert-TRAinee assistance
Ego-EXTRA:视频语言眼动数据集用于专家-学员协助
Francesco Ragusa, Michele Mazzamuto, Rosario Forte, Irene D'Ambra, James Fort, Jakob Engel, Antonino Furnari, Giovanni Maria Farinella
机构
*
Department of Mathematics and Computer Science - University of Catania(数学与计算机科学系 - 卡塔尼亚大学)
;
Next Vision s.r.l. - Spinoff of the University of Catania(Next Vision公司 - 卡塔尼亚大学衍生机构)
;
Meta Reality Labs Research(Meta现实实验室)