Zhuoran Yang, Ed Li, Jianliang He, Aman Priyanshu, Baturay Saglam, Paul Kassianik, Sajana Weerawardhena, Anu Vellore, Blaine Nelson, Neusha Javidnia, Arthur Goldblatt, Fraser Burch, Avi Zohary, Assaf Eisenman, Mahdi Sabbaghi, Supriti Vijay, Rahim Dharssi, Dhruv Kedia, Kojin Oshiba, Yaron Singer, Amin Karbasi
机构
*
Foundation AI–Cisco Systems Inc.(Foundation AI–Cisco系统公司)
;
Yale University(耶鲁大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
University of Pennsylvania(宾夕法尼亚大学)
;
Carnegie Mellon University(卡内基梅隆大学)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
基于框架的思考:视觉上下文和测试时扩展如何增强视频推理
Chengzu Li, Zanyi Wang, Jiaang Li, Yi Xu, Han Zhou, Huanyu Zhang, Ruichuan An, Dengyang Jiang, Zhaochong An, Ivan Vulić, Serge Belongie, Anna Korhonen
机构
*
University of Cambridge(剑桥大学)
;
Pioneer Center for AI, University of Copenhagen(人工智能先锋中心,哥本哈根大学)
;
Hong Kong University of Science(香港科学大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Peking University(北京大学)
Yuhang Liu, Zhen Zhang, Dong Gong, Erdun Gao, Biwei Huang, Mingming Gong, Anton van den Hengel, Kun Zhang, Javen Qinfeng Shi
机构
*
Australian Institute for Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学)
;
School of Computer Science and Engineering, The University of New South Wales(计算机科学与工程学院,新南威尔士大学)
;
Halicioğlu Data Science Institute, University of California San Diego(Halicioğlu数据科学研究所,加州大学圣地亚哥分校)
;
School of Mathematics and Statistics, The University of Melbourne(数学与统计学学院,墨尔本大学)
;
Department of Philosophy, Carnegie Mellon University(哲学系,卡内基梅隆大学)