CommentsAccepted at the ECCV 2026 Workshop on Generative AI for Audio-Visual Content Creation (Gen4AVC), poster presentation; non-archival workshop. 7 pages (4-page main text + references + 2-page appendix), 3 figures, 8 tables. Project page: this https URL (https://jaishrm07.github.io/avsync-reliability-card/)
VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning
VBVR-Pro:用于原生视觉推理的可扩展且可验证工具套件
Junxiang Xu, Ruisi Wang, Fanyi Pu, Maijunxian Wang, Ran Ji, Tongxi Zhou, Chenyang Gu, Jing Zuo, Hongcan Xiao, Yimeng Geng, Wanqi Yin, Wei Chen, Oscar Qian, Zhengan Yan, Ziqi Huang, Haiwen Diao, Liang Pan, Bo Li, Xiangyu Fan, Dezhi Luo, Fengyuan Yu, Zehong Zhao, Qingying Gao, Tinghui Zhu, Yilan Zhang, Jingqi Tong, Pinyuan Feng, Zhengze Jiang, Letian Wang, Ziyu Guo, Renrui Zhang, Jieneng Chen, Sonia Joseph, Constantin Venhoff, Saman Motamed, Mengyue Yang, Chandra Sripada, Alan Yuille, Philip Torr, Lvmin Zhang, Vikash Kumar, Daniel Khashabi, Nikolaus Kriegeskorte, Raphaël Millière, Vincent C. Müller, Anyi Rao, Quan Wang, Ziwei Liu, Dahua Lin, Lei Yang, Hokin Deng, Zhongang Cai
机构
*
Nanyang Technological University(南洋理工大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
The University of Tokyo(东京大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of Michigan(密歇根大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of California, Davis(加州大学戴维斯分校)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Columbia University(哥伦比亚大学)
;
University of Toronto(多伦多大学)
MyoMechanix: Biomechanically-Grounded Compositional Skilled Activity Understanding and Coaching
MyoMechanix:基于生物力学的可组合技能活动理解与指导
Hao Yin, Paritosh Parmar, Lijun Gu, Lin Xu, Tianxiao Guo, Xiujin Liu, Tianyou Zheng, Yang Zhang, Weiwei Fu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Suzhou Institute of Biomedical Engineering and Technology, Chinese Academy of Sciences(中国科学院苏州生物医学工程技术研究所)
;
Arexeni Research and Technologies Inc.(Arexeni研究与技术公司)
;
Beijing Sports University(北京体育大学)
;
University of Michigan(密歇根大学)
AdaptiveEmbed: Sample-Adaptive Multi-Vector Representation for Multimodal Retrieval
AdaptiveEmbed:面向多模态检索的样本自适应多向量表示
Xinze Liu, Lei Yang, Dayan Wu, Hengjie Zhu, Zihao Zhang, Hanqi Wu, Tianzhu Hu, Peng Fu, Zheng Lin, Weiping Wang
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
Fusing Perceptual Vision Experts with Multimodal Large Language Models for Explainable Plant Disease Diagnosis: From Benchmark Imagery to Real-World Robotic Field Validation
融合感知视觉专家与多模态大语言模型的可解释植物病害诊断:从基准图像到真实世界机器人现场验证
Ranjan Sapkota, Konstantinos I. Roumeliotis, Pengyao Xie, Nikolaos D. Tselikas, Lirong Xiang, Manoj Karkee
机构
*
Cornell University(康奈尔大学)
;
University of the Peloponnese(伯罗奔尼撒大学)
;
Agricultural University of Athens(雅典农业大学)