Physics Question Scene Graph: Fine-grained Evaluation of Physical Plausibility in Text-to-Video Generation
物理问题场景图:文本到视频生成中物理合理性的细粒度评估
Atin Pothiraj, Jaemin Cho, Yue Zhang, Elias Stengel-Eskin, Mohit Bansal
机构
*
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
AI2(艾伦人工智能研究所)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
A Benchmark for Hallucination Detection in VLMs for Gastrointestinal Endoscopy
胃肠内窥镜中视觉语言模型幻觉检测的基准测试
Aminu Lawal, Niyoj Oli, Sachin Acharya, Prashnna Gyawali, Maria Carmen Romano, Binod Bhattarai
机构
*
University of Aberdeen(阿伯丁大学)
;
Nepal Applied Mathematics and Informatics Institute for Research(尼泊尔应用数学与信息学研究所)
;
West Virginia University(西弗吉尼亚大学)
EEG Benchmarking Needs a Task Specification Layer: NeuroDoc for Rulebook-Guided, Executable Benchmark Construction
EEG基准测试需要一个任务规范层:NeuroDoc用于基于规则手册的可执行基准构建
Chengxuan Qin, Zhige Chen, Shu Peng, Rui Yang, Jiping Cui, Yikai Dong, Jun Li, Liu Peng, Zhida Shang, Mingze Tang, Kay Chen Tan, Jibin Wu
机构
*
School of Advanced Technology, Xi’an Jiaotong-Liverpool University(西交利物浦大学先进技术学院)
;
School of Electrical Engineering, Electronics and Computer Science, University of Liverpool(利物浦大学电气工程、电子与计算机科学学院)
;
School of Computer Science and Informatics, University of Liverpool(利物浦大学计算机科学与信息学学院)
;
Department of Data Science and Artificial Intelligence, Hong Kong Polytechnic University(香港理工大学数据科学与人工智能系)
ConnectomeBench2: A Unified Benchmark for Automated Connectomic Proofreading
ConnectomeBench2:用于自动连接组校对的标准基准
Jeff Brown, Tim Farkas, Gleb Razgar, Edward S. Boyden
机构
*
MIT(麻省理工学院)
;
The Open University(开放大学)
;
Mindspan Institute(Mindspan研究所)
;
Yang Tan Collective(杨谭集团)
;
McGovern Institute(麦戈文研究所)
;
MIT Departments of Brain and Cognitive Sciences and Biological Engineering(麻省理工学院脑与认知科学系和生物工程系)
SARLO-80: Worldwide Slant SAR Language Optic Dataset 80cm
SARLO-80:全球斜距SAR语言光学数据集80cm
Solène Debuysère, Nicolas Trouvé, Nathan Letheule, Elise Colin, Georgia Channing
机构
*
DEMR-ONERA – The French Aerospace Lab, Université Paris-Saclay(法国航空航天实验室DEMR-ONERA,巴黎-萨克雷大学)
;
DTIS-ONERA – The French Aerospace Lab, Université Paris-Saclay(法国航空航天实验室DTIS-ONERA,巴黎-萨克雷大学)
;
Hugging Face
EFIQA: Explainable Fundus Image Quality Assessment via Anatomical Priors
EFIQA: 基于解剖先验的可解释眼底图像质量评估
Pengwei Wang, José Morano, Qian Wan, Hrvoje Bogunović
机构
*
Institute of Artificial Intelligence, Center for Medical Data Science, Medical University of Vienna, Austria(维也纳医科大学医学数据科学中心人工智能研究所)
;
Christian Doppler Lab for Artificial Intelligence in Retina, Medical University of Vienna, Austria(维也纳医科大学视网膜人工智能克里斯蒂安·多普勒实验室)
NEST: Narrative Event Structures in Time for Long Video Understanding
NEST:面向长视频理解的时间叙事事件结构
Ali Asgarov, Kaushik Narasimhan, Najibul Haque Sarker, Hani Alomari, Chia-Wei Tang, Anushka Sivakumar, Zaber Ibn Abdul Hakim, Shaurya Mallampati, Chris Thomas
机构
*
Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)
CommentsPublished in 2026 IEEE 2nd International Conference on Quantum Photonics, Artificial Intelligence & Networking (QPAIN). \c{opyright} 2026 IEEE. Personal use of this material is permitted
Journal ref2026 IEEE 2nd International Conference on Quantum Photonics, Artificial Intelligence & Networking (QPAIN)
Reference-Driven Multi-Speaker Audio Scene Generation from In-the-Wild Priors
参考驱动的野外先验多说话人音频场景生成
Michael Finkelson, Daniel Segal, Eitan Richardson, Shahar Armon, Nani Goldring, Poriya Panet, Nir Zabari, Benjamin Brazowski, Or Patashnik, Yoav HaCohen