SimpleVSF: VLM-Scoring Fusion for Trajectory Prediction of End-to-End Autonomous Driving
机构 * IEIT Systems(IEIT系统)
专题命中 幻觉与鲁棒性 :VLM(title,abstract);vision-language model(abstract);分类 cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * IEIT Systems(IEIT系统)
专题命中 幻觉与鲁棒性 :VLM(title,abstract);vision-language model(abstract);分类 cs.AI
专题命中 幻觉与鲁棒性 :multimodal large language model(abstract);分类 cs.CV
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院) ; University of California, Santa Barbara(加州大学圣芭芭拉分校) ; Center for Research on Intelligent Perception and Computing, NLPR, CASIA(中国科学院CASIA智能感知与计算中心)
专题命中 幻觉与鲁棒性 :vision-language model(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2025 Dataset and Benchmark Track, Project page: https://liuxuannan.github.io/Video-SafetyBench.github.io/
机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) ; School of Future Science and Engineering, Soochow University(未来科学与工程学院,苏州大学) ; DataLab: Data Science and Informatics, University of California, Davis(数据实验室:数据科学与信息学,加州大学戴维斯分校) ; University of Rochester(罗切斯特大学) ; Ningbo University(宁波大学) ; Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Academy for Computer Science and Informatics, Cardiff University(计算机科学与信息学学院,卡迪夫大学)
专题命中 幻觉与鲁棒性 :vision-language model(abstract);分类 cs.CV