SG-CADVLM: A Context-Aware Decoding Powered Vision Language Model for Safety-Critical Scenario Generation
SG-CADVLM: 一种基于上下文感知解码的视觉语言模型,用于安全关键场景生成
机构 * School of Transportation, Southeast University(东南大学交通学院)
专题命中 幻觉与鲁棒性 :vision language model(title);vision-language model(abstract)
AI总结 本文提出SG-CADVLM,一种结合上下文感知解码的多模态输入处理框架,用于从事故报告中生成高保真的安全关键场景,通过减少视觉语言模型的幻觉并同时生成道路几何和车辆轨迹,提升了生成场景的准确性和实用性。