Investigating Relational Reasoning in VLMs
研究视觉语言模型(VLMs)中的关系推理
机构 * ETH Zurich(苏黎世联邦理工学院)
AI总结 本研究以Qwen3-VL-4B为对象,构建含几何形状的合成数据集,探究VLMs的关系推理能力,发现其结合了真正视觉推理与基于语言线索的捷径策略。
高校专区
研究视觉语言模型(VLMs)中的关系推理
机构 * ETH Zurich(苏黎世联邦理工学院)
AI总结 本研究以Qwen3-VL-4B为对象,构建含几何形状的合成数据集,探究VLMs的关系推理能力,发现其结合了真正视觉推理与基于语言线索的捷径策略。
MIVIFI:弥合透视域与鱼眼域以训练多视图鱼眼图像生成模型
机构 * ETH Zurich(苏黎世联邦理工学院) ; Bosch Research(博世研究中心) ; Technical University of Munich(慕尼黑工业大学)
AI总结 本研究针对多视图鱼眼图像生成问题,提出SyntheOcc-FE与MIVIFI两种方法,其中MIVIFI利用跨域学习缓解鱼眼数据稀缺问题,实现高保真的多视图鱼眼图像生成。
Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC) 2026
微笑的拓扑:牙科成像中的持续同调
机构 * ETH Zürich(苏黎世联邦理工学院) ; PSU(宾夕法尼亚州立大学) ; University of Zürich(苏黎世大学) ; University of Fribourg(弗里堡大学)
AI总结 该研究将拓扑数据分析中的持续同调与支持向量机结合,实现CBCT扫描中牙齿分类与诊断,准确率优于CNN,为牙科成像的自动化分析提供了新方法。