arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2025-12-30 至 2025-12-30 共收录 4
2512.19683 2025-12-30 cs.CV

From Indoor to Open World: Revealing the Spatial Reasoning Gap in MLLMs

从室内到开放世界:揭示MLLMs中的空间推理差距

Mingrui Wu, Zhaozhi Wang, Fangjinhua Wang, Jiaolong Yang, Marc Pollefeys, Tong Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) ETH Zürich(苏黎世联邦理工学院) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出了一种大规模基准测试,通过户外数据集揭示MLLMs在空间推理方面的不足,并证明其依赖语言先验而非真实视觉推理。

Comments Project page: https://mingrui-wu.github.io/openbench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18060 2025-12-30 cs.CV

Fine-Tuned Vision Transformers Capture Complex Wheat Spike Morphology for Volume Estimation from RGB Images

微调视觉Transformer捕捉复杂小麦穗形态以从RGB图像估计体积

Olivia Zumsteg, Nico Graf, Aaron Haeusler, Norbert Kirchgessner, Nicola Storni, Lukas Roth, Andreas Hund

机构 * ETH Zurich, Institute of Agricultural Science(苏黎世联邦理工学院农业科学研究所) ETH Zurich, Department of Computer Science(苏黎世联邦理工学院计算机科学系) ETH Zurich, Department of Mechanical and Process Engineering(苏黎世联邦理工学院机械与过程工程系)

AI总结 本文提出利用微调的视觉Transformer和MLP方法,通过RGB图像和结构光3D扫描估计小麦穗体积,实现了高精度的非破坏性表型分析。

Comments 18 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11938 2025-12-30 cs.CL cs.AI cs.LG

Improving Large Language Model Safety with Contrastive Representation Learning

通过对比表征学习提升大语言模型安全性

Samuel Simko, Mrinmaya Sachan, Bernhard Schölkopf, Zhijing Jin

机构 * ETH Zurich(苏黎世联邦理工学院) MPI for Intelligent Systems(智能系统最大计划) University of Toronto(多伦多大学)

AI总结 本文提出基于对比表征学习的框架,通过三元组损失和对抗性难负样本挖掘提升大语言模型对对抗攻击的鲁棒性。

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25924 2025-12-30 cs.LG cs.AI stat.ME stat.ML

Transferring Causal Effects using Proxies

通过代理转移因果效应

Manuel Iglesias-Alonso, Felix Schur, Julius von Kügelgen, Jonas Peters

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 本文提出通过代理变量在多领域中估计因果效应的方法,证明了可识别性并提供了估计技术与实证支持。

Comments Advances in Neural Information Processing Systems (NeurIPS 2025) final camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏