Representations of Text and Images Align From Layer One
文本和图像的表示从第一层对齐
机构 * D-INFK, ETH Zurich, Switzerland(苏黎世联邦理工学院信息与知识系统研究所) ; Aisle Research(Aisle研究)
AI总结 该研究通过合成方法证明,视觉-语言模型中图像和文本表示在第一层即可实现对齐,为模型可解释性提供了新路径。
高校专区
文本和图像的表示从第一层对齐
机构 * D-INFK, ETH Zurich, Switzerland(苏黎世联邦理工学院信息与知识系统研究所) ; Aisle Research(Aisle研究)
AI总结 该研究通过合成方法证明,视觉-语言模型中图像和文本表示在第一层即可实现对齐,为模型可解释性提供了新路径。
基于几何意识的操作变换器:一种高效的准确神经代理用于任意域上的偏微分方程
机构 * Seminar for Applied Mathematics, ETH Zurich, Switzerland(应用数学研讨会,苏黎世联邦理工学院,瑞士) ; ETH AI Center, Zurich, Switzerland(ETH人工智能中心,苏黎世,瑞士) ; Department of Mechanical and Process Engineering, ETH Zurich, Switzerland(机械与过程工程系,苏黎世联邦理工学院,瑞士) ; School of Computer Science, CMU, USA(计算机科学学院,卡内基梅隆大学,美国) ; Centre for Applicable Mathematics, TIFR, India(应用数学中心,印度泰姬·弗里德曼研究所)
AI总结 本文提出几何意识的操作变换器GAOT,用于高效准确地学习任意域上的偏微分方程解,通过多尺度注意图神经网络和几何嵌入实现高精度与高效能的结合。
基于学习的多视图立体:综述
机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) ; Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究生院) ; Department of Computer Science, University of Southern California(南加州大学计算机科学系) ; Department of Engineering Science, University of Oxford(牛津大学工程科学系) ; University of Chinese Academy of Sciences(中国科学院大学) ; School of Computer and Communication Sciences, EPFL(苏黎世联邦理工学院计算机与通信科学学院) ; Australian National University(澳大利亚国立大学) ; Microsoft, Zurich(微软(瑞士))
AI总结 本文综述了基于学习的多视图立体方法,重点介绍了基于深度图的方法,并讨论了该领域未来的研究方向。
Comments Accepted to IEEE T-PAMI 2026