How Do Linear Probes Emerge? A Circuit-Tracing Framework with Concept-Targeted Attribution
线性探针如何产生?基于概念定向归因的电路追踪框架
Vedant Palit, Florent Draye, Terry Jingchen Zhang, Bernhard Schölkopf, Zhijing Jin
机构
*
University of Toronto(多伦多大学)
;
Vector Institute(矢量研究院)
;
Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
;
ELLIS Institute Tübingen(图宾根ELLIS研究所)
Learned Relay Representations for Forward-Thinking Discrete Diffusion Models
学习的中继表示用于前向思考的离散扩散模型
Benjamin Rozonoyer, Jacopo Minniti, Dhruvesh Patel, Neil Band, Avishek Joey Bose, Tim G. J. Rudner, Andrew McCallum
机构
*
University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)
;
University of Toronto(多伦多大学)
;
Stanford University(斯坦福大学)
;
Imperial College London(伦敦帝国学院)
;
Mila
;
Vijil
Reasoning models do not yet follow their reasoning in autonomous driving: The KITScenes LongTail Dataset
长尾驾驶场景与推理轨迹:KITScenes长尾数据集
Royden Wagner, Omer Sahin Tas, Jaime Villa, Felix Hauser, Yinzhe Shen, Marlon Steiner, Dominik Strutz, Carlos Fernandez, Quentin Delfosse, Christoph Weinhuber, Christian Kinzig, Guillermo S. Gutierrez-Cabello, Hendrik Königshof, Fabian Immel, Richard Schwarzkopf, Nils Alexander Rack, Kevin Rösch, Kaiwen Wang, Jan-Hendrik Pauls, Martin Lauer, Igor Gilitschenski, Holger Caesar, Christoph Stiller
机构
*
Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院)
;
FZI Research Center for Information Technology(FZI信息技术研究中心)
;
University Charles III of Madrid(马德里卡洛斯三世大学)
;
Technical University of Madrid(马德里理工大学)
;
University of Toronto(多伦多大学)
;
Delft University of Technology(代尔夫特理工大学)