arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2025-12-09 至 2025-12-09 共收录 8
2512.07832 2025-12-09 cs.CL cs.LG

Do Generalisation Results Generalise?

泛化结果是否能泛化?

Matteo Boglioni, Andrea Sgobbi, Gabriel Tavernini, Francesco Rita, Marius Mosbach, Tiago Pimentel

机构 * ETH Zürich(苏黎世联邦理工学院) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所) McGill University(麦吉尔大学)

AI总结 本文研究了大型语言模型在不同分布外测试集上的泛化能力是否具有普遍趋势,通过分析多个模型发现泛化结果的相关性依赖于具体模型的选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07673 2025-12-09 cs.RO

Multi-Domain Motion Embedding: Expressive Real-Time Mimicry for Legged Robots

多域运动嵌入:用于腿部机器人实时模仿的表达性方法

Matthias Heyrman, Chenhao Li, Victor Klemm, Dongho Kang, Stelian Coros, Marco Hutter

机构 * Robotic Systems Lab, ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院机器人系统实验室) Computational Robotics Lab, ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院计算机器人实验室) ETH Zürich(苏黎世联邦理工学院)

AI总结 本文提出多域运动嵌入方法,通过结合小波编码器和概率嵌入,实现对运动结构和非结构特征的统一表示,从而提升机器人实时模仿复杂轨迹的保真度和泛化能力。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04556 2025-12-09 stat.ML cs.LG math.ST q-fin.ST stat.AP stat.TH

Model Monitoring: A General Framework with an Application to Non-life Insurance Pricing

模型监控:一个通用框架及其在非寿险定价中的应用

Alexej Brauer, Paul Menzel, Mario V. Wüthrich

机构 * Department of Mathematics, ETH Zurich(数学系,苏黎世联邦理工学院)

AI总结 本文提出一个通用模型监控框架,用于非寿险定价中的概念漂移检测与模型校准,通过Gini分数和自动校准测试提升模型性能评估的统计可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00224 2025-12-09 physics.chem-ph cond-mat.mtrl-sci cs.LG

Learning from the electronic structure of molecules across the periodic table

在元素周期表范围内学习分子的电子结构

Manasa Kaniselvan, Benjamin Kurt Miller, Meng Gao, Juno Nam, Daniel S. Levine

机构 * FAIR at Meta(Meta 的 FAIR 部门) ETH Zurich(苏黎世联邦理工学院) MIT(麻省理工学院)

AI总结 HELM模型通过利用哈密顿矩阵数据提升分子电子结构学习,为低数据条件下能量预测提供改进方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06084 2025-12-09 cs.RO cs.CV

MAPLE: Encoding Dexterous Robotic Manipulation Priors Learned From Egocentric Videos

MAPLE:从第一人称视频中学习的灵巧机器人操作先验知识编码

Alexey Gavryushin, Xi Wang, Robert J. S. Malate, Chenyu Yang, Davide Liconti, René Zurbrügg, Robert K. Katzschmann, Marc Pollefeys

机构 * ETH Zürich(苏黎世联邦理工学院) Mimic Robotics(Mimic机器人公司) Microsoft Research(微软研究院)

AI总结 MAPLE通过从第一人称视频中学习的先验知识,提升灵巧机器人操作任务的策略学习,有效应对复杂精细的操作需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06353 2025-12-09 cs.CV

TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search

TreeQ: 通过树结构混合精度搜索推动扩散变换器的量化边界

Kaicheng Yang, Kaisen Yang, Baiting Wu, Xun Zhang, Qianrui Yang, Haotong Qin, He Zhang, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) Adobe Research(Adobe研究院)

AI总结 TreeQ通过树结构混合精度搜索方法,首次在DiT模型上实现接近无损的4位PTQ性能,解决了DiT量化中的关键挑战。

Comments Code and Supplementary Material could be found at https://github.com/racoonykc/TreeQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06294 2025-12-09 q-bio.MN cs.LG math.PR q-bio.QM stat.ML

Interpretable Neural Approximation of Stochastic Reaction Dynamics with Guaranteed Reliability

可解释的神经近似随机反应动力学:具有保证可靠性的方法

Quentin Badolle, Arthur Theuer, Zhou Fang, Ankit Gupta, Mustafa Khammash

机构 * Department of Biosystems Science and Engineering, ETH Zurich(1 生物系统科学与工程系,苏黎世联邦理工学院)

AI总结 DeepSKA通过结合可解释性、可靠性保证和高效计算,为随机反应动力学提供了一种新的神经近似方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12758 2025-12-09 cs.CL

Democratic or Authoritarian? Probing a New Dimension of Political Biases in Large Language Models

民主或威权?探讨大型语言模型中政治偏见的新维度

David Guzman Piedrahita, Irene Strauss, Bernhard Schölkopf, Rada Mihalcea, Zhijing Jin

机构 * University of Zürich(苏黎世大学) ETH Zürich(苏黎世联邦理工学院) MPI for Intelligent Systems(智能系统研究所) University of Michigan(密歇根大学) University of Toronto(多伦多大学)

AI总结 本文探讨了大型语言模型在民主与威权政治偏见方面的表现,通过引入F-scale、FavScore和角色模型探测方法,揭示了模型在不同语言提示下对民主与威权倾向性的差异。

详情

展开后加载摘要…

URL PDF HTML 收藏