arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8044 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8044 篇

2605.06258 2026-05-08 cs.LG cs.AI 62%

The Weight Gram Matrix Captures Sequential Feature Linearization in Deep Networks

权重格雷矩阵捕捉深度网络中的序列特征线性化

Taehun Cha, Daniel Beaglehole, Adityanarayanan Radhakrishnan, Donghun Lee

机构 * MIT Mathematics Broad Institute of MIT and Harvard(麻省理工学院数学Broad研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于特征的框架,通过将权重更新与特征演变关联,揭示深度网络训练中权重格雷矩阵捕捉特征动态,并引入目标线性度量,展示深度网络如何逐步将表示转换为目标线性结构。

Comments 29 pages including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05421 2026-05-08 cs.CV cs.AI cs.LG 62%

DARK: Diagonal-Anchored Repulsive Knowledge Distillation for Vision-Language Models under Extreme Compression

DARK:针对极端压缩下视觉-语言模型的对角锚定排斥知识蒸馏

Numan Saeed, Asif Hanif, Fadillah Adamsyah Maani, Hussain Alasmawi, Mohammad Yaqub

机构 * Mohamed Bin Zayed University of Artificial Intelligence(Mohamed Bin Zayed人工智能大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DARK,一种对比知识蒸馏框架,通过分解损失函数为对角项和非对角项,使学生模型在极端压缩下更高效地排斥教师模型的非目标相似结构,实验证明其在零样本基准上表现优异。

Comments Project website: www.numansaeed.com/mobilefetalclip

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08110 2026-05-08 cs.CV cs.CL cs.LG 62%

The ART of Composition: Attention-Regularized Training for Compositional Visual Grounding

构图的艺术:用于组合视觉定位的注意力正则化训练

Jiayun Luo, Mir Rayat Imtiaz Hossain, Pritam Sarkar, Boyang Li, Leonid Sigal

机构 * The University of British Columbia(不列颠哥伦比亚大学) Nanyang Technological University(南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文提出CompART,通过分解标题为以对象为中心的短语并构建复合短语,提升多对象定位能力,验证了其在多种视觉语言模型上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05218 2026-05-08 cs.LG cs.AI math.DS nlin.CD 62%

Horizon-Constrained Rashomon Sets for Chaotic Forecasting

具有水平约束的Rashomon集用于混沌预测

Gauri Kale, Rahul Vishwakarma, Holly Diamond, Ava Hedayatipour, Amin Rezaei

机构 * Dept. of Electrical Engineering, California State University Long Beach, USA WorkOnward Inc., USA Dept. of Computer Engineering \& Computer Science, California State University Long Beach, USA

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出水平约束Rashomon集理论框架,用于研究混沌系统中模型多样性随预测时间的变化,通过Lyapunov加权指标和决策对齐算法提升决策质量,实验表明在安全关键领域具有显著优势。

Journal ref AIP Advances 16, 045208 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20180 2026-05-08 cs.CV cs.AI cs.CL 62%

Adaptive Greedy Frame Selection for Long Video Understanding

自适应贪心帧选择用于长视频理解

Yuning Huang, Xiaoyu Ji, Joseph Huang, Yichi Zhang, Fengqing Zhu

机构 * Purdue University(普渡大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种自适应贪心帧选择方法,在固定帧预算下联合优化查询相关性和语义代表性,通过构建1FPS候选池并嵌入两种互补空间,提升长视频问答的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01609 2026-05-05 cs.LG cs.AI 62%

Concepts Whisper While Syntax Shouts: Spectral Anti-Concentration and the Dual Geometry of Transformer Representations

概念低语而语法高呼:频谱反集中与Transformer表示的双几何

Pratyush Acharya, Nuraj Rimal, Habish Dhakal

机构 * Pratyush Acharya Nuraj Rimal Habish Dhakal

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 研究通过跨语言概念传输测试,发现因果内积在频谱正则化下无显著差异,揭示了残差流中反集中现象及静态解嵌行对比的高方差集中特性,支持语法优先编码于高方差子空间。

Comments 25 pages, 16 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01167 2026-05-05 cs.LG cs.AI 62%

Minimizing Collateral Damage in Activation Steering

最小化激活引导中的附带损害

Tam Nguyen, Tu Anh Nguyen, Sina Alemohammad, Richard G. Baraniuk

机构 * Department of Electrical \& Computer Engineering, Rice University, Houston, USA Department of Computational Applied Mathematics, Rice University, Houston, USA Department of Electrical \& Computer Engineering, The University of Texas at Austin, Austin, USA

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于约束优化的框架,通过数学形式化附带损害并优化激活变化,以更精确地控制大语言模型行为,同时减少对无关任务性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17815 2026-05-05 cs.HC cs.CL cs.CY 62%

Navigating the Conceptual Multiverse

在概念多元宇宙中导航

Andre Ye, Jenny Y. Huang, Alicia Guo, Rose Novick, Tamara Broderick, Mitchell L. Gordon

机构 * MIT EECS(麻省理工学院电子工程与计算机科学系) UW Allen School of CSE(华盛顿大学Allen学院计算机科学与工程系) UW Department of Philosophy(华盛顿大学哲学系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.CY

AI总结 本文提出概念多元宇宙,通过交互系统让用户透明地检查和改变概念决策,提升问题理解。在三个领域中,该系统帮助参与者更清晰地把握问题,如哲学学生改写论文、对齐标注者深入分析用户意图、诗人发现创作模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27077 2026-05-04 cs.LG cs.AI stat.ML 62%

Learning Rate Transfer in Normalized Transformers

归一化变换器中的学习率转移

Boris Shigida, Boris Hanin, Andrey Gromov

机构 * Meta Superintelligence Labs(Meta超智能实验室) Princeton University(普林斯顿大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出νGPT模型,通过结合数值实验和对齐指数,改进了超参数转移方法,实现了模型宽度、深度和token horizon上的学习率转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00072 2026-05-04 cs.CV cs.AI cs.LG 62%

Unlocking Zero-Shot Geospatial Reasoning via Indirect Rewards

通过间接奖励解锁零样本地理推理

Chenhui Xu, Fuxun Yu, Michael J. Bianco, Jacob Kovarskiy, Raphael Tang, Qi Zhang, Zirui Xu, Will LeVine, Brandon Dubbs, Heming Liao, Cassandra Burgess, Suvam Bag, Jay Patravali, Rupanjali Kukal, Mikael Figueroa, Rishi Madhok, Nikolaos Karianakis, Jinjun Xiong

机构 * University at Buffalo(布法罗大学) Microsoft(微软)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Geo-R1方法,利用间接可验证奖励提升地理推理能力,在多个下游任务中实现卓越的零样本迁移性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28182 2026-05-01 cs.LG cs.CL 62%

Exploration Hacking: Can LLMs Learn to Resist RL Training?

探索黑客:大语言模型能否学会抵抗强化学习训练?

Eyon Jang, Damon Falck, Joschka Braun, Nathalie Kirch, Achu Menon, Perusha Moodley, Scott Emmons, Roland S. Zimmermann, David Lindner

机构 * MATS UC San Diego(UC圣迭戈大学) Google DeepMind(谷歌DeepMind) Anthropic

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文研究了大语言模型在强化学习训练中可能通过策略性调整探索行为导致失败的机制,通过微调创建了具有特定低效策略的模型,并评估了检测与缓解策略。

Comments 81 pages, 37 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26880 2026-04-30 cs.CL cs.LG 62%

HealthNLP_Retrievers at ArchEHR-QA 2026: Cascaded LLM Pipeline for Grounded Clinical Question Answering

HealthNLP_Retrievers在ArchEHR-QA 2026中的表现:基于级联LLM管道的 grounded临床问答

Md Biplob Hosen, Md Alomgeer Hussein, Md Akmol Masud, Omar Faruque, Tera L Reynolds, Lujie Karen Chen

机构 * University of Maryland Baltimore County(马里兰大学巴尔的摩县分校) Jahangirnagar University(贾旺吉拉大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文提出基于Gemini 2.5 Pro的级联管道,通过多阶段模块实现患者问题理解、证据检索与回答生成,提升临床问答的准确性和专业性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26361 2026-04-30 cs.CL cs.AI 62%

Text Style Transfer with Machine Translation for Graphic Designs

通过机器翻译进行文本风格迁移用于图形设计

Deergh Singh Budhauria, Sanyam Jain, Rishav Agarwal, Tracy King

机构 * Adobe

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了三种新方法用于图形设计文本风格迁移中的词对齐问题,基于商业可用的NMT和LLM翻译技术,通过定制输入输出标签进行文本风格迁移,并与注意力头方法进行比较。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17698 2026-04-30 cs.LG cs.CL stat.ML 62%

The Geometric Canary: Predicting Steerability and Detecting Drift via Representational Stability

几何渡鸦:通过表征稳定性预测可操控性并检测漂移

Prashant C. Raju

机构 * Prashant C. Raju

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过表征稳定性预测语言模型的可操控性并检测漂移,展示了监督和非监督稳定性在不同任务中的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25806 2026-04-29 cs.CL cs.AI cs.HC 62%

MAIC-UI: Making Interactive Courseware with Generative UI

MAIC-UI: 用生成式UI制作交互式课程ware

Shangqing Tu, Yanjia Li, Keyu Chen, Sichen Zhang, Jifan Yu, Daniel Zhang-Li, Lei Hou, Juanzi Li, Yu Zhang, Huiqin Liu

机构 * Tsinghua University(清华大学) Guangzhou University(广州大学) Zhejiang University(浙江大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 MAIC-UI通过零代码系统实现教育者快速编辑交互式课程ware,采用多模态知识分析、生成-验证-优化流程和点击定位编辑技术,提升教学效果和学习公平性。

Comments You can try our demo at https://open.maic.chat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11449 2026-04-29 cs.LG cs.AI 62%

Tabular Data with Class Imbalance: Predicting Electric Vehicle Crash Severity with Pretrained Transformers (TabPFN) and Mamba-Based Models

表格数据中的类别不平衡:利用预训练转换器(TabPFN)和Mamba-based模型预测电动汽车碰撞严重程度

Shriyank Somvanshi, Pavan Hebli, Gaurab Chhetri, Subasish Das

机构 * College of Science and Engineering, Texas State University, San Marcos, Texas, USA(科学与工程学院,德克萨斯州立大学,圣马科斯,德克萨斯州,美国)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种深度表格学习框架,利用真实世界碰撞数据预测电动汽车碰撞严重程度,通过SMOTEENN处理类别不平衡问题,评估了TabPFN、MambaNet和MambaAttention三种模型,发现MambaAttention在严重伤害分类上表现更优。

Comments This is the author's preprint version of a paper accepted for presentation at the 24th International Conference on Machine Learning and Applications (ICMLA 2025), December 3-5, 2025, Florida, USA. The final published version will appear in the official IEEE proceedings. Conference site: https://www.icmla-conference.org/icmla25/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24186 2026-04-28 cs.CL cs.AI 62%

MultiDx: A Multi-Source Knowledge Integration Framework towards Diagnostic Reasoning

MultiDx: 一个面向诊断推理的多源知识整合框架

Yimin Deng, Zhenxi Lin, Yejing Wang, Guoshuai Zhao, Pengyue Jia, Zichuan Fu, Derong Xu, Yefeng Zheng, Xiangyu Zhao, Li Zhu, Xian Wu, Xueming Qian

机构 * Xi’an Jiaotong University(西安交通大学) City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯 Jarvis实验室) Westlake University(西湖大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出MultiDx框架,通过多源知识整合提升诊断推理能力,结合网络搜索、病例数据库等多视角证据,生成最终预测。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23578 2026-04-28 cs.CL cs.AI 62%

LLMs Reading the Rhythms of Daily Life: Aligned Understanding for Behavior Prediction and Generation

LLMs阅读日常生活节奏:行为预测与生成的对齐理解

Fanjin Meng, Jingtao Ding, Nian Li, Yizhou Sun, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,BNRist,清华大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出BUA框架,通过结构化课程学习将LLMs融入人类行为建模,提升行为预测与生成能力,实验证明其在复杂行为建模中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23307 2026-04-28 cs.LG cs.AI 62%

CombiMOTS: Combinatorial Multi-Objective Tree Search for Dual-Target Molecule Generation

CombiMOTS:基于双靶分子生成的组合多目标树搜索

Thibaud Southiratn, Bonil Koo, Yijingxiu Lu, Sun Kim

机构 * Department of Computer Science and Engineering, Seoul National University, Seoul, Republic of Korea(首尔国立大学计算机科学与工程系) Interdisciplinary Program in Bioinformatics, Seoul National University, Seoul, Republic of Korea(首尔国立大学生物信息学跨学科项目) AIGENDRUG Co., Ltd., Seoul, Republic of Korea(AIGENDRUG公司) Interdisciplinary Program in Artificial Intelligence, Seoul National University, Seoul, Republic of Korea(首尔国立大学人工智能跨学科项目)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出CombiMOTS,一种基于多目标树搜索的框架,用于生成双靶分子,通过向量优化约束平衡靶点亲和力与物理化学性质,实验表明其能生成高评分、多样化的双靶分子。

Comments Accepted as a poster at ICML 2025 (Main Track)

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:56650-56691, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21768 2026-04-28 cs.LG cs.AI 62%

Extending Precipitation Nowcasting Horizons via Spectral Fusion of Radar Observations and Foundation Model Priors

通过雷达观测与基础模型先验的频谱融合扩展降水现在预报时间范围

Yuze Qin, Qingyong Li, Zhiqing Guo, Wen Wang, Yan Liu, Yangli-ao Geng

机构 * 1 Key Laboratory of Big Data \& Artificial Intelligence in Transportation (Ministry of Education), Beijing Jiaotong University, Beijing, China 2 CMA Key Laboratory of Transportation Meteorology, Nanjing Innovation Institute for Atmospheric Sciences, Nanjing, China

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PW-FouCast框架,通过频谱融合雷达数据与气象先验,解决雷达图像与气象数据表示差异问题,提升降水预报可靠性与时间范围。

Comments Accepted by IJCNN 2026. Code is available at https://github.com/Onemissed/PW-FouCast

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20938 2026-04-24 cs.LG cs.AI 62%

HARBOR: Automated Harness Optimization

HARBOR:自动化Harness优化

Biswa Sengupta, Jinhua Wang

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HARBOR框架,通过约束噪声贝叶斯优化解决Harness配置问题,强调自动化配置优于手动堆叠,并在生产编码代理中实例化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20398 2026-04-23 cs.CL cs.LG cs.SE 62%

WebGen-R1: Incentivizing Large Language Models to Generate Functional and Aesthetic Websites with Reinforcement Learning

WebGen-R1: 通过强化学习激励大语言模型生成功能性和美观的网站

Juyong Jiang, Chenglin Cai, Chansung Park, Jiasi Shen, Sunghun Kim, Jianguo Li, Yue Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里云实验室) Electronics and Telecommunications Research Institute(电子电信研究院) Ant Group(蚂蚁集团)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文提出WebGen-R1框架,通过强化学习生成多页面功能性和美观的网站,解决了传统方法在多页面交互和审美评估上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20012 2026-04-23 cs.CV cs.AI cs.CL 62%

EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training

EmbodiedMidtrain: 通过中训练弥合视觉语言模型与视觉语言动作模型之间的差距

Yiyang Du, Zhanqiu Guo, Xin Ye, Liu Ren, Chenyan Xiong

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所) Bosch Research North America & Bosch Center for Artificial Intelligence (BCAI)(博世北美研究部及博世人工智能中心(BCAI))

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出EmbodiedMidtrain方法,通过中训练弥合视觉语言模型与视觉语言动作模型之间的差距,实验表明中训练能提升不同VLM骨干网络的性能,且在初始化阶段对VLA微调有显著帮助。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19754 2026-04-23 cs.AI cs.LG 62%

Exploring Data Augmentation and Resampling Strategies for Transformer-Based Models to Address Class Imbalance in AI Scoring of Scientific Explanations in NGSS Classroom

探索数据增强和重采样策略以解决基于Transformer模型的AI评分中科学解释类不平衡问题

Prudence Djagba, Kevin Haudek, Clare G. C. Franovic, Leonora Kaldaras

机构 * Michigan State University(密歇根州立大学) CREATE for STEM(STEM创新计划) University of Houston(休斯顿大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了通过数据增强策略提升Transformer模型对科学解释评分的性能,发现GPT生成数据和ALP方法在处理严重类别不平衡时效果显著,优于传统过采样方法。

Comments Published as a conference paper at NARST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15861 2026-04-23 cs.CL cs.AI 62%

CAST: Achieving Stable LLM-based Text Analysis for Data Analytics

CAST:实现稳定的大语言模型文本分析用于数据分析

Jinxiang Xie, Zihao Li, Wei He, Rui Ding, Shi Han, Dongmei Zhang

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Peking University(北京大学) Microsoft Research(微软研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 CAST通过算法提示和先思考后发言提升大语言模型在表格数据分析中的输出稳定性,实验表明其在多个基准上表现最佳,稳定性提升达16.2%。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13928 2026-04-23 cs.CL cs.AI 62%

LLMs Can Get "Brain Rot": A Pilot Study on Twitter/X

Shuo Xing, Junyuan Hong, Yifan Wang, Runjin Chen, Zhenyu Zhang, Ananth Grama, Zhengzhong Tu, Zhangyang Wang

机构 * Texas A&M University(德克萨斯农工大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Purdue University(普渡大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

Comments Updated experiments with corrected data

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05090 2026-04-22 cs.CL cs.LG 62%

Multilingual Language Models Encode Script Over Linguistic Structure

多语言语言模型编码脚本而非语言结构

Aastha A K Verma, Anwoy Chatterjee, Mehak Gupta, Tanmoy Chakraborty

机构 * Indian Institute of Technology Delhi(印度理工学院德里)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究揭示多语言模型通过表面形式而非语言结构组织表示,发现正字法影响显著,深层结构逐渐显现。

Comments Accepted at ACL 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10559 2026-04-22 cs.LG cs.AI cs.RO 62%

Generative Models and Connected and Automated Vehicles: A Survey in Exploring the Intersection of Transportation and AI

生成模型与连接与自动化车辆:探索交通与人工智能交汇点的综述

Bo Shu, Yiting Zhang, Saisai Hu, Dong Shu

机构 * School of Engineering Science(工程科学学院) Shandong Xiehe University(山东谢河大学) Department of Electrical Engineering(电气工程系) Northwestern University(西北大学) Department of Computer Science(计算机科学系) Pace University(帕克大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文综述了生成模型与连接自动化车辆在交通与AI交汇领域的应用,探讨其在预测建模、模拟精度和自动驾驶决策中的提升作用及面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18468 2026-04-21 cs.CV cs.AI cs.GR cs.LG 62%

Asset Harvester: Extracting 3D Assets from Autonomous Driving Logs for Simulation

资产收割者:从自动驾驶日志中提取3D资产用于模拟

Tianshi Cao, Jiawei Ren, Yuxuan Zhang, Jaewoo Seo, Jiahui Huang, Shikhar Solanki, Haotian Zhang, Mingfei Guo, Haithem Turki, Muxingzi Li, Yue Zhu, Sipeng Zhang, Zan Gojcic, Sanja Fidler, Kangxue Yin

机构 * NVIDIA

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Asset Harvester,通过图像到3D模型的端到端流程,将稀疏的现实日志中物体观测转换为完整的模拟资产,结合大规模数据整理、几何感知预处理和鲁棒训练方案,解决自动驾驶数据中的稀疏视角等挑战。

Comments NVIDIA white paper. The project page: https://research.nvidia.com/labs/sil/projects/asset-harvester/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26475 2026-04-21 cs.LG cs.AI eess.SP math.RT 62%

Foundation Model for Cardiac Time Series via Masked Latent Attention

通过掩码潜在注意力的心脏时间序列基础模型

Moritz Vandenhirtz, Samuel Ruipérez-Campillo, Simon Böhi, Sonia Laguna, Irene Cannistraci, Andrea Agostini, Ece Ozkan, Thomas M. Sutter, Julia E. Vogt

机构 * Department of Computer Science, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机科学系,瑞士) Department of Biomedical Engineering, University of Basel, Switzerland(巴塞尔大学生物医学工程系,瑞士)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LAMAE基础模型,通过自监督预训练学习跨导联连接机制,提升ECG表示质量和迁移能力,在预测ICD-10编码上优于独立导联掩码模型和对齐基线。

Comments First two authors are co-first. Last two authors are co-senior

Journal ref ICLR 2026: Workshop on Foundation Models for Science

详情

展开后加载摘要…

URL PDF HTML 收藏