arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-01-21 至 2026-01-21 共收录 131 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 25 篇

2601.11688 2026-01-21 cs.SE cs.AI 57%

SpecMap: Hierarchical LLM Agent for Datasheet-to-Code Traceability Link Recovery in Systems Engineering

SpecMap:用于系统工程中datasheet到代码可追溯性链接恢复的分层LLM代理

Vedant Nipane, Pulkit Agrawal, Amit Singh

机构 * H2LooP.ai(H2LooP人工智能研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 SpecMap通过分层LLM代理实现嵌入式系统datasheet到代码的可追溯性链接恢复,提升映射精度与效率,支持自动化分析与下游应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11666 2026-01-21 cs.CV cs.AI 57%

MATEX: Multi-scale Attention and Text-guided Explainability of Medical Vision-Language Models

MATEX: 医疗视觉-语言模型的多尺度注意力与文本引导可解释性

Muhammad Imran, Chi Lee, Yugyung Lee

机构 * Computer Science, School of Science and Engineering(科学与工程学院计算机科学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 MATEX通过多尺度注意力与文本引导方法提升医疗视觉-语言模型的可解释性,实现更精确和临床相关的梯度归因图。

Comments 12 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11608 2026-01-21 cs.DC cs.AI 57%

Hardware-Aware Reformulation of Convolutions for Efficient Execution on Specialized AI Hardware: A Case Study on NVIDIA Tensor Cores

面向专用AI硬件高效执行的卷积重 formulations:NVIDIA Tensor Cores 的案例研究

Ganesh Bikshandi

机构 * NVIDIA

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出了一种硬件感知的卷积计算重 formulations 方法,通过重写规则在训练后满足专用AI硬件的对齐要求,为高效部署CNN模型提供了新的优化策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11606 2026-01-21 cs.LG 57%

A Multimodal Data Processing Pipeline for MIMIC-IV Dataset

用于MIMIC-IV数据集的多模态数据处理流程

Farzana Islam Adiba, Varsha Danduri, Fahmida Liza Piya, Ali Abbasi, Mehak Gupta, Rahmatollah Beheshti

机构 * University of Delaware(德克萨斯大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出了一种用于MIMIC-IV数据集的多模态数据处理流程,旨在提升多模态数据处理效率和研究可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14106 2026-01-21 cs.NI 50%

Communication Technologies for Intelligent Transportation Systems: From Railways to UAVs and Beyond

智能交通系统中的通信技术:从铁路到无人机及更远

Shrief Rizkalla, Adrian Kliks, Nila Bagheri, Miguel A. Bellido-Manganell, Aniruddha Chandra, Anja Dakic, Laura Finarelli, Davy Gaillot, Matti Hamalainen, Ruisi He, Markus Hofer, Sandaruwan Jayaweera, Francesco Linsalata, Konstantin Mikhaylov, Jon M. Peha, Ibrahim Rashdan, Gianluca Rizzo, Abdul Saboor, Martin Schmidhammer, Michal Sybis, Fredrik Tufvesson, Paul Unterhuber, Fernando J. Velez, Evgenii Vinogradov, Michael Walter, Thomas Zemen, Haibin Zhang, Zhengyu Zhang

专题命中 其他安全 :safety(abstract)

AI总结 本文探讨了智能交通系统中通信技术的发展,涵盖铁路、公路、航空和无人机等领域,分析现有技术的局限性,并提出5G、6G和AI驱动网络等新兴技术的整合路径,旨在提升交通系统的互操作性和效率。

Comments 113 pages

Journal ref White Paper: Communication Technologies for Intelligent Transportation Systems: From Railways to UAVs and Beyond, JTIT, pp. 1 to 108, Dec. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13886 2026-01-21 cs.CV 50%

Revisiting Multi-Task Visual Representation Learning

重新审视多任务视觉表示学习

Shangzhe Di, Zhonghua Zhai, Weidi Xie

机构 * SAI, Shanghai Jiao Tong University(上海交通大学SAI) ByteDance Seed(字节跳动种子)

专题命中 其他安全 :alignment(abstract)

AI总结 MTV框架通过多任务学习结合视觉-语言对比、自监督和密集空间目标,提升空间推理能力的同时保持全局语义理解。

Comments Code: https://github.com/Becomebright/MTV

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13440 2026-01-21 cs.CV 50%

Analyzing VLM-Based Approaches for Anomaly Classification and Segmentation

分析基于视觉语言模型的异常分类和分割方法

Mohit Kakda, Mirudula Shri Muthukumaran, Uttapreksha Patel, Lawrence Swaminathan Xavier Prince

机构 * Northeastern University(东北大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文分析了基于视觉语言模型的异常分类和分割方法,探讨了其架构范式、对齐策略及性能评估,为工业质量控制提供了方法选择和未来研究方向的指导。

Comments 10 pages,4 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12820 2026-01-21 cs.CV 50%

A Generalist Foundation Model for Total-body PET/CT Enables Diagnostic Reporting and System-wide Metabolic Profiling

一种通用的基础模型用于全身PET/CT,实现诊断报告和系统层面的代谢分析

Wei Chen, Liang Wu, Shuyi Lu, Yuanyuan Sun, Wenkai Bi, Zilong Yuan, Yaoyao He, Feng Wang, Junchi Ma, Shuyong Liu, Zhaoping Cheng, Xiaoyan Hu, Jianfeng Qiu

专题命中 其他安全 :alignment(abstract)

AI总结 SDF-HOLO是一种用于全身PET/CT的通用基础模型,通过多模态学习实现诊断报告和系统代谢分析,提升医疗影像处理的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12591 2026-01-21 cs.SD eess.AS 50%

SmoothCLAP: Soft-Target Enhanced Contrastive Language\--Audio Pretraining for Affective Computing

SmoothCLAP: 用于情感计算的软目标增强对比语言-音频预训练

Xin Jing, Jiadong Wang, Andreas Triantafyllopoulos, Maurice Gerczuk, Shahin Amiriparian, Jun Luo, Björn Schuller

机构 * CHI -- Chair of Health Informatics, TUM University Hospital, Munich, Germany(健康信息学系,塔尔博特大学医院,德国慕尼黑) Huawei, Netherlands(华为,荷兰) GLAM, Imperial College London, UK(GLAM,伦敦帝国学院,英国)

专题命中 其他安全 :alignment(abstract)

AI总结 SmoothCLAP通过引入软目标和副语言特征,改进了对比语言-音频预训练,以更准确地捕捉情感的连续性,从而提升情感计算任务的性能。

Comments 5 pages, accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12303 2026-01-21 cs.CV 50%

Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual Representations

表示法中的概念:通过视觉表示的稀疏分解实现事后概念瓶颈模型

Shizhan Gong, Xiaofan Zhang, Qi Dou

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出PCBM-ReD,通过视觉表示的稀疏分解,实现对预训练模型的可解释性增强,提升图像分类任务的准确性和可解释性。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20339 2026-01-21 cs.SD 50%

MMEDIT: A Unified Framework for Multi-Type Audio Editing via Audio Language Model

MMEDIT: 一种基于音频语言模型的多类型音频编辑统一框架

Ye Tao, Wen Wu, Chao Zhang, Mengyue Wu, Shuai Wang, Xuenan Xu

机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能莫埃实验室、X-LANCE实验室、上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学)

专题命中 其他安全 :alignment(abstract)

AI总结 MMEdit提出一种基于音频语言模型的统一框架,通过扩展任务定义和设计数据合成管道,实现多类型音频编辑的高精度与高保真度。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏