arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-02-02 至 2026-02-02 共收录 72 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 22 篇

2509.02521 2026-02-02 cs.SD cs.AI cs.CL 62%

FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training

FLM-Audio: 自然独白提升原生全双工聊天机器人通过双训练

Yiqun Yao, Xiang Li, Xin Jiang, Xuezhi Fang, Naitong Yu, Wenjia Ma, Aixin Sun, Yequan Wang

机构 * Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) Nanyang Technological University, Singapore(南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 FLM-Audio通过双训练策略和连续独白提升全双工聊天机器人的响应质量和体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22949 2026-02-02 cs.CL cs.CR 57%

Autonomous Chain-of-Thought Distillation for Graph-Based Fraud Detection

基于图的欺诈检测的自主链式思维蒸馏

Yuan Li, Jun Hu, Bryan Hooi, Bingsheng He, Cheng Chen

机构 * National University of Singapore(新加坡国立大学) ByteDance Inc.(字节跳动公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 FraudCoT通过自主链式思维推理和高效联合训练策略,提升基于图的欺诈检测性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22851 2026-02-02 cs.CL 57%

When Meanings Meet: Investigating the Emergence and Quality of Shared Concept Spaces during Multilingual Language Model Training

意义交汇:探究多语言语言模型训练中共享概念空间的产生与质量

Felicia Körner, Max Müller-Eberstein, Anna Korhonen, Barbara Plank

机构 * MaiNLP, Center for Information and Language Processing, LMU Munich(MaiNLP,信息与语言处理中心,慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) University of Tokyo(东京大学) IT University of Copenhagen(哥本哈根IT大学) Language Technology Lab, University of Cambridge(语言技术实验室,剑桥大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究通过因果可解释方法探讨多语言语言模型训练中共享概念空间的产生与质量,发现早期出现并随训练细化,但语言依赖性显著,且翻译质量提升可能反映行为变化而非能力提升。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02452 2026-02-02 cs.CR cs.AI 57%

XAI-CF -- Examining the Role of Explainable Artificial Intelligence in Cyber Forensics

XAI-CF -- 探讨可解释人工智能在网络安全取证中的作用

Shahid Alam, Zeynep Altiparmak

机构 * Department of Information Security, College of Computer Science and Engineering, University of Ha’il, Ha’il, Saudi Arabia(信息安全系,计算机科学与工程学院,哈伊尔大学,沙特阿拉伯)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文探讨了可解释人工智能(XAI)在网络安全取证(CF)中的作用,强调了建立可信任的AI系统以提高公众接受度和法律合规性的重要性,并提出了XAI-CF的定义、挑战及解决方案。

Journal ref Engineering Applications of Artificial Intelligence, 167(3), 2026, 113892

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22439 2026-02-02 cs.CL 57%

Stop Jostling: Adaptive Negative Sampling Reduces the Marginalization of Low-Resource Language Tokens by Cross-Entropy Loss

停止推搡:自适应负采样减少交叉熵损失对低资源语言标记的边缘化

Galim Turumtaev

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出自适应负采样技术,通过减少交叉熵损失对低资源语言标记的边缘化影响,提升模型对低资源语言的表示能力。

Comments Accepted at LoResLM 2025 (COLING 2025 workshop). Oral presentation

Journal ref In Proceedings of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025), pages 373-386, Abu Dhabi, United Arab Emirates. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22284 2026-02-02 cs.LG 57%

Riemannian Lyapunov Optimizer: A Unified Framework for Optimization

Riemannian Lyapunov Optimizer:一种优化的统一框架

Yixuan Wang, Omkar Sudhir Patil, Warren E. Dixon

机构 * Department of Mechanical and Aerospace Engineering(机械与航空航天工程系) University of Florida(佛罗里达大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 Riemannian Lyapunov Optimizer通过控制理论框架统一优化算法,提供稳定有效的优化器设计方法。

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12243 2026-02-02 cs.CV cs.AI 57%

Less is More: Label-Guided Summarization of Procedural and Instructional Videos

少即是多:基于标签的程序性和教学视频摘要

Shreya Rajpal, Michal Golovanevsky, Carsten Eickhoff

机构 * University of Tübingen(图宾根大学) Vellore Institute of Technology(维洛雷理工学院) Brown University(布朗大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 PRISM提出了一种基于标签的视频摘要方法,通过集成语义和多模态分析,生成语义准确且上下文连贯的摘要,有效提升摘要质量。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06777 2026-02-02 cs.CV cs.AI 57%

MolX: Enhancing Large Language Models for Molecular Understanding With A Multi-Modal Extension

MolX: 通过多模态扩展增强大型语言模型的分子理解能力

Khiem Le, Zhichun Guo, Kaiwen Dong, Xiaobao Huang, Bozhao Nan, Roshni Iyer, Xiangliang Zhang, Olaf Wiest, Wei Wang, Ting Hua, Nitesh V. Chawla

机构 * University of Notre Dame, IN, USA(诺丁汉大学) University of California, Los Angeles, CA, USA(加州大学洛杉矶分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 MolX通过多模态扩展提升LLM对分子的理解能力,利用SMILES和分子图提取细粒度特征,并结合分子指纹提升性能,有效提升分子相关任务表现。

Comments MLoG-GenAI@KDD'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22927 2026-02-02 cs.RO cs.ET 50%

Toward Fully Autonomous Driving: AI, Challenges, Opportunities, and Needs

迈向完全自动驾驶:人工智能、挑战、机遇与需求

Lars Ullrich, Michael Buchholz, Klaus Dietmayer, Knut Graichen

机构 * Institute of Measurement, Control and Microtechnology(测量、控制与微技术研究所) Ulm University(乌尔姆大学)

专题命中 其他安全 :safety(abstract)

AI总结 本文探讨了人工智能在完全自动驾驶中的挑战、机遇及需求,分析了AI在提升自动驾驶能力方面的潜力与限制。

Comments Published in IEEE Access, 29 January 2026

Journal ref IEEE Access, 29 January 2026, pp. 1--26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22919 2026-02-02 cs.SE 50%

A Serverless Edge-Native Data Processing Architecture for Autonomous Driving Training

用于自动驾驶训练的无服务器边缘原生数据处理架构

Fabian Bally, Michael Schötz, Thomas Limbrunner

专题命中 其他安全 :safety(abstract)

AI总结 本文提出Lambda框架,通过无服务器架构实现边缘计算中的实时数据处理,提升自动驾驶训练效率。

Comments Source code is available at https://github.com/LASFAS/jblambda

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27647 2026-02-02 cs.CV 50%

NegoCollab: A Common Representation Negotiation Approach for Heterogeneous Collaborative Perception

NegoCollab: 一种用于异构协作感知的共同表示协商方法

Congzhang Shao, Quan Yuan, Guiyang Luo, Yue Hu, Danni Wang, Yilin Liu, Rui Pan, Bo Chen, Jinglin Li

专题命中 其他安全 :alignment(abstract)

AI总结 NegoCollab通过协商共同表示方法解决异构协作感知中的领域差距问题,提升多智能体协作性能。

Comments 23 pages, Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18220 2026-02-02 cs.SD eess.AS 50%

LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech

LLM-ForcedAligner: 一种非自回归且准确的基于大语言模型的强制对齐器,适用于多语言和长文本语音

Bingshen Mu, Xian Shi, Xiong Wang, Hexin Liu, Jin Xu, Lei Xie

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

专题命中 其他安全 :alignment(abstract)

AI总结 LLM-ForcedAligner通过非自回归方法实现多语言和长文本语音的准确强制对齐,显著减少时间偏移。

详情

展开后加载摘要…

URL PDF HTML 收藏