arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8017 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8017 篇

2603.09740 2026-03-11 cs.RO cs.CV 78%

Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments

逐步奖励:面向连续环境的视觉语言导航中的步骤感知对比对齐

Haoyuan Li, Rui Liu, Hehe Fan, Yi Yang

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院,杭州,中国)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出SACA框架,通过步骤感知对比对齐提升连续环境中视觉语言导航的性能,解决传统方法在错误恢复和训练稳定性方面的不足。

Comments 28 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06077 2026-03-09 cs.IT cs.GT math.IT 78%

Distributed Semantic Alignment over Interference Channels: A Game-Theoretic Approach

分布式语义对齐 over 干扰信道:一种博弈论方法

Giuseppe Di Poce, Mattia Merluzzi, Emilio Calvanese Strinati, Paolo Di Lorenzo

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出了一种基于博弈论的分布式语义对齐方法,通过非合作博弈优化MIMO收发器,解决语义匹配和干扰问题,提升AI驱动系统通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05762 2026-03-09 eess.SY cs.SY 78%

Combinatorial Safety-Critical Coordination of Multi-Agent Systems via Mixed-Integer Responsibility Allocation and Control Barrier Functions

通过混合整数责任分配和控制屏障函数实现多智能体系统的组合安全关键协调

Johannes Autenrieb, Mark Spiller, Hyo-Sang Shin, Namhoon Cho

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出通过混合整数规划和控制屏障函数实现多智能体系统的安全关键协调,以提高避障效率和减少计算复杂性。

Comments 6 pages, 4 figures, submitted to the IEEE for possible publication,

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02878 2026-03-04 cs.RO astro-ph.EP 78%

Emerging trends in Cislunar Space for Lunar Science Exploration and Space Robotics aiding Human Spaceflight Safety

月球科学探索与空间机器人助力人类航天安全的新兴趋势

Arsalan Muhammad, Yue Wang, Hai Huang, Hao Wang

专题命中 其他安全 :safety(title,abstract)

AI总结 本文探讨了人工智能与空间机器人在月球科学探索及载人航天安全中的应用,旨在推动可持续月球探索和未来火星任务的发展。

Comments Conference Proceedings of 2nd IAA Conference on AI in and for Space (2nd IAA SPAICE), Suzhou, China, 1-3 November, 2025

Journal ref Conference Proceedings of 2nd IAA Conference on AI in and for Space (2nd IAA SPAICE), Suzhou, China, 1-3 November, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02250 2026-03-04 cs.SD eess.AS 78%

SGPA: Spectrogram-Guided Phonetic Alignment for Feasible Shapley Value Explanations in Multimodal Large Language Models

SGPA: 基于频谱的语音对齐用于多模态大语言模型中可行的谢普利值解释

Paweł Pozorski, Jakub Muszyński, Maria Ganzha

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 SGPA通过结合连接主义时间分类和频谱边界细化,实现了多模态大语言模型中可行的音频解释,显著减少了模型评估次数并保持了全局轮廓。

Comments Submitted for admission in Interspeech 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00443 2026-03-03 cs.CV 78%

SesaHand: Enhancing 3D Hand Reconstruction via Controllable Generation with Semantic and Structural Alignment

SesaHand: 通过语义和结构对齐可控生成增强3D手重建

Zhuoran Zhao, Xianghao Kong, Linlin Yang, Zheng Wei, Pan Hui, Anyi Rao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) Communication University of China(中国通信大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 SesaHand通过语义和结构对齐提升可控手部生成,优化3D手重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00412 2026-03-03 cs.CV 78%

PointAlign: Feature-Level Alignment Regularization for 3D Vision-Language Models

PointAlign:用于3D视觉-语言模型的特征级对齐正则化

Yuanhao Su, Shaofeng Zhang, Xiaosong Jia, Qi Fan

机构 * University of Science and Technology of China(中国科学技术大学) Fuzhou University(福州大学) Fudan University(复旦大学) Nanjing University(南京大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 PointAlign通过特征级对齐正则化提升3D视觉-语言模型的几何信息保留与任务性能

Comments CVPR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00193 2026-03-03 q-bio.QM 78%

Multimodal Alignment Improves Generalizability of Genomic Biomarker Prediction in Computational Pathology

多模态对齐提升了计算病理学中基因组生物标志物预测的泛化能力

Ekaterina Redekop, Eric Zimmermann, Ava P Amini, Alex X Lu, Neil Tenenholtz, James Brian Hall, Lorin Crawford, Kristen A Severson

专题命中 其他安全 :alignment(title,abstract)

AI总结 MARBLE通过多模态对比预训练策略,将组织病理学图像与基因组生物标志物的表示对齐,提升计算病理学中基因组生物标志物预测的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20644 2026-02-25 cs.SE 78%

An LLM-driven Scenario Generation Pipeline Using an Extended Scenic DSL for Autonomous Driving Safety Validation

基于扩展Scenic DSL的LLM驱动场景生成流水线用于自动驾驶安全验证

Fida Khandaker Safa, Yupeng Jiang, Xi Zheng

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出基于扩展Scenic DSL和LLM的场景生成流水线,实现高精度自动驾驶安全验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17599 2026-02-20 cs.CV cs.MM cs.SD 78%

Art2Mus: Artwork-to-Music Generation via Visual Conditioning and Large-Scale Cross-Modal Alignment

Art2Mus: 通过视觉条件和大规模跨模态对齐进行艺术品到音乐生成

Ivan Rinaldi, Matteo Mendula, Nicola Fanelli, Florence Levé, Matteo Testi, Giovanna Castellano, Gennaro Vessio

机构 * University of Bari Aldo Moro(巴里大学阿尔多·莫罗大学) Catalonia's Telecommunications Technology Centre(加泰罗尼亚电信技术中心) University of Picardie Jules Verne(皮卡第大学朱利·瓦内大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 ArtToMus通过直接视觉条件生成音乐,无需图像到文本转换,实现艺术品到音乐的跨模态对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16584 2026-02-19 q-bio.NC 78%

The Representational Alignment Hypothesis: Evidence for and Consequences of Invariant Semantic Structure Across Embedding Modalities

表征对齐假说:跨嵌入模态的不变语义结构的证据及其后果

Akhil Ramidi, Kevin Scharp

专题命中 其他安全 :alignment(title,abstract)

AI总结 该研究提出表征对齐假说,探讨跨模态嵌入的不变语义结构,质疑其根本性,并提出新的哲学视角和区分方法。

Comments 23 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15903 2026-02-19 cs.CV 78%

Detecting Deepfakes with Multivariate Soft Blending and CLIP-based Image-Text Alignment

利用多变量软融合和基于CLIP的图像-文本对齐检测深度伪造

Jingwei Li, Jiaxin Tong, Pengfei Wu

机构 * Zhejiang Gongshang University(浙江工商大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出MSBA-CLIP框架,通过多变量软融合和CLIP引导的伪造强度估计,提升深度伪造检测的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11235 2026-02-16 cs.IR 78%

MTFM: A Scalable and Alignment-free Foundation Model for Industrial Recommendation in Meituan

MTFM:一种可扩展且无对齐的工业推荐基础模型

Xin Song, Zhilin Guan, Ruidong Han, Binghao Tang, Tianwen Chen, Bing Li, Zihao Li, Han Zhang, Fei Jiang, Qing Wang, Zikang Xu, Fengyi Li, Chunzhen Jing, Lei Yu, Wei Lin

专题命中 其他安全 :alignment(title,abstract)

AI总结 MTFM是一种基于Transformer的工业推荐基础模型,通过异构标记和多场景样本聚合提升效率,实现无对齐的多场景推荐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12569 2026-02-16 cs.HC 78%

Editable XAI: Toward Bidirectional Human-AI Alignment with Co-Editable Explanations of Interpretable Attributes

可编辑的可解释性AI:通过可编辑的可解释属性实现双向人机对齐

Haoyang Chen, Jingwen Bai, Fang Tian, Brian Y Lim

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出可编辑的XAI方法CoExplain,通过允许用户编写规则来提升人机对齐,实验表明其在理解和控制方面优于传统只读XAI。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09483 2026-02-11 cs.CV 78%

Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions

超越单个词对齐:通过令牌交互蒸馏多模态大语言模型

Lin Chen, Xiaoke Zhao, Kun Ding, Weiwei Feng, Changtao Miao, Zili Wang, Wenxuan Guo, Ying Wang, Kaiyuan Zheng, Bo Zhang, Zhe Li, Shiming Xiang

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所信息与智能系统研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Zhejiang University(浙江大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 Align-TI通过令牌交互改进知识蒸馏,实现多模态大语言模型的高效压缩与性能提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15831 2026-02-11 cs.CV 78%

UniFit: Towards Universal Virtual Try-on with MLLM-Guided Semantic Alignment

UniFit: 向基于多模态大语言模型引导的语义对齐的通用虚拟试衣迈进

Wei Zhang, Yeying Jin, Xin Li, Yan Zhang, Xiaofeng Cong, Cong Wang, Fengcai Qiao, zhichao Lian

专题命中 其他安全 :alignment(title,abstract)

AI总结 UniFit通过多模态大语言模型引导的语义对齐模块,解决虚拟试衣中语义差距和数据稀缺问题,实现通用且高性能的试衣框架。

Comments accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14410 2026-02-11 eess.AS 78%

TTA: Transcribe, Translate and Alignment for Cross-lingual Speech Representation

TTA:跨语言语音表示的转录、翻译与对齐

Wei Liu, Jiahong Li, Yiwen Shao, Dong Yu

专题命中 其他安全 :alignment(title,abstract)

AI总结 TTA通过大规模训练生成跨语言语音表示,提升语音识别与翻译任务的性能,优于Whisper模型。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01547 2026-02-03 cs.SD eess.AS 78%

Attention-weighted Centered Kernel Alignment for Knowledge Distillation in Large Audio-Language Models Applied to Speech Emotion Recognition

基于注意力加权中心核对齐的知识蒸馏:用于大音频-语言模型的语音情感识别

Qingran Yang, Botao Zhao, Zuheng Kang, Xue Li, Yayun He, Chuhang Liu, Xulong Zhang, Xiaoyang Qu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 PL-Distill通过结合投影层和输出层蒸馏方法,有效压缩大音频-语言模型并提升语音情感识别性能。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00531 2026-02-03 cs.CV 78%

Enhancing Open-Vocabulary Object Detection through Multi-Level Fine-Grained Visual-Language Alignment

通过多级细粒度视觉-语言对齐增强开放词汇物体检测

Tianyi Zhang, Antoine Simoulin, Kai Li, Sana Lakdawala, Shiqing Yu, Arpit Mittal, Hongyu Fu, Yu Lin

机构 * University of Minnesota(明尼苏达大学) Meta

专题命中 其他安全 :alignment(title,abstract)

AI总结 VLDet通过多级细粒度视觉-语言对齐提升开放词汇物体检测性能,引入VL-PUB模块和SigRPN块,实现新类别检测的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02767 2026-02-02 cs.CV 78%

Dynamic Reflections: Probing Video Representations with Text Alignment

动态反射:通过文本对齐探测视频表示

Tyler Zhu, Tengda Han, Leonidas Guibas, Viorica Pătrăucean, Maks Ovsjanikov

机构 * Princeton University(普林斯顿大学) Google DeepMind(谷歌DeepMind)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究通过视频-文本表示对齐探索现代视频和语言编码器的能力,揭示了跨模态对齐与数据丰富性、语义对齐与性能相关性以及时间推理与对齐的关系。

Comments To appear at ICLR 2026. 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15301 2026-01-29 cond-mat.soft nlin.AO 78%

Collective behaviors of self-propelled particles with tunable alignment angles

具有可调对齐角度的自驱动粒子集体行为

Zichen Qin, Nariya Uchida

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出了一种具有可调对齐角度的自驱动粒子模型,通过数值模拟发现其在特定参数范围内表现出反平行带等独特集体行为,揭示了多体相互作用对向列序的破坏作用。

Comments 7 pages, 5 figures

Journal ref Phys. Rev. E 113, 015411 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23919 2026-01-29 cs.IT cs.SY eess.SY math.IT 78%

Intelligent Angle Map-based Beam Alignment for RIS-aided mmWave Communication Networks

基于智能角度图的RIS辅助毫米波通信网络波束对齐

Hao Xia, Qing Xue, Yanping Liu, Binggui Zhou, Meng Hua, Qianbin Chen

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出基于智能角度图的波束对齐方法,利用Transformer模型实现高效波束对齐,无需扫描即可实现高精度通信性能。

Journal ref IEEE Transactions on Network Science and Engineering, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19247 2026-01-28 cs.CV 78%

TIGaussian: Disentangle Gaussians for Spatial-Awared Text-Image-3D Alignment

TIGaussian: 解耦高斯分布以实现空间感知的图文-3D对齐

Jiarun Liu, Qifeng Chen, Yiru Zhao, Minghua Liu, Baorui Ma, Sheng Yang

机构 * Unmanned Vehicle Dept., Cainiao Inc., Alibaba Group, Hangzhou, China(阿里巴巴集团 Cainiao 无人机部门,杭州,中国) Hillbot, Sunnyvale, USA(Hillbot,美国 Sunnyvale) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院,北京,中国)

专题命中 其他安全 :alignment(title,abstract)

AI总结 TIGaussian通过多分支3DGS分词器和模态特定对齐策略,实现空间感知的图文-3D跨模态对齐,提升3D相关任务的预训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15331 2026-01-27 cs.HC 78%

DesignerlyLoop: Forming Design Intent through Curated Reasoning for Human-LLM Alignment

DesignerlyLoop: 通过精选推理形成设计意图以实现人-大语言模型对齐

Anqi Wang, Zhengyi Li, Xin Tong, Pan Hui

专题命中 其他安全 :alignment(title,abstract)

AI总结 DesignerlyLoop通过精选推理提升人-大语言模型在设计任务中的对齐,改进设计质量和创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13664 2026-01-22 cs.CV 78%

VIAFormer: Voxel-Image Alignment Transformer for High-Fidelity Voxel Refinement

VIAFormer:用于高保真体素细化的体素-图像对齐变换器

Tiancheng Fang, Bowen Pan, Lingxi Chen, Jiangjing Lyu, Chengfei Lyu, Chaoyue Niu, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

专题命中 其他安全 :alignment(title,abstract)

AI总结 VIAFormer通过体素-图像对齐变换器实现高保真体素细化,结合图像索引、校正流目标和混合流变换器,提升多视角条件下体素修复的精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19678 2026-01-21 eess.SY cs.SY 78%

Distributed Safety-Critical MPC for Multi-Agent Formation Control and Obstacle Avoidance

分布式安全关键MPC用于多智能体编队控制与障碍规避

Chao Wang, Shuyuan Zhang, Lei Wang

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出了一种分布式安全关键MPC算法,通过高阶控制屏障函数和控制Lyapunov函数实现多智能体编队控制与障碍规避,提升了系统的安全性和效率。

Comments Accepted for presentation at the 64th IEEE Conference on Decision and Control (CDC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07682 2026-01-13 physics.ins-det 78%

Sub-Pixel Electron Beam Alignment for Machine Learning Characterization of Hybrid Pixel Detectors

亚像素电子束对准用于机器学习对混合像素探测器的表征

Emiliya Poghosyan, Xiangyu Xie, Joakim Reuteler, Kirsty A. Paton, Luis Barba Flores, Benjamin Béjar Haro, Erik Fröjdh, Anna Bergamaschi, Elisabeth Müller

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究提出两种新方法生成高质量训练数据,用于通过机器学习实现混合像素探测器的亚像素对准和超分辨率表征。

Comments 11 pages, 6 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04605 2026-01-09 cs.CV 78%

Detection of Deployment Operational Deviations for Safety and Security of AI-Enabled Human-Centric Cyber Physical Systems

面向AI赋能的人本型网络物理系统的部署操作偏差检测

Bernard Ngabonziza, Ayan Banerjee, Sandeep K. S. Gupta

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出了一种基于个性化图像的新技术,用于检测AI赋能的人本型网络物理系统在部署中的操作偏差,以确保其安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18795 2026-01-08 cs.CV 78%

ProCLIP: Progressive Vision-Language Alignment via LLM-based Embedder

通过基于大语言模型的嵌入器实现渐进式视觉-语言对齐的ProCLIP

Xiaoxing Hu, Kaicheng Yang, Ziyang Gong, Qi Ming, Zonghao Guo, Yu Tian, Xiang An, Ziyong Feng, Xue Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) DeepGlint(深图科技) Beijing University of Technology(北京工业大学) Tsinghua University(清华大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 ProCLIP通过课程学习逐步对齐CLIP图像编码器与基于大语言模型的嵌入器,提升长文本处理和多语言理解能力。

Comments 17 pages, 5 fiugres

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01289 2026-01-06 cs.CR 78%

dataRLsec: Safety, Security, and Reliability With Robust Offline Reinforcement Learning for DPAs

dataRLsec: 通过鲁棒的离线强化学习实现DPAs的安全性、安全性和可靠性

Shriram KS Pandian, Naresh Kshetri

专题命中 其他安全 :safety(title,abstract)

AI总结 dataRLsec提出了一种鲁棒的离线强化学习方法,结合加权哈希验证和密度比加权行为克隆算法,以提升DPAs的安全性和可靠性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏