arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 598 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 598 篇

2608.09821 2026-08-11 eess.SP 新提交 50%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08225 2026-08-11 eess.SP cs.SY eess.SY 新提交 50%

Toward Intelligent Skies: Signal Processing and AI Foundations of Low-Altitude Wireless Networks

迈向智能天空:低空无线网络的信号处理与人工智能基础

Weijie Yuan, Geng Sun, Jiacheng Wang, Jun Wu, Yuanhao Cui, Jiahui Li, Wei Zhang, George K. Karagiannidis, Sumei Sun, Yonina C. Eldar

专题命中 其他安全 :safety(abstract)

AI总结 本教程从AI与信号处理视角,全面阐述低空无线网络(LAWN)的架构基础、信号处理与AI技术,结合案例分析其融合应用,指出未来发展挑战与机遇。

Comments Invited Overview Paper in JSTSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08950 2026-08-11 cs.SE 新提交 50%

Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework

基于双向重构-验证框架的代码智能体独立补丁验证

Chenglin Li, Yisen Xu, Zehao Wang, Shin Hwei Tan, Tse-Hsun, Chen

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对代码智能体生成补丁后缺乏独立验证的问题,提出无需训练的RETRACE双向重构-验证框架,在SWE-bench Verified等基准上显著提升了代码补丁的正确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08701 2026-08-11 cs.RO 新提交 50%

Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar

基于锚的人工智能方法:利用汽车雷达中的微多普勒特征进行碰撞前目标检测

Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser, Jonathan Wache, Soumya Dewangan, Thomas Brandmeier

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出基于锚的AI模型,结合雷达微多普勒特征与创新雷达图像膨胀技术,提升碰撞前目标检测性能,在动态场景中优于现有汽车雷达跟踪方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08663 2026-08-11 cs.HC cs.CV 新提交 50%

A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data

用于在视觉感知数据中建立人类指代表达式基础的动态语义框架

Joseph Bingham

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出动态语义框架,通过显式约定状态绑定集合与感知对齐流程,解决视觉-语言模型在词汇同步任务中的不足,在斯坦福重复参考游戏语料库上达到83.56%的top-5准确率,核心是透明符号层与可检查感知通道的结合。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08462 2026-08-11 cs.AR 新提交 50%

ARMOR: Accelerating RTL Simulation by Mitigating the Front-End Bottleneck Using Node Compression

ARMOR:通过节点压缩缓解前端瓶颈以加速RTL仿真

Jiaping Tang, Jianan Mu, Zhiteng Chao, Jingzhong Wen, Jing Ye, Huawei Li

专题命中 其他安全 :alignment(abstract)

AI总结 ARMOR是一款通过节点压缩缓解前端瓶颈的高效RTL仿真器,利用比特级数据并行性压缩节点,在CPU和AI加速器设计上分别实现1.6倍和2.7倍加速。

Comments Accepted by 2026 59th IEEE/ACM International Symposium on Microarchitecture (MICRO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 50%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他安全 :alignment(abstract)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07554 2026-08-11 cs.CV cs.RO 新提交 50%

Impact of Dataset Composition on Embedded Real-Time UAV Wildfire Detection Using Compact YOLO Models

数据集组成对采用轻量YOLO模型的嵌入式实时无人机野火检测的影响

Eduardo de los Santos, Andre S. Kelbouscas, Ricardo B. Grando, Bruna V. Guterres

机构 * Technological University of Uruguay(乌拉圭技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究以轻量YOLO模型为对象,探究数据集组成对嵌入式实时无人机野火检测的影响,发现真实未增强数据集的检测性能最优,合成数据混合与图像增强均未提升部署效果,数据集真实性和领域对齐更具价值。

Comments Paper accepted at the ICCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07279 2026-08-10 eess.SP 新提交 50%

Token Communication for Multimodal Large Language Model

多模态大语言模型的令牌通信

Jingkai Ying, Zhijin Qin, Yuan Shen, Khaled B. Letaief

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对多模态大语言模型(MLLMs)的令牌传输问题,提出适配MLLMs的令牌通信框架,通过集成神经编解码器、两阶段语义对齐训练及自适应适配器,在相同传输数据量下实现更优任务性能。

Comments 13 pages, 11 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06170 2026-08-07 cs.RO cs.CV 新提交 50%

Prior-SG: Task and Prior Driven Region Segmentation for Scene Graphs in Arbitrarily-Structured Environments

Prior-SG:面向任意结构环境中场景图的任务与先验驱动区域分割

Giorgio Tonetti, Laurent Kneip, Abel Gawel, Marco Hutter

机构 * RAI Institute(RAI研究所) ETH Zurich(苏黎世联邦理工学院)

专题命中 其他安全 :alignment(abstract)

AI总结 提出Prior-SG框架,将场景图生成视为概率对齐问题,通过融合异构专家与拓扑先验提升任意结构环境的语义区域分割精度,实现零样本本体灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05921 2026-08-07 cs.SE 新提交 50%

Sensor-Level Fault Diagnosis for Automotive Software Validation Using Large Language Models

基于大语言模型的汽车软件验证传感器级故障诊断

Mohammad Abboush, Hamza Ouarrad, Andreas Rausch

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出两阶段框架,用经4-bit低秩适配的LLM对HIL平台的汽车传感器记录做故障诊断,最小模型准确率达81.6%,适配循环可在单商用加速器运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05221 2026-08-07 cs.RO 新提交 50%

A System for Train Condition Monitoring and Structural Health Assessment of Rail Vehicles

轨道车辆的列车状态监测与结构健康评估系统

Maximilian Posner, Martin Dazer, Daniela Lauer, Robert Winkler-Höhn, Mathilde Laporte, Tobias Herrmann, Martin Köppel

机构 * DB InfraGO AG(DB InfraGO股份公司) DB Systemtechnik(DB系统技术公司) MSG Ammendorf(MSG阿门多夫公司)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种融合结构传感器技术与AI数据分析的系统,用于轨道车辆状态监测与撞击检测,可自动检测相关事件、支持状态维护及设计优化,助力干线铁路向全自动运行过渡。

Journal ref IEEE Intelligent Vehicles Symposium, Detroit, USA, Jun, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05763 2026-08-07 physics.geo-ph 新提交 50%

Foundation Model-Assisted Full Waveform Inversion

基础模型辅助的全波形反演

Mustafa Alfarhan, Matteo Ravasi, Fuqiang Chen, George Turkiyyah, David Keyes

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出用预训练地震基础模型SeisLM的特征构建全波形反演早期目标函数,通过实验验证其可避免周期跳变,提升反演效果,优于传统及混合损失工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04622 2026-08-06 cs.CV 新提交 50%

DAC-Pose: Dual-Agent Collaborative Framework for Pose-Guided Human Generation

DAC-Pose:用于姿态引导人体生成的双智能体协作框架

Haotian Yang, Zhile Yang, Huiyu Zhou, Xin Sun

机构 * Faculty of Data Science, City University of Macau(澳门城市大学数据科学学院) Shenzhen University of Advanced Technology(深圳理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Computing and Mathematical Sciences, University of Leicester(莱斯特大学计算与数学科学学院)

专题命中 其他安全 :alignment(abstract)

AI总结 针对姿态引导人体生成在剧烈视角变化下的视觉伪影问题,提出双智能体协作框架DAC-Pose,通过PSR与DAVE智能体的反馈循环实现高保真合成,在DeepFashion和Market-1501基准上验证了其优越性。

Comments Code is available at DAC-Pose" target="_blank" rel="noopener">https://github.com/AIVRC/DAC-Pose

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04483 2026-08-06 cs.CV 新提交 50%

Not All Redundant Tokens Are Alike: Analyzing Visual Token Pruning through Token Roles

并非所有冗余视觉标记都相同:通过标记角色分析视觉标记剪枝

Hyeonyu Kim, Sehwan Lim, Youngwon Choi, Taeyoun Kwon, Jaejin Kim

机构 * Maum AI Inc.(Maum AI公司)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对视觉-语言模型(VLMs)的视觉标记剪枝问题,通过EmbedLens分析标记角色,发现代表性剪枝方法存在标记角色偏差但与下游性能无直接关联,优化角色分配后表明保留非活跃标记可维持或提升性能,为剪枝方法优化提供了新视角。

Comments Accepted to ECCV 2026 workshop, UniWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04318 2026-08-06 cs.MA 新提交 50%

Responsibility in Multi-Agent Sequential Decision-Making: Comparing Human Judgments to Formal Models of Causal Attribution

多智能体序贯决策中的责任归属:人类判断与因果归因形式模型的比较

Nripsuta Ani Saxena, Stelios Triantafyllou, Goran Radanović

专题命中 其他安全 :alignment(abstract)

AI总结 本研究对比了多智能体序贯决策中责任归因的形式模型与人类判断的契合度,通过大规模调查和Goofspiel实验识别出影响人类责任判断的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03899 2026-08-05 cs.IR 新提交 50%

ATLAS: Learning to Recommend Across Unseen Domains

ATLAS:学习在未见域间进行推荐

Pervez Shaik, Prosenjit Biswas, Abhinav Thorat, Ravi Kolla, Niranjan Pedanekar

专题命中 其他安全 :alignment(abstract)

AI总结 ATLAS是一种多源推荐域泛化框架,无需目标域适配或LLM预训练,可从异构源域学习域不变表示,在未见域零样本推荐中优于多种基线,HitRate平均提升24%。

Comments 18 pages, 5 figures, 14 tables. Includes appendix with proofs and additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03143 2026-08-05 cs.CV cs.RO 新提交 50%

From Routes to Steps: Separating Semantic Progress from Local Execution in Vision-and-Language Navigation

从路线到步骤:在视觉语言导航中分离语义进展与局部执行

Xiangyun Huang, Xiangchen Wang, Runfeng Lin, Yihao Xu, Kangyu Huang, Jiang Hengchen, Xiwang Dong, Lin Jiarong

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对视觉语言导航中进展与执行错误难区分的问题,提出Route2Step框架,通过步骤级接口分离语义进展跟踪与动作生成,在R2R-CE数据集上显著提升了导航性能,且在真实环境中具备实用性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03016 2026-08-05 cs.CV 新提交 50%

Clinically-Grounded Hierarchical Classification for Consistent Chest X-ray Interpretation

基于临床依据的分层分类用于一致性胸部X射线影像解读

Jong Hak Moon, Minjun Kim, Minjun Kim

机构 * Yeji X(艺智X)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对胸部X射线解读的层级特性,提出CHASE框架,通过三级分类与多层级优化,提升了预测的一致性与性能。

Comments MICCAI 2026 Accepted. First & Corresponding author: Jong Hak Moon (jh.moon@yejix.com)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01988 2026-08-04 cs.CV 新提交 50%

Grounding and Explaining Visual Evidence for AI-Generated Image Detection in Human-Centric Scenes

面向以人为中心场景中AI生成图像检测的视觉证据定位与解释

Kun Guo, Yuzhou Yang, Haoyue Wang, Qichao Ying, Sheng Li, Zhenxing Qian

专题命中 其他安全 :alignment(abstract)

AI总结 针对以人为中心场景AI生成图像检测的证据定位与解释局限,提出HAVE数据集及PAVE框架,实现真伪预测、证据定位与解释生成,实验表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01896 2026-08-04 cs.CV 新提交 50%

GeoCore-9B: Towards Geo-Aware Generative Foundation Models in Earth Observation

GeoCore-9B:面向地球观测的地理感知生成基础模型

Jeonghyeok Do, Munchurl Kim

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对现有EO生成模型的地理空间约束冲突问题,推出90亿参数的GeoCore-9B,采用Flow Matching的DiT与地理空间元数据条件生成,结合地理空间语义对齐损失,在多项EO任务上实现最优性能。

Comments Please visit our project page at https://kaist-viclab.github.io/GeoCore-9B_site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01636 2026-08-04 cs.RO 新提交 50%

A Forward-Inverse Dynamic Game Framework for Enhanced Multi-Agent Trajectory Planning

用于增强多智能体轨迹规划的前向-逆向动态博弈框架

Tianle Liu, Youcheng Niu, Jing Zeng, Shuo Li, Jinming Xu

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 其他安全 :safety(abstract)

AI总结 针对多智能体轨迹规划的动态博弈方法局限,本文提出带状态依赖权重的KL正则化动态博弈及上下文感知逆向博弈模块,经模拟与多机器人实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01335 2026-08-04 cs.HC 新提交 50%

PartInteractor: Intent-Driven Part-Aware 3D Authoring for Continuous Co-Creation in XR

PartInteractor:面向XR中持续协同创作的意图驱动、部件感知的三维创作工具

Jianan Jiang, Bin Li

专题命中 其他安全 :alignment(abstract)

AI总结 PartInteractor是支持语音、草图、图像输入的部件感知三维创作框架,将语义部件层级作为可操控单元,提升生成后控制与意图一致性,助力XR中持续人机协同创作。

Comments Accepted to ACM UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01306 2026-08-04 cs.CV 新提交 50%

SPAE: Spectrally Guided Autoencoder for Pretrained Visual Latents

SPAE:用于预训练视觉隐层的频谱引导自编码器

Yibin Huang, Jixiang Hong, Zongzhao Li, Yuhan Dai, Zhibin Wang, Chunwei Wang, Jun Song, Chen Wang, Xiaofei Sun, Xiaoxiao Xu, Conghui Zhu

机构 * Alibaba Group(阿里巴巴集团) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

专题命中 其他安全 :alignment(abstract)

AI总结 针对DiT生成隐层与编码器隐层的频谱不匹配问题,提出SPAE框架,通过紧凑瓶颈结构与通道级掩码策略实现隐层适配,在视觉理解、生成质量与重建保真度间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00976 2026-08-04 cs.CV 新提交 50%

Location-Aware Fine-Grained Representation Learning for Medical Vision Foundation Models

面向医学视觉基础模型的位置感知细粒度表示学习

Myeongkyun Kang, Yanting Yang, Xiaoxiao Li

机构 * The University of British Columbia(不列颠哥伦比亚大学) Vector Institute(矢量研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究提出基于位置感知细粒度表示学习的医学视觉基础模型LoFi,构建大规模医学定位数据集MedG,在多项医学视觉任务中性能优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00775 2026-08-04 cs.RO cs.CV cs.HC 新提交 50%

ORCESTRA: VLM-driven Visual Robot programming in Mixed Reality

ORCESTRA:基于视觉语言模型的混合现实视觉机器人编程系统

Ivan Snegirev, Elizaveta Semenyakina, Mikhail Konenkov, Artem Lykov, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科技学院) R&D Center, MWS(MWS研发中心)

专题命中 其他安全 :safety(abstract)

AI总结 ORCESTRA是一款混合现实系统,通过无代码路径点示教和语言引导控制实现机器人数字孪生编程,支持多种异构机器人,其混合现实验证可作为语言引导机器人物理部署前的安全层。

Comments 4 page, 3 figures, 1 table, ISMAR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00690 2026-08-04 cs.NI 新提交 50%

LLM-Assisted Coalition Formation for Cooperative Perception in Autonomous Driving

大语言模型辅助的自动驾驶协同感知联盟形成

Ahmad Sarlak, Hao Wang, Rahul Amin, Abolfazl Razi

专题命中 其他安全 :safety(abstract)

AI总结 该研究针对现有协同感知方法未优化车辆选择的问题,提出LLM辅助的联盟形成框架,结合DPP与ADMM优化,在OPV2V等数据集上实现更优性能与网络效率。

Comments Accepted for presentation at IEEE Global Communications Conference (GLOBECOM 2026), Cognitive Radio and AI-Enabled Networks Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00661 2026-08-04 cs.SE 新提交 50%

Unreliable in Practice? A Comprehensive Study of Errors in LLM-Generated Code

实践中不可靠?对大语言模型生成代码中的错误的综合研究

Rodrigo Pato Nogueira, Marco Vieira, João R. Campos

专题命中 其他安全 :safety(abstract)

AI总结 本研究分析7款LLMs生成的86726个含错代码样本,对比不同模型、语言的错误模式,发现大型模型也常犯简单错误,代码常省略关键安全检查,为提升LLM生成代码可靠性提供依据。

Comments Accepted for publication in the 37th IEEE International Symposium on Software Reliability Engineering (ISSRE) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29367 2026-08-03 cs.CV 新提交 50%

SatEdit: Mask-Conditioned Image Editing via VLM-Guided Segment Annotation

SatEdit:基于VLM引导的区域标注的掩码条件卫星图像编辑

Muhammad Talha, Muhammad Ahmed Amer

专题命中 其他安全 :alignment(abstract)

AI总结 SatEdit是基于VLM引导区域标注的卫星图像编辑框架,通过未标注图像构建监督信号,经LoRA微调后在对比中实现最高掩码区域语义对齐,为卫星图像编辑提供了数据高效的可行方案。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29338 2026-08-03 cs.SE 新提交 50%

BRHC: Backend-driven Reactive Hypermedia Controls with a Statically Typed Kotlin DSL

BRHC:基于后端驱动的反应式超媒体控件与静态类型Kotlin DSL

Fernando Miguel Carvalho, Paulo Carvalho, Leonel Correia, Ricardo Gomes, Juho Vepsäläinen

专题命中 其他安全 :safety(abstract)

AI总结 本研究针对AI辅助编码生成Web应用的复杂性问题,提出基于Kotlin静态类型HTML DSL的后端驱动反应式Web应用方法,可减少JS需求并提升类型安全性。

Comments Submitted to Software: Practice and Experience (Wiley)

详情

展开后加载摘要…

URL PDF HTML 收藏