arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 9434 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 9434 篇

2603.25092 2026-03-27 cs.IR 50%

AuthorityBench: Benchmarking LLM Authority Perception for Reliable Retrieval-Augmented Generation

AuthorityBench: 评估LLM权威感知以实现可靠的检索增强生成

Zhihui Yao, Hengran Zhang, Keping Bi

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出AuthorityBench基准,通过三个数据集评估LLM权威感知能力,发现ListJudge和PairJudge方法与真实权威最相关,且权威感知对检索增强生成的准确性有显著提升。

Comments 11 pages, 4 figures. Submitted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24837 2026-03-27 cs.CR 50%

Bridging Code Property Graphs and Language Models for Program Analysis

连接代码属性图与语言模型用于程序分析

Ahmed Lekssays

专题命中 安全评测 :safety(abstract)

AI总结 本文提出codebadger,结合Joern的代码属性图引擎与LLM,解决代码分析中的挑战,通过高级工具实现程序切片、污点追踪等,提升大规模代码库的分析能力。

Comments Accepted at Software Vulnerability Management Workshop @ ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24703 2026-03-27 cs.SE cs.RO cs.SY eess.SY 50%

IndustriConnect: MCP Adapters and Mock-First Evaluation for AI-Assisted Industrial Operations

IndustriConnect:MCP适配器与先假测试用于AI辅助工业操作

Melwin Xavier, Melveena Jolly, Vaisakh M A, Midhun Xavier

机构 * Independent Researcher(独立研究者)

专题命中 安全评测 :safety(abstract)

AI总结 本文提出IndustriConnect,通过MCP适配器将工业操作暴露为可发现的AI工具,支持协议特定连接和安全控制,并通过先假测试和确定性基准验证适配器的正确性、并发行为和结构化错误处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24696 2026-03-27 cs.CV 50%

LLaVA-LE: Large Language-and-Vision Assistant for Lunar Exploration

LLaVA-LE:用于月球探索的大型语言和视觉助手

Gokce Inal, Pouyan Navard, Alper Yilmaz

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出LLaVA-LE,一个专为月球表面和地下特征分析设计的多模态模型,通过构建大规模月球数据集LLUCID和两阶段训练方法,提升了行星科学领域的视觉语言模型性能。

Comments Accepted in AI4Space Workshop CVPR2026. Website: https://osupcvlab.github.io/LLaVA-LE/, Dataset: https://huggingface.co/datasets/pcvlab/lucid

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24684 2026-03-27 cs.CV 50%

KitchenTwin: Semantically and Geometrically Grounded 3D Kitchen Digital Twins

KitchenTwin: 基于语义和几何的3D厨房数字孪生

Quanyun Wu, Kyle Gao, Daniel Long, David A. Clausi, Jonathan Li, Yuhao Chen

机构 * University of Waterloo(滑铁卢大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出一种基于语义和几何的3D厨房数字孪生框架,通过融合视觉引导的对象网格与Transformer预测的全局点云,实现几何一致的数字孪生构建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24484 2026-03-26 cs.CV 50%

Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models

视频-only ToM:增强多模态大语言模型的理论思维

Siqi Liu, Xinyang Li, Bochao Zou, Junbao Zhuo, Huimin Ma, Jiansheng Chen

机构 * University of Science and Technology Beijing(北京科技大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出VisionToM框架,通过视觉干预增强多模态大语言模型的理论思维能力,改进模型在多模态任务中的推理和问答性能。

Comments 20 pages, 7 figures, accepted at CVPR 2026, project page: see https://founce.github.io/VisionToM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24204 2026-03-26 cs.IR 50%

SumRank: Aligning Summarization Models for Long-Document Listwise Reranking

SumRank:对长文档列表级重排序进行总结化对齐

Jincheng Feng, Wenhan Liu, Zhicheng Dou

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出SumRank模型,通过压缩长文档为简洁的排序对齐摘要,提升列表级重排序的效率与效果,实验显示其在多个基准数据集上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05629 2026-03-26 cs.SE cs.CV 50%

ROMAN: Reward-Orchestrated Multi-Head Attention Network for Autonomous Driving System Testing

ROMAN:基于奖励协调的多头注意力网络用于自动驾驶系统测试

Jianlei Chi, Yuzhen Wu, Jiaxuan Hou, Xiaodong Zhang, Ming Fan, Suhui Sun, Weijun Dai, Bo Li, Jianguo Sun, Jun Sun

机构 * IEEE Publication Technology Group(IEEE出版技术组) Hangzhou Institute of Technology, Xidian University(杭州科技学院,西安电子科技大学) Qingdao Port International Co., Ltd.(青岛港口国际有限公司) Shandong Port Qingdao Port Group Co., Ltd.(山东港口青岛港集团有限公司) University of Science and Technology of China(中国科学技术大学) Xi’an Jiaotong University(西安交通大学) Singapore Management University(新加坡管理大学)

专题命中 安全评测 :safety(abstract)

AI总结 ROMAN通过结合多头注意力网络与交通法规加权机制,生成高风险违规场景,提升自动驾驶系统测试的全面性与针对性。

Comments The manuscript includes 13 pages, 8 tables, and 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23925 2026-03-26 cs.CV 50%

DP^2-VL: Private Photo Dataset Protection by Data Poisoning for Vision-Language Models

DP^2-VL: 通过数据污染保护隐私照片的视觉语言模型隐私威胁模型

Hongyi Miao, Jun Jia, Xincheng Wang, Qianli Ma, Wei Sun, Wangqiu Zhou, Dandan Zhu, Yewen Cao, Zhi Liu, Guangtao Zhai

机构 * Shandong University(山东大学) Shanghai Jiao Tong University(上海交通大学) Donghua University(东华大学) Shanghai Normal University(上海师范大学) East China Normal University(华东师范大学) Hefei University of Technology(合肥工业大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出DP2-VL框架,通过数据污染保护隐私照片,分析视觉语言模型在身份关联泄露中的脆弱性,并展示其在不同保护比例下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23801 2026-03-26 cs.CR 50%

AgentRFC: Security Design Principles and Conformance Testing for Agent Protocols

AgentRFC:关于智能体协议的安全设计原则与合规性测试

Shenghan Zheng, Qifan Zhang

专题命中 安全评测 :safety(abstract)

AI总结 本文提出AgentProtocolStack、Agent-AgnosticSecurityModel和AgentConform,旨在为智能体协议提供系统性的安全框架,解决协议合规性测试问题,并揭示协议组合时的安全隐患。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19775 2026-03-26 cs.CV 50%

Evaluating Image Editing with LLMs: A Comprehensive Benchmark and Intermediate-Layer Probing Approach

基于大语言模型的图像编辑评估:一个全面的基准和中间层探针方法

Shiqi Gao, Zitong Xu, Kang Fu, Huiyu Duan, Xiongkuo Min, Jia wang

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(图像通信与网络工程研究所,上海交通大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出TIEdit基准和EditProbe方法,通过5120张编辑图像和专家评分,评估文本引导图像编辑方法的感知质量、对齐性和内容保真度,同时利用大语言模型中间层探针提升评估准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19507 2026-03-26 physics.acc-ph 50%

AI-Ready Control System for the Fermilab Accelerator Complex

面向 Fermilab 加速器复杂系统的 AI 准备控制系统

Tia Miceli, Erik Gottschalk, Donovan Tooke, Evan Milton, Robert Santucci, Hayden Hoschouer, Michael Balcewicz, Jennifer Case, Abhishek Deshpande, Kit Fieldhouse, Sudeshna Ganguly, Beau Harrison, Aisha Ibrahim, Thomas Kobilarcik, Michael Olander, Abhishek Pathak, Jason St. John, Aaron Sauers

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出面向 Fermilab 加速器复杂系统的 AI 准备控制系统,涵盖 MLOps 框架、数据质量框架及大语言模型整合,以支持高强度可靠运行。

Comments 43 pages, 31 tables, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23132 2026-03-25 cs.CV 50%

InterDyad: Interactive Dyadic Speech-to-Video Generation by Querying Intermediate Visual Guidance

InterDyad:通过查询中间视觉指导实现交互式双人语音到视频生成

Dongwei Pan, Longwei Guo, Jiazhi Guan, Luying Huang, Yiding Li, Haojie Liu, Haocheng Feng, Wei He, Kaisiyuan Wang, Hang Zhou

机构 * Baidu Inc.(百度公司)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出InterDyad框架,通过查询结构运动指导实现自然交互动态合成,解决双人场景中跨个体依赖和精细行为控制问题,提出交互性注入器、元查询模态对齐机制和角色感知双人高斯指导等方法,提升唇形同步和空间一致性。

Comments Project Page: https://interdyad.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22860 2026-03-25 cs.SI 50%

Who Sits Where? Automated Detection of Director Interlocks in Indian Companies

谁坐在哪里?印度公司的董事交叉任职自动检测

Prateek Sancheti, Kamalakar Karlapalem, Kavita Vemuri

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出一种可扩展的图论框架,用于系统识别和分析董事交叉任职,利用BFS和LLM检测董事-公司集群,揭示潜在的网络驱动因素,提升自动检测复杂企业关系的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22574 2026-03-25 cs.RO 50%

GIFT: Generalizing Intent for Flexible Test-Time Rewards

GIFT:基于意图的灵活测试时间奖励

Fin Amin, Nathaniel Dennler, Andreea Bobu

机构 * NC State(北卡罗来纳州立大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 安全评测 :alignment(abstract)

AI总结 GIFT通过语言模型推断用户演示中的高层意图,以提升奖励在新环境下的泛化能力,优于基于视觉和语义相似性的基线方法。

Comments To appear at IEEE ICRA '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18835 2026-03-25 cs.DB 50%

Tursio Database Search: How far are we from ChatGPT?

Tursio数据库搜索:我们距离ChatGPT还有多远?

Sulbha Jain, Shivani Tripathi, Shi Qiao, Alekh Jindal

专题命中 安全评测 :safety(abstract)

AI总结 本文提出评估框架,评估企业数据库自然语言搜索质量,对比Tursio与ChatGPT在银行数据库上的表现,发现Tursio在相关性上表现接近基准,但存在数据库完整性瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17108 2026-03-25 cs.CV 50%

LLM-Powered Flood Depth Estimation from Social Media Imagery: A Vision-Language Model Framework with Mechanistic Interpretability for Transportation Resilience

基于大语言模型的社交媒体影像洪水深度估计:一种具有机制可解释性的视觉-语言模型框架用于交通韧性

Nafis Fuad, Xiaodong Qian

专题命中 安全评测 :safety(abstract)

AI总结 本文提出FloodLlama,一种基于视觉-语言模型的洪水深度估计框架,通过合成数据集和多模态传感管道实现厘米级实时洪水深度估计,提升交通网络韧性。

Comments There is a update in result, which is needed to be addressed

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22212 2026-03-24 cs.CV 50%

Omni-WorldBench: Towards a Comprehensive Interaction-Centric Evaluation for World Models

Omni-WorldBench:迈向全面的交互导向的世界模型评估

Meiqi Wu, Zhixin Cai, Fufangchen Zhao, Xiaokun Feng, Rujing Dang, Bingze Song, Ruitian Tian, Jiashu Zhu, Jiachen Lei, Hao Dou, Jing Tang, Lei Sun, Jiahong Wu, Xiangxiang Chu, Zeming Liu, Kaiqi Huang

机构 * School of Computer Science and Technology, UCAS(UCAS计算机科学与技术学院) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, CASIA(复杂系统认知与决策智能重点实验室) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) State Key Laboratory of Networking and Switching Technology, BUPT(网络与交换技术国家重点实验室) AMAP, Alibaba Group(阿里妈妈实验室,阿里巴巴集团)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出Omni-WorldBench,一个针对4D世界模型交互响应能力的综合评估基准,通过Omni-WorldSuite和Omni-Metrics评估交互动作对状态转移的影响,分析现有模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21986 2026-03-24 cs.CV 50%

Speed by Simplicity: A Single-Stream Architecture for Fast Audio-Video Generative Foundation Model

速度与简洁:一种单流架构用于快速音频视频生成基础模型

SII-GAIR, Sand. ai, :, Ethan Chern, Hansi Teng, Hanwen Sun, Hao Wang, Hong Pan, Hongyu Jia, Jiadi Su, Jin Li, Junjie Yu, Lijie Liu, Lingzhi Li, Lyumanshan Ye, Min Hu, Qiangang Wang, Quanwei Qi, Steffi Chern, Tao Bu, Taoran Wang, Teren Xu, Tianning Zhang, Tiantian Mi, Weixian Xu, Wenqiang Zhang, Wentai Zhang, Xianping Yi, Xiaojie Cai, Xiaoyang Kang, Yan Ma, Yixiu Liu, Yunbo Zhang, Yunpeng Huang, Yutong Lin, Zewei Tao, Zhaoliang Liu, Zheng Zhang, Zhiyao Cen, Zhixuan Yu, Zhongshu Wang, Zhulin Hu, Zijin Zhou, Zinan Guo, Yue Cao, Pengfei Liu

机构 * SII-GAIR

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出daVinci-MagiHuman模型,通过单流Transformer实现同步视频音频生成,支持多语言语音生成,生成256p视频仅需2秒,自动评估中视觉质量和文本对齐最佳,语音识别错误率最低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21939 2026-03-24 cs.CV cs.MM 50%

FeatDistill: A Feature Distillation Enhanced Multi-Expert Ensemble Framework for Robust AI-generated Image Detection

FeatDistill: 一种结合特征蒸馏的多专家集成框架,用于鲁棒的AI生成图像检测

Zhilin Tu, Kemou Li, Fengpeng Li, Jianwei Fei, Jiamin Zhang, Haiwei Wu

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) State Key Laboratory of Internet of Things for Smart City, University of Macau(澳门大学物联网智能城市国家重点实验室) PRADA Lab, King Abdullah University of Science and Technology(科学与技术王国大学PRADA实验室) Department of Information Engineering, University of Florence(佛罗伦萨大学信息工程系)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出FeatDistill框架,结合特征蒸馏与多专家集成,解决深度伪造图像检测中的退化干扰、特征表示不足和泛化能力有限问题,通过四主干Vision Transformer集成和两阶段训练提升检测鲁棒性和泛化能力。

Comments 6th place (6/507) technical report at the NTIRE 2026: Robust AI-Generated Image Detection in the Wild Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09161 2026-03-24 eess.IV cs.CV 50%

From Explanations to Architecture: Explainability-Driven CNN Refinement for Brain Tumor Classification in MRI

从解释到架构:基于可解释性的CNN细化用于MRI中脑肿瘤分类

Rajan Das Gupta, Md Imrul Hasan Showmick, Lei Wei, Mushfiqur Rahman Abir, Shanjida Akter, Md. Yeasin Rahat, Md. Jakir Hossen

机构 * American International Brac University Faculty of Psychology University-Bangladesh(美国国际布拉大学心理学学院(孟加拉国)) Shinawatra University Department of Computer Science(辛纳瓦特大学计算机科学系) American International North South University(美国国际北南大学) American International University–Bangladesh Department of Computer Science(美国国际大学–孟加拉国计算机科学系) Multimedia University Department of Computer Science(多媒体大学计算机科学系)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出一种可解释性驱动的CNN框架,通过Grad-CAM量化层间相关性以去除低贡献层,提升模型透明度并保持分类精度,实验证明在多类脑MRI数据集上达到高准确率,支持更可信的脑肿瘤分类。

Comments This is the preprint version of the manuscript. It is currently being prepared for submission to an academic conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20348 2026-03-24 cs.CV 50%

Toward a Multi-View Brain Network Foundation Model: Cross-View Consistency Learning Across Arbitrary Atlases

迈向多视角脑网络基础模型:跨视角一致性学习在任意脑图谱上的应用

Jiaxing Xu, Jingying Ma, Xin Lin, Yuxiao Liu, Kai He, Qika Lin, Yiping Ke, Yang Li, Dinggang Shen, Mengling Feng

机构 * Saw Swee Hock School of Public Health at National University of Singapore(国立新加坡大学 Saw Swee Hock 公共卫生学院) School of Biomedical Engineering & State Key Laboratory of Advanced Medical Materials and Devices, ShanghaiTech University(上海科技大学 生物医学工程学院及先进医学材料与设备国家重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学 计算与数据科学学院) School of Automation Science and Electrical Engineering, Beihang University(北航自动化科学与电气工程学院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北航虚拟现实技术与系统国家重点实验室) Shanghai United Imaging Intelligence(上海联合影像智能有限公司) Shanghai Clinical Research and Trial Center(上海临床研究与试验中心)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出MV-BrainFM多视角脑网络基础模型,通过跨视角一致性学习在任意脑图谱上学习通用且可扩展的表示,提升跨图谱的鲁棒性和一致性,实验表明其在20000+受试者数据集上优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14052 2026-03-23 cs.CV cs.MA 50%

A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning

一种多智能体感知-行动联盟用于高效长视频推理

Yichang Xu, Gaowen Liu, Ramana Rao Kompella, Tiansheng Huang, Sihao Hu, Fatih Ilhan, Selim Furkan Tekin, Zachary Yahn, Ling Liu

机构 * Georgia Institute of Technology(佐治亚理工学院) Cisco Systems(思科系统)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出A4VL多智能体感知-行动探索联盟,通过多轮感知-行动探索循环提升长视频推理效率,采用事件驱动划分和线索引导块对齐技术,实现高质量推理并降低推理延迟。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13219 2026-03-23 cs.CV 50%

Prompt-based Adaptation in Large-scale Vision Models: A Survey

基于提示的大规模视觉模型适应:综述

Xi Xiao, Yunbei Zhang, Lin Zhao, Yiyang Liu, Xiaoying Liao, Zheda Mai, Xingjian Li, Xiao Wang, Hao Xu, Jihun Hamm, Xue Lin, Min Xu, Qifan Wang, Tianyang Wang, Cheng Han

机构 * University of Alabama at Birmingham, USA(美国阿拉巴马大学伯明翰分校) Tulane University, USA(美国路易斯安那大学) Northeastern University, USA(美国东北大学) University of Missouri-Kansas City, USA(美国密苏里大学堪萨斯城分校) Johns Hopkins University, USA(约翰霍普金斯大学) Ohio State University, USA(俄亥俄州立大学) Carnegie Mellon University, USA(卡内基梅隆大学) Oak Ridge National Laboratory, USA(橡树岭国家实验室) Harvard University, USA(哈佛大学) Mohamed bin Zayed University of Artificial Intelligence, UAE(阿联酋Mohamed bin Zayed人工智能大学) Meta AI, USA(Meta AI)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文综述了基于提示的视觉模型适应方法,探讨了VP和VPT的核心机制及在不同领域的应用,揭示了其在测试时适应和可信AI中的作用,并总结了当前基准和未来研究方向。

Comments Accepted by TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19884 2026-03-23 cs.CV 50%

A Survey of AI-Generated Video Evaluation

人工智能生成视频评估综述

Xiao Liu, Xinhao Xiang, Zizhong Li, Yongheng Wang, Zhuoheng Li, Zhuosheng Liu, Weidi Zhang, Weiqi Ye, Jiawei Zhang

机构 * IFM Lab, University of California, Davis(加州大学戴维斯分校IFM实验室) University of California, Davis(加州大学戴维斯分校)

专题命中 安全评测 :alignment(abstract)

AI总结 本文综述了人工智能生成视频评估领域,探讨了视频内容复杂性和评估方法的系统性分析,强调了建立更稳健的评估框架的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19098 2026-03-20 cs.CV 50%

TAU-R1: Visual Language Model for Traffic Anomaly Understanding

TAU-R1:用于交通异常理解的视觉语言模型

Yuqiang Lin, Kehua Chen, Sam Lockyer, Arjun Yadav, Mingxuan Sui, Shucheng Zhang, Yan Shi, Bingzhang Wang, Yuang Zhang, Markus Zarbock, Florain Stanek, Adrian Evans, Wenbin Li, Yinhai Wang, Nic Zhang

机构 * University of Bath(巴斯大学) University of Washington(华盛顿大学) City of Carmel, Indiana(印第安纳州卡迈尔市) Starwit GmbH

专题命中 安全评测 :safety(abstract)

AI总结 本文提出TAU-R1模型,通过两层框架提升交通异常识别与推理能力,结合定制化训练策略与数据集,实现高效部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19132 2026-03-19 cs.SE 50%

LLMs-Powered Real-Time Fault Injection: An Approach Toward Intelligent Fault Test Cases Generation

基于大语言模型的实时故障注入:一种智能故障测试用例生成方法

Mohammad Abboush, Ahmad Hatahet, Andreas Rausch

专题命中 安全评测 :safety(abstract)

AI总结 本文提出一种利用大语言模型生成实时故障测试用例的方法,通过分析功能安全需求提高测试效率和安全性。

Journal ref 2025 IEEE 28th International Conference on Intelligent Transportation Systems (ITSC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02341 2026-03-19 cs.CV 50%

TALO: Pushing 3D Vision Foundation Models Towards Globally Consistent Online Reconstruction

TALO:推动3D视觉基础模型向全球一致的在线重建迈进

Fengyi Zhang, Tianjun Zhang, Kasra Khosoussi, Zheng Zhang, Zi Huang, Yadan Luo

机构 * UQMM Lab, The University of Queensland(昆士兰大学UQMM实验室) Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出基于薄板样条的高自由度长期对齐框架,通过全局传播控制点纠正空间变化不一致,并采用点无关子图注册设计提升鲁棒性,实验表明其在多数据集和相机配置下均能获得更一致的几何和更低的轨迹误差。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16382 2026-03-18 cs.CR 50%

Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models

旋转鲁棒性:一种对抗大语言模型位翻转攻击的无训练防御方法

Deng Liu, Song Chen

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出旋转鲁棒性(RoR),通过正交Householder变换对激活空间进行旋转,有效消除激活异常值与敏感权重之间的对齐,提升大语言模型的可靠性。

Comments 13 pages, 8 figures. Preprint. Under review at IEEE Transactions on Information Forensics and Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16372 2026-03-18 cs.CV 50%

InViC: Intent-aware Visual Cues for Medical Visual Question Answering

InViC:面向医疗视觉问答的意图感知视觉线索

Zhisong Wang, Ziyang Chen, Zanting Ye, Hongze Zhu, Yefeng Zheng, Yong Xia

机构 * National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology, School of Computer Science and Engineering, Northwestern Polytechnical University, Xi’an 710072, China(集成空天地海大数据应用技术国家工程实验室,计算机科学与工程学院,西北工业大学,西安710072,中国) Westlake University(西湖大学) Southern Medical University(南方医科大学)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出InViC框架,通过引入Cue Tokens Extraction模块和两阶段微调策略,提升医疗视觉问答中意图对齐的视觉证据利用,验证了瓶颈化训练在提高可信度上的有效性。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏