arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-11 至 2026-08-11 共收录 188 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 39 篇

2608.08663 2026-08-11 cs.HC cs.CV 新提交 50%

A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data

用于在视觉感知数据中建立人类指代表达式基础的动态语义框架

Joseph Bingham

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出动态语义框架,通过显式约定状态绑定集合与感知对齐流程,解决视觉-语言模型在词汇同步任务中的不足,在斯坦福重复参考游戏语料库上达到83.56%的top-5准确率,核心是透明符号层与可检查感知通道的结合。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08462 2026-08-11 cs.AR 新提交 50%

ARMOR: Accelerating RTL Simulation by Mitigating the Front-End Bottleneck Using Node Compression

ARMOR:通过节点压缩缓解前端瓶颈以加速RTL仿真

Jiaping Tang, Jianan Mu, Zhiteng Chao, Jingzhong Wen, Jing Ye, Huawei Li

专题命中 其他安全 :alignment(abstract)

AI总结 ARMOR是一款通过节点压缩缓解前端瓶颈的高效RTL仿真器,利用比特级数据并行性压缩节点,在CPU和AI加速器设计上分别实现1.6倍和2.7倍加速。

Comments Accepted by 2026 59th IEEE/ACM International Symposium on Microarchitecture (MICRO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 50%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他安全 :alignment(abstract)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07554 2026-08-11 cs.CV cs.RO 新提交 50%

Impact of Dataset Composition on Embedded Real-Time UAV Wildfire Detection Using Compact YOLO Models

数据集组成对采用轻量YOLO模型的嵌入式实时无人机野火检测的影响

Eduardo de los Santos, Andre S. Kelbouscas, Ricardo B. Grando, Bruna V. Guterres

机构 * Technological University of Uruguay(乌拉圭技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究以轻量YOLO模型为对象,探究数据集组成对嵌入式实时无人机野火检测的影响,发现真实未增强数据集的检测性能最优,合成数据混合与图像增强均未提升部署效果,数据集真实性和领域对齐更具价值。

Comments Paper accepted at the ICCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06939 2026-08-11 cs.CV 版本更新 50%

Degradation-Aware Prompt Learning with Cross-Modal Compensation for Adverse Weather Removal

面向恶劣天气去除的退化感知跨模态补偿提示学习

Wanshu Fan, Yunzhe Zhang, Yue Shen, Liyan Wang, Jing Qin, Kin-Man Lam, Cong Wang, Jinshan Pan

机构 * School of Software Engineering, Dalian University(大连大学软件工程学院) School of Mathematical Sciences, Dalian University of Technology(大连理工大学数学科学学院) The Hong Kong Polytechnic University(香港理工大学) University of California, San Francisco(加利福尼亚大学旧金山分校) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对恶劣天气导致图像退化影响视觉系统可靠性的问题,提出 DCMPC-Net 模型,通过跨模态提示补偿实现鲁棒的恶劣天气图像修复,性能优于现有最先进方法。

Comments Accepted for publication in IEEE Transactions on Image Processing. The code is available at: https://github.com/fanamber831/DCMPC-Net

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18566 2026-08-11 eess.SY cs.SY 版本更新 50%

HJ-Gauss: A Monte-Carlo HJ Reachability Scheme

HJ-Gauss: 一种蒙特卡洛HJ可达性方案

Lekan Molu, Venkatraman Renganathan, Namhoon Cho

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种基于局部PDE线性化的方法,通过冻结系数采样方案解决高维系统中经典网格基HJ求解器内存消耗大的问题,实现了存储和网格无关的算法,适用于高维可达性分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22632 2026-08-11 cs.IR 版本更新 50%

Fine-grained Semantics Integration for Large Language Model-based Recommendation

细粒度语义集成用于基于大语言模型的推荐

Jiawei Feng, Xiaoyu Kong, Leheng Sheng, Bin Wu, Chao Yi, Feifang Yang, Xiang-Rong Sheng, Han Zhu, Xiang Wang, Jiancan Wu, Xiangnan He

专题命中 其他安全 :alignment(abstract)

AI总结 TS-Rec通过细粒度语义集成提升基于LLM的推荐系统性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03847 2026-08-11 cs.SI 50%

Event-aware analysis of cross-city visitor flows using large language models and social media data

Xiaohan Wang, Zhan Zhao, Ruiyu Wang, Yang Xu

专题命中 其他安全 :safety(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏