arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-01-13 至 2026-01-13 共收录 98 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 20 篇

2510.03544 2026-01-13 math.OC cs.AI cs.RO 57%

Agile Tradespace Exploration for Space Rendezvous Mission Design via Transformers

通过变换器实现空间交汇任务设计的敏捷贸易空间探索

Yuji Takubo, Daniele Gammelli, Marco Pavone, Simone D'Amico

机构 * Dept. of Aeronautics & Astronautics Stanford University(航空与航天系 斯坦福大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出基于变换器的框架,实现快速生成多目标交汇任务的帕累托最优轨迹,提升任务设计效率与灵活性。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00828 2026-01-13 cs.CR cs.AI 57%

Towards Ultra-Low Latency: Binarized Neural Network Architectures for In-Vehicle Network Intrusion Detection

迈向超低延迟:用于车载网络入侵检测的二值化神经网络架构

Huiyao Dong, Igor Kotenko

机构 * Faculty of Information Technology and Security(信息科技与安全学院) ITMO University(ITMO大学) Laboratory of Computer Security Problems(计算机安全问题实验室) St. Petersburg Federal Research Center of the Russian Academy of Sciences (SPC RAS)(俄罗斯科学院圣彼得堡联邦科研中心(SPC RAS))

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出基于二值化神经网络的轻量级入侵检测方法,通过混合二进制编码技术提升车载网络安全性,适用于实时通信场景。

Comments 6 pages, accepted and presented at INISTA 2025 (https://conferences.sigappfr.org/inista2025/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04791 2026-01-13 cs.AI 57%

What-If Analysis of Large Language Models: Explore the Game World Using Proactive Thinking

大型语言模型的What-If分析:通过前瞻性思维探索游戏世界

Yuan Sui, Yanming Zhang, Yi Liao, Yu Gu, Guohua Tang, Zhongqian Sun, Wei Yang, Bryan Hooi

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 WiA-LLM通过前瞻性思维提升大型语言模型在复杂游戏环境中的决策能力,实现74.2%的预测准确率和更接近专家玩家的策略行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00140 2026-01-13 cs.SE cs.AI 57%

LLM-based Zero-shot Triple Extraction for Automated Ontology Generation from Software Engineering Standards

基于大型语言模型的零样本三元组提取用于从软件工程标准自动生成本体

Songhui Yue

机构 * Computer Science Department(计算机科学系) Charleston Southern University(查尔斯顿南方大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出基于LLM的零样本三元组提取方法,用于从软件工程标准中自动生成本体,通过改进的工作流程和专家标注集验证了其有效性。

Comments Semantic Data Integration Workshop, held in conjunction with IEEE International Conference on Semantic Computing (IEEE ICSC 2026), accepted, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07219 2026-01-13 cs.CV 50%

VENUS: Visual Editing with Noise Inversion Using Scene Graphs

VENUS: 使用场景图进行视觉编辑的噪声反演

Thanh-Nhan Vo, Trong-Thuan Nguyen, Tam V. Nguyen, Minh-Triet Tran

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) Vietnam National University(越南国家大学) University of Dayton(戴维森大学)

专题命中 其他安全 :alignment(abstract)

AI总结 VENUS是一种无需训练的场景图引导图像编辑框架,通过噪声反演和拆分提示策略提升图像编辑的保真度和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07181 2026-01-13 cs.CV 50%

ShowUI-Aloha: Human-Taught GUI Agent

ShowUI-Aloha: 由人类指导的GUI代理

Yichun Zhang, Xiangwu Guo, Yauhong Goh, Jessica Hu, Zhiheng Chen, Xin Wang, Difei Gao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 其他安全 :safety(abstract)

AI总结 ShowUI-Aloha通过将无结构的人类屏幕记录转化为结构化任务,提供了一种可扩展的解决方案,用于构建能够从观察人类中有效学习的通用GUI代理。

Comments 13 Pages, 16 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07092 2026-01-13 cs.CV 50%

Efficient Visual Question Answering Pipeline for Autonomous Driving via Scene Region Compression

面向自动驾驶的高效视觉问答流水线:场景区域压缩

Yuliang Cai, Dongqiangzi Ye, Zitian Chen, Chongruo Wu

机构 * University of Southern California(南加州大学) XPeng(小鹏)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出SRC-Pipeline框架,通过场景区域压缩技术,在保持性能的同时显著降低计算成本,提升自动驾驶中的实时视觉问答效率。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06490 2026-01-13 cs.MA 50%

Bi-Mem: Bidirectional Construction of Hierarchical Memory for Personalized LLMs via Inductive-Reflective Agents

Bi-Mem: 通过归纳-反思代理双向构建层次化记忆以实现个性化大语言模型

Wenyu Mao, Haosong Tan, Shuchang Liu, Haoyang Liu, Yifan Xu, Huaxiang Ji, Xiang Wang

专题命中 其他安全 :alignment(abstract)

AI总结 Bi-Mem通过归纳-反思代理双向构建层次化记忆,解决对话噪声和记忆幻觉问题,提升个性化大语言模型的问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏