arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-01-19 至 2026-01-19 共收录 35 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7 篇

2601.11124 2026-01-19 cs.IR cs.AI 57%

Learn Before Represent: Bridging Generative and Contrastive Learning for Domain-Specific LLM Embeddings

在表示之前学习:连接生成学习与对比学习以构建领域特定的LLM嵌入

Xiaoyu Liang, Yuchen Peng, Jiale Luo, Wenhao Wang, Haoji Hu, Xincheng Zhou

机构 * Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出LBR框架,通过生成学习和对比学习结合,在垂直领域中提升LLM嵌入的准确性和鲁棒性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05487 2026-01-19 cs.MA cs.AI 57%

EvidFuse: Writing-Time Evidence Learning for Consistent Text-Chart Data Reporting

EvidFuse: 为一致的文本-图表数据报告进行写作时的证据学习

Huanxiang Lin, Qianyue Wang, Jinwu Hu, Bailin Chen, Qing Du, Mingkui Tan

机构 * South China University of Technology(华南理工大学) Pazhou Laboratory(琶洲实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 EvidFuse通过多智能体框架实现写作时文本-图表交织生成,解决数据驱动报告中图表与文本不一致的问题,提升分析深度和证据空间扩展能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07128 2026-01-19 cs.CL 57%

DeepSeek-R1 Thoughtology: Let's think about LLM Reasoning

DeepSeek-R1 思维学:让我们思考LLM推理

Sara Vera Marjanović, Arkil Patel, Vaibhav Adlakha, Milad Aghajohari, Parishad BehnamGhader, Mehar Bhatia, Aditi Khandelwal, Austin Kraft, Benno Krojer, Xing Han Lù, Nicholas Meade, Dongchan Shin, Amirhossein Kazemnejad, Gaurav Kamath, Marius Mosbach, Karolina Stańczak, Siva Reddy

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 DeepSeek-R1通过多步骤推理链实现复杂问题解决,研究揭示其推理性能的'甜点'及潜在安全漏洞。

Comments 135 pages, Published to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19859 2026-01-19 eess.SY cs.FL cs.SC cs.SY 50%

Scalable and Approximation-free Symbolic Control for Unknown Euler-Lagrange Systems

可扩展且无近似符号控制用于未知欧拉-拉格朗日系统

Ratnangshu Das, Shubham Sawarkar, Pushpak Jagtap

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种可扩展且无近似符号控制方法,用于确保未知欧拉-拉格朗日系统满足时序逻辑规范,同时减少计算和内存需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11248 2026-01-19 cs.CV 50%

Language-Agnostic Visual Embeddings for Cross-Script Handwriting Retrieval

跨脚本手写检索的语言无关视觉嵌入

Fangke Chen, Tianhao Dong, Sirry Chen, Guobin Zhang, Yishu Zhang, Yining Chen

机构 * School of Integrated Circuits, Zhejiang University(浙江大学集成电路学院) Shanghai Innovation Institute(上海创新研究院) School of Electrical and Electronic Engineering (EEE), Nanyang Technological University(南洋理工大学电子与电气工程学院) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出了一种轻量级双编码框架,通过学习语言无关的视觉嵌入,实现跨脚本手写检索的高精度与低资源消耗。

Comments 9 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏