arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-11-18 至 2025-11-18 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 4 篇

2506.05925 2025-11-18 cs.CY cs.AI 73%

Small Models, Big Support: A Local LLM Framework for Educator-Centric Content Creation and Assessment with RAG and CAG

Zarreen Reza, Alexander Mazur, Michael T. Dugdale, Robin Ray-Chaudhuri

专题命中 隐私与版权 :alignment(abstract);safety(abstract);分类 cs.AI、cs.CY

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13373 2025-11-18 cs.LG cs.AI 62%

A Novel Hierarchical Integration Method for Efficient Model Merging in Medical LLMs

Prakrit Timilsina, Anuj Nepal, Rajan Kadel, Robin Doss

机构 * Deakin Cyber Research(德肯网络研究) Innovation Centre Deakin University / Universal Higher Education Melbourne, Australia(德肯大学创新中心/通用高等教育墨尔本,澳大利亚) School of IT(信息科技学院) Engineering Melbourne Institute of Technology Melbourne, Australia(工程墨尔本技术学院墨尔本,澳大利亚) Innovation Centre Deakin University Geelong, Australia(德肯大学创新中心吉朗,澳大利亚)

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11591 2025-11-18 cs.AI cs.CL 62%

LLM-Generated Negative News Headlines Dataset: Creation and Benchmarking Against Real Journalism

Olusola Babalola, Bolanle Ojokoh, Olutayo Boyinbode

专题命中 隐私与版权 :alignment(abstract);分类 cs.CL、cs.AI

Comments 50 pages, 19 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09862 2025-11-18 cs.LG 57%

RadarLLM: Empowering Large Language Models to Understand Human Motion from Millimeter-Wave Point Cloud Sequence

Zengyuan Lai, Jiarui Yang, Songpengcheng Xia, Lizhou Lin, Lan Sun, Renwen Wang, Jianran Liu, Qi Wu, Ling Pei

专题命中 隐私与版权 :alignment(abstract);分类 cs.LG

Comments Accepted by AAAI 2026 (extended version with supplementary materials)

详情

展开后加载摘要…

URL PDF HTML 收藏