arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-02-19 至 2026-02-19 共收录 3 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 3 篇

2602.15881 2026-02-19 cs.CY 83%

Pluralism in AI Governance: Toward Sociotechnical Alignment and Normative Coherence

AI治理中的多元主义:迈向社会技术对齐与规范一致性

Mike Wa Nkongolo

专题命中 AI治理与伦理 :alignment(title,abstract);safety(abstract);分类 cs.CY

AI总结 本文提出了一种全面的价值敏感AI治理模型,通过整合多种框架和比较分析,探讨如何将公共价值观嵌入社会技术系统,强调监管作为主动机制的重要性。

Comments 18 pages, 6 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16438 2026-02-19 cs.LG cs.AI 81%

Intra-Fairness Dynamics: The Bias Spillover Effect in Targeted LLM Alignment

内在公平动态:定向大语言模型对齐中的偏见溢出效应

Eva Paraschou, Line Harder Clemmensen, Sneha Das

机构 * Department of Applied Mathematics and Computer Science, Technical University of Denmark(应用数学与计算机科学系,丹麦技术大学) Department of Mathematical Sciences, University of Copenhagen(数学科学系,哥本哈根大学)

专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI、cs.LG

AI总结 本文研究了定向性别对齐对多敏感属性公平性的影响,发现改善某一属性公平性可能加剧其他属性的不平等,强调了多属性、情境感知公平性评估的重要性。

Comments Submitted to the BiAlign CHI Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16553 2026-02-19 cs.CY 57%

Agentic AI, Medical Morality, and the Transformation of the Patient-Physician Relationship

代理AI、医疗道德与患者-医生关系的变革

Robert Ranisch, Sabine Salloch

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY

AI总结 本文探讨代理AI如何通过重塑患者-医生关系改变医疗道德,呼吁在广泛应用前融入伦理考量。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏