arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-20 至 2026-08-20 共收录 5 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 5 篇

2608.18135 2026-08-20 cs.AI 新提交 79%

Improving Rural Medication Safety with AI: A Scoping Review

用人工智能提升农村用药安全:一项范围综述

Jeong-ah Kim, Muhammad Ashad Kabir, Daniel Terry, Maryam Rouhi

专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI

AI总结 本范围综述探究AI在农村医疗场景中提升用药安全的应用,发现AI可覆盖用药全流程,机器学习类技术能减少34%-80%的用药错误,但存在基础设施不足等农村特有挑战。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18086 2026-08-20 cs.AI cs.LG 新提交 73%

Position: Current Model Cards Are Insufficient for Downstream Governance of Open-Weight Foundation Models

立场:当前模型卡片不足以支持开放权重基础模型的下游治理

Sungwon Chae, Keonwoo Kim, Hoki Kim, Jaeyeon Ju, Sangchul Park

专题命中 AI治理与伦理 :alignment(abstract);safety(abstract);分类 cs.AI、cs.LG

AI总结 本文分析Hugging Face的500份模型卡片,指出现有模型卡片无法支持开放权重基础模型下游治理,提出需整合模型卡片、可接受使用政策、许可证的多层治理框架。

Comments Accepted as a position paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18122 2026-08-20 cs.CY cs.AI 新提交 62%

Global Index on Responsible AI 2026 : Conceptual Framework and Methodology

2026年全球负责任AI指数:概念框架与方法论

Fola Adeleke, Rachel Adams, Ayantola Alayande, Daniela Benavente, Ana Florido, Nicolás Grossman, Leah Junck

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 该研究介绍2026年全球负责任AI指数(GIRAI)第二版的方法论,优化框架维度与指标,经审计验证,用于跨国评估各国负责任AI治理,助力相关主体识别保护成效与差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18774 2026-08-20 cs.CV cs.LG 新提交 57%

MIFR: A Modality-Invariant and Fair Representation Framework for Skin Disease Classification

MIFR:用于皮肤病分类的模态不变公平表示框架

Asonyu Senge Njih, Yvan Guifo Fodjo, Vianney Kengne Tchendji, Jerry Lacmou Zeutouo, Kerol Djoumessi

机构 * University of Dschang(德昌大学) Université Paris-Panthéon-Assas(巴黎先贤祠-阿萨斯大学) Université de Picardie Jules Verne(儒勒·凡尔纳皮卡第大学) Hertie Institute for AI in Brain Health, University of Tübingen(蒂宾根大学赫蒂脑健康人工智能研究所)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG

AI总结 本研究提出MIFR框架,通过配对临床与皮肤镜图像的多目标损失训练,实现皮肤病分类的模态不变性与公平性,在多数据集上验证了其预测性能与公平性。

Comments Accepted for publication at the First Workshop on Advancing African Medical AI through Global Integration (AFRICAI)-MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06412 2026-08-20 cs.CY 版本更新 57%

Brokerage in the Black Box: Swing States, Strategic Ambiguity, and the Global Politics of AI Governance

黑箱中的中介作用: swing州、战略模糊性与人工智能治理的全球政治

Ha-Chi Tran

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY

AI总结 本研究探讨了技术swing州如何通过战略模糊性和制度透明性互动,调解大国技术竞争,影响全球人工智能治理的制度设计与政策结果。

详情

展开后加载摘要…

URL PDF HTML 收藏