arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-08-21 至 2025-08-21 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 2 篇

2508.14116 2025-08-21 cs.CY cs.AI 62%

Enriching Moral Perspectives on AI: Concepts of Trust amongst Africans

Lameck Mbangula Amugongo, Nicola J Bidwell, Joseph Mwatukange

机构 * Namibia University of Science \& Technology 13 Jackson Kaujeua Windhoek Namibia 9000 Rhodes University Makhanda South Africa International University of Management Namibia Charles Darwin University Australia Namibia University of Science \& Technology Rhodes University International University of Management Charles Darwin University

专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14415 2025-08-21 cs.AI 57%

The Agent Behavior: Model, Governance and Challenges in the AI Digital Age

Qiang Zhang, Pei Yan, Yijia Xu, Chuanpo Fu, Yong Fang, Yang Liu

机构 * School of Cyber Science and Engineering, Sichuan University, China(计算机科学与工程学院,四川大学) College of Computing and Data Science, Nanyang Technological University, Sinapore(计算与数据科学学院,南洋理工大学) College of Electronics and Information Engineering, Shenzhen University, China(电子与信息工程学院,深圳大学) Department of Computer Science and Technology, Tsinghua University, China(计算机科学与技术系,清华大学)

专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏