arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-02 至 2026-03-02 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 4 篇

2507.10619 2026-03-02 cs.LG cs.AI cs.NI 62%

Meta-Reinforcement Learning for Fast and Data-Efficient Spectrum Allocation in Dynamic Wireless Networks

元强化学习用于动态无线网络中快速且数据高效的频谱分配

Oluwaseyi Giwa, Tobi Awodunmila, Muhammad Ahmed Mohsin, Ahsan Bilal, Muhammad Ali Jamshed

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出元学习框架用于动态无线网络中快速且数据高效的频谱分配,通过对比实验展示其在性能和适应性上的优势。

Comments 5 pages, 6 figures, under review at IEEE Wireless Communications Letters

Journal ref IEEE Wireless Communications Letters 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23378 2026-03-02 cs.HC cs.AI cs.CY 62%

Now You See Me: Designing Responsible AI Dashboards for Early-Stage Health Innovation

现在你看到了:为早期健康创新设计负责任的AI仪表盘

Svitlana Surodina, Sinem Görücü, Lili Golmohammadi, Emelia Delaney, Rita Borgo

机构 * OPORA Health Technologies LTD(OPORA健康科技有限公司) King's College London(国王学院伦敦)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出了一种面向早期健康创新的负责任AI治理仪表板设计方法,通过协作设计和治理机制支持决策和问责。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23720 2026-03-02 cs.AI 57%

The Auton Agentic AI Framework

自主AI框架

Sheng Cao, Zhao Chang, Chang Li, Hannan Li, Liyao Fu, Ji Tang

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI

AI总结 Auton框架通过分离认知蓝图与运行时引擎,实现自主代理系统的标准化创建、执行和治理,采用增强POMDP模型和三级自我进化框架提升安全性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08552 2026-03-02 cs.LG cs.CV 57%

Confronting Reward Overoptimization for Diffusion Models: A Perspective of Inductive and Primacy Biases

对抗扩散模型中的奖励过度优化:从归纳偏置和优先偏置的角度出发

Ziyi Zhang, Sen Zhang, Yibing Zhan, Yong Luo, Yonggang Wen, Dacheng Tao

机构 * Institute of Artificial Intelligence, School of Computer Science, Wuhan University, China Hubei Luojia Laboratory, Wuhan, China The University of Sydney, Australia JD Explore Academy, Beijing, China Nanyang Technological University, Singapore

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG

AI总结 本文提出TDPO-R算法,通过利用扩散模型的时间归纳偏置和抑制活跃神经元的优先偏置,有效缓解奖励过度优化问题。

Comments Accepted to ICML 2024

Journal ref International Conference on Machine Learning, pp. 60396-60413, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏