arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1847 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 1847 篇

2510.14466 2026-05-19 cs.CL cs.AI 62%

Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages

迈向低资源语言LLM鲁棒多语言适应

Haolin Li, Haipeng Zhang, Mang Li, Yaohua Wang, Lijie Wen, Yu Zhang, Biqing Huang

机构 * Department of Automation, Tsinghua University, Beijing, China(清华大学自动化系) Alibaba International Digital Commerce Group, Beijing, China(阿里巴巴国际数字 commerce 集团) School of Software, Tsinghua University, Beijing, China(清华大学软件学院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LiRA框架,通过轻量级微调实现低资源语言LLM的鲁棒多语言适应,结合Arca和LaSR组件提升跨语言语义一致性与表示稳定性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16351 2026-05-19 cs.LG cs.AI 62%

PIMSM: Physics-Informed Multi-Scale Mamba for Stable Neural Representations under Distribution Shift

PIMSM:基于物理的多尺度Mamba用于在分布偏移下稳定的神经表示

Sangyoon Bae, Shinjae Yoo, Jiook Cha

机构 * Interdisciplinary Program in Artificial Intelligence(人工智能交叉学科项目) Seoul National University(首尔国立大学) Computational Science Initiative(计算科学倡议) Brookhaven National Laboratory(布鲁赫斯国家实验室) Department of Psychology(心理学系)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PIMSM,一种基于物理的多尺度Mamba架构,通过时间尺度对齐提升科学基础模型在分布偏移下的鲁棒性和表示稳定性,实验证明其在fMRI和气象预测中的有效性。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15915 2026-05-18 cs.HC cs.AI cs.CL 62%

SLIP & ETHICS: Graduated Intervention for AI Emotional Companions

SLIP与伦理:面向AI情感伴侣的渐进干预

Minseo Kim

机构 * HUA Labs(HUA实验室)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SLIP与ETHICS框架,通过渐进干预方法解决AI情感伴侣的安全与亲和力矛盾,实验显示在高能量状态下干预不足,但提升模型能力可改善检测效果。

Comments Accepted to PervasiveHealth 2026. 11 pages, 2 figures, 4 tables. Proc. of the 20th EAI International Conference on Pervasive Computing Technologies for Healthcare (PervasiveHealth 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12505 2026-05-14 cs.CY cs.AI 62%

Precautionary Governance of Autonomous AI: Legal Personhood as Functional Instrument

自主AI的谨慎治理:法人身份作为功能性工具

Karsten Brensing

机构 * Independent Researcher AGI Rights Project(AGI权利项目独立研究员)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出有限法人身份作为治理高级AI系统的工具,通过双层公司架构实现透明和问责,同时保持对意识和道德地位的中立。

Comments 25 pages. Experimental implementation under development at www.agi-rights.com. Contact: karsten.brensing@agi-rights.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11272 2026-05-13 cs.LG cs.AI cs.IR 62%

Localization Boosting for Growth Markets: Mitigating Cross-Locale Behavioral Bias in Learning-to-Rank

增长市场中的定位增强:减轻跨本地化行为偏差在学习到排序中的影响

Suryaa Veerabathiran Seran, Ashwin Naresh Kumar, Tracy Holloway King, Jing Zheng

机构 * Adobe

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种多目标框架,结合行为监督、VLM相关性信号和本地化增强,以改善学习到排序中的本地内容可见性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09922 2026-05-12 cs.CL cs.AI 62%

Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs

基于双自适应加权的团队自博弈:用于微调大语言模型

Wu Li, Yigeng Zhou, Zesheng Shi, Yequan Wang, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TPAW算法,通过团队协作与竞争机制提升自监督下LLM对齐效果,采用双自适应加权机制提高优化效率,实验证明其在多种模型和基准测试中表现优异。

Comments Accepted by ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14345 2026-05-12 cs.LG cs.AI stat.ML 62%

PAC-MCTS: Bias-Aware Pruning for Robust LLM-Guided Search and Planning

PAC-MCTS:具有偏见意识的剪枝用于稳健的LLM引导搜索与规划

Tianhao Qian

机构 * School of Mathematics, Southeast University(东南大学数学学院)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PAC-MCTS框架,通过动态调整置信区间来应对LLM引导下的偏见问题,实验表明其在Blocksworld和ALFWorld任务中显著提升了鲁棒性和搜索效率。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00398 2026-05-11 cs.CY cs.AI 62%

A Study on the Framework for Evaluating the Ethics and Trustworthiness of Generative AI

对生成式AI伦理性和可信度评估框架的研究

Cheonsu Jeong, Seunghyun Lee, Seonhee Jeong, Sungsu Kim

机构 * Hyper Automation Team, SAMSUNG SDS(三星SDS超自动化团队) Digital CRM Team, SAMSUNG SDS(三星SDS数字客户关系管理团队)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文研究生成式AI的伦理和可信度评估框架,提出系统评估方法,涵盖公平性、透明度等关键维度,并分析不同国家的AI伦理政策。

Comments 22 pages, 3 figures, 6 tables

Journal ref Artificial Intelligence and Applications, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01871 2026-05-08 cs.GT cs.AI cs.CY econ.GN q-fin.EC 62%

Auction-Based Regulation for Artificial Intelligence

基于拍卖的人工智能监管

Marco Bornstein, Zora Che, Suhas Julapalli, Abdirisak Mohamed, Amrit Singh Bedi, Furong Huang

机构 * Department of Computer Science, University of Maryland, College Park, MD, USA(马里兰大学计算机科学系,College Park, MD, USA) SAP Labs, LLC(SAP实验室) Department of Computer Science, University of Central Florida, FL, USA(佛罗里达大学计算机科学系,FL, USA)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文提出基于拍卖的AI监管机制,通过数学框架激励企业部署合规模型并参与监管,实验证明其在提升合规率和参与率方面优于传统方法。

Comments 26 pages, 7 figures, 3 tables. Accepted at ACM FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01229 2026-05-05 cs.LG cs.CL 62%

Attention Sinks in Massively Multilingual Neural Machine Translation:Discovery, Analysis, and Mitigation

大规模多语言神经机器翻译中的注意力 sinks:发现、分析与缓解

Hillary Mutisya, John Mugane

机构 * Harvard University(哈佛大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究发现神经机器翻译中跨注意力模式存在注意力 sinks,非内容token占据大部分注意力质量,影响相似性评估,提出内容过滤方法以恢复语言信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26958 2026-05-01 cs.CY cs.AI 62%

Designing Ethical Learning for Agentic AI: Toegye Yi Hwang's Ethical Emotion Regulation Framework

为智能代理AI设计道德学习:Toegye Yi Hwang的道德情感调节框架

Ji Yeon Kim

机构 * Seoul National University(首尔国立大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出一种基于Toegye Yi Hwang道德哲学的智能代理AI道德情感调节框架,通过五阶段架构和评估工具规范自主决策周期中的道德情感过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26955 2026-05-01 cs.CY cs.AI 62%

Policy-Governed LLM Routing with Intent Matching for Instrument Laboratories

基于意图匹配的政策引导LLM路由用于仪器实验室

Emmanuel A. Olowe, Danial Chitnis

机构 * School of Engineering The University of Edinburgh Edinburgh, UK(工程学院 苏格兰爱丁堡大学 爱丁堡 英国)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出基于意图匹配的政策引导LLM路由系统,通过Routiium和EduRouter实现对实验室辅助系统的管理和控制,提升学习挑战度和任务完成率。

Comments IEEE EduCon

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13387 2026-04-30 cs.CY cs.AI 62%

Uncovering AI Governance Themes in EU Policies using BERTopic and Thematic Analysis

利用BERTopic和主题分析揭示欧盟政策中的AI治理主题

Delaram Golpayegani, Marta Lasek-Markey, Arjumand Younus, Aphra Kerr, Dave Lewis

机构 * ADAPT Centre(ADAPT中心) Trinity College Dublin, Dublin, Ireland(都柏林大学三一学院) University College Dublin, Dublin, Ireland(都柏林大学)

专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY

AI总结 本文通过BERTopic和主题分析方法,研究欧盟AI治理政策中的主要主题,分析其演变和核心贡献。

Journal ref Frontiers in Artificial Intelligence and Applications, Volume 416: Legal Knowledge and Information Systems, 2025, pp. 400 - 411

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03254 2026-04-29 cs.CY cs.AI 62%

Is your AI Model Accurate Enough? The Difficult Choices Behind Rigorous AI Development and the EU AI Act

你的AI模型准确吗?严格AI开发背后的艰难选择以及欧盟AI法案

Lucas G. Uberti-Bona Marin, Bram Rijsbosch, Kristof Meding, Gerasimos Spanakis, Gijs van Dijck, Konrad Kollnig

机构 * Law \& Tech Lab, Maastricht University Maastricht The Netherlands University of Tübingen - Computational Law Lab TÜBingen Germany Law \& Tech Lab, Maastricht University University of Tübingen - Computational Law Lab

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文探讨AI准确性的评估依赖于情境相关的规范决策,通过欧盟AI法案分析四个关键选择,揭示技术规范在AI部署中的作用。

Comments To appear in the 2026 ACM Conference on Fairness, Accountability, and Transparency (ACM FAccT '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13400 2026-04-29 cs.CY cs.AI 62%

Justice in Judgment: Unveiling (Hidden) Bias in LLM-assisted Peer Reviews

审判中的公正:揭示(隐藏)在LLM辅助同行评审中的偏见

Sai Suresh Macharla Vasu, Ivaxi Sheth, Hui-Po Wang, Ruta Binkyte, Mario Fritz

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全研究中心) Saarland University(萨尔兰大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文研究LLM生成的同行评审中的偏见,通过操控作者元数据发现机构偏见、资历偏好和性别影响,揭示隐性偏见在软评分中的显现。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09871 2026-04-23 cs.AI cs.HC cs.LG 62%

Epistemology gives a Future to Complementarity in Human-AI Interactions

认识论为人类-人工智能互动中的互补性赋予未来

Andrea Ferrario, Alessandro Facchini, Juan M. Durán

机构 * SUPSI, Dalle Molle Institute for Artificial Intelligence (IDSIA)(SUPSI,达姆施塔特人工智能研究所(IDSIA)) Management in Networked and Digital Societies (MINDS) Department, Kozminski University(网络化与数字化社会管理系(MINDS)部,科米斯基大学) TU Delft(代尔夫特理工大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文通过认识论重构互补性,将其作为可靠知识过程的证据,提升人类-人工智能团队预测的可靠性,并提出设计与治理建议。

Comments Submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18444 2026-04-21 cs.LG cs.AI cs.CV 62%

ProtoCLIP: Prototype-Aligned Latent Refinement for Robust Zero-Shot Chest X-Ray Classification

ProtoCLIP:基于原型对齐的潜在细化用于鲁棒零样本胸部X光分类

Florian Kittler, Sheethal Bhat, Andreas Maier

机构 * Friedrich-Alexander University Erlangen-Nuremberg(埃朗根-纽伦堡弗里德里希-亚历山大大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 ProtoCLIP通过针对性数据筛选和锚点对齐优化,提升零样本胸部X光分类的鲁棒性,在VinDr-CXR数据集上提升AUC2-10个百分点,尤其在肺部气胸检测中达到0.94的SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14898 2026-04-17 cs.AI cs.CY cs.HC 62%

Governing Reflective Human-AI Collaboration: A Framework for Epistemic Scaffolding and Traceable Reasoning

引导反思的人工智能协作:一种知识支架和可追溯推理的框架

Rikard Rosenbacke, Carl Rosenbacke, Victor Rosenbacke, Martin McKee

机构 * Faculty of Medicine, Lund University(Lund大学医学院) Department of Economics, Lund University School of Economics and Management(Lund大学经济学与管理学院经济系) Department of Health Services Research and Policy, London School of Hygiene & Tropical Medicine(伦敦卫生与热带医学学院健康服务研究与政策系)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出一种人机协作的推理框架,通过知识支架和可追溯推理提升AI透明度与可控性,不依赖新模型架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13705 2026-04-16 cs.CL cs.AI cs.GT cs.MA 62%

Beyond Arrow's Impossibility: Fairness as an Emergent Property of Multi-Agent Collaboration

超越阿罗不可能定理:公平性作为多智能体协作的涌现属性

Sayan Kumar Chaki, Antoine Gourru, Julien Velcin

机构 * Department of Computer Science(计算机科学系)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨多智能体协作中公平性的涌现特性,通过医院急诊框架实验发现,智能体间的互动能产生比单一模型更公平的分配结果,揭示了公平性作为系统属性而非个体属性的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10590 2026-04-14 cs.CL cs.AI 62%

Bridging Linguistic Gaps: Cross-Lingual Mapping in Pre-Training and Dataset for Enhanced Multilingual LLM Performance

弥合语言鸿沟:预训练和数据集中的跨语言映射以提升多语言大语言模型性能

Weihua Zheng, Chang Liu, Zhengyuan Liu, Xin Huang, Kui Wu, Muhammad Huzaifah Md Shahrin, Aiti Aw, Roy Ka-Wei Lee

机构 * Singapore University of Technology and Design(新加坡科技设计大学) Agency for Science, Technology and Research(新加坡科技研究局)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出在预训练阶段引入跨语言映射任务,提升多语言对齐能力,通过语言对齐系数量化一致性,实验显示在机器翻译、跨语言自然语言理解及问答任务中性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06219 2026-04-09 cs.CY cs.AI 62%

From experimentation to engagement: on the paradox of participatory AI and power in contexts of forced displacement and humanitarian crises

从实验到参与:关于参与式AI与权力在流离失所和人道主义危机中的悖论

Stella Suge, Sarah W. Spencer, Nyalleng Moorosi, Helen McElhinney, Geoff Loane, Sue Black

机构 * FilmAid Kenya(肯尼亚电影援助组织) The Distributed AI Research Institute (DAIR)(分布式人工智能研究所) The CDAC Network(CDAC网络) Durham University(杜伦大学)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文探讨参与式AI在流离失所和人道主义危机中的局限性,指出其可能加剧'参与洗白'和算法伤害,强调需更严谨的方法和独立治理架构。

Comments This paper was submitted to the ACM FAccT conference in 2025 and is published here as a preprint in March 2026. The research was conducted in December 2024. Since submission, AI deployment across the humanitarian sector has accelerated without commensurate development of independent accountability

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06203 2026-04-09 cs.CY cs.AI 62%

Front-End Ethics for Sensor-Fused Health Conversational Agents: An Ethical Design Space for Biometrics

传感器融合健康对话代理的前端伦理:生物特征的伦理设计空间

Hansoo Lee, Rafael A. Calvo

机构 * Imperial College London(伦敦帝国理工学院) Korea Institute of Science and Technology(韩国科学技术研究院)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文探讨了生物特征翻译的伦理设计,提出五个维度分析前端伦理风险,提出适应性披露作为安全机制,确保健康代理支持用户自主性。

Comments Accepted at the Proceedings of the CHI 2026 Workshop: Ethics at the Front-End

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05826 2026-04-08 cs.AI cs.CY 62%

Reciprocal Trust and Distrust in Artificial Intelligence Systems: The Hard Problem of Regulation

人工智能系统中的互惠信任与不信任:监管的难题

Martino Maggetti

机构 * Institute of Political Studies (IEP), University of Lausanne(洛桑大学政治研究所)

专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY

AI总结 本文探讨人工智能系统信任与不信任的互惠动态,提出应将AI视为可行使代理的工具,分析其对监管的影响及未来监管面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23406 2026-04-03 cs.AI cs.CL cs.HC 62%

Beyond Preset Identities: How Agents Form Stances and Boundaries in Generative Societies

超越预设身份:生成社会中代理如何形成立场和边界

Hanzhong Zhang, Siyang Song, Jindong Wang

机构 * University of Exeter(埃克塞特大学) William & Mary(威廉与玛丽学院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文通过混合方法框架研究生成社会中代理的立场形成与边界构建,提出三个新指标揭示代理在复杂干预中的动态变化及信任与行为关系。

Comments 22 pages, 3 figures. arXiv admin note: substantial text overlap with arXiv:2508.17366

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00323 2026-04-02 cs.CL cs.CY 62%

Large Language Models in the Abuse Detection Pipeline

大语言模型在滥用检测流水线中的应用

Suraj Kath, Sanket Badhe, Preet Shah, Ashwin Sampathkumar, Shivani Gupta

机构 * Google LLC(谷歌有限责任公司)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.CY

AI总结 本文探讨大语言模型在滥用检测生命周期中的应用,分析其在标签生成、检测、审核及审计等阶段的作用,并讨论其面临的挑战与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28589 2026-03-31 cs.AI cs.LG 62%

Towards a Medical AI Scientist

迈向医疗AI科学家

Hongtao Wu, Boyun Zheng, Dingjie Song, Yu Jiang, Jianfeng Gao, Lei Xing, Lichao Sun, Yixuan Yuan

机构 * The Chinese University of Hong Kong(香港中文大学) Lehigh University(里海大学) Stanford University(斯坦福大学) Microsoft Research(微软研究院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出医疗AI科学家框架,通过临床工程师协同推理机制生成可落地的医学研究想法,并基于结构化医学规范和伦理政策撰写论文,验证其在171案例、19临床任务和6种数据模态中的高质量表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12433 2026-03-31 cs.CL cs.AI 62%

Exploring Cultural Variations in Moral Judgments with Large Language Models

探索大语言模型在道德判断中的文化差异

Hadi Mohammadi, Ayoub Bagheri

机构 * Utrecht University(乌得勒支大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文研究大语言模型在捕捉文化多样性道德价值观方面的能力,通过对比不同模型与全球态度调查数据的关联性,发现指令微调模型在跨文化道德规范上表现更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23251 2026-03-25 cs.CL cs.LG 62%

Is AI Catching Up to Human Expression? Exploring Emotion, Personality, Authorship, and Linguistic Style in English and Arabic with Six Large Language Models

人工智能是否正在赶上人类表达?探索英语和阿拉伯语中情感、个性、作者身份和语言风格的模仿

Nasser A Alsadhan

机构 * College of Computer and Information Sciences, King Saud University(计算机与信息科学学院,沙特阿拉伯国王沙德大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文研究六种大语言模型在英语和阿拉伯语中模仿情感和个性的能力,发现AI生成文本可被识别,但分类性能下降,揭示了LLM在情感信号编码上的差异。

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20235 2026-03-24 cs.CY cs.AI cs.HC 62%

Writing literature reviews with AI: principles, hurdles and some lessons learned

用AI撰写文献综述:原则、障碍与一些经验教训

Saadi Lahlou, Annabelle Gouttebroze, Atrina Oraee, Julian Madera

机构 * London School of Economics and Political Science(伦敦政治经济学院) Paris Institute for Advanced Study(巴黎高级研究学院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文通过比较不同AI辅助程度下的文献综述,揭示了AI生成内容的偏见、主流化倾向及局限性,强调了在使用AI撰写综述时需注意的防范措施。

Comments 31 pages and 193 pages of Appendices, including 6 different versions of the literature review, and complete chat with the LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20214 2026-03-24 cs.CY cs.AI cs.HC 62%

Beyond Detection: Governing GenAI in Academic Peer Review as a Sociotechnical Challenge

超越检测:将生成式人工智能在学术同行评审中的治理视为一个社会技术挑战

Tatiana Chakravorti, Pranav Narayanan Venkit, Sourojit Ghosh, Sarah Rajtmajer

机构 * Pennsylvania State University(宾夕法尼亚州立大学) Salesforce AI Research(Salesforce AI研究) University of Washington(华盛顿大学)

专题命中 AI治理与伦理 :prompt injection(abstract);分类 cs.AI、cs.CY

AI总结 本文通过混合方法研究,探讨生成式人工智能在学术同行评审中的社会技术风险,发现核心评估应由人类承担,同时提出保留问责机制的治理建议。

详情

展开后加载摘要…

URL PDF HTML 收藏