C2PO: Diagnosing and Disentangling Bias Shortcuts in LLMs
C2PO:诊断和解构大语言模型中的偏见捷径
Xuan Feng, Bo An, Tianlong Gu, Liang Chang, Fengrui Hao, Peipeng Yu, Shuai Zhao
机构
*
Jinan University(济南大学)
;
Nanyang Technological University(南洋理工大学)
;
Engineering Research Center of Trustworthy AI (Ministry of Education)(可信人工智能工程研究中心)
;
Guangxi Key Laboratory of Trusted Software(广西可信软件重点实验室)
Towards Responsible and Explainable AI Agents with Consensus-Driven Reasoning
迈向负责任和可解释的AI代理:基于共识驱动的推理
Eranga Bandara, Tharaka Hewa, Ross Gore, Sachin Shetty, Ravi Mukkamala, Peter Foytik, Abdul Rahman, Safdar H. Bouk, Xueping Liang, Amin Hass, Sachini Rajapakse, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan
机构
*
Old Dominion University, Norfolk, VA, USA(老奥本大学)
;
Center for Wireless Communications, University of Oulu, Finland(无线通信中心,奥卢大学)
;
Florida International University, USA(佛罗里达国际大学)
;
Nanyang Technological University, Singapore(南洋理工大学)
;
University of Colombo, Sri Lanka(科伦坡大学)
;
Accenture Technology Labs, Arlington, VA, USA(Accenture技术实验室)
Conservative Bias in Multi-Teacher Learning: Why Agents Prefer Low-Reward Advisors
多教师学习中的保守偏见:为什么智能体更偏好低奖励顾问
Maher Mesto, Francisco Cruz
机构
*
School of Computer Science and Engineering, University of New South Wales(新南威尔士大学计算机科学与工程学院)
;
Escuela de Ingeniería, Universidad Central de Chile(智利中央大学工程学院)
CommentsIn Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining (WSDM '26)
Journal refIn Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining (WSDM '26), 2026, Boise, ID, USA. ACM, New York, NY, USA
NDRL: Cotton Irrigation and Nitrogen Application with Nested Dual-Agent Reinforcement Learning
NDRL:基于嵌套双智能体强化学习的棉花灌溉与氮肥施用
Ruifeng Xu, Liang He
机构
*
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
;
Xinjiang Multimodal Information Technology Engineering Research Center(新疆多模态信息处理工程技术研究中心)
;
Xinjiang Key Laboratory of Signal Detection and Processing(新疆信号检测与处理重点实验室)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
机构
*
Department of Computer Science, Shantou University(汕头大学计算机科学系)
;
Department of Automation, Tsinghua University(清华大学自动化系)
;
BNRIST, Tsinghua University(清华大学脑科学与类脑智能研究院)
Journal refIn Coordination, Organizations, Institutions, Norms, and Ethics for Governance of Multi-Agent Systems XVII. COINE 2024. LNCS, vol 15398. Springer, Cham (2025)
Agentic Artificial Intelligence for Ethical Cybersecurity in Uganda: A Reinforcement Learning Framework for Threat Detection in Resource-Constrained Environments
代理人工智能用于乌干达的伦理网络安全:一种强化学习框架用于资源受限环境中的威胁检测
Ibrahim Adabara, Bashir Olaniyi Sadiq, Aliyu Nuhu Shuaibu, Yale Ibrahim Danjuma, Venkateswarlu Maninti, Mutebi Joe
Democratic or Authoritarian? Probing a New Dimension of Political Biases in Large Language Models
民主或威权?探讨大型语言模型中政治偏见的新维度
David Guzman Piedrahita, Irene Strauss, Bernhard Schölkopf, Rada Mihalcea, Zhijing Jin
机构
*
University of Zürich(苏黎世大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
MPI for Intelligent Systems(智能系统研究所)
;
University of Michigan(密歇根大学)
;
University of Toronto(多伦多大学)
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
College of Automation Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学自动化工程学院)
;
College of Computer Science and Engineering, Chongqing Three Gorges University(重庆三峡大学计算机科学与工程学院)
;
Chinese Academy of Sciences, New Territories, Hong Kong(中国科学院香港新 Territories 分院)
;
City University of Hong Kong, Kowloon, Hong Kong(香港城市大学)
机构
*
Institute for Clarity in Documentation(清晰文档研究所)
;
Inria Paris-Rocquencourt(巴黎- Rocquencourt 国家信息与自动化研究所)
;
Rajiv Gandhi University(拉贾·甘地大学)
;
Tsinghua University(清华大学)
;
Palmer Research Laboratories(帕勒尔研究实验室)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))