Truthful or Fabricated? Using Causal Attribution to Mitigate Reward Hacking in Explanations
真实还是编造?利用因果归因减轻解释中的奖励作弊
Pedro Ferreira, Wilker Aziz, Ivan Titov
机构
*
Institute for Logic, Language and Computation (ILLC), University of Amsterdam(逻辑、语言与计算研究所(ILLC),阿姆斯特丹大学)
;
Institute for Language, Cognition and Computation (ILCC), University of Edinburgh(语言、认知与计算研究所(ILCC),爱丁堡大学)
机构
*
Institute for Clarity in Documentation(文档清晰度研究所)
;
Inria Paris-Rocquencourt(法国国家信息与自动化研究所巴黎-罗康库尔中心)
;
Rajiv Gandhi University(拉吉夫·甘地大学)
;
Tsinghua University(清华大学)
;
Palmer Research Laboratories(帕默研究实验室)
;
State Key Laboratory of Opto-Electronic Information Acquisition and Protection Technology, Institute of Physical Science and Information Technology, Anhui University(光电信息获取与防护技术国家重点实验室,物理科学与信息技术学院,安徽大学)
;
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
;
School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院)
;
School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)
;
State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China, the Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(认知智能国家重点实验室,中国科学技术大学,人工智能研究院,合肥综合性国家科学中心)
Deontic Policies for Runtime Governance of Agentic AI Systems
面向自主AI系统运行时治理的道义策略
Anupam Joshi, Tim Finin, Karuna Pande Joshi, Lalana Kagal
机构
*
CSEE Department UMBC Baltimore, MD, USA
;
Center for AI UMBC Baltimore, MD, USA
;
Information Systems Department UMBC Baltimore, MD, USA
;
CSAIL MIT Cambridge, MA, USA
A Neuro-Symbolic Approach to Strategy Synthesis for Strategic Logics
一种面向策略逻辑的策略综合的神经符号方法
Marco Aruta, Vadim Malvone, Aniello Murano, Domenico Parente, Luca Rizzuti
机构
*
University of Naples Federico II(那不勒斯费德里科二世大学)
;
LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI,巴黎电信学院,巴黎理工学院)
;
Università degli Studi di Salerno(萨勒诺大学)
Evaluating Second-Order Bias of LLMs Through Epistemic Entitlement
通过认知权利评估大语言模型的二阶偏见
Ramaravind Kommiya Mothilal, Terry Jingchen Zhang, Raiyan Ahmed, Zhijing Jin, Shion Guha, Syed Ishtiaque Ahmed
机构
*
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
EuroSafeAI
;
Max Planck Institute for Intelligent Systems, Tübingen, Germany(马克斯·普朗克智能系统研究所(德国图宾根))
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Generative Symbolic Intelligence Lab (GenSI), Tsinghua University(生成符号智能实验室(GenSI),清华大学)
;
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
Kintsugi: Learning Policies by Repairing Executable Knowledge Bases
Kintsugi: 通过修复可执行知识库学习策略
Teng Cao, Yu Deng, Hikaru Shindo, Quentin Delfosse, Lanxi Wen, Suli Wang, Jannis Blüml, Christopher Tauchmann, Kristian Kersting
机构
*
Artificial Intelligence and Machine Learning Lab, Technical University of Darmstadt, Germany(德累斯顿技术大学人工智能与机器学习实验室)
;
Hessian Center for Artificial Intelligence (hessian.AI), Germany(黑森人工智能中心)
;
Department of Computer Science, Technical University of Darmstadt, Germany(德累斯顿技术大学计算机科学系)
;
Department of Computer Science, Technical University of Munich (TUM), Germany(慕尼黑技术大学计算机科学系)
;
German Research Center for Artificial Intelligence (DFKI), Germany(德国人工智能研究中心)
;
Centre for Cognitive Science, Technical University of Darmstadt, Germany(德累斯顿技术大学认知科学中心)
Multi-Stage Retrieval for Operational Technology Cybersecurity Compliance Using Large Language Models: A Railway Casestudy
基于大语言模型的多阶段检索在运营技术网络安全合规中的应用:铁路案例研究
Regan Bolton, Mohammadreza Sheikhfathollahi, Simon Parkinson, Dan Basher, Howard Parkinson
机构
*
Digital Transit Limited, 3M Buckley Innovation Centre(数字交通有限公司,3M Buckley创新中心)
;
Department of Computer Science at University of Huddersfield(赫德瑟尔大学计算机科学系)
Mind the Gap No More: Achieving Zero-Gap Multimodal Integration via One Tokenizer
不再有间隙:通过一个分词器实现零间隙多模态整合
Yanan Li, Christina Yi Jin, Yuan Jin, Manli Luo, Tie Xu, Shuai Jiao, Wei He, Qing Zhang
机构
*
Research Center for Frontier Fundamental Studies, Zhejiang Lab(前沿基础研究研究中心,浙江实验室)
;
Research Center for Scientific Data Hub, Zhejiang Lab(科学数据枢纽研究中心,浙江实验室)
Lifting Traces to Logic: Programmatic Skill Induction with Neuro-Symbolic Learning for Long-Horizon Agentic Tasks
将轨迹提升到逻辑:基于神经符号学习的程序化技能诱导用于长视界代理任务
Jie-Jing Shao, Haiyan Yin, Yueming Lyu, Xingrui Yu, Lan-Zhe Guo, Ivor Tsang, James Kwok, Yu-Feng Li
机构
*
State Key Laboratory of Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学)
;
School of Artificial Intelligence, Nanjing University, China(人工智能学院,南京大学)
;
School of Intelligence Science and Technology, Nanjing University, China(智能科学与技术学院,南京大学)
;
Centre for Frontier AI Research(前沿人工智能研究中心)
;
Institute of High Performance Computing, Agency for Science, Technology and Research, Singapore(高性能计算研究所,新加坡科技研究局)
;
Department of Computer Science and Engineering, Hong Kong University of Science and Technology, China(香港科学与技术大学计算机科学与工程系)
Retrieval-Augmented Multimodal Model for Fake News Detection
增强检索的多模态模型用于虚假新闻检测
Yiheng Li, Weihai Lu, Hanyi Yu, Yue Wang
机构
*
University of International Business and Economics(国际商务经济大学)
;
Peking University(北京大学)
;
University of Southern California(南加州大学)
;
Upstart Holdings, Inc.(Upstart Holdings公司)
机构
*
Department of Automation(清华大学自动化系)
;
Institute for Artificial Intelligence(北京大学人工智能研究院)
;
School of Psychological and Cognitive Sciences(北京大学心理与认知科学系)
;
State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室)
;
Beijing Key Laboratory of Behavior and Mental Health(北京行为与心理健康重点实验室)
The Bitter Lesson of Diffusion Language Models for Agentic Workflows: A Comprehensive Reality Check
扩散语言模型在代理工作流中的苦涩教训:全面的现实检验
Qingyu Lu, Liang Ding, Kanjian Zhang, Jinxia Zhang, Dacheng Tao
机构
*
Southeast University(东南大学)
;
Alibaba(阿里巴巴)
;
Southeast University Shenzhen Research Institute(东南大学深圳研究院)
;
College of Computing and Data Science at Nanyang Technological University(南洋理工大学计算机与数据科学学院)