Towards Ethical Multi-Agent Systems of Large Language Models: A Mechanistic Interpretability Perspective
迈向伦理化的大型语言模型多智能体系统:从机制可解释性视角出发
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL
AI总结 本文从机制可解释性视角出发,提出确保大型语言模型多智能体系统伦理行为的研究议程,聚焦于伦理评估框架、内部机制解析及参数高效对齐技术。
Comments Accepted to LaMAS 2026@AAAI'26 (https://sites.google.com/view/lamas2026)