MEGen: Generative Backdoor into Large Language Models via Model Editing
Jiyang Qiu, Xinbei Ma, Zhuosheng Zhang, Hai Zhao, Yun Li, Qianren Wang
机构
*
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering, Shanghai Jiao Tong University(上海交通大学智能交互与认知工程重点实验室)
;
Shanghai Key Laboratory of Trusted Data Circulation and Governance in Web3(上海Web3可信数据流通与治理重点实验室)
;
Cognitive AI Lab(认知人工智能实验室)
专题命中
知识编辑与模型理解
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
Exploring and Mitigating Fawning Hallucinations in Large Language Models
Zixuan Shangguan, Yanjie Dong, Lanjun Wang, Xiaoyi Fan, Victor C. M. Leung, Xiping Hu
机构
*
School of Medical Technology, Beijing Institute of Technology(北京理工大学医学技术学院)
;
Artificial Intelligence Research Institute, Shenzhen MSU-BIT University(深圳MSU-BIT大学人工智能研究院)
;
Tianjin University(天津大学)
;
The Hong Kong University of Science(香港科学大学)
专题命中
知识编辑与模型理解
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
Confident, Calibrated, or Complicit: Probing the Trade-offs between Safety Alignment and Ideological Bias in Language Models in Detecting Hate Speech
Sanjeeevan Selvaganapathy, Mehwish Nasim
机构
*
School of Physics, Mathematics and Computing(物理、数学与计算学系)
;
Network Analysis and Social Influence Modelling (NASIM) Lab(网络分析与社会影响建模实验室)
;
The University of Western Australia(西澳大学)
专题命中
知识编辑与模型理解
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI
EEGDM: EEG Representation Learning via Generative Diffusion Model
Jia Hong Puah, Sim Kuan Goh, Ziwei Zhang, Zixuan Ye, Chow Khuen Chan, Kheng Seang Lim, Si Lei Fong, Kok Sin Woon, Cuntai Guan
机构
*
School of Artificial Intelligence and Robotics, Xiamen University Malaysia(厦门大学马来西亚分校人工智能与机器人学院)
;
School of Energy and Chemical Engineering, Xiamen University Malaysia(厦门大学马来西亚分校能源与化学工程学院)
;
Department of Biomedical Engineering, Universiti Malaya(马来亚大学生物医学工程系)
;
Department of Medicine, Universiti Malaya(马来亚大学医学系)
;
Thrust of Carbon Neutrality and Climate Change, Hong Kong University of Science and Technology (Guangzhou)(香港科学与艺术大学(广州)碳中和与气候变化研究方向)
;
College of Computing & Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
专题命中
知识编辑与模型理解
:large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)
A Multi-granularity Concept Sparse Activation and Hierarchical Knowledge Graph Fusion Framework for Rare Disease Diagnosis
Mingda Zhang, Na Zhao, Jianglong Qin, Guoyu Ye, Ruixiang Tang
机构
*
School of Software, Yunnan University(云南大学软件学院)
;
Yunnan Key Laboratory of Software Engineering(云南软件工程重点实验室)
;
Yunnan Provincial Hospital of Traditional Chinese Medicine(云南中医药省人民医院)
专题命中
知识编辑与模型理解
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Bridging Human Cognition and AI: A Framework for Explainable Decision-Making Systems
N. Jean, G. Le Pera
专题命中
知识编辑与模型理解
:large language model(abstract);language model(abstract)
CommentsWe introduce a practical framework for explainable AI that combines modern interpretability methods with Malle's five-category model of human behavior explanation, illustrated through real-world case studies in credit risk and regulatory analysis