From Automation to Collaboration: Human-in-the-Loop Methods for Safe and Trustworthy NLP
从自动化到协作:面向安全可信NLP的人机协同方法
Most. Sharmin Sultana Samu, MD. Tanvir Ahmed Seum, Md. Rakibul Islam
机构
*
Department of Computer Science and Engineering, BRAC University(布拉克大学计算机科学与工程系)
;
Department of Electrical and Electronic Engineering, Rajshahi University of Engineering and Technology(拉贾沙希工程与技术大学电子与电气工程系)
PID-Guided Partial Alignment for Multimodal Decentralized Federated Learning
PID引导的多模态去中心化联邦学习部分对齐
Yanhang Shi, Xiaoyu Wang, Houwei Cao, Jian Li, Yong Liu
机构
*
Department of Electrical and Computer Engineering, Stony Brook University(石溪大学电气与计算机工程系)
;
Department of Applied Mathematics and Statistics and the Department of Computer Science, Stony Brook University(石溪大学应用数学与统计系和计算机科学系)
;
Department of Electrical and Computer Engineering, New York University(纽约大学电气与计算机工程系)
;
Department of Computer Science, New York Institute of Technology(纽约理工学院计算机科学系)
Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety
温水煮青蛙:面向智能体安全的多轮基准测试
Piercosma Bisconti, Matteo Prandi, Federico Pierucci, Federico Sartore, Enrico Panai, Laura Caroli, Yue Zhu, Adam Leon Smith, Luca Nannini, Marcello Galisai, Susanna Cifani, Francesco Giarrusso, Marcantonio Bracale Syrnikov, Daniele Nardi
机构
*
Icaro Foundation(Icaro基金会)
;
Sapienza University of Rome(罗马萨皮恩扎大学)
;
Sant’Anna School of Advanced Studies(圣安娜高级研究学校)
;
Tongji University School of Law(同济大学法学院)
;
AIQI Consortium(AIQI联盟)
;
Università Cattolica del Sacro Cuore(圣心大学)
;
Piccadilly Labs(皮卡迪利实验室)
;
VU Amsterdam(阿姆斯特丹伏伊大学)
;
Independent(独立)
Cross-lingual robustness of LLM-brain alignment and its computational roots
LLM-脑对齐的跨语言鲁棒性及其计算根源
Ni Yang, Rui He, Philipp Homan, Iris Sommer, Davide Staub, Wolfram Hinzen
机构
*
Grammar and Cognition Lab, Department of Translation & Language Sciences, Universitat Pompeu Fabra(语言与翻译科学系语法与认知实验室,庞培法华大学)
;
Department of Adult Psychiatry and Psychotherapy, University of Zurich(苏黎世大学成人精神病学与心理治疗系)
;
Neuroscience Center Zurich, University of Zurich and ETH Zurich(苏黎世大学神经科学中心与苏黎世联邦理工学院)
;
Center for Clinical Neuroscience and Cognition and Department of Psychiatry, University of Groningen, University Medical Center Groningen(格罗宁根大学临床神经科学与认知中心及精神病学系,格罗宁根大学医学中心)
;
Scalable Scientific Machine Learning Lab, Imperial College London, Department of Earth Science and Engineering(伦敦帝国理工学院可扩展科学机器学习实验室,地球科学与工程系)
;
Institut Català de Recerca i Estudis Avançats (ICREA), Barcelona, Spain(加泰罗尼亚高级研究与研究机构(ICREA),巴塞罗那,西班牙)
GrandGuard: Taxonomy, Benchmark, and Safeguards for Elderly-Chatbot Interaction Safety
GrandGuard:面向老年人与聊天机器人交互安全的分类、基准及防护措施
Changxuan Fan, Xi Yang, Yueyuan Zheng, Bin Zhou, Yuanping Wang, Wenbin Hu, Huihao Jing, Ki Sen Hung, Dazhao Du, Haoran Li, Janet Hui-wen Hsiao, Yangqiu Song
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
Evaluating Cognitive Age Alignment in Interactive AI Agents
评估交互式AI代理的认知年龄对齐
Yifan Shen, Jiawen Zhang, Jian Xu, Junho Kim, Ismini Lourentzou, Xu Cao, Meihuan Huang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Shenzhen Children's Hospital(深圳儿童医院)
;
Peking University(北京大学)
;
Hong Kong Polytechnic University(香港理工大学)
SHED: Style-Homogenized Embedding Alignment for Domain Generalization
SHED: 风格均质化嵌入对齐用于领域泛化
Kai Gan, Tong Wei
机构
*
School of Computer Science and Engineering, Southeast University, Nanjing 210096, China(1 东南大学计算机科学与工程学院,南京 210096,中国)
;
Key Laboratory of Computer Network and Information Integration (Southeast University), Ministry of Education, China(2 教育部计算机网络与信息集成重点实验室(东南大学),中国)
CommentsPreprint manuscript, 16 pages, 4 figures, 3 tables. This manuscript presents a residual-bounded 2.5D CT/CTA restoration framework for conservative medical image enhancement and evaluates it using image-recovery, baseline comparison, Monte Carlo stability, anatomical localization, and external low-dose CT testing
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
AgenticEval: 向大型语言模型的代理和自演化安全评估迈进
Yixu Wang, Xin Wang, Yang Yao, Xinyuan Li, Xibang Yang, Yan Teng, Xingjun Ma, Yingchun Wang
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Fudan University(复旦大学)
;
The University of Hong Kong(香港大学)
;
East China Normal University(华东师范大学)
机构
*
Research Intern, Department of Mechanical and Aerospace Engineering, George Washington University(乔治华盛顿大学机械与航空航天工程系研究实习生)
;
Ph.D. Student, Department of Mechanical and Aerospace Engineering, George Washington University(乔治华盛顿大学机械与航空航天工程系博士生)
;
Undergraduate Student, Aerospace Program, University of California, Berkeley(加州大学伯克利分校航空航天项目本科生)
;
Full Professor, Department of Electrical Engineering and Computer Science, University of California, Berkeley(加州大学伯克利分校电气工程与计算机科学系教授)
;
Ph.D. Student, Department of Computer Science, George Washington University(乔治华盛顿大学计算机科学系博士生)
;
Associate Professor, Department of Mechanical and Aerospace Engineering, George Washington University(乔治华盛顿大学机械与航空航天工程系副教授)
Safety-Oriented Evaluation of Language Understanding Systems for Air Traffic Control
面向安全的语言理解系统在空交通管制中的评估
Yujing Chang, Yash Guleria, Duc-Thinh Pham, Nhut-Huy Pham, Ningli Wang, Vu N. Duong, Sameer Alam
机构
*
ATMRI, Nanyang Technological University (NTU), Singapore(航空交通管理研究所,南洋理工大学(NTU),新加坡)
;
School of Management, Indian Institute of Technology Mandi, India(管理学院,印度理工学院曼迪分校,印度)
;
Centre of AI Research, VinUniversity, Vietnam(人工智能研究中心,文大学,越南)
Toward Stable Value Alignment: Introducing Independent Modules for Consistent Value Guidance
迈向稳定的值对齐:引入独立模块以实现一致的价值引导
Wenhao Chen, Sirui Sun, Shengyuan Bai, Guojie Song
机构
*
School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院)
;
Yuanpei College, Peking University(北京大学元培学院)
;
State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(北京大学通用人工智能国家重点实验室)