Comments12 pages, 8 figures. Accepted at the Second Workshop on Large Language Models for Generative Software Engineering (LLM4SE 2026), co-located with STAF 2026, Rennes, France, June 29 - July 3, 2026
Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing
智能体安全:LLM驱动渗透测试的工具、失效模式与设计法则体系化研究
Israt Moyeen Noumi, Tarannum Ahmed Nowshin, Md. Mehedi Hasan Nipu, Mohammad Sakib Mahmood, Md. Jakir Hossain, M. F. Mridha
机构
*
Ahsanullah University of Science and Technology(阿赫桑乌拉科技大学)
;
BRAC University(BRAC大学)
;
North South University(北南大学)
;
Missouri State University(密苏里州立大学)
;
Multimedia University(多媒体大学)
;
American International University-Bangladesh(孟加拉国美国国际大学)
Beyond Benchmarks: LLM Evaluation with an Anthropomorphic and Lifecycle-oriented Roadmap
超越基准:基于拟人化与生命周期导向路线图的大语言模型评估
Jun Wang, Ninglun Gu, Kailai Zhang, Pengyong Li, Yelun Bao, Jin Yang, Xu Yin, Liwei Liu, Zijiao Zhang, Yihuan Liu, Gary G. Yen, Junchi Yan
机构
*
Department of Networks, China Mobile Communications Group Co.,Ltd.(中国移动通信集团有限公司网络部)
;
Xidian University(西安电子科技大学)
;
Oklahoma State University(俄克拉荷马州立大学)
;
Shanghai Jiao Tong University(上海交通大学)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Register Shifts Break LLM Safety: A Bengali Benchmark with Culturally Grounded Harms
寄存器偏移破坏大语言模型安全:具有文化相关危害的孟加拉语基准测试
Naymul Islam, Nusrat Jahan Lia, Shubhashis Roy Dipta, Sabik Bin Sultan, Abdullah Khan Zehady
机构
*
Institute of Information Technology, University of Dhaka(达卡大学信息技术学院)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
;
Bangladesh Air Force Shaheen College Kurmitola(孟加拉国空军库尔米托拉沙欣学院)
;
Ciroos Inc.(Ciroos公司)