Pentest-R1: Towards Autonomous Penetration Testing Reasoning Optimized via Two-Stage Reinforcement Learning
机构 * State Key Laboratory of Cyberspace Security Defense, Institute of Information Engineering, Chinese Academy of Sciences(中国科学院网络空间安全防御重点实验室,信息工程研究所) ; School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与安全学院)
专题命中 复杂问题求解 :reasoning(title,abstract);self-correction(abstract);分类 cs.AI、cs.LG