AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
机构 * Department of Mathematical Sciences National Chengchi University Taipei Taiwan(数学科学系 国立政治大学 台北 台湾) ; Department of Computer Science National Chengchi University Taipei Taiwan(计算机科学系 国立政治大学 台北 台湾) ; Institute of Information Science Academia Sinica Taipei Taiwan(信息科学研究所 中国学术院 台北 台湾) ; National Chengchi University(国立政治大学)
专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 7 pages, accepted by CIKM 2025 as a short paper