Verifier-Backed Hard Problem Generation for Mathematical Reasoning
基于验证器的数学推理硬问题生成
Yuhang Lai, Jiazhan Feng, Yee Whye Teh, Ning Miao
机构
*
Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)
;
Hong Kong Institute of AI for Science, City University of Hong Kong(香港城市大学人工智能科学研究所)
;
School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)
;
Department of Statistics, University of Oxford(牛津大学统计系)
专题命中
推理与问题求解
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
CommentsWe argue that when the goal is to intervene on model behavior, skill characterization should be *model-native*: grounded in the model's own representations rather than imposed through external ontologies
AVRT: Audio-Visual Reasoning Transfer through Single-Modality Teachers
AVRT:通过单模态教师模型实现音频-视觉推理迁移
Edson Araujo, Saurabhchand Bhati, M. Jehanzeb Mirza, Brian Kingsbury, Samuel Thomas, Rogerio Feris, James R. Glass, Hilde Kuehne
机构
*
University of Tübingen, Germany(图宾根大学)
;
MIT, Cambridge MA, USA(麻省理工学院)
;
IBM Research, USA(IBM研究院)
;
MIT-IBM Watson AI Lab, USA(麻省理工-IBM沃森人工智能实验室)
;
Tuebingen AI Center, Germany(图宾根人工智能中心)
机构
*
School of Computer Science, Peking University(北京大学计算机科学系)
;
Tongyi Lab, Alibaba Group(阿里集团通义实验室)
;
Department of Computing Science, University of Alberta(阿尔伯塔大学计算机科学系)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)
专题命中
推理与问题求解
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Demystifying Chains, Trees, and Graphs of Thoughts
解开思维链、树和图的谜团
Maciej Besta, Florim Memedi, Zhenyu Zhang, Robert Gerstenberger, Guangyuan Piao, Nils Blach, Piotr Nyczyk, Marcin Copik, Grzegorz Kwaśniewski, Jürgen Müller, Lukas Gianinazzi, Ales Kubicek, Hubert Niewiadomski, Aidan O'Mahony, Onur Mutlu, Torsten Hoefler
David Anugraha, Shou-Yi Hung, Zilu Tang, Annie En-Shiun Lee, Derry Tanti Wijaya, Genta Indra Winata
机构
*
Stanford University(斯坦福大学)
;
University of Toronto(多伦多大学)
;
Boston University(波士顿大学)
;
Ontario Tech University(安大略技术大学)
;
Monash University Indonesia(墨尔本大学印尼分校)
;
Capital One(Capital One公司)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)
How malicious AI swarms can threaten democracy: The fusion of agentic AI and LLMs marks a new frontier in information warfare
恶意AI群如何威胁民主:代理AI与大语言模型的融合标志着信息战争的新前沿
Daniel Thilo Schroeder, Meeyoung Cha, Andrea Baronchelli, Nick Bostrom, Nicholas A. Christakis, David Garcia, Amit Goldenberg, Yara Kyrychenko, Kevin Leyton-Brown, Nina Lutz, Gary Marcus, Filippo Menczer, Gordon Pennycook, David G. Rand, Maria Ressa, Frank Schweitzer, Dawn Song, Christopher Summerfield, Audrey Tang, Jay J. Van Bavel, Sander van der Linden, Jonas R. Kunst
机构
*
Department of Sustainable Communication Technologies, SINTEF Digital(可持续通信技术系,SINTEF数字)
;
Max Planck Institute for Security and Privacy(安全与隐私研究所)
;
Department of Mathematics, City St George’s University of London(数学系,圣乔治大学)
;
Macrostrategy Research Initiative(战略研究计划)
;
Human Nature Lab, Yale University(人性实验室,耶鲁大学)
;
Department of Politics and Public Administration, University of Konstanz(政治与公共管理系,康斯坦茨大学)
;
Harvard Business School, Harvard University(哈佛商学院,哈佛大学)
;
Department of Psychology, University of Cambridge(心理学系,剑桥大学)
;
Department of Computer Science, University of British Columbia(计算机科学系,不列颠哥伦比亚大学)
;
Department of Human Centered Design & Engineering, University of Washington(以人为本设计与工程系,华盛顿大学)
;
Department of Psychology, New York University(心理学系,纽约大学)
;
Observatory on Social Media and Luddy School of Informatics, Computing, and Engineering, Indiana University(社交媒体观察所和信息、计算与工程学院,印第安纳大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments5 Pages, This is the author's version of the work. It is posted here by permission of the AAAS for personal use, not for redistribution. The definitive version was published in Science on January 22, 2026, DOI: 10.1126/science.adz1697
机构
*
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
NLCo Lab, Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院NLCo实验室)
;
Department of Automation, Tsinghua University(清华大学自动化系)
;
Shanghai Jiao Tong University(上海交通大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of California, Los Angeles(加州大学洛杉矶分校)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构
*
LIRIS, KU Leuven, Leuven, Belgium(LIRIS,KU莱顿,比利时)
;
Department of Business Informatics and Operations Management, Ghent University, Ghent, Belgium(商业信息学与运营管理系,根特大学,比利时)
;
Department of Decision Analytics and Risk, University of Southampton, Southampton, UK(决策分析与风险系,南安普顿大学,英国)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)