机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
RMIT University(皇家墨尔本理工大学)
;
School of Computer Science, Central China Normal University(中央师范大学计算机学院)
;
School of Artificial Intelligence, Shenzhen Polytechnic University(深圳职业技术学院人工智能学院)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Do Persona-Infused LLMs Affect Performance in a Strategic Reasoning Game?
带有个性特征的LLM是否会影响战略推理游戏中的表现?
John Licato, Stephen Steinle, Brayden Hollis
机构
*
Bellini College of Artificial Intelligence, Cybersecurity and Computing(人工智能、网络安全与计算学院)
;
University of South Florida(佛罗里达州立大学)
;
Information Directorate(信息 Directorate)
;
Air Force Research Library(空军研究图书馆)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Training a Scientific Reasoning Model for Chemistry
为化学训练一个推理模型
Siddharth M. Narayanan, James D. Braza, Ryan-Rhys Griffiths, Albert Bou, Geemi Wellawatte, Mayk Caldas Ramos, Ludovico Mitchener, Samuel G. Rodriques, Andrew D. White
机构
*
FutureHouse Inc.(FutureHouse公司)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
机构
*
Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
School of Computer Science and Engineering(计算机科学与工程学院)
;
Central South University(中南大学)
;
Du Xiaoman (Beijing) Science Technology Co., Ltd.(杜小蔓(北京)科技有限公司)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
ChartPoint: Guiding MLLMs with Grounding Reflection for Chart Reasoning
ChartPoint: 通过 grounding 反射引导 MLLMs 进行图表推理
Zhengzhuo Xu, SiNan Du, Yiyan Qi, SiwenLu, Chengjin Xu, Chun Yuan, Jian Guo
机构
*
Tsinghua University(清华大学)
;
International Digital Economy Academy(国际数字经济学院)
;
Beihang University(北航)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);SFT(abstract);prompting(abstract)
Can LLMs Faithfully Explain Themselves in Low-Resource Languages? A Case Study on Emotion Detection in Persian
LLMs能否在低资源语言中忠实解释自己?一种波斯语情感检测的案例研究
Mobina Mehrazar, Mohammad Amin Yousefi, Parisa Abolfath Beygi, Behnam Bahrak
机构
*
School of Electrical and Computer Engineering College of Engineering, University of Tehran, Tehran, Iran(电气与计算机工程学院,德黑兰大学)
;
Computer Science Department, University of British Columbia, Vancouver, Canada(计算机科学系,不列颠哥伦比亚大学)
;
Tehran Institute for Advanced Studies, Khatam University, Tehran, Iran(德黑兰高级研究学院,卡坦大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构
*
School of Software, Shandong University(山东大学软件学院)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
School of Computing and Artificial Intelligence, Shandong University of Finance and Economics(山东财经大学计算机与人工智能学院)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构
*
Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)
;
School of Data Science, Fudan University(复旦大学数据科学学院)
;
Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
Zhuoyang Wu, Xinze Li, Zhenghao Liu, Yukun Yan, Zhiyuan Liu, Minghe Yu, Cheng Yang, Yu Gu, Ge Yu, Maosong Sun
机构
*
School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院)
;
Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学人工智能研究院计算机科学与技术系)
;
School of Computer Science, Beijing University of Posts and Telecommunications, China(北京邮电大学计算机科学学院)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);small language model(abstract);SFT(abstract)
Path Drift in Large Reasoning Models:How First-Person Commitments Override Safety
Yuyi Huang, Runzhe Zhan, Lidia S. Chao, Ailin Tao, Derek F. Wong
机构
*
The Second Affiliated Hospital, Guangdong Provincial Key Laboratory of Allergy and Clinical Immunology, Guangzhou Medical University(广东省过敏与临床免疫学重点实验室,广州医科大学第二附属医院)
;
NLP 2 CT Lab, Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系NLP2CT实验室)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);RLHF(abstract);prompting(abstract)
CrunchLLM: Multitask LLMs for Structured Business Reasoning and Outcome Prediction
Rabeya Tus Sadia, Qiang Cheng
机构
*
Department of Computer Science University of Kentucky(计算机科学系 俄亥俄大学)
;
Department of Computer Science, Institute for Biomedical Informatics University of Kentucky(计算机科学系 生物医学信息学研究所 俄亥俄大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Classical AI vs. LLMs for Decision-Maker Alignment in Health Insurance Choices
Mallika Mainali, Harsha Sureshbabu, Anik Sen, Christopher B. Rauch, Noah D. Reifsnyder, John Meyer, J. T. Turner, Michael W. Floyd, Matthew Molineaux, Rosina O. Weber
机构
*
Information Science, Drexel University, Philadelphia, PA 19104 USA
;
Parallax Advanced Research, 4035 Colonel Glenn Hwy, Beavercreek, OH 45431 USA
;
Knexus Research, 174 Waterfront Street, Suite 310, National Harbor, Oxon Hill, MD 20745 USA
;
Information Science \& Computer Science, Drexel University, Philadelphia, PA 19104 USA
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments15 pages, 3 figures. Accepted at the Twelfth Annual Conference on Advances in Cognitive Systems (ACS 2025)
Wolfgang Lehrach, Daniel Hennes, Miguel Lazaro-Gredilla, Xinghua Lou, Carter Wendelken, Zun Li, Antoine Dedieu, Jordi Grau-Moya, Marc Lanctot, Atil Iscen, John Schultz, Marcus Chiam, Ian Gemp, Piotr Zielinski, Satinder Singh, Kevin P. Murphy
机构
*
Google DeepMind(谷歌DeepMind)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
HalluGuard: Evidence-Grounded Small Reasoning Models to Mitigate Hallucinations in Retrieval-Augmented Generation
Loris Bergeron, Ioana Buhnila, Jérôme François, Radu State
机构
*
Banque de Luxembourg(卢森堡银行)
;
Center for Data Science in Humanities, Chosun University(人文数据科学中心,全州大学)
;
ATILF, University of Lorraine–CNRS(ATILF,洛林大学–CNRS)
;
SnT, University of Luxembourg(SnT,卢森堡大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)