arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-26 至 2025-08-26 共收录 57 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 57 篇

2507.13357 2025-08-26 cs.CL 92%

Adaptive Linguistic Prompting (ALP) Enhances Phishing Webpage Detection in Multimodal Large Language Models

Atharva Bhargude, Ishan Gonehal, Dave Yoon, Kaustubh Vinnakota, Chandler Haney, Aaron Sandoval, Kevin Zhu

机构 * Algoverse AI Research(Algoverse AI研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL

Comments Published at ACL 2025 SRW, 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16729 2025-08-26 cs.CL 91%

Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?

Jason Li, Lauren Yraola, Kevin Zhu, Sean O'Brien

机构 * Algoverse AI Research(Algoverse AI 研究所)

专题命中 推理与问题求解 :language model(title,abstract);prompting(title,abstract);large language model(title);分类 cs.CL

Comments Accepted to Insights @ NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15969 2025-08-26 cs.CV cs.AI cs.CL 90%

Forgotten Polygons: Multimodal Large Language Models are Shape-Blind

William Rudman, Michal Golovanevsky, Amir Bar, Vedant Palit, Yann LeCun, Carsten Eickhoff, Ritambhara Singh

机构 * Brown University(布朗大学) Tel Aviv University(特拉维夫大学) IIT Kharagpur(印度理工学院卡里帕尔分校) New York University(纽约大学) University of Tübingen(图宾根大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04352 2025-08-26 cs.CL cs.AI 90%

Investigating the Robustness of Deductive Reasoning with Large Language Models

Fabian Hoppe, Filip Ilievski, Jan-Christoph Kalo

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Universiteit van Amsterdam(阿姆斯特丹大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments to be published in ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21805 2025-08-26 cs.CL cs.AI 90%

ImF: Implicit Fingerprint for Large Language Models

Jiaxuan Wu, Wanli Peng, Hang Fu, Yiming Xue, Juan Wen

机构 * China Agricultural University(中国农业大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17971 2025-08-26 cs.AI cs.RO 89%

Neural Algorithmic Reasoners informed Large Language Model for Multi-Agent Path Finding

Pu Feng, Size Wang, Yuhong Cao, Junkang Liang, Rongye Shi, Wenjun Wu

机构 * 1State Key Laboratory of Complex \& Critical Software Environment, Beihang University, Beijing, China 2School of Artificial Intelligence, Beihang University, Beijing, China 3Hangzhou International Innovation Institute, Hangzhou, China 4Department of Mechanical Engineering, National University of Singapore, Singapore

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23060 2025-08-26 cs.CL 89%

Self-Correcting Code Generation Using Small Language Models

Jeonghun Cho, Deokhyung Kang, Hyounghun Kim, Gary Geunbae Lee

机构 * Graduate School of Artificial Intelligence, POSTECH(人工智能研究生院,POSTECH) Department of Computer Science and Engineering, POSTECH(计算机科学与工程系,POSTECH)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Accepted at EMNLP 2025 (Findings, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21397 2025-08-26 cs.CL 89%

DecisionFlow: Advancing Large Language Model as Principled Decision Maker

Xiusi Chen, Shanyong Wang, Cheng Qian, Hongru Wang, Peixuan Han, Heng Ji

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);LLM(abstract);prompting(abstract)

Comments EMNLP 2025 Findings; 25 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17636 2025-08-26 cs.RO cs.AI 89%

MALMM: Multi-Agent Large Language Models for Zero-Shot Robotics Manipulation

Harsh Singh, Rocktim Jyoti Das, Mingfei Han, Preslav Nakov, Ivan Laptev

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10624 2025-08-26 cs.CL 89%

SensorLLM: Aligning Large Language Models with Motion Sensors for Human Activity Recognition

Zechen Li, Shohreh Deldari, Linyao Chen, Hao Xue, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) University of Tokyo(东京大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16910 2025-08-26 cs.CL 89%

Unbiased Reasoning for Knowledge-Intensive Tasks in Large Language Models via Conditional Front-Door Adjustment

Bo Zhao, Yinghao Zhang, Ziqi Xu, Yongli Ren, Xiuzhen Zhang, Renqiang Luo, Zaiwen Feng, Feng Xia

机构 * Huazhong Agricultural University(华中农业大学) RMIT University(皇家墨尔本理工大学) Jilin University(吉林大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments This paper has been accepted to the 34th ACM International Conference on Information and Knowledge Management (CIKM 2025), Full Research Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08925 2025-08-26 cs.LG cs.AI cs.CL 89%

Disentangling Exploration of Large Language Models by Optimal Exploitation

Tim Grams, Patrick Betz, Sascha Marton, Stefan Lüdtke, Christian Bartelt

机构 * Technical University of Clausthal(Clausthal 技术大学) University of Mannheim(曼海姆大学) University of Rostock(罗斯托克大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18556 2025-08-26 cs.CL cs.AI 88%

Exploring the Vulnerability of the Content Moderation Guardrail in Large Language Models via Intent Manipulation

Jun Zhuang, Haibo Jin, Ye Zhang, Zhengjian Kang, Wenbin Zhang, Gaby G. Dagher, Haohan Wang

机构 * Boise State University(博伊州立大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Pittsburgh(匹兹堡大学) New York University(纽约大学) Florida International University(佛罗里达国际大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted for EMNLP'25 Findings. TL;DR: We propose a new two-stage intent-based prompt-refinement framework, IntentPrompt, that aims to explore the vulnerability of LLMs' content moderation guardrails by refining prompts into benign-looking declarative forms via intent manipulation for red-teaming purposes

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16705 2025-08-26 cs.CL cs.AI 88%

Assessing Consciousness-Related Behaviors in Large Language Models Using the Maze Test

Rui A. Pimenta, Tim Schlippe, Kristina Schaaff

机构 * IU International University of Applied Sciences Germany(国际应用科学大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16603 2025-08-26 cs.CL cs.AI cs.LG 87%

GreenTEA: Gradient Descent with Topic-modeling and Evolutionary Auto-prompting

Zheng Dong, Luming Shang, Gabriela Olinto

机构 * Amazon Buyer Risk Prevention(亚马逊买家风险预防)

专题命中 推理与问题求解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18098 2025-08-26 cs.CL cs.LG 86%

Detecting and Characterizing Planning in Language Models

Jatin Nainani, Sankaran Vaidyanathan, Connor Watts, Andre N. Assis, Alice Rigg

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.LG

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16695 2025-08-26 cs.CL cs.AI 86%

Do Cognitively Interpretable Reasoning Traces Improve LLM Performance?

Siddhant Bhambri, Upasana Biswas, Subbarao Kambhampati

机构 * Arizona State University(亚利桑那州立大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17959 2025-08-26 cs.AI 85%

Language Models Coupled with Metacognition Can Outperform Reasoning Models

Vedant Khandelwal, Francesca Rossi, Keerthiram Murugesan, Erik Miehling, Murray Campbell, Karthikeyan Natesan Ramamurthy, Lior Horesh

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments 37 Pages, 95 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08276 2025-08-26 cs.CL cs.AI 84%

Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models

Yassine Jamaa, Badr AlKhamissi, Satrajit Ghosh, Martin Schrimpf

机构 * EPFL(苏黎世联邦理工学院) MIT(麻省理工学院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at the Interplay of Model Behavior and Model Internals Workshop co-located with COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17054 2025-08-26 cs.AI cs.CL cs.SD eess.AS 84%

Using LLM for Real-Time Transcription and Summarization of Doctor-Patient Interactions into ePuskesmas in Indonesia: A Proof-of-Concept Study

Nur Ahmad Khatim, Azmul Asmar Irfan, Mansur M. Arief

机构 * Institut Teknologi Sepuluh Nopember(印度尼西亚十月份十号技术大学) UIN Syarif Hidayatullah(伊斯兰教大学 Syarif Hidayatullah) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17005 2025-08-26 cs.CL 83%

Planning for Success: Exploring LLM Long-term Planning Capabilities in Table Understanding

Thi-Nhung Nguyen, Hoang Ngo, Dinh Phung, Thuy-Trang Vu, Dat Quoc Nguyen

机构 * Monash University(墨尔本大学) Qualcomm AI Research(高通人工智能研究)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to CoNLL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16998 2025-08-26 cs.CL cs.IR 83%

DeAR: Dual-Stage Document Reranking with Reasoning Agents via LLM Distillation

Abdelrahman Abdallah, Jamshid Mozafari, Bhawna Piryani, Adam Jatowt

机构 * University of Innsbruck(因斯布鲁克大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accept at EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13237 2025-08-26 eess.AS cs.CL cs.SD 83%

SAKURA: On the Multi-hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information

Chih-Kai Yang, Neo Ho, Yen-Ting Piao, Hung-yi Lee

机构 * National Taiwan University(国立台湾大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted to Interspeech 2025 (Oral). Update acknowledgement in this version. Project page: https://github.com/ckyang1124/SAKURA

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06791 2025-08-26 cs.RO cs.AI cs.HC cs.MA 83%

AutoMisty: A Multi-Agent LLM Framework for Automated Code Generation in the Misty Social Robot

Xiao Wang, Lu Dong, Sahana Rangasrinivasan, Ifeoma Nwogu, Srirangaraj Setlur, Venugopal Govindaraju

机构 * State University of New York at Buffalo(纽约州立大学布法罗分校) Department of Computer Science and Engineering, Amrita School of Computing, Amrita Vishwa Vidyapeetham(计算机科学与工程系,阿米特拉学校 computing,阿米特拉世界大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18174 2025-08-26 cs.HC 82%

InReAcTable: LLM-Powered Interactive Visual Data Story Construction from Tabular Data

Gerile Aodeng, Guozheng Li, Yunshan Feng, Qiyang Chen, Yu Zhang, Chi Harold Liu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 16 pages, 10 figures, accepted at ACM UIST 2025 (to appear)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18091 2025-08-26 cs.AI math.OC 81%

Teaching LLMs to Think Mathematically: A Critical Study of Decision-Making via Optimization

Mohammad J. Abdel-Rahman, Yasmeen Alslman, Dania Refai, Amro Saleh, Malik A. Abu Loha, Mohammad Yahya Hamed

机构 * Data Science Department, Princess Sumaya University for Technology(普里姆斯萨大学技术学院数据科学系) Electrical and Computer Engineering Department, Virginia Tech(弗吉尼亚理工大学电气与计算机工程系) Computer Science Department, Princess Sumaya University for Technology(普里姆斯萨大学技术学院计算机科学系) Computer Science Department, King Fahd University of Petroleum and Minerals(国王法赫德石油与矿物大学计算机科学系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23266 2025-08-26 cs.CV cs.AI cs.CL 81%

TOMATO: Assessing Visual Temporal Reasoning Capabilities in Multimodal Foundation Models

Ziyao Shangguan, Chuhan Li, Yuxuan Ding, Yanan Zheng, Yilun Zhao, Tesca Fitzgerald, Arman Cohan

专题命中 推理与问题求解 :foundation model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17153 2025-08-26 cs.CL cs.AI 81%

Natural Language Satisfiability: Exploring the Problem Distribution and Evaluating Transformer-based Language Models

Tharindu Madusanka, Ian Pratt-Hartmann, Riza Batista-Navarro

机构 * Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) Instytut Informatyki, Uniwersytet Opolski(奥波尔大学计算机科学学院)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments The paper was accepted to the 62nd Association for Computational Linguistics (ACL 2024), where it won the Best Paper Award

Journal ref In Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 15278 to 15294. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11398 2025-08-26 cs.HC cs.AI cs.IR 79%

Trustworthy AI Psychotherapy: Multi-Agent LLM Workflow for Counseling and Explainable Mental Disorder Diagnosis

Mithat Can Ozgun, Jiahuan Pei, Koen Hindriks, Lucia Donatelli, Qingzhi Liu, Junxiao Wang

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Wageningen University and Research(瓦赫宁根大学和研究中心) Guangzhou University(广州大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI

Comments This paper has been accepted by CIKM 2025 as a full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23163 2025-08-26 cs.AI 77%

Argumentatively Coherent Judgmental Forecasting

Deniz Gorur, Antonio Rago, Francesca Toni

机构 * Department of Computing, Imperial College London, UK(帝国理工学院计算系) Department of Informatics, King’s College London, UK(伦敦国王学院信息学系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 17 pages, 18 figures, ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏