arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2402.07945 2025-05-27 cs.HC cs.AI cs.CV 85%

ScreenAgent: A Vision Language Model-driven Computer Control Agent

Runliang Niu, Jindong Li, Shiqi Wang, Yali Fu, Xiyu Hu, Xueyuan Leng, He Kong, Yi Chang, Qi Wang

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Journal ref Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence (IJCAI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18471 2025-05-27 cs.CR cs.AI 85%

Invisible Tokens, Visible Bills: The Urgent Need to Audit Hidden Operations in Opaque LLM Services

Guoheng Sun, Ziyao Wang, Xuandong Zhao, Bowei Tian, Zheyu Shen, Yexiao He, Jinming Xing, Ang Li

机构 * University of Maryland, College Park(马里兰大学学院公园分校) University of California, Berkeley(加州大学伯克利分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08498 2025-05-26 cs.CL 85%

"Reasoning" with Rhetoric: On the Style-Evidence Tradeoff in LLM-Generated Counter-Arguments

Preetika Verma, Kokil Jaidka, Svetlana Churina

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 24 pages, 9 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15740 2025-05-22 cs.FL cs.AI cs.SE 85%

HybridProver: Augmenting Theorem Proving with LLM-Driven Proof Synthesis and Refinement

Jilin Hu, Jianyu Zhang, Yongwang Zhao, Talia Ringer

机构 * College of Computer Science and Technology Zhejiang University(浙江大学计算机科学与技术学院) Siebel Center for Computer Science University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14350 2025-05-22 cs.AI 85%

An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint

Yi Sun, Han Wang, Jiaqiang Li, Jiacheng Liu, Xiangyu Li, Hao Wen, Yizhen Yuan, Huiwen Zheng, Yan Liang, Yuanchun Li, Yunxin Liu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05047 2025-05-21 cs.AI 85%

Debate Only When Necessary: Adaptive Multiagent Collaboration for Efficient LLM Reasoning

Sugyeong Eo, Hyeonseok Moon, Evelyn Hayoon Zi, Chanjun Park, Heuiseok Lim

机构 * Korea University(韩国大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14148 2025-05-21 cs.AI 85%

MM-Agent: LLM as Agents for Real-world Mathematical Modeling Problem

Fan Liu, Zherui Yang, Cancheng Liu, Tianrui Song, Xiaofeng Gao, Hao Liu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13890 2025-05-21 cs.CL 85%

Mapping the Minds of LLMs: A Graph-Based Analysis of Reasoning LLM

Zhen Xiong, Yujun Cai, Zhecheng Li, Yiwei Wang

机构 * University of Southern California(南加州大学) The University of Queensland(昆士兰大学) University of California, San Diego(加州大学圣地亚哥分校) University of California, Merced(加州大学默塞德分校)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12981 2025-05-21 cs.CR cs.AI cs.HC 85%

From Assistants to Adversaries: Exploring the Security Risks of Mobile LLM Agents

Liangxuan Wu, Chao Wang, Tianming Liu, Yanjie Zhao, Haoyu Wang

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12501 2025-05-20 cs.AI 85%

ALAS: A Stateful Multi-LLM Agent Framework for Disruption-Aware Planning

Edward Y. Chang, Longling Geng

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 36 pages, 10 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11011 2025-05-19 econ.GN cs.AI cs.MA q-fin.EC 85%

Humans expect rationality and cooperation from LLM opponents in strategic games

Darija Barak, Miguel Costa-Gomes

机构 * School of Economics University of Edinburgh(经济学院爱丁堡大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09427 2025-05-16 cs.LG cs.RO 85%

SafePath: Conformal Prediction for Safe LLM-Based Autonomous Navigation

Achref Doula, Max Mühlhäuser, Alejandro Sanchez Guinea

机构 * Technical University of Darmstadt(德累斯顿技术大学) NTT Data(NTT数据)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00551 2025-05-16 cs.CL 85%

100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models

Chong Zhang, Yue Deng, Xiang Lin, Bin Wang, Dianwen Ng, Hai Ye, Xingxuan Li, Yao Xiao, Zhanfeng Mo, Qi Zhang, Lidong Bing

机构 * MiroMind(米罗Mind) Fudan University(复旦大学) National University of Singapore(新加坡国立大学) Singapore University of Technology and Design(新加坡科技设计大学) Nanyang Technological University(南洋理工大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11026 2025-05-08 cs.CV cs.AI 85%

SceneLLM: Implicit Language Reasoning in LLM for Dynamic Scene Graph Generation

Hang Zhang, Zhuoling Li, Jun Liu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13184 2025-05-08 cs.CL 85%

Can LLM be a Good Path Planner based on Prompt Engineering? Mitigating the Hallucination for Path Planning

Hourui Deng, Hongjie Zhang, Jie Ou, Chaosheng Feng

机构 * College of Computer Science(计算机科学学院) Sichuan Normal University(四川师范大学) School of Information and Software Engineering(信息与软件工程学院) University of Electronic Science and Technology of China(电子科技大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ICIC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00368 2025-05-02 cs.AI cs.ET cs.MA cs.RO 85%

Urban Air Mobility as a System of Systems: An LLM-Enhanced Holonic Approach

Ahmed R. Sadik, Muhammad Ashfaq, Niko Mäkitalo, Tommi Mikkonen

机构 * Honda Research Institute Europe(本田欧洲研究院) Faculty of IT University of Jyväskylä(信息技术学院约赫斯基尔亚大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19093 2025-04-29 cs.CR cs.AI cs.PF 85%

CipherBank: Exploring the Boundary of LLM Reasoning Capabilities through Cryptography Challenges

Yu Li, Qizhi Pei, Mengyuan Sun, Honglin Lin, Chenlin Ming, Xin Gao, Jiang Wu, Conghui He, Lijun Wu

机构 * Shanghai AI Laboratory(上海人工智能实验室) Wuhan University(武汉大学) Renmin University of China(中国人民大学) Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17200 2025-04-25 cs.CL 85%

A RAG-Based Multi-Agent LLM System for Natural Hazard Resilience and Adaptation

Yangxinyu Xie, Bowen Jiang, Tanwi Mallick, Joshua David Bergerson, John K. Hutchison, Duane R. Verner, Jordan Branham, M. Ross Alexander, Robert B. Ross, Yan Feng, Leslie-Anne Levy, Weijie Su, Camillo J. Taylor

机构 * Department of Statistics and Data Science, University of Pennsylvania(统计与数据科学系,宾夕法尼亚大学) Department of Computer and Information Science, University of Pennsylvania(计算机与信息科学系,宾夕法尼亚大学) Mathematics and Computer Science Division, Argonne National Laboratory(阿贡国家实验室数学与计算机科学 division) Decision and Infrastructure Sciences Division, Argonne National Laboratory(阿贡国家实验室决策与基础设施科学 division) Environmental Science Division, Argonne National Laboratory(阿贡国家实验室环境科学 division)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13192 2025-04-25 cs.CR cs.AI 85%

CheatAgent: Attacking LLM-Empowered Recommender Systems via LLM Agent

Liang-bo Ning, Shijie Wang, Wenqi Fan, Qing Li, Xin Xu, Hao Chen, Feiran Huang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by KDD 2024;

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19572 2025-04-24 cs.CL 85%

ChunkRAG: Novel LLM-Chunk Filtering Method for RAG Systems

Ishneet Sukhvinder Singh, Ritvik Aggarwal, Ibrahim Allahverdiyev, Muhammad Taha, Aslihan Akalin, Kevin Zhu, Sean O'Brien

机构 * Algoverse AI Research(Algoverse AI研究院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at Conference of the North American Chapter of the Association for Computational Linguistics, Student Research Workshop 2025 (NAACL SRW 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14650 2025-04-22 cs.AI 85%

A Framework for Benchmarking and Aligning Task-Planning Safety in LLM-Based Embodied Agents

Yuting Huang, Leilei Ding, Zhipeng Tang, Tianfu Wang, Xinrui Lin, Wuyang Zhang, Mingxiao Ma, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13032 2025-04-18 cs.AI cs.IR 85%

InstructRAG: Leveraging Retrieval-Augmented Generation on Instruction Graphs for LLM-Based Task Planning

Zheng Wang, Shu Xian Teo, Jun Jie Chew, Wei Shi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This paper has been accepted by SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02623 2025-04-17 cs.AI 85%

Multi-Mission Tool Bench: Assessing the Robustness of LLM based Agents through Related and Dynamic Missions

Peijie Yu, Yifan Yang, Jinjian Li, Zelong Zhang, Haorui Wang, Xiao Feng, Feng Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11001 2025-04-16 cs.CL 85%

ReZero: Enhancing LLM search ability by trying one-more-time

Alan Dao, Thinh Le

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09855 2025-04-15 cs.MA cs.AI 85%

PestMA: LLM-based Multi-Agent System for Informed Pest Management

Hongrui Shi, Shunbao Li, Zhipeng Yuan, Po Yang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09586 2025-04-15 cs.CL 85%

Short-Path Prompting in LLMs: Analyzing Reasoning Instability and Solutions for Robust Performance

Zuoli Tang, Junjie Ou, Kaiqin Hu, Chunwei Wu, Zhaoxin Huan, Chilin Fu, Xiaolu Zhang, Jun Zhou, Chenliang Li

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09420 2025-04-15 cs.CL 85%

SaRO: Enhancing LLM Safety through Reasoning-based Alignment

Yutao Mou, Yuxiao Luo, Shikun Zhang, Wei Ye

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07596 2025-04-14 cs.AI 85%

Boosting Universal LLM Reward Design through Heuristic Reward Observation Space Evolution

Zen Kit Heng, Zimeng Zhao, Tianhao Wu, Yuanfei Wang, Mingdong Wu, Yangang Wang, Hao Dong

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06943 2025-04-14 cs.AI cs.MA 85%

Review of Case-Based Reasoning for LLM Agents: Theoretical Foundations, Architectural Components, and Cognitive Integration

Kostas Hatalis, Despina Christou, Vyshnavi Kondapalli

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06581 2025-04-10 cs.AI 85%

Right Prediction, Wrong Reasoning: Uncovering LLM Misalignment in RA Disease Diagnosis

Umakanta Maharana, Sarthak Verma, Avarna Agarwal, Prakashini Mruthyunjaya, Dwarikanath Mahapatra, Sakir Ahmed, Murari Mandal

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏