arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-26 至 2025-08-26 共收录 302 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 15 篇

2505.15075 2025-08-26 cs.CL cs.AI cs.CV cs.LG 75%

Traveling Across Languages: Benchmarking Cross-Lingual Consistency in Multimodal LLMs

Hao Wang, Pinzhi Huang, Jihan Yang, Saining Xie, Daisuke Kawahara

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The first version of this paper mistakenly included a prompt injection phrase, which was inappropriate and unprofessional. Although we corrected the version on arXiv and withdrew from the conference, my co-authors and university strongly request a full withdrawal. Given the situation, I no longer have the authority to manage this paper, and withdrawing it from arXiv is the most responsible action

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18040 2025-08-26 cs.AI 70%

PerPilot: Personalizing VLM-based Mobile Agents via Memory and Exploration

Xin Wang, Zhiyao Cui, Hao Li, Ya Zeng, Chenxu Wang, Ruiqi Song, Yihang Chen, Kun Shao, Qiaosheng Zhang, Jinzhuo Liu, Siyue Ren, Shuyue Hu, Zhen Wang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17198 2025-08-26 cs.AI 70%

From reactive to cognitive: brain-inspired spatial intelligence for embodied agents

Shouwei Ruan, Liyuan Wang, Caixin Kang, Qihui Zhu, Songming Liu, Xingxing Wei, Hang Su

机构 * Department of Computer Science and Technology, Institute for AI, BNRist Center, Tsinghua-Bosch Joint ML Center, THBI Lab(计算机科学与技术系、人工智能研究院、BNRist中心、清华-博世联合机器学习中心、THBI实验室) Institute of Artificial Intelligence(人工智能研究院) Department of Psychological and Cognitive Sciences(心理学与认知科学系)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 40 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13045 2025-08-26 cs.LG cs.CV 70%

Continual Learning for Generative AI: From LLMs to MLLMs and Beyond

Haiyang Guo, Fanhu Zeng, Fei Zhu, Jiayi Wang, Xukai Wang, Jingang Zhou, Hongbo Zhao, Wenzhuo Liu, Shijie Ma, Da-Han Wang, Xu-Yao Zhang, Cheng-Lin Liu

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences(中国科学院香港科学与创新研究院人工智能与机器人中心) School of Computer and Information Engineering, Xiamen University of Technology(厦门理工大学计算机与信息工程学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21577 2025-08-26 cs.SE cs.AI 70%

RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving

Huacan Wang, Ziyi Ni, Shuo Zhang, Shuo Lu, Sen Hu, Ziyang He, Chen Hu, Jiaye Lin, Yifu Guo, Ronghao Chen, Xin Li, Daxin Jiang, Yuntao Du, Pin Lyu

机构 * UCAS(中国科学技术大学) CASIA(中国科学院自动化研究所) BUPT(北京邮电大学) PKU(北京大学) NUS(新加坡国立大学) StepFun THU(清华大学) SCNU(华南师范大学) USTC(中国科学技术大学) SDU(山东大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

Comments A novel approach; Very practical

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09425 2025-08-26 cs.IR 67%

MARM: Unlocking the Future of Recommendation Systems through Memory Augmentation and Scalable Complexity

Xiao Lv, Jiangxia Cao, Shijie Guan, Xiaoyou Zhou, Zhiguang Qi, Yaqiang Zang, Ming Li, Ben Wang, Kun Gai, Guorui Zhou

专题命中 长上下文与记忆 :LLM(abstract);language model(abstract)

Comments CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17862 2025-08-26 cs.IR 67%

Retrieval Feedback Memory Enhancement Large Model Retrieval Generation Method

Leqian Li, Dianxi Shi, Jialu Zhou, Xinyu Wei, Mingyue Yang, Songchang Jin, Shaowu Yang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17826 2025-08-26 cs.AR 67%

LLMulator: Generalizable Cost Modeling for Dataflow Accelerators with Input-Adaptive Control Flow

Kaiyan Chang, Wenlong Zhu, Shengwen Liang, Huawei Li, Ying Wang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

Comments Accepted by MICRO (IEEE/ACM International Symposium on Microarchitecture) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18162 2025-08-26 cs.LO cs.AI cs.CC cs.LG 62%

The Computational Complexity of Satisfiability in State Space Models

Eric Alsmann, Martin Lange

机构 * University of Kassel, Germany(卡塞尔大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ECAI 25

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 推理与问题求解 57 篇

2507.13357 2025-08-26 cs.CL 92%

Adaptive Linguistic Prompting (ALP) Enhances Phishing Webpage Detection in Multimodal Large Language Models

Atharva Bhargude, Ishan Gonehal, Dave Yoon, Kaustubh Vinnakota, Chandler Haney, Aaron Sandoval, Kevin Zhu

机构 * Algoverse AI Research(Algoverse AI研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL

Comments Published at ACL 2025 SRW, 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16729 2025-08-26 cs.CL 91%

Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?

Jason Li, Lauren Yraola, Kevin Zhu, Sean O'Brien

机构 * Algoverse AI Research(Algoverse AI 研究所)

专题命中 推理与问题求解 :language model(title,abstract);prompting(title,abstract);large language model(title);分类 cs.CL

Comments Accepted to Insights @ NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15969 2025-08-26 cs.CV cs.AI cs.CL 90%

Forgotten Polygons: Multimodal Large Language Models are Shape-Blind

William Rudman, Michal Golovanevsky, Amir Bar, Vedant Palit, Yann LeCun, Carsten Eickhoff, Ritambhara Singh

机构 * Brown University(布朗大学) Tel Aviv University(特拉维夫大学) IIT Kharagpur(印度理工学院卡里帕尔分校) New York University(纽约大学) University of Tübingen(图宾根大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04352 2025-08-26 cs.CL cs.AI 90%

Investigating the Robustness of Deductive Reasoning with Large Language Models

Fabian Hoppe, Filip Ilievski, Jan-Christoph Kalo

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Universiteit van Amsterdam(阿姆斯特丹大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments to be published in ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21805 2025-08-26 cs.CL cs.AI 90%

ImF: Implicit Fingerprint for Large Language Models

Jiaxuan Wu, Wanli Peng, Hang Fu, Yiming Xue, Juan Wen

机构 * China Agricultural University(中国农业大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17971 2025-08-26 cs.AI cs.RO 89%

Neural Algorithmic Reasoners informed Large Language Model for Multi-Agent Path Finding

Pu Feng, Size Wang, Yuhong Cao, Junkang Liang, Rongye Shi, Wenjun Wu

机构 * 1State Key Laboratory of Complex \& Critical Software Environment, Beihang University, Beijing, China 2School of Artificial Intelligence, Beihang University, Beijing, China 3Hangzhou International Innovation Institute, Hangzhou, China 4Department of Mechanical Engineering, National University of Singapore, Singapore

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23060 2025-08-26 cs.CL 89%

Self-Correcting Code Generation Using Small Language Models

Jeonghun Cho, Deokhyung Kang, Hyounghun Kim, Gary Geunbae Lee

机构 * Graduate School of Artificial Intelligence, POSTECH(人工智能研究生院,POSTECH) Department of Computer Science and Engineering, POSTECH(计算机科学与工程系,POSTECH)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Accepted at EMNLP 2025 (Findings, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21397 2025-08-26 cs.CL 89%

DecisionFlow: Advancing Large Language Model as Principled Decision Maker

Xiusi Chen, Shanyong Wang, Cheng Qian, Hongru Wang, Peixuan Han, Heng Ji

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);LLM(abstract);prompting(abstract)

Comments EMNLP 2025 Findings; 25 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17636 2025-08-26 cs.RO cs.AI 89%

MALMM: Multi-Agent Large Language Models for Zero-Shot Robotics Manipulation

Harsh Singh, Rocktim Jyoti Das, Mingfei Han, Preslav Nakov, Ivan Laptev

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10624 2025-08-26 cs.CL 89%

SensorLLM: Aligning Large Language Models with Motion Sensors for Human Activity Recognition

Zechen Li, Shohreh Deldari, Linyao Chen, Hao Xue, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) University of Tokyo(东京大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16910 2025-08-26 cs.CL 89%

Unbiased Reasoning for Knowledge-Intensive Tasks in Large Language Models via Conditional Front-Door Adjustment

Bo Zhao, Yinghao Zhang, Ziqi Xu, Yongli Ren, Xiuzhen Zhang, Renqiang Luo, Zaiwen Feng, Feng Xia

机构 * Huazhong Agricultural University(华中农业大学) RMIT University(皇家墨尔本理工大学) Jilin University(吉林大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments This paper has been accepted to the 34th ACM International Conference on Information and Knowledge Management (CIKM 2025), Full Research Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08925 2025-08-26 cs.LG cs.AI cs.CL 89%

Disentangling Exploration of Large Language Models by Optimal Exploitation

Tim Grams, Patrick Betz, Sascha Marton, Stefan Lüdtke, Christian Bartelt

机构 * Technical University of Clausthal(Clausthal 技术大学) University of Mannheim(曼海姆大学) University of Rostock(罗斯托克大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18556 2025-08-26 cs.CL cs.AI 88%

Exploring the Vulnerability of the Content Moderation Guardrail in Large Language Models via Intent Manipulation

Jun Zhuang, Haibo Jin, Ye Zhang, Zhengjian Kang, Wenbin Zhang, Gaby G. Dagher, Haohan Wang

机构 * Boise State University(博伊州立大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Pittsburgh(匹兹堡大学) New York University(纽约大学) Florida International University(佛罗里达国际大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted for EMNLP'25 Findings. TL;DR: We propose a new two-stage intent-based prompt-refinement framework, IntentPrompt, that aims to explore the vulnerability of LLMs' content moderation guardrails by refining prompts into benign-looking declarative forms via intent manipulation for red-teaming purposes

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16705 2025-08-26 cs.CL cs.AI 88%

Assessing Consciousness-Related Behaviors in Large Language Models Using the Maze Test

Rui A. Pimenta, Tim Schlippe, Kristina Schaaff

机构 * IU International University of Applied Sciences Germany(国际应用科学大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16603 2025-08-26 cs.CL cs.AI cs.LG 87%

GreenTEA: Gradient Descent with Topic-modeling and Evolutionary Auto-prompting

Zheng Dong, Luming Shang, Gabriela Olinto

机构 * Amazon Buyer Risk Prevention(亚马逊买家风险预防)

专题命中 推理与问题求解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18098 2025-08-26 cs.CL cs.LG 86%

Detecting and Characterizing Planning in Language Models

Jatin Nainani, Sankaran Vaidyanathan, Connor Watts, Andre N. Assis, Alice Rigg

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.LG

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16695 2025-08-26 cs.CL cs.AI 86%

Do Cognitively Interpretable Reasoning Traces Improve LLM Performance?

Siddhant Bhambri, Upasana Biswas, Subbarao Kambhampati

机构 * Arizona State University(亚利桑那州立大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17959 2025-08-26 cs.AI 85%

Language Models Coupled with Metacognition Can Outperform Reasoning Models

Vedant Khandelwal, Francesca Rossi, Keerthiram Murugesan, Erik Miehling, Murray Campbell, Karthikeyan Natesan Ramamurthy, Lior Horesh

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments 37 Pages, 95 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08276 2025-08-26 cs.CL cs.AI 84%

Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models

Yassine Jamaa, Badr AlKhamissi, Satrajit Ghosh, Martin Schrimpf

机构 * EPFL(苏黎世联邦理工学院) MIT(麻省理工学院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at the Interplay of Model Behavior and Model Internals Workshop co-located with COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17054 2025-08-26 cs.AI cs.CL cs.SD eess.AS 84%

Using LLM for Real-Time Transcription and Summarization of Doctor-Patient Interactions into ePuskesmas in Indonesia: A Proof-of-Concept Study

Nur Ahmad Khatim, Azmul Asmar Irfan, Mansur M. Arief

机构 * Institut Teknologi Sepuluh Nopember(印度尼西亚十月份十号技术大学) UIN Syarif Hidayatullah(伊斯兰教大学 Syarif Hidayatullah) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17005 2025-08-26 cs.CL 83%

Planning for Success: Exploring LLM Long-term Planning Capabilities in Table Understanding

Thi-Nhung Nguyen, Hoang Ngo, Dinh Phung, Thuy-Trang Vu, Dat Quoc Nguyen

机构 * Monash University(墨尔本大学) Qualcomm AI Research(高通人工智能研究)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to CoNLL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏