arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4797 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4797 篇

2508.01166 2026-01-19 cs.SD 85%

Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR

听更清晰,用更少:多模态检索与选择增强的对话式LLM基于ASR

Bingshen Mu, Hexin Liu, Hongfei Xue, Kun Wei, Lei Xie

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出MARS方法,通过多模态检索与选择提升对话式LLM-ASR的准确性,仅用1.5K小时数据即可超越训练于179K小时数据的顶级系统。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05504 2026-01-13 cs.CR cs.MA 85%

Memory Poisoning Attack and Defense on Memory Based LLM-Agents

基于内存的LLM代理中的内存污染攻击与防御

Balachandra Devarangadi Sunil, Isheeta Sinha, Piyush Maheshwari, Shantanu Todmal, Shreyan Mallik, Shuchi Mishra

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了基于内存的LLM代理中的内存污染攻击与防御,通过实验发现预存合法记忆可显著降低攻击效果,并提出两种新的防御机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20986 2025-12-25 cs.CR 85%

AegisAgent: An Autonomous Defense Agent Against Prompt Injection Attacks in LLM-HARs

AegisAgent:一种对抗LLM-HAR中提示注入攻击的自主防御代理

Yihan Wang, Huanqi Yang, Shantanu Pal, Weitao Xu

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 AegisAgent通过自主推理和验证机制,有效降低LLM-HAR系统中提示注入攻击的成功率,提升系统安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08242 2025-12-10 cs.DC cs.AR 85%

Chopper: A Multi-Level GPU Characterization Tool & Derived Insights Into LLM Training Inefficiency

Chopper:一个多级GPU特性工具及对LLM训练低效性的衍生见解

Marco Kurzynski, Shaizeen Aga, Di Wu

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Chopper通过多级GPU特性分析揭示LLM训练低效原因,发现频率开销是性能差距的主要因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22530 2025-12-01 cs.SE 85%

Boosting Pointer Analysis With LLM-Enhanced Allocation Function Detection

通过LLM增强的分配函数检测提升指针分析

Baijun Cheng, Kailong Wang, Ling Shi, Haoyu Wang, Peng Di, Ding Li, Xiangqun Chen, Yao Guo

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CAFD技术,通过LLM增强的分配函数检测提升指针分析精度,有效识别CAFs并减少别名集大小,提升分析效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00882 2025-11-26 cs.CR 85%

VULSOLVER: Vulnerability Detection via LLM-Driven Constraint Solving

通过LLM驱动的约束求解进行漏洞检测:VULSOLVER

Xiang Li, Yueci Su, Jiahao Liu, Zhiwei Lin, Yuebing Hou, Peiming Gao, Yuanchao Zhang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 VULSOLVER通过LLM驱动的约束求解方法,实现高精度漏洞检测,准确率达97.85%

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05079 2025-11-03 cs.SE 85%

LLM-Guided Scenario-based GUI Testing

Shengcheng Yu, Yuchen Ling, Chunrong Fang, Quan Zhou, Yi Zhao, Chunyang Chen, Shaomin Zhu, Zhenyu Chen

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24188 2025-10-29 cs.SE 85%

Investigating Software Aging in LLM-Generated Software Systems

César Santos, Ermeson Andrade, Roberto Natella

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Presented at the 17th International Workshop on Software Aging and Rejuvenation (WoSAR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19747 2025-10-23 cs.SE 85%

Review of Tools for Zero-Code LLM Based Application Development

Priyaranjan Pattnayak, Hussain Bohra

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted in 6th World Conference on Artificial Intelligence: Advances and Applications (WCAIAA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07604 2025-10-10 cs.SE 85%

RustAssure: Differential Symbolic Testing for LLM-Transpiled C-to-Rust Code

Yubo Bai, Tapti Palit

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 13 pages to appear in Proceedings of ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03611 2025-10-07 cs.CL cs.AI cs.LG 85%

Can an LLM Induce a Graph? Investigating Memory Drift and Context Length

Raquib Bin Yousuf, Aadyant Khatri, Shengzhe Xu, Mandar Sharma, Naren Ramakrishnan

机构 * Department of Computer Science, Virginia Tech, Alexandria, VA(计算机科学系,弗吉尼亚理工大学,亚历山大,VA)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 2025 IEEE International Conference on Knowledge Graph (ICKG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02449 2025-09-03 cs.DC 85%

KubeIntellect: A Modular LLM-Orchestrated Agent Framework for End-to-End Kubernetes Management

Mohsen Seyedkazemi Ardebili, Andrea Bartolini

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18572 2025-08-27 cs.DC 85%

Strata: Hierarchical Context Caching for Long Context Language Model Serving

Zhiqiang Xie, Ziyi Xu, Mark Zhao, Yuwei An, Vikram Sharma Mailthody, Scott Mahlke, Michael Garland, Christos Kozyrakis

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments 13 pages, 14 figures, under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07664 2025-08-12 cs.HC 85%

Understanding Users' Privacy Perceptions Towards LLM's RAG-based Memory

Shuning Zhang, Rongjun Ma, Ying Ma, Shixuan Li, Yiqun Xu, Xin Yi, Hewu Li

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19349 2025-08-11 cs.AR 85%

DECA: A Near-Core LLM Decompression Accelerator Grounded on a 3D Roofline Model

Gerasimos Gerogiannis, Stijn Eyerman, Evangelos Georganas, Wim Heirman, Josep Torrellas

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03585 2025-06-05 cs.SE 85%

Improving LLM-Based Fault Localization with External Memory and Project Context

Inseok Yeo, Duksan Ryu, Jongmoon Baik

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 12 Pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18160 2025-06-02 cs.SE cs.PL 85%

RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing

Jinyao Guo, Chengpeng Wang, Xiangzhe Xu, Zian Su, Xiangyu Zhang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 18 pages, 11 tables, 6 figures, 3 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19580 2025-05-29 cs.LG cs.AI cs.CL 85%

Mini-batch Coresets for Memory-efficient Language Model Training on Data Mixtures

Dang Nguyen, Wenhan Yang, Rathul Anand, Yu Yang, Baharan Mirzasoleiman

机构 * Computer Science Department, UCLA(计算机科学系,加州大学洛杉矶分校)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 21 pages, 6 figures, 9 tables, link: https://github.com/BigML-CS-UCLA/CoLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14925 2025-05-22 cs.CL cs.AI cs.LG 85%

Too Long, Didn't Model: Decomposing LLM Long-Context Understanding With Novels

Sil Hamilton, Rebecca M. M. Hicke, Matthew Wilkens, David Mimno

机构 * Department of Information Science(信息科学系) Department of Computer Science(计算机科学系) Cornell University(康奈尔大学)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05832 2025-05-12 cs.HC cs.RO 85%

Augmented Body Communicator: Enhancing daily body expression for people with upper limb limitations through LLM and a robotic arm

Songchen Zhou, Mark Armstrong, Giulia Barbareschi, Toshihiro Ajioka, Zheng Hu, Ryoichi Ando, Kentaro Yoshifuji, Masatane Muto, Kouta Minamizawa

机构 * Keio University Graduate School of Media Design(庆应大学媒体设计研究生院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02376 2025-05-06 cs.SE 85%

LAMeD: LLM-generated Annotations for Memory Leak Detection

Ekaterina Shemetova, Ilya Shenbin, Ivan Smirnov, Anton Alekseev, Alexey Rukhovich, Sergey Nikolenko, Vadim Lomshakov, Irina Piontkovskaya

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12943 2025-05-01 cs.HC 85%

Customizing Emotional Support: How Do Individuals Construct and Interact With LLM-Powered Chatbots

Xi Zheng, Zhuoyang Li, Xinning Gui, Yuhan Luo

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 20 pages, 3 figures, 3 tables. Accepted to CHI 2025, ACM Conference on Human Factors in Computing Systems

Journal ref Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems (CHI '25), Article 376, 20 pages. ACM, New York, NY, USA.

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16565 2025-03-26 cs.LG cs.AI cs.CL q-bio.GN 85%

Gene42: Long-Range Genomic Foundation Model With Dense Attention

Kirill Vishniakov, Boulbaba Ben Amor, Engin Tekin, Nancy A. ElNaker, Karthik Viswanathan, Aleksandr Medvedev, Aahan Singh, Maryam Nadeem, Mohammad Amaan Sayeed, Praveenkumar Kanithi, Tiago Magalhaes, Natalia Vassilieva, Dwarikanath Mahapatra, Marco Pimentel, and Shadab Khan

专题命中 长上下文与记忆 :foundation model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17741 2025-03-25 cs.SE 85%

RustMap: Towards Project-Scale C-to-Rust Migration via Program Analysis and LLM

Xuemeng Cai, Jiakun Liu, Xiping Huang, Yijun Yu, Haitao Wu, Chunmiao Li, Bo Wang, Imam Nur Bani Yusuf, Lingxiao Jiang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15520 2025-03-21 cs.HC 85%

Agent-S: LLM Agentic workflow to automate Standard Operating Procedures

Mandar Kulkarni

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15079 2025-03-20 cs.SE 85%

LogiAgent: Automated Logical Testing for REST Systems with LLM-Based Multi-Agents

Ke Zhang, Chenxi Zhang, Chong Wang, Chi Zhang, YaChen Wu, Zhenchang Xing, Yang Liu, Qingshan Li, Xin Peng

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14647 2025-03-20 cs.NI 85%

Towards More Economical Context-Augmented LLM Generation by Reusing Stored KV Cache

Hanchen Li, Yuhan Liu, Yihua Cheng, Kuntai Du, Junchen Jiang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11087 2025-02-21 cs.CR cs.AI cs.CL cs.LG 85%

DP-MemArc: Differential Privacy Transfer Learning for Memory Efficient Language Models

Yanming Liu, Xinyue Peng, Yuwei Zhang, Xiaolan Ke, Songhang Deng, Jiannan Cao, Chen Ma, Mengchen Fu, Tianyu Du, Sheng Cheng, Xun Wang, Jianwei Yin, Xuhong Zhang

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Fix metadata error

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06428 2025-02-12 cs.CV 85%

CoS: Chain-of-Shot Prompting for Long Video Understanding

Jian Hu, Zixu Cheng, Chenyang Si, Wei Li, Shaogang Gong

专题命中 长上下文与记忆 :prompting(title,abstract);large language model(abstract);language model(abstract)

Comments A training-free test-time optimisation approach for long video understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20262 2025-01-20 cs.CL cs.AI cs.LG 85%

ELITR-Bench: A Meeting Assistant Benchmark for Long-Context Language Models

Thibaut Thonet, Jos Rozen, Laurent Besacier

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏