arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-24 至 2025-12-24 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 8 篇

2503.12511 2025-12-24 cs.SE cs.AI cs.PL 86%

SACTOR: LLM-Driven Correct and Idiomatic C to Rust Translation with Static Analysis and FFI-Based Verification

SACTOR:基于大语言模型的C到Rust翻译工具,结合静态分析和FFI验证

Tianyang Zhou, Ziyi Zhang, Haowen Lin, Somesh Jha, Mihai Christodorescu, Kirill Levchenko, Varun Chandrasekaran

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Google(谷歌)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SACTOR通过结合静态分析和FFI验证,利用大语言模型实现C到Rust的正确且习惯性翻译,提升了代码安全性和效率

Comments 35 pages, 15 figures Previously named as "LLM-Driven Multi-step Translation from C to Rust using Static Analysis"

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20237 2025-12-24 cs.AI 85%

MemR$^3$: Memory Retrieval via Reflective Reasoning for LLM Agents

MemR$^3$: 通过反思推理实现LLM代理的记忆检索

Xingbo Du, Loka Li, Duzhen Zhang, Le Song

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MemR$^3$通过反思推理实现LLM代理的记忆检索,提升检索准确性和闭环控制能力。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15649 2025-12-24 cs.CV cs.AI cs.CL 81%

VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?

VTCBench: 视觉-语言模型能否通过视觉-文本压缩理解长上下文?

Hongbo Zhao, Meng Wang, Fei Zhu, Wenzhuo Liu, Bolin Ni, Fanhu Zeng, Gaofeng Meng, Zhaoxiang Zhang

机构 * 1 Institute of Automation, Chinese Academy of Sciences 2 School of Artificial Intelligence, University of Chinese Academy of Sciences 3 Centre for Artificial Intelligence Robotics, Hong Kong Institute of Science \& Innovation, CAS 4 Independent Researcher

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 VTCBench评估视觉-文本压缩对视觉语言模型长上下文理解能力的影响,发现多数模型在处理压缩信息时表现不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20179 2025-12-24 cs.HC 78%

RESPOND: Risk-Enhanced Structured Pattern for LLM-driven Online Node-level Decision-making

基于风险增强的结构化模式:面向LLM驱动的在线节点级决策

Dan Chen, Heye Huang, Tiantian Chen, Zheng Li, Yongji Li, Yuhui Xu, Sikai Chen

专题命中 长上下文与记忆 :LLM(title,abstract)

AI总结 RESPOND通过结构化模式和风险增强机制提升LLM驱动驾驶代理的决策精度与安全性,有效减少碰撞并实现个性化驾驶风格适应。

Comments 28 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20278 2025-12-24 cs.AI 70%

Synthesizing Procedural Memory: Challenges and Architectures in Automated Workflow Generation

生成程序记忆:自动化工作流生成中的挑战与架构

Nishant Gaurav, Adit Akarsh, Ankit Ranjan, Manoj Bajaj

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过科学方法自主生成工作流技能,解决自动化技能生成中的四个结构性瓶颈。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20245 2025-12-24 cs.NE cs.AI cs.IR cs.SC cs.SE 70%

Memory as Resonance: A Biomimetic Architecture for Infinite Context Memory on Ergodic Phonetic Manifolds

记忆作为共振:一种仿生架构,用于在周期性语音流形上实现无限上下文记忆

Tarik Houichime, Abdelghani Souhar, Younes El Amrani

机构 * System Research & Development Laboratory(系统研究与开发实验室) EME AXE LLC(5EME AXE公司) Faculty of Science, Mohammed V University In Rabat(穆罕默德五世大学科学学院) Computer Science Research Laboratory (LaRI)(计算机科学研究实验室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出语音轨迹记忆架构,通过神经符号方法实现无限上下文记忆,利用周期性流形上的连续路径实现高压缩比和低延迟检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16189 2025-12-24 cs.LG cs.CL 62%

Latent learning: episodic memory complements parametric learning by enabling flexible reuse of experiences

潜在学习:情景记忆通过使经验的灵活重用来补充参数学习

Andrew Kyle Lampinen, Martin Engelcke, Yuxuan Li, Arslan Chaudhry, James L. McClelland

机构 * Google DeepMind(谷歌DeepMind) Department of Psychology, Stanford University(斯坦福大学心理学系)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出情景记忆可通过灵活重用经验来补充参数学习,提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20482 2025-12-24 cs.SE cs.AI 57%

SweRank+: Multilingual, Multi-Turn Code Ranking for Software Issue Localization

SweRank+: 多语言、多轮次代码排名用于软件问题定位

Revanth Gangi Reddy, Ye Liu, Wenting Zhao, JaeHyeok Doo, Tarun Suresh, Daniel Lee, Caiming Xiong, Yingbo Zhou, Semih Yavuz, Shafiq Joty

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Salesforce AI Research(Salesforce AI研究院) KAIST AI(韩国科学技术院AI研究中心)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI

AI总结 SweRank+结合跨语言代码排名工具和代理搜索设置,实现多轮次的代码库推理,提升多语言软件问题定位的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏