arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-06 至 2026-01-06 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 7 篇

2512.24618 2026-01-06 cs.CL 91%

Youtu-LLM: Unlocking the Native Agentic Potential for Lightweight Large Language Models

Youtu-LLM:解锁轻量级大语言模型的原生代理潜力

Junru Lu, Jiarui Qin, Lingfeng Qiao, Yinghui Li, Xinyi Dai, Bo Ke, Jianfeng He, Ruizhi Qiao, Di Yin, Xing Sun, Yunsheng Wu, Yinsong Liu, Shuangyin Liu, Mingkong Tang, Haodong Lin, Jiayi Kuang, Fanxu Meng, Xiaojuan Tang, Yunjia Xi, Junjie Huang, Haotong Yang, Zhenyi Shen, Yangning Li, Qianwen Zhang, Yifei Yu, Siyu An, Junnan Dong, Qiufeng Wang, Jie Wang, Keyu Chen, Wei Wen, Taian Guo, Zhifeng Shen, Daohai Yu, Jiahao Li, Ke Li, Zongyi Li, Xiaoyu Tan

机构 * Youtu-LLM Team(Youtu-LLM团队)

专题命中 长上下文与记忆 :LLM(title,abstract);language model(title,abstract);large language model(title);分类 cs.CL

AI总结 Youtu-LLM通过紧凑架构和长上下文支持,实现了轻量级大语言模型在代理任务中的高效推理与规划能力。

Comments 57 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01298 2026-01-06 cs.LG cs.AI cs.AR cs.DC cs.MA 79%

Warp-Cortex: An Asynchronous, Memory-Efficient Architecture for Million-Agent Cognitive Scaling on Consumer Hardware

Warp-Cortex: 一种异步、内存高效的用于百万智能体认知扩展的消费级硬件架构

Jorge L. Ruiz Williams

机构 * Warp Research(Warp研究)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Warp-Cortex通过异步架构和内存优化技术,实现百万智能体在消费级硬件上的高效认知扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18773 2026-01-06 cs.AR cs.AI cs.CL cs.PF 73%

BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache

BitDecoding: 通过低精度KV缓存解锁Tensor Cores用于长上下文LLM

Dayou Du, Shijie Cao, Jianyi Cheng, Luo Mai, Ting Cao, Mao Yang

机构 * University of Edinburgh(爱丁堡大学) Microsoft Research(微软研究院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 BitDecoding通过协同利用CUDA核心和Tensor Core,实现低精度KV缓存的高效解码,提升长上下文LLM的解码速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02311 2026-01-06 cs.DC cs.AI 70%

Placement Semantics for Distributed Deep Learning: A Systematic Framework for Analyzing Parallelism Strategies

分布式深度学习中的放置语义:一种分析并行策略的系统框架

Deep Pankajbhai Mehta

机构 * Adobe Inc(Adobe公司)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出放置语义框架,通过分析不同并行策略在设备上的状态放置方式,统一了多种分布式训练方法,实现了对内存和通信成本的准确预测。

Comments 8 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21394 2026-01-06 cs.AI 70%

AI Compute Architecture and Evolution Trends

人工智能计算架构与演进趋势

Bor-Sung Liang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出七层人工智能计算架构模型,分析了大型语言模型演进的三个阶段及各层技术发展与影响。

Comments 33 pages, 17 figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17229 2026-01-06 cs.CV 67%

Video Detective: Seek Critical Clues Recurrently to Answer Question from Long Videos

视频侦探:通过反复寻找关键线索来回答长视频中的问题

Henghui Du, Chunjie Zhang, Xi Chen, Chang Zhou, Di Hu

机构 * Gaoling School of Artificial Intelligence(北京中国人民大学人工智能学院) Renmin University of China(中国人民大学) AI Technology Center Online Video Business Unit(人工智能技术中心在线视频业务部) Tencent PCG(腾讯PCG)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 VideoDetective通过问题感知的记忆机制,使大语言模型能高效处理长视频问答任务,减少计算资源消耗并提升关键信息提取能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07554 2026-01-06 cs.IR 50%

A Multi-Task Embedder For Retrieval Augmented LLMs

为检索增强型大语言模型提供多任务嵌入器

Peitian Zhang, Shitao Xiao, Zheng Liu, Zhicheng Dou, Jian-Yun Nie

专题命中 长上下文与记忆 :LLM(abstract)

AI总结 LLM-Embedder通过引入排名感知奖励和分级蒸馏,统一多任务检索增强,提升大语言模型在多种下游任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏