arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4847 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4847 篇

2608.08569 2026-08-11 cs.AI cs.SD 新提交 70%

VoxZip: Semantic-Anchored Temporal KV Cache Compression for Long-Context Audio Inference

VoxZip:面向长上下文音频推理的语义锚定时序KV缓存压缩

Wenxu Jia, Dongjie Fu, Xize Cheng, Fangming Feng, Linjun Li, Wenshi Chen, Yingming Li, Zhou Zhao, Tao Jin

机构 * Zhejiang University(浙江大学) Meituan(美团)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对语音大语言模型长上下文推理的KV缓存内存瓶颈,提出无训练两阶段语义锚定框架VoxZip,在多音频基准上实现高效压缩,维持高性能并提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08077 2026-08-11 cs.AI cs.MA cs.RO 新提交 70%

Explore, Map, Remember, Decide: Are Embodied VLMs Ready for Safety-Critical Scenarios?

探索、建图、记忆、决策:具身视觉语言模型是否已准备好应对安全关键场景?

Gabriele La Malfa, Nitay Alon, Emanuele La Malfa, Reuth Mirsky, Stefan Sarkadi

专题命中 长上下文与记忆 :language model(abstract,abstract_cn);分类 cs.AI

AI总结 本文扩展ToS框架为EMRD流程,评估VLMs在安全关键场景下的空间理解与决策能力,发现其决策依赖文本先验、空间推理受低光照影响,且记忆与人类认知存在根本差异,存在对齐风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07915 2026-08-11 cs.LG 新提交 70%

SPECTRA: Pushing the KV Cache Beyond the 2-Bit Cliff via Spectral Transform Coding

SPECTRA:通过谱变换编码将KV缓存推向2比特极限之外

Jiamu Zhang, Liang Wu, Kelly Wan, Hanjie Chen, Liangjie Hong

机构 * Nokia(诺基亚) Rice University(莱斯大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 SPECTRA是一种无需训练的KV缓存压缩编解码器,通过谱变换编码将比特预算集中于关键通道,在Llama-3.1-8B等模型上实现最高12倍压缩,突破2比特极限,提升长上下文处理能力

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28126 2026-08-11 cs.AI 版本更新 70%

ConMem: Contribution-Aware Memory for Long-Horizon Manufacturing Inspection Logs

ConMem:面向长周期制造检查日志的贡献感知记忆

Bingchen Liu, Yuanyuan Fang, Lei Liu, Guangyuan Dong, Xing Fu, Yuanyuan Gao, Shuyue Wei, Xin Li, Xiangtian Meng

机构 * Shandong University(山东大学) Boston University(波士顿大学) North China Electric Power University(华北电力大学) National University of Singapore(新加坡国立大学) Joint SDU-NTU Centre for Artificial Intelligence Research (C-FAIR), Shandong University(山东大学-南洋理工大学人工智能联合研究中心(C-FAIR)) Rizhao Steel Holding Group Co., Ltd.(日照钢铁控股集团有限公司)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对长周期制造检查日志的早期风险筛查需求,提出ConMem贡献感知记忆框架,通过Shapley风格评估保留高价值证据,在真实数据集上实现76.0% QA准确率,大幅减少输入token数与响应时间,可有效保留弱早期信号并提供预警。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21379 2026-08-11 cs.NE cs.AI 版本更新 70%

How to Build Marcus's Algebraic Mind: Algebro-Deterministic Substrate over Galois Fields

如何构建马库斯的代数心智:基于伽罗瓦域的代数确定性介质

Hiroyuki Chuma, Kanji Otsuk, Yoichi Sato

机构 * Institute of Innovation Research, Hitotsubashi University(立命馆大学创新研究所) Meisei University(立命馆大学) Shuhari System(Shuhari系统)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种基于伽罗瓦域的代数确定性介质,实现了马库斯提出的三种认知架构核心要素,并展示了该架构在逻辑推理和语义区分方面的应用。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02704 2026-08-11 cs.CL 版本更新 70%

InfMem: Learning System-2 Memory Control for Long-Context Agent

InfMem: 面向长上下文智能体的系统2记忆控制

Xinyu Wang, Mingze Li, Peng Lu, Xiao-Wen Chang, Lifeng Shang, Jinping Li, Fei Mi, Prasanna Parthasarathi, Yufei Cui

机构 * McGill University(麦吉尔大学) Noah's Ark Lab(诺亚实验室)

专题命中 长上下文与记忆 :SFT(abstract,abstract_cn);分类 cs.CL

AI总结 InfMem通过预思考-检索-写作协议实现系统2风格的控制,有效提升超长文档推理的准确率并减少推理时间。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05784 2026-08-07 cs.AI 新提交 70%

Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay

活动帧:面向智能体记忆与回放的确定性屏幕活动编译

Nossa Iyamu

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出确定性零模型流水线将屏幕活动编译为智能体记忆,可缩小上下文体积、提升问答准确率,还能获取智能体成本模型所需的例程开销比率与重复率等参数,相关资源开源。

Comments 14 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10921 2026-08-07 cs.CL 版本更新 70%

Trace Only What You Need: Structure-Aware On-Demand Hypergraph Memory for Long-Document Question Answering

仅追踪所需:面向长文档问答的结构感知按需超图记忆

Xiangjun Zai, Xingyu Tan, Chen Chen, Xiaoyang Wang, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) CSIRO(澳大利亚联邦科学与工业研究组织) University of Wollongong(伍伦贡大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出DocTrace,一种多智能体RAG框架,通过查询触发的知识组织、文档结构感知和经验引导推理,解决长文档问答中知识组织成本高、结构利用不足和推理经验无法复用的问题,在三个数据集上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04753 2026-08-06 cs.LG 新提交 70%

Attention, Anomalies! Handling Attention Layers in Unsupervised Federated Outlier Detection

注意力,异常点!处理无监督联邦离群点检测中的注意力层

Mihailo Ilić, Miloš Savić, Vladimir Kurbalija, Mirjana Ivanović, Giancarlo Fortino, Dušan Jakovetić

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究针对联邦学习中记忆增强自编码器缺乏专用聚合技术的问题,提出新颖的引导式聚合方案,在非IID数据集上验证其对无监督异常检测的鲁棒性,可提升浅层自编码器性能并适配资源受限环境。

Comments Submitted to the 4th IEEE International Conference on Federated Learning Technologies and Applications (FLTA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04746 2026-08-06 cs.CL cs.IR 新提交 70%

Caching for the Future: Scrub Jay Episodic Memory Principles for Agent Memory Systems

面向未来的缓存:用于智能体记忆系统的灌丛鸦情景记忆原理

Kartikey Singh Bhandari, Aarya Wadhwani, Dhruv Kumar, Pratik Narang

机构 * Birla Institute of Technology and Science, Pilani(比拉理工学院皮拉尼分校)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究借鉴灌丛鸦情景记忆原理,提出ScrubJay-MEM智能体记忆系统,通过类型条件时间衰减优化记忆管理,在TGT和MemoryAgentBench任务上取得优于现有方法的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04574 2026-08-06 cs.CL 新提交 70%

When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

当记忆“说谎”:VLM智能体中空间记忆过时的实证研究

Yushi Sun, Yanjie Zhang

机构 * Tencent LIGHTSPEED(腾讯光速工作室)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究通过动态FrozenLake测试平台,探究了VLM智能体的空间记忆过时问题,发现文本可解性不代表视觉接地、信任过时记忆存在安全隐患、审核无法完全消除差距,明确了相关核心挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04505 2026-08-06 cs.CL 新提交 70%

K-EXAONE 2.0 Technical Report

K-EXAONE 2.0 技术报告

Eunbi Choi, Kibong Choi, Sehyun Chun, Seokhee Hong, Junwon Hwang, Hyojin Jeon, Ahra Jo, Hyunjik Jo, Yeonsik Jo, Minhyeok Jung, Doyoung Kim, Heegyu Kim, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Yongil Kim, Byungoh Ko, Changhun Lee, Dohaeng Lee, Haeju Lee, Jinsik Lee, Kyungmin Lee, Minwoo Lee, Wonkee Lee, Sangha Park, Sungjune Park, Kwangrok Ryoo, Kijung Seo, Minju Seo, Yongwoo Song, Sejong Yang, Heuiyeen Yeen, Stanley Jungkyu Choi, Yemuk Choi, Yongchan Chun, Jiwon Ham, Dasol Hong, Sujeong Im, Kijeong Jeon, Gerrard Jeongwon Jo, Hyeongjun Jo, Yujin Jo, Jiyeon Jung, Naeun Kang, Daeseong Kim, Euisoon Kim, Hayeon Kim, Hyosang Kim, Myoungshin Kim, Unsol Kim, Youchul Kim, Chaeeun Lee, ChaeYoon Lee, Edward Hwayoung Lee, Honglak Lee, Hwansoo Lee, Minkyung Lee, Sangeun Lee, Solji Lim, Woohyung Lim, Chanwoo Moon, Jueun Mun, Jimin Park, Seojeong Park, Yongmin Park, Hyerin Seo, Donghyeon Shin, Donghyun Son, Eunyong Son, Kaehyun Um, Sihoon Yang, Chang En Yea, Sihyuk Yi, Kyungjae Yoo, Chansik Yoon

机构 * LG AI Research(LG AI研究院)

专题命中 长上下文与记忆 :foundation model(abstract);post-training(abstract);分类 cs.CL

AI总结 该报告介绍LG AI Research开发的K-EXAONE 2.0,这是一款7500亿参数的MoE多语言基础模型,经升级前代模型而来,支持25.6万token上下文,在多类评估中表现优异,以Apache 2.0许可发布,助力AI生态发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03062 2026-08-05 cs.AI cs.GR cs.SE 新提交 70%

TraceCAD: Trace-Guided Repair for Agentic CAD Generation

TraceCAD:面向智能体CAD生成的轨迹引导修复

Fengxiao Fan, Jingzhe Ni, Fan Sang, Xiaolong Yin, Yu Liu, Ruofeng Tong, Min Tang, Peng Du

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 TraceCAD是一种用于智能体CAD生成的轨迹引导修复方法,通过引入持久状态等机制提升了CAD生成的几何质量与修复可靠性,在DeepCAD基准测试中取得了良好效果。

Comments 18 pages, 7 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02843 2026-08-05 cs.CR cs.AI 新提交 70%

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem:持久智能体内存中的密码学授权突变

Walid Saidi

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究针对持久智能体内存的授权与防篡改问题,提出HOM-AIMOS中的MutMem协议,经实验验证其在多个基准任务中表现良好,可有效抵御中毒攻击。

Comments https://github.com/wallidsaydi-creator/HOM-AIMOS. 32 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01679 2026-08-05 cs.AI 版本更新 70%

When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidation Boundary

当记忆成为权威:在记忆整合边界处对权威崩溃进行基准测试

Qiuyang Zhan, Rui Zhang, Sheng Guo, Lepeng Zhao, Zhuotao Liu

机构 * Tsinghua University(清华大学) East China Normal University(华东师范大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究推出AuthMem-Bench基准,发现智能体记忆整合存在权威崩溃问题,自动保留权威标签可大幅降低未授权动作率,证明记忆适配需同时保留权威信息。

Comments 38 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01995 2026-08-04 cs.AI 新提交 70%

Long-Horizon Autonomous Architecture Research with a Language-Model Agent: A Behavioural Case Study

基于语言模型智能体的长时自主架构研究:一项行为案例研究

Aon Safdar, Mohamed Saadeldin

机构 * University College Dublin(都柏林大学学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究以语言模型智能体为唯一研究者开展长时神经架构设计案例,经三阶段约100次实验改进了视觉Transformer,揭示其生产力阶段结构等四项发现,提出自主研究的未来方向。

Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01708 2026-08-04 cs.CL 新提交 70%

PGMem: Tightly Coupled Persona-Memory Graph for Lifelong Personalized Agents

PGMem:用于终身个性化智能体的紧耦合角色记忆图

Wonjun Choi, Yerim Kim, Yukyung Lee, Susik Yoon

机构 * Korea University(高丽大学) Boston University(波士顿大学)

专题命中 长上下文与记忆 :language model(abstract);small language model(abstract);分类 cs.CL

AI总结 该研究针对现有对话智能体记忆系统的角色与事件松散耦合问题,提出PGMem异构角色记忆图,通过溯源边关联角色与事件,在多个基准测试中性能优于多种基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01637 2026-08-04 cs.AI 新提交 70%

Salami Attack: Stealthy Collusive Memory Poisoning against OpenClaw

Salami攻击:针对OpenClaw的隐蔽合谋式内存投毒

Zheng Lin, Yuzhe Huang, Zhenxing Niu, Xianmin Ye, Haichang Gao

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对OpenClaw,提出MemCollusion框架,采用Salami策略生成合谋式内存投毒攻击,在48种场景下平均内存保存率81.3%、攻击成功率75.0%,可应对良性内存稀释与内存级防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01619 2026-08-04 cs.AI 新提交 70%

When Memory Updates but Behavior Does Not: Repairing Implicit Stale Dependencies in Personalized Agent Responses

当记忆更新但行为未更新时:修复个性化智能体响应中的隐式陈旧依赖

Haofei Sun, Lin He

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对智能体存在的隐式陈旧依赖问题,提出StateAuditor反向审计方法,在STALE基准上实现显著性能提升,验证了转换机制对修复IPA缺口的有效性。

Comments 9 pages, 4 figures; supplementary material in ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01614 2026-08-04 cs.CV cs.AI 新提交 70%

Linear Multi-Timescale Retention as a Memory-Efficient Vision-Language Bridge

线性多时间尺度保留作为内存高效的视觉-语言桥梁

Ashfak Yeafi, Mehedi Hasan, Md Khairul Islam

专题命中 长上下文与记忆 :language model(abstract);instruction tuning(abstract);分类 cs.AI

AI总结 该研究针对视觉-语言模型高分辨率图像处理的内存瓶颈,提出线性多时间尺度保留模块,兼具O(N)复杂度与上下文路由能力,在长序列任务、硬件效率及MME基准上均优于MLP基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00528 2026-08-04 cs.CL 新提交 70%

S$^4$R: Selective Sampling, Subspaces, and Sparse Reconstruction for Compressed Long-Context KV Caching

S$^4$R:用于压缩长上下文KV缓存的选择性采样、子空间与稀疏重构

Jialong Han, You Wu, Kewei Tu

机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程研究中心)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 S$^4$R通过选择性采样token构建低秩子空间、稀疏重构KV表示,在LongBench等数据集上实现最高5倍KV压缩且接近全缓存准确率,兼顾压缩效率与提示词适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00028 2026-08-04 cs.MA cs.AI 新提交 70%

Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems

宽度、内存与延迟:扁平多智能体系统的资源限制核算

Oleksandr Kuznetsov, Emanuele Frontoni

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对扁平多智能体系统,构建了基于宽度、内存、延迟的定量资源模型,反驳了其存在不可约因果下限的结论,明确资源不可替代性并给出设计规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10429 2026-08-03 cs.MA cs.AI 版本更新 70%

AIvilization v0: Toward Large-Scale Artificial Social Simulation with a Unified Agent Architecture and Adaptive Agent Profiles

AIvilization v0:迈向大规模人工社会模拟的统一代理架构与自适应代理档案

Wenkai Fan, Shurui Zhang, Xiaolong Wang, Haowei Yang, Tsz Wai Chan, Xingyan Chen, Junquan Bi, Zirui Zhou, Jia Liu, Kani Chen

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Bauhinia AI

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 AIvilization v0通过统一代理架构和自适应代理档案,实现大规模人工社会模拟,解决目标稳定性与反应正确性矛盾,支持长周期自主性和多目标环境下的稳健性。

Comments v2: major revision. Agent architecture and environment consolidated into self-contained sections; new problem-setting section formalizing the asynchronous event model; evaluation reorganized by experiment with results reported alongside each protocol; added action-simulator audit, and human-steering analyses; other sections rewritten

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27919 2026-07-31 cs.CL 新提交 70%

Memory Decoder at Scale: A Pretrained, Parametric Long-Term Memory

规模化的记忆解码器:一种预训练的参数化长期记忆

Rubin Wei, Jiaqi Cao, Jiarui Wang, Junming Zhang, Qipeng Guo, Bowen Zhou, Zhouhan Lin

专题命中 长上下文与记忆 :language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 本研究将记忆解码器扩展至69亿参数并在3000亿token上预训练,通过分布式Faiss等技术解决索引瓶颈,发现独立扩展记忆可更高效提升语言模型性能,在多基准测试中验证了其优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27080 2026-07-30 cs.CR cs.AI 新提交 70%

MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair

MemSecBench:追踪智能体内存中毒从持久性到后果及修复的全生命周期

Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究提出MemSecBench基准测试,通过24种配置的实验发现不同内存系统栈在智能体内存中毒的持久性、后果及选择性修复上存在显著差异,为智能体内存安全评估提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13097 2026-07-30 cs.PL cs.AI 版本更新 70%

Functional Cache Grafting: Robust and Rapid Code-Policy Synthesis for Embodied Agents

功能缓存嫁接:具身智能体的鲁棒且快速代码策略合成

Saehun Chun, Wonje Choi, Sera Choi, Sanghyun Ahn, Honguk Woo

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出FCGraft框架,通过维护函数级验证代码骨架及其键值缓存,对新任务进行缓存嫁接(拼接和修补),减少预填充计算并复用验证结构,实现更鲁棒和快速的策略合成。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25816 2026-07-29 cs.AI 新提交 70%

Speculate While You Reason: Teaching Agents to Predict Their Next Tool Call via Joint Agent-Speculator RL

推理时进行推测:通过联合智能体-推测器强化学习教智能体预测其下一个工具调用

Jiabao Ji, Yujian Liu, Li An, Rohit Jain, Gungor Polatkan, Siyu Zhu, Shiyu Chang

机构 * University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校) Linkedin Inc(领英公司)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对大型语言模型智能体等待工具调用结果时间长的问题,提出联合智能体-推测器强化学习方法,统一智能体和推测器为自推测智能体,复用缓存,提升了Qwen不同模型下一个工具调用的Hit@1指标及任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25032 2026-07-29 cs.SE cs.AI 新提交 70%

Authoring Agent Skills: A Software-Engineering Approach

编写智能体技能:一种软件工程方法

Giuseppe Destefanis

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究如何编写智能体技能,遵循软件工程原则,以Claude Code为参考实现阐述技能结构等,与其他塑造智能体行为机制比较并给出选择规则,还介绍评估驱动编写过程等,为智能体技能编写提供方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24873 2026-07-29 cs.AI cs.SD 新提交 70%

MusiChat: Vibe Composing for Music Creation

MusiChat:用于音乐创作的氛围作曲

Callie C. Liao, Duoduo Liao, Ellie L. Zhang

机构 * Stanford University(斯坦福大学) George Mason University(乔治梅森大学) IntelliSky(智能天空)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对AI音乐创作中迭代难问题,提出MusiChat系统,通过分层可控框架、记忆增强架构及混合意图路由机制,实现人机协作音乐创作,经评估在交互准确率和用户喜好比例上表现良好,支持多轮音乐创作和人机共创。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24331 2026-07-28 cs.LG 新提交 70%

DynaCalKV: Key-Value Cache Compression via Head Grouping and Adaptive Rank Allocation

DynaCalKV:通过头部分组和自适应秩分配实现键值缓存压缩

Tan T. Nguyen, Quan V. Dang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对大语言模型KV缓存瓶颈问题,提出DynaCalKV框架,通过基于CKA相似性动态分组注意力头并自适应分配秩预算处理键缓存,值缓存采用ReCalKV方法优化,实验表明能减少键缓存参数且保持准确率,对MHA模型效果好,对GQA模型应用需更谨慎。

详情

展开后加载摘要…

URL PDF HTML 收藏