OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching
OasisKV:通过前瞻稀疏预取将解码中KV缓存扩展至HBM之外
专题命中 其他推理 :reasoning(abstract)
AI总结 针对LLM推理中HBM容量受限问题,提出以内存为中心的OasisKV系统,通过前瞻稀疏预取技术解耦KV缓存存储与HBM,在精度损失极小的情况下显著提升推理吞吐量并降低内存占用。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
OasisKV:通过前瞻稀疏预取将解码中KV缓存扩展至HBM之外
专题命中 其他推理 :reasoning(abstract)
AI总结 针对LLM推理中HBM容量受限问题,提出以内存为中心的OasisKV系统,通过前瞻稀疏预取技术解耦KV缓存存储与HBM,在精度损失极小的情况下显著提升推理吞吐量并降低内存占用。
从以用户为中心的设计到人机协作:人机交互的未来为何仍以人作为起点
专题命中 其他推理 :reasoning(abstract)
AI总结 本文提出GenAI应作为人类协同思考伙伴而非HCD方法替代品,指出HCI未来需聚焦保留人类能动性、批判性思维与责任的人机协作。
Comments 4 pages, 1 figure. Accepted to the CHIWORK 2026 Workshop: Interrogating GenAI Augmentation for CHIworkers
MemoryCPT:用于成本-性能权衡的端到端智能体记忆框架
专题命中 其他推理 :reasoning(abstract)
AI总结 MemoryCPT是一种端到端可训练的智能体记忆框架,通过QAD和QAR阶段优化记忆处理,在LoCoMo和LongMemEval数据集上实现了更优的成本-性能权衡。
区块链赋能的可信智能体网络:基础、分类与未来方向
专题命中 其他推理 :reasoning(abstract)
AI总结 本文综述从经典多智能体系统到开放智能体网络的演化,构建五维信任分类,明确区块链作为共享信任层为可信智能体网络提供多类支撑机制。
RUTA:基于率-效用优化的原则性视觉令牌分配方法
机构 * City University of Hong Kong(香港城市大学) ; Google Inc.(谷歌公司)
专题命中 其他推理 :reasoning(abstract)
AI总结 针对视觉语言模型因长视觉令牌序列导致的LLM侧计算和内存成本过高问题,提出RUTA方法,仅用2.0%、4.2%的视觉令牌,分别在LLaVA-NeXT-7B、Qwen3-VL-8B上保留88.2%、94.4%的任务性能。
人工制度:制度设计如何塑造大语言模型(LLM)模拟
专题命中 其他推理 :reasoning(abstract)
AI总结 本文研究LLM智能体构建的人工社会,通过控制变量实验发现,五种市场制度的规则差异会显著改变市场结果,证明制度架构对人工社会模拟的重要影响。
Comments 19 pages, 2 figures, 2 tables
MalTotal:面向数百万代码仓库的高性价比、语言无关型恶意代码投毒检测方法
专题命中 其他推理 :reasoning(abstract)
AI总结 本文提出MalTotal框架,可跨5种主流语言检测恶意代码,F1值达93.1%,成本大幅降低,在12万个GitHub仓库中发现564个未知恶意仓库,适用于大规模多语言场景。
Comments Accepted by ISSTA'26
基于临床依据的分层分类用于一致性胸部X射线影像解读
机构 * Yeji X(艺智X)
专题命中 其他推理 :reasoning(abstract)
AI总结 本研究针对胸部X射线解读的层级特性,提出CHASE框架,通过三级分类与多层级优化,提升了预测的一致性与性能。
Comments MICCAI 2026 Accepted. First & Corresponding author: Jong Hak Moon (jh.moon@yejix.com)
更好、更强、更快、更广泛:基于多模态大型语言模型(MLLM)的结构化全掩码预测分割
机构 * The Hong Kong University of Science and Technology (HKUST)(香港科技大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 STAMPlus通过结构化全掩码预测解耦自回归对话与非自回归掩码预测,解决了MLLM分割的三难问题,在提升性能的同时降低延迟,实现多类开放词汇等分割任务的SOTA表现。
十年深度学习在无线通信中的应用:从学习模块到可部署的无线智能
专题命中 其他推理 :reasoning(abstract)
AI总结 本文梳理了十年间深度学习在无线通信领域从替代孤立模块到开发无线智能的三次转变,指出未来无线AI发展需结合物理基础、智能体能力与标准化机制。
LongHorizon-Harness:推进面向真实世界任务的长时程智能体
机构 * Alibaba Group(阿里巴巴集团)
专题命中 其他推理 :reasoning(abstract)
AI总结 本研究提出LongHorizon-Harness框架,通过MEA循环等设计解决长时程智能体的状态追踪与错误传播问题,在多个基准测试中显著提升了Qwen、Claude等模型的表现。
Comments 29 pages
结合先进深度学习技术的优势,从无人机影像中评估灾后建筑物损毁情况
机构 * KDDI Research, Inc.(KDDI研究所)
专题命中 其他推理 :reasoning(abstract)
AI总结 本文提出将CV模型与LVLM结合的混合框架,在RescueNet、FloodNet基准上评估,可准确统计灾后建筑物损毁情况,性能优于单独基准模型且仅需少量标注数据,相关资源公开。
Comments Accepted at ECMLPKDD 2026, 31 pages (including appendix), 18 figures
HorizonServe:面向全模态模型服务的请求调度与GPU共享协调系统
专题命中 其他推理 :reasoning(abstract)
AI总结 HorizonServe是一款单GPU全模态模型服务系统,通过协调请求准入与GPU分配,提升了SLO达成率并降低了首响应延迟,解决了全模态模型统一部署的调度问题。
变异规避:基于知识驱动多智能体编排的自主端点规避
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对商用EDR系统的自动化弹性评估难题,提出AutoBypass多智能体框架,经实验可高比例绕过多款商用EDR,还能提升开源模型的规避成功率。
面向KV缓存的互联网:在大语言模型推理时代重新思考经典基础设施边界
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究提出面向KV缓存的互联网愿景,主张跨云与数据中心解耦计算与KV缓存存储,将KV缓存管理作为内容分发系统,以最小化大语言模型推理的延迟与成本。
氛围建模的必要性:基于AI的可信软件开发中缺失的一环
专题命中 其他推理 :reasoning(abstract)
AI总结 本文提出在AI辅助软件开发中引入氛围建模作为轻量中间抽象,通过学生调查验证其在提升LLM输出理解、降低验证工作量及增强信任方面的潜力,为可信AI软件工程研究提供方向。
Comments 7 pages, 1 figure
从理解到行动:面向生成式推荐的反馈驱动策略发现
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对生成式推荐的“理解-行动差距”,提出反馈驱动智能体框架,经蒸馏迁移至轻量模型实现无LLM在线推理,在基准测试与在线A/B测试中均取得推荐效果提升。
CHARGE:利用CWE层次结构生成硬件安全SystemVerilog断言
专题命中 其他推理 :reasoning(abstract)
AI总结 CHARGE是利用CWE层次结构和LLM生成硬件安全SVA的自动化框架,在Hack@DAC系列SoC设计中检测到多个已知与新错误,生成的SVA具备较高有效性。
Comments This paper is an extended version of the paper accepted to the IEEE/ACM International Conference on Computer-Aided Design (ICCAD 2026)
推理前校准:针对视觉语言模型中语义漂移的鲁棒视觉令牌缩减
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对VLMs的语义漂移问题,提出无训练的CaRe框架,通过两个互补模块校准视觉表示,在剪枝94.4%视觉令牌时保留96.4%原性能,使推理速度提升最高2.30倍。
通过个性化自然语言恢复语义-ID生成式推荐中的协同信号
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对基于LLM的生成式推荐模型中SID丢失协同信号导致准确率受限的问题,提出个性化自然语言引导的框架,通过添加分层协同线索恢复信号,提升推荐准确率。
Comments 8 pages, 4 figures
多人离散出价博弈:确定性、均衡性与复杂性
专题命中 其他推理 :reasoning(abstract)
AI总结 本文研究多人离散出价博弈,证明其在温和假设下具有确定性,均值收益博弈存在值,定性博弈存在纯纳什均衡,且可达性博弈中判断联盟获胜的问题为PSPACE-hard。
Veritas++:面向感知增强的AIGI检测的值感知在线策略蒸馏
机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences (UCAS)(中国科学院大学先进交叉科学学院) ; Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所) ; School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院) ; Ant Group(蚂蚁集团) ; Sangfor Technologies Inc.(深信服科技股份有限公司)
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对现有AIGI检测模型的感知瓶颈,提出Veritas++框架,通过PoRL与VaOPD机制增强感知能力,提升了检测泛化性与效率。
SCALPEL:基于大语言模型驱动的编码器学习的医学视觉-语言语义跨模态对齐框架
机构 * School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机学院)
专题命中 其他推理 :reasoning(abstract)
AI总结 针对现有医学视觉-语言预训练的三大瓶颈,本文提出SCALPEL框架,通过临床报告对比微调、非对称对齐策略及解剖-否定感知目标,在三大医学基准上实现了多项任务的最优性能。
Comments 14 pages, 3 figures, accepted by PRCV2026
熟能生巧:从零人类演示中引导与整合机器人能力
专题命中 其他推理 :reasoning(abstract)
AI总结 本研究提出HERO自改进层级具身智能体,通过整合启发式推理等技术,实现机器人从零人类演示自主演进操作能力,减少数据收集人工干预并提升多样化任务操作稳健性。
从角色提示到无限思考:利用角色条件进行大语言模型推理成本攻击
专题命中 其他推理 :reasoning(abstract)
AI总结 研究LLMs推理成本问题,提出RolePlay框架利用角色条件诱导低效行为放大推理成本,实验证明该框架优于现有方法,为LLM推理效率攻击提供新视角。
Comments 17pages
中间的模型:迈向人工智能原生实时通信
专题命中 其他推理 :reasoning(abstract)
AI总结 研究迈向人工智能原生实时通信,提出将模型视为有状态计算中间盒的新观点,探索网络感知推理调度等三个跨阶段协调机会,构建Conflux验证,结果显示在网络退化时响应延迟等有改善,呼吁建立相关实时通信堆栈。
ALIBI:通过对抗性代码注释对基于大语言模型的漏洞检测器进行自适应智能体攻击
专题命中 其他推理 :reasoning(abstract)
AI总结 研究如何通过对抗性代码注释对基于大语言模型的漏洞检测器进行自适应智能体攻击,提出ALIBI框架,将现实世界漏洞修复提交转换为编码任务评估多个检测器,发现其高度易受攻击,揭示攻击面并推动安全意识设计。
凝视到文本生成:超越人类注意力的分类解码
机构 * Stony Brook University(纽约州立大学石溪分校) ; Australian Institute for Machine Learning(澳大利亚机器学习研究所) ; Adelaide University(阿德莱德大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究提出将凝视解码为自然语言描述人类目标的新问题,构建Gazette框架,基于多模态大语言模型,利用新颖策略合成出声思考转录本并指令调优,使其在多任务凝视解码中达最优性能,能推断多样场景下人类目标意图。
Comments To appear in European Conference on Computer Vision (ECCV) 2026
StateAct:在像素之前的程序状态,用于长期计算机使用代理
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对计算机使用代理,提出基于程序状态的StateAct多代理框架,主要代理用代码处理状态,GUI子代理辅助,支持验证,在OSWorld 2.0上提升了Claude Opus 4.8的成功率,且成本降低,实现从感知到推理的瓶颈转移。
PCA:用于快速视频大语言模型的持久性感知压缩与聚合
机构 * Institute for Artificial Intelligence, Great Bay University(大湾区大学人工智能研究院) ; Sun Yat-sen University(中山大学) ; Youtu Lab, Tencent(腾讯优图实验室) ; Shenzhen University(深圳大学) ; Dongguan Key Laboratory for Intelligence and Information Technology(东莞市智能信息技术重点实验室)
专题命中 其他推理 :reasoning(abstract)
AI总结 研究视频大语言模型长时帧冗余问题,提出PCA方法,含动态下采样和持久性感知运动增强模块,能在编码前保留视觉信息,提升效率与准确性,优于现有方法,速度有显著提升。
Comments Accepted by ACM MM 2026