YAVIN: A Unified Architecture for Secure Edge Processing in Memory
YAVIN:面向安全边缘内存处理的统一架构
专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn)
AI总结 针对边缘计算中多租户安全执行及内存处理的挑战,提出将TEE扩展至内存的YAVIN架构,实现后量子密码与认证加密的PIM协同设计,在量化LLM执行时获超20倍加速且开销极低。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
YAVIN:面向安全边缘内存处理的统一架构
专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn)
AI总结 针对边缘计算中多租户安全执行及内存处理的挑战,提出将TEE扩展至内存的YAVIN架构,实现后量子密码与认证加密的PIM协同设计,在量化LLM执行时获超20倍加速且开销极低。
面向多模态认知的分层能量基模型
专题命中 长上下文与记忆 :LLM(abstract_cn);language model(abstract);分类 cs.AI
AI总结 该研究提出IM-LEPP多模态能量基模型,扩展单模态LEPP整合视觉与语言,能解释注意现象、复现心理语言学发现,还与Transformer模型形成可证伪对比并提出实验预测。
Comments 48 pages, 14 figures
vToken:用于可回收KV缓存的令牌级虚拟化技术
机构 * National University of Defense Technology(国防科技大学) ; Peking University(北京大学)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI
AI总结 vToken是一种轻量级令牌级虚拟化层,可解耦逻辑令牌活性与物理块放置,在保留PagedAttention兼容性的同时,提升KV缓存回收效率与服务吞吐量,降低策略集成代码量。
变压器动力学中的红外组织与临界认知场形成
机构 * Electronics and Telecommunications Research Institute(电子和电信研究所)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG
AI总结 研究大语言模型中Transformer动力学集体行为的物理机制,利用Pythia语言模型提取弛豫谱,定量测量相关指标,发现其动力学受红外集体组织支配,红外慢模式组织是普遍集体原则。
Comments 55 pages, 47 figures
预测随机低维重参数化何时能训练神经网络
机构 * Tsinghua University(清华大学) ; The University of Manchester(曼彻斯特大学) ; University of Kentucky(肯塔基大学) ; Miami University(迈阿密大学) ; University of Dayton(代顿大学) ; Institute for Biomedical Informatics, University of Kentucky(肯塔基大学生物医学信息学研究所)
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究针对随机低维重参数化训练神经网络的潜在空间规模问题,提出取向分辨二次主公式,引入RaMaN模型,实现内存优化,实验验证其预测与转换跟踪性能优于取向无关近似。
优化器状态应存于何处?内存高效的专家混合训练分层状态分配
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG
AI总结 研究MoE训练中优化器状态存储位置,提出SkewAdam方法,根据参数群体差异分层分配状态,大幅减少内存占用,提升训练效率,验证了优化器状态存储位置对训练效果的重要性。
Comments 12 pages, 4 figures, 9 tables. v2: adds Adam-mini discussion, learning-rate sweeps with repeated seeds for the AdamW and Adafactor baselines, and a tier ablation; corrects the attribution of the perplexity advantage between momentum and the factored estimator. Code and per-run training logs: https://github.com/nuemaan/skewadam
当局部方差最优性不足时:用于动态4比特量化的RoPE对齐Q/K旋转
专题命中 长上下文与记忆 :post-training(abstract);分类 cs.LG
AI总结 本文针对动态4比特量化,研究RoPE对齐的Q/K旋转,推导了相关旋转角度,发现结构化代理最优性在与量化器尺度统计量不匹配时无法降低量化误差。
空间记忆智能体:用于空间智能的基于经验的过程记忆
机构 * Zhejiang University(浙江大学) ; Shanghai Jiao Tong University(上海交通大学) ; Shanghai Innovation Institute(上海创新研究院)
专题命中 长上下文与记忆 :post-training(abstract);分类 cs.AI
AI总结 该研究提出SMA框架,让冻结VLM智能体无需外部空间工具,通过无参数更新自进化提升空间推理,在多基准和模型上表现最优,提供了空间自进化的实用路径。
Comments Under Review
受控持久内存:长程智能体的源绑定状态语义与故障关闭式释放
机构 * Qingdao Guodongxiansheng Network Technology Co., Ltd.(青岛果动先生网络科技有限公司)
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI
AI总结 本文针对长程智能体内存的矛盾记录问题,提出受控持久内存(GPM)模型,经多组基准测试与服务评估,其在GPM-ReleaseBench、中英文指令分支等场景均实现零不匹配,修复大量基线故障且无退化。
Comments 23 pages, 2 figures, 11 tables. Includes a sealed end-to-end governed-memory service evaluation with an ungoverned local Qwen2.5-7B comparison
MARCH:通过内容路由状态锚点扩展循环记忆
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Tsinghua University(清华大学) ; Fudan University(复旦大学)
专题命中 长上下文与记忆 :pretraining(abstract);分类 cs.LG
AI总结 本文提出MARCH架构,通过内容路由状态锚点扩展循环记忆,在长序列上保持计算效率,经预训练后在多个长程任务中优于线性注意力变体,增强了循环长程记忆能力。
私人词源:设计长期人机交互中共享符号的关系性复用
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI
AI总结 该论文提出Private Etymology关系溯源模型,整合现有思路形成持久可修正的人机关系符号单元,以支持对话智能体在长期人机交互中安全复用特定二元组的符号表达。
Comments Added a link to the Apple Watch prototype "MikasaWatch" demonstration video on 10 page
不想让你的大语言模型(LLM)推荐核打击?试试用日语提问
专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究发现,用日语提问可降低部分LLM在核打击场景中的发动率,其机制为模型的推理语言而非输入语言,且仅适用于在英语中已存在犹豫的模型,表明LLM安全行为具语言依赖性。
Journal ref Proceedings of the 6th Workshop on Trustworthy NLP (TrustNLP 2026), Jul 2026, San Diego, United States. pp.489-502
通过大语言模型的战略搜索实现自动化设计优化
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG
AI总结 本研究提出AUTO框架,利用大语言模型的战略搜索实现GPU代码优化,提升搜索效率并降低成本。
Comments 16 pages, 4 tables, 8 figures, preprint
AaLLM:基于大语言模型的从拓扑生成到尺寸确定的端到端模拟电路设计框架
专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(title);language model(title);分类 cs.AI
AI总结 本文提出AaLLM,一种端到端多智能体LLM工作流,自动完成模拟电路拓扑生成与尺寸确定,可减少SPICE调用次数和运行时间,创新拓扑性能与传统拓扑相当。
保留、定制还是退出:大语言模型推理服务中的默认设计与代币定价
专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究针对LLM推理服务的供需交互建立Stackelberg博弈模型,推导最优解,明确默认设置的影响条件,实验验证模型并展示均衡相关因素。
大语言模型辅助的自动驾驶车辆中攻击者可及软件弱点的动态威胁分析
专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 该研究针对自动驾驶车辆软件弱点的动态威胁分析难题,探究LLM辅助Autoware的自动化测试工件生成,发现构建集成是核心障碍,推理模型编译测试用例的表现优于代码专用模型。
Comments 17 pages, 8 figures, 8 tables
当真相被分散时:错误信息会破坏基于大语言模型(LLM)的多智能体系统中的集体事实恢复
专题命中 推理与问题求解 :LLM(title,title_cn)
AI总结 本研究提出Hi-Agreement评估框架,发现基于LLM的多智能体系统中,关键证据持有者的虚假证词会破坏集体事实恢复,使恢复率从72.50%降至14.17%,且虚假证据会持续传播。
嵌入器的困境:大型语言模型(LLM)性能更优,但代价是什么?
机构 * Harvard University(哈佛大学) ; Stanford University(斯坦福大学)
专题命中 推理与问题求解 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 该研究对比LLM与嵌入模型在37项任务的性能与成本,发现二者性能接近但LLM成本高、速度慢,建议嵌入模型用于通用任务,LLM用于推理密集型检索。
Comments Accepted to COLM 2026
社会视听问答的推理:我们处于什么阶段?
机构 * Inria(法国国家信息与自动化研究所) ; Univ. Grenoble Alpes(格勒诺布尔大学) ; CNRS(法国国家科学研究中心) ; University of Twente(特文特大学)
专题命中 推理与问题求解 :SFT(summary_cn,abstract);large language model(abstract,abstract_cn);language model(abstract,abstract_cn)
AI总结 本文针对社会视听问答研究,发现IntentBench存在高噪声,Vanilla SFT基线性能优于现有推理方法,仅用文本模态即可实现与视频相当的性能,并发布了IntentBench-Prime等资源。
Comments Accepted at HCMIW ECCV workshop. Code available here: https://github.com/koenv759/VanillaSFT
超越最佳猜测:用进化策略提升大语言模型的解决方案覆盖率
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) ; Cognizant AI Lab(高知特人工智能实验室)
专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 该研究针对LLM后训练中RL导致pass@k受限、解决方案覆盖率不足的问题,采用进化策略(ES)方法,提升了pass@k与解决方案覆盖率,在数学基准上取得更好结果,为相关领域后训练提供了更好基础。
Unicode文本水印方法对抗大语言模型的安全性与可检测性分析
机构 * Fraunhofer ISST(弗劳恩霍夫研究所)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG
AI总结 本文分析了Unicode文本水印方法在大语言模型下的安全性和可检测性,发现最新模型能检测水印但无法提取。
Comments Author's version of a paper, accepted and presented at the ICISSP 2026 conference
REHEARSE:大语言模型中用于语言置信度校准的经验式排练
机构 * University of Pennsylvania(宾夕法尼亚大学) ; University of Southern California(南加州大学) ; University of Illinois Chicago(伊利诺伊大学香槟分校)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
AI总结 针对大语言模型置信度与实际正确性不匹配的问题,提出无训练的Rehearse方法,通过置信度校准博弈的反馈生成校准信号,在多模型多基准实验中显著降低了预期校准误差并提升准确率。
Foam-Agent:迈向自动化智能CFD工作流程
机构 * Department of Computer Science, Rensselaer Polytechnic Institute(里士满理工学院计算机科学系) ; Department of Mechanical, Aerospace, and Nuclear Engineering, Rensselaer Polytechnic Institute(里士满理工学院机械、航空航天与核工程系) ; Department of Computer Science and Engineering, University of California San Diego(加州大学圣地亚哥分校计算机科学与工程系) ; College of Education, Zhejiang Normal University(浙江师范大学教育学院) ; School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 Foam-Agent通过多智能体框架和大型语言模型,实现自动化CFD工作流程,显著提升模拟效率和成功率。
Comments 34 pages, 9 figures, 9 tables
Journal ref Computer Methods in Applied Mechanics and Engineering, Vol. 461, 119271 (2026)
大语言模型无需规划即可说服理论之心理论
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结 大语言模型通过战略性揭示信息说服目标,无需显式理论之心推理,实验显示其在说服任务中表现优于人类。
机构 * Institute for Energy Systems, School of Engineering, The University of Edinburgh(能源系统研究所,工程学院,爱丁堡大学) ; Nadara, Lisbon, Portugal(纳达拉,里斯本,葡萄牙)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL
TennisVAR:一种基于击球证据的多模态大语言模型,用于网球视频中的战术推理
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)
AI总结 该研究针对网球视频理解的感知与理解差距,提出回合级战术推理任务,构建专家标注基准TRACE,开发基于证据的多模态大语言模型TennisVAR,实现网球视频的战术推理。
Comments Project Page: https://whynotgit2025.github.io/TennisVAR/
TsuGO:通过围棋死活问题探究大语言模型推理中的搜索效率
专题命中 推理与问题求解 :LLM(title,summary_cn);分类 cs.AI
AI总结 本研究提出围棋死活问题基准TsuGO,发现现有LLM的推理搜索组织能力远逊于神经引导的KataGo,指出搜索组织是LLM推理评估的缺失维度。
Comments 23 pages, 12 figures, 20 tables, 2 algorithms
大型语言模型(LLMs)并非优秀的战略家,然而记忆增强的智能体可提升推理能力
机构 * University of Chicago(芝加哥大学) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究针对LLM在长时环境中战略推理的缺陷,提出EpicStar框架,结合跨回合记忆与动态门控机制,在星际争霸II测试中实现更高胜率且令牌消耗大幅减少。
Journal ref Published at Reasoning and Planning for LLMs at ICLR 2025
CAPRI:面向Isabelle的感知契约的证明修复
专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究提出CAPRI工具,用于解决Isabelle证明修复中LLM修改未授权内容的问题,通过契约检查机制保障安全,在12个失败证明的实验中验证了不同工作流的修复效果。
Comments 17 pages, 1 figure, 7 tables. Submitted to SBMF 2026. Reproducibility artefact available on Zenodo
StateBridge:面向大语言模型多智能体系统潜在通信的无训练隐藏状态对齐
机构 * School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院)
专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 StateBridge 是一种无训练的潜在通信方法,通过闭式正交变换对齐大语言模型多智能体的隐藏状态,在 26 个模型-任务对中 22 个取得最优或并列最优性能,优于基线。
Comments 18 pages, 3 figures, 4 tables, accepted by COLM2026