arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-31 至 2026-08-31 共收录 337 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 55 篇

2608.27911 2026-08-31 cs.LG 新提交 74%

TACIT-Switch: Cost-Aware Model Escalation for LLM Agents from Censored Supervision

TACIT-Switch:基于审查式监督的大语言模型智能体成本感知模型升级方案

Ji'an Lei, Jian Huang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :LLM(title);分类 cs.LG

AI总结 TACIT-SWITCH从审查式监督学习切换策略,在可比成本下提升大语言模型智能体成功率7.4-11.1个百分点,在ALFWorld和DABench上取得最优保留成功率。

Comments 17 pages, 6 figures, 3 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28576 2026-08-31 stat.ME cs.AI cs.LG stat.ML 新提交 73%

Learning a Size-Weight Frontier for Synthetic-Augmented Inference

学习合成增强推理的大小-权重边界

Chengpiao Huang, Kaizheng Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对真实数据稀缺时合成数据引入偏差的问题,提出合成增强推理框架,通过大小-权重边界保证覆盖率,实验中用大语言模型响应增强调查数据,达到目标覆盖率并缩小置信区间。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27513 2026-08-31 cs.LG cs.AI 新提交 73%

DAMP: Decay-Aware Mixed-Precision Recurrent-State Quantization

DAMP:感知衰减的混合精度循环状态量化

Tao Zhang, Jianchao Tan, Pingwei Sun, Yanqi Yu, Zixu Jiang, Yuchen Xie, Xunliang Cai, Ziqian Zeng

机构 * South China University of Technology(华南理工大学) Meituan(美团) East China Normal University(华东师范大学)

专题命中 效率与部署 :language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 DAMP是针对GDN、KDA类语言模型循环状态的混合精度量化方法,通过识别高风险通道差异化精度存储,在接近FP32基线精度的同时大幅降低存储、加速更新并减少推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27466 2026-08-31 cs.CL cs.AI 新提交 73%

PACE: Publisher-Adaptive Content Extraction via Agentic Automation

PACE:基于智能体自动化的发布者自适应内容提取

Zhanlin Liu, Munirathnam Srikanth

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 PACE是一种智能体框架,可从代表性页面和用户需求学习发布者特定提取配置,在多模态提取任务中优于可扩展非手动基准,接近手动解析器质量,实现高效自适应内容提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19719 2026-08-31 cs.IR cs.CL cs.LG 版本更新 73%

Closing the Operational Gap in Semantic Caching

缩小语义缓存中的校准差距

Aditeya Baral, Radoslav Ralev, Iliya Sotirov Zhechev, Srijith Rajamohan, Jen Agarwal

机构 * New York University(纽约大学) Redis(Redis公司)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 针对语义缓存系统中离线指标与部署性能的差距,提出P-CHR AUC和CRR指标,发现校准差距由训练目标主导,模型选择本质是校准问题。

Comments 24 pages, 2 figures. Source code: https://github.com/aditeyabaral/operational-gap-semantic-caching. Models and Datasets: https://huggingface.co/redis. Accepted at EMNLP 2026, Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26112 2026-08-31 cs.CL 版本更新 70%

TreeGraft: Adaptive Multi-Drafter Grafting for Tree-Based Speculative Decoding

TreeGraft:面向基于树的推测解码的自适应多 Draft 嫁接方法

Jiaming Fan, Daming Cao, Canchen Huang, Jiale Fu, Jin Zhang, Junjie Gao, Kai Yang, Xiangzhong Luo, Xu Yang

机构 * Southeast University(东南大学) Ant Group(蚂蚁集团) Nanjing University of Information Science and Technology(南京信息工程大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 TreeGraft 是多 Draft 器框架,通过强弱 Draft 器协作及轻量调度器控制成本,在 10 组模型对和 6 个基准上,较最优单 Draft 器策略平均性能提升 15.1%,解决了树结构推测解码的速度与质量两难问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12634 2026-08-31 cs.AI 版本更新 70%

Atomic Units of X: The Compression Layer of Intelligence

X的原子单位:智能的压缩层

Sachin Dev Duggal, Pradyumna Swarnalatha Ramanna, Alexandros Vassiliades

机构 * SeKondBrain AI Labs(第二大脑人工智能实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该论文提出将智能视为原子压缩与组合复用过程的理论框架,借助多学科证据阐述原子单位概念,给出压缩演算等核心方法,为设计自进化知识系统奠基,为智能相关多方面提供统一视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23149 2026-08-31 cs.AI 版本更新 70%

Describe-Then-Act: Proactive Agent Steering via Distilled Language-Action World Models

描述-然后-行动:通过蒸馏的语言-动作世界模型实现前瞻性智能体导航

Massimiliano Pappa, Luca Romani, Valentino Sacco, Alessio Palma, Stéphane Lathuilière, Fabio Galasso, Xavier Alameda-Pineda, Indro Spinelli

机构 * Sapienza University of Rome, Italy(罗马大学萨皮恩扎) Inria, Univ. Grenoble Alpes, CNRS, LJK(法国国家信息与自动化技术研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出DILLO模型,通过蒸馏方法实现无需视觉模拟的前瞻性智能体导航,提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28359 2026-08-31 cs.IR 新提交 67%

Every Article Deserves a Video: Contextual Video Matching for Digital Publishers

每篇文章都值得拥有视频:面向数字出版商的上下文视频匹配

Arnaud Corone, Brice Pierre de la Briere, Gladys Roch, Samuel Leonardo Gracio, Yassine Bouher, Parvati Chauchaix

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 针对数字出版商需为文本文章匹配相关视频的需求,提出基于LLMs和文本嵌入的上下文视频匹配系统,已在Dailymotion部署并获数百家出版商采用,提升了用户参与度与体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28192 2026-08-31 cs.CV 新提交 67%

Locate Anything in Videos: Rethinking Efficient Generative Spatio-Temporal Video Grounding

在视频中定位任意目标:重新思考高效的生成式时空视频定位

Hanoona Rasheed, Haania Siddiqui, Ming-Hsuan Yang, Fahad Shahbaz Khan, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University of California, Merced(加州大学默塞德分校) Apertix(阿珀蒂克斯公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 针对时空视频定位的自回归解码存在延迟高、误差易传播的问题,提出并行轨迹解码,在VidSTG等数据集上实现显著的延迟降低与吞吐量提升,且可零样本泛化到多项相关任务

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27866 2026-08-31 cs.CV 新提交 67%

Iron: Intent-Aligned and Retrospective Dual Learning Framework for Enhancing Generalist Virtual Agents

Iron:用于增强通用虚拟智能体的意图对齐与回溯双学习框架

Jiahe Ying, Wendong Bu, Kaihang Pan, Bingchen Miao, Siyu Chen, Wen Wang, Xueming Jiang, Juncheng Li, Siliang Tang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 Iron是用于训练GUI智能体的意图对齐与回溯双学习框架,通过逐步循环一致奖励和事后回放机制提升性能,在跨环境等任务中优于三倍数据训练的模型,未见过的网页任务获25.06%相对提升。

Comments 11 pages, 5 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23873 2026-08-31 cs.AI cs.CL cs.CR cs.LG 版本更新 67%

Semantic Overlays: Mitigating Prompt Injection with Annotations Beyond Tokens and Steering Vectors

语义覆盖层:通过超越 token 和引导向量的注释缓解提示注入攻击

Joshua Penman

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究提出 Semantic Overlays 技术,通过在冻结语言模型残差流上应用小型学习适配器构建带外注释通道,有效缓解提示注入攻击,在多个基准测试中大幅降低攻击成功率且保持模型效用。

Comments 21 pages, 4 figures, 13 tables. Interactive demo: https://semantic-overlays.vercel.app. Code and released adapters: https://github.com/JoshuaSP/semantic-overlays

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25270 2026-08-31 cs.CL cs.AI cs.LG 版本更新 67%

Where Steering Signals Come From: Activation Source Selection in Activation Steering

转向信号来自何处:激活转向中的激活源选择

Jiaran Ye, Lingxu Ran, Zijun Yao, Chenpeng Wang, Yong Jiang, Lei Hou, Juanzi Li, Liangming Pan

机构 * Peking University(北京大学) Tsinghua University(清华大学) Beijing Academy of Artificial Intelligence(北京智源人工智能研究院) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) YiXin-AILab(易信人工智能实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究激活转向中转向信号的来源选择,通过实验表明改变源激活会影响转向成功率,有效转向信号来自执行边界状态,基于此提出尾部减法,揭示转向取决于模型即将做的事而非已出现的内容。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27882 2026-08-31 cs.LG cs.AI 新提交 62%

SOMTab: Set-Order Mamba for Efficient Tabular In-Context Learning

SOMTab:用于高效表格上下文学习的集合-顺序Mamba

Hao Wang, Siyu Zhang, Wei Ma

机构 * Institute of Statistics and Big Data, Renmin University of China(中国人民大学统计与大数据研究院)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SOMTab架构,将表格上下文学习的表示构建与查询条件检索分离,结合DCH-TailMix合成先验,在接近Transformer模型性能的同时提升了效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21933 2026-08-31 cs.CV cs.AI cs.LG 版本更新 62%

Camera-Agnostic Pruning of 3D Gaussian Splats via Descriptor-Based Beta Evidence

基于描述符的Beta证据的3D高斯点集剪枝

Peter Fasogbon, Ugurcan Budak, Patrice Rondao Alface, Hamed Rezazadegan Tavakoli

机构 * Nokia Technologies(诺基亚技术)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种无需相机参数的3D高斯点集剪枝方法,通过属性衍生的邻域描述符进行一阶剪枝,引入混合描述符框架并建立Beta证据模型以评估点集可靠性。

Comments 16 pages, 3 figures, 3 tables. Accepted for publication in the Proceedings of the British Machine Vision Conference (BMVC), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05917 2026-08-31 cs.CV cs.CL 版本更新 57%

MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering

MemoryCard: 面向长视频问答的主题感知多模态线索压缩

Qing Yang, Pengcheng Huang, Xinze Li, Zhenghao Liu, Yukun Yan, Yu Gu, Ge Yu, Gang Li, Maosong Sun

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Digital China Group(数字中国集团)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出MemoryCard框架,通过将长视频分割为主题事件单元并生成事件级摘要和代表性视觉时刻,以记忆卡形式增强VLMs的长视频问答能力,在相同视觉令牌预算下准确率提升高达21.8%。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22967 2026-08-31 cs.LG 版本更新 57%

Learned Relay Representations for Forward-Thinking Discrete Diffusion Models

学习的中继表示用于前向思考的离散扩散模型

Benjamin Rozonoyer, Jacopo Minniti, Dhruvesh Patel, Neil Band, Avishek Joey Bose, Tim G. J. Rudner, Andrew McCallum

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of Toronto(多伦多大学) Stanford University(斯坦福大学) Imperial College London(伦敦帝国学院) Mila Vijil

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 提出Learned Relay Representations (Relay)方法,通过可微通道传递潜在信息,使掩码扩散模型在去噪步骤间前向思考,减少推理延迟并提升性能。

Comments 16 pages, 3 figures. Equal contribution: Benjamin Rozonoyer, Jacopo Minniti, and Dhruvesh Patel. Code: https://github.com/jacopo-minniti/relay

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22556 2026-08-31 cs.LG 版本更新 57%

ImplicitTerrainV2: Wavelet-Guided Spatially Adaptive Neural Terrain Representation

ImplicitTerrainV2: 基于小波引导的时空自适应神经地形表示

Haoan Feng, Xin Xu, Leila De Floriani

机构 * University of Maryland, College Park(马里兰大学学院市分校)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本文提出ImplicitTerrainV2,通过结合频谱控制机制、小波引导的空间自适应性、导数感知监督和训练后模型压缩,实现了紧凑高效的神经地形数据格式,提升了地形分析的精度和效率。

Comments 14 pages, 8 figures; https://fengyee.github.io/implicitterrainv2/; Accepted to ACM SIGSPATIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20971 2026-08-31 cs.LG cs.CV 版本更新 57%

Amortizing intractable inference in diffusion models for vision, language, and control

在视觉、语言与控制任务的扩散模型中分摊难解推理

Siddarth Venkatraman, Moksh Jain, Luca Scimeca, Minsu Kim, Marcin Sendera, Mohsin Hasan, Luke Rowe, Sarthak Mittal, Pablo Lemos, Emmanuel Bengio, Alexandre Adam, Jarrid Rector-Brooks, Yoshua Bengio, Glen Berseth, Esmeralda S. Whitammer

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

AI总结 本文针对扩散模型用作下游任务先验时的难解后验推理问题,提出相对轨迹平衡方法,在视觉、语言、多模态及连续控制等任务上取得良好效果

Comments NeurIPS 2024; code: https://github.com/GFNOrg/diffusion-finetuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28205 2026-08-31 cs.CV 新提交 50%

Cut-ViT: Task-Specific Model Pruning via Gram Anchoring Subspace Consistency

Cut-ViT:基于Gram锚定子空间一致性的任务特定模型剪枝

Jianjian Yin, Liulei Li, Tao Chen, Yi Chen, Yazhou Yao, Wenguan Wang

机构 * Nanjing University of Science and Technology(南京理工大学) State Key Laboratory of Intelligent Manufacturing of Advanced Construction Machinery(先进工程机械智能制造国家重点实验室) Zhejiang University(浙江大学) Nanjing Normal University(南京师范大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 Cut-ViT是一种基于Gram锚定子空间一致性的任务特定视觉模型剪枝方法,可高效生成高鲁棒性子网络,在6项任务9个数据集上达SOTA性能,耗时与内存开销仅为旧方法的约五分之一和近一半。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27562 2026-08-31 cs.CV 新提交 50%

VidParse: Online Parsing of Egocentric Procedures Like a Pro

VidParse:像专业人员一样在线解析第一人称视角流程

Anubhav Gupta, Archit Kambhamettu, Vatsal Agarwal, Pulkit Kumar, Abhinav Shrivastava

机构 * University of Maryland(马里兰大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 VidParse是一种无需训练的在线框架,通过图约束推理处理第一人称视角视频的流程解析,在复杂多步骤解析精度上较基线提升最高达10倍。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03099 2026-08-31 eess.IV eess.SP 版本更新 50%

AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications

AirTF:面向任务的多模态令牌通信的空中令牌融合

Bole Liu, Li Qiao, Minghui Wu, Yulin Shao, Zhen Gao

专题命中 效率与部署 :foundation model(abstract)

AI总结 针对车联网中高维多模态传感数据传输面临的频谱瓶颈,提出AirTF框架。利用视觉变压器编码器提取语义令牌,通过共享无线信道并发传输,利用多址信道叠加特性空中融合多模态语义,提升频谱效率。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20543 2026-08-31 cs.CV 版本更新 50%

SSD: Spatially Speculative Decoding Accelerates Autoregressive Image Generation

SSD: 空间推测解码加速自回归图像生成

Shilong Xiang, Zirui Zhang, Lijun Yu, Chengzhi Mao

机构 * Rutgers University(罗格斯大学)

专题命中 效率与部署 :language model(abstract)

AI总结 提出空间推测解码(SSD),利用二维空间相关性同时预测相邻水平与下方令牌,突破视觉推理中的内存瓶颈,实现高达13.3倍的自回归图像生成加速。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 20 篇

2608.26587 2026-08-31 cs.CL 版本更新 93%

Surgical Alignment in Knowledge Graph Training for Clinical Diagnosis with Large Language Models

面向临床诊断的大语言模型训练中知识图谱的外科式对齐

Saksham Khatwani, He Cheng, Majid Afshar, Dmitriy Dligach, Yanjun Gao

机构 * University of Colorado Anschutz Medical Campus(科罗拉多大学安舒茨医学校区) University of Wisconsin Madison(威斯康星大学麦迪逊分校) Loyola University(洛约拉大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);SFT(abstract,abstract_cn)

AI总结 该研究针对临床诊断的LLM训练,通过多维度系统研究引入GID和GD,发现KL正则化下KG判断训练的稀疏更新(外科式对齐)可提升推理质量,需结合优化几何诊断评估KG-LLM整合。

Comments This work has been accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26895 2026-08-31 cs.LG cs.AI stat.ML 版本更新 91%

Negligible in Size, Significant in Effect: On Scale Vectors in Large Language Models

微不足道的大小,显著的效果:大型语言模型中的尺度向量

Mingze Wang, Shuchen Zhu, Yuxin Fang, Binghui Li, Kai Shen, Shu Zhong

机构 * Peking University(北京大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 本文系统研究了大型语言模型中的尺度向量,发现其虽参数占比极小但对预训练至关重要,通过自放大预条件效应优化优化过程,并提出了三种轻量级改进策略,在多种模型规模上一致提升性能。

Comments 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28225 2026-08-31 astro-ph.IM 新提交 89%

Design and implementation of an SLM-driven coherent differential imaging scheme

基于空间光调制器(SLM)驱动的相干差分成像方案的设计与实现

L. Lin, L. Marquis, R. Tandon, J. Kühn

专题命中 领域大模型 :SLM(title,title_cn)

AI总结 本文设计实现了基于SLM的相干差分成像集成器,通过模拟与实验室验证研究其性能,未来或可用于抑制AO后残余波前误差以提升地面系外行星直接成像对比度。

Comments 10 pages, 5 figures, spie astronomical telescopes + instrumentation 2026, Proceedings Volume 14154

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28236 2026-08-31 cs.LG 新提交 89%

D-TAIA: Domain-Aware LLM Adaptation for Multi-Task Predictive Process Monitoring

D-TAIA:面向多任务预测过程监控的领域感知大语言模型适配

Sjoerd van Straten, Christine Jacob, Marwan Hassani

机构 * Eindhoven University of Technology(埃因霍温理工大学) University of Wuppertal(伍珀塔尔大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出D-TAIA框架,通过参数高效微调FM骨干网,结合DATL预训练与FAISS检索等技术,在四个真实事件日志上实现多任务PPM的SOTA或竞争力性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27998 2026-08-31 cs.AI 新提交 88%

Automated Analysis Framework for Multilingual Climate-Health Literature Based on Multi-Agent Large Language Model

基于多智能体大语言模型的多语言气候-健康文献自动分析框架

Yuze Sun, Shihui Zhang, Jiancheng Pan, Yunjia Ye, Wentao Luo, Jiahao Li, Quan Zhang, Wenjia Cai, Xiaomeng Huang

机构 * Tsinghua University(清华大学) Huawei Technologies Co., Ltd(华为技术有限公司) Renmin University of China(中国人民大学) Beijing Forestry University(北京林业大学) National Institute of Natural Hazards, Ministry of Emergency Management of China(中国应急管理部国家自然灾害防治研究院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 针对多语言气候-健康文献分析痛点,提出多智能体大语言模型自动分析框架,经双语语料验证核心信息提取F1值达0.92,可支撑该领域大规模证据挖掘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25546 2026-08-31 cs.IR 版本更新 87%

An Event is Worth One Token: Event Tokenization for Industrial-scale LLM Recommendation

一个事件等价于一个Token:面向工业级LLM推荐的事件分词

Fan Xia, Zhaoheng Zheng, Iman Setayesh, Ruogu Lin, Yiqin Pan, Samarth Mittal, Wentao Bao, Vinti Pandey, Sachin Patil, Jianpeng Cheng, Jun Xiao, Zhuang Wang, Xiangjun Fan, Sri Reddy, Minghai Chen

专题命中 领域大模型 :LLM(title,title_cn)

AI总结 该研究提出以事件为中心的AMBER方法,将交互快照压缩为事件Token,在工业级推荐基准上提升了计算-质量帕累托前沿,且事件Token可跨模型架构迁移并随容量扩展持续优化。

Comments 11 pages, 10 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30105 2026-08-31 cs.SE 版本更新 86%

EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution

EvoRepair: 通过基于经验的自我进化增强漏洞修复智能体

Haichuan Hu, Guoqing Xie, Quanjun Zhang, Jiawei Liu, Shengcheng Yu, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出EvoRepair框架,通过循环学习-修复过程积累和复用漏洞修复经验,在多个基准上显著提升LLM的自动漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏