arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12294 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 2073 篇

2608.24004 2026-08-26 cs.CL 新提交 90%

AgentSpec: Speculative Decoding for Batch Inference of LLM Agents

AgentSpec:面向大语言模型智能体批量推理的推测解码算法

Xin Wang, Ziming Miao, Yi Zhu, Hui Shen, Zhongwei Wan, Fan Yang, Mi Zhang

机构 * The Ohio State University(俄亥俄州立大学) Microsoft Research(微软研究院) University of Michigan(密歇根大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对LLM智能体批量推理响应慢的问题,本研究提出AgentSpec推测解码算法,通过结构隔离的draft机制和感知冗余的预算分配提升效率,在多工作负载与模型上验证其性能优于现有最优方法。

Comments EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23353 2026-08-25 cs.CL cs.NE 新提交 90%

FormuEvo: LLM-Guided Evolution for Discovering Solver-Efficient Mixed-Integer Programming Formulations

FormuEvo:大语言模型引导的进化算法用于发现求解器高效的混合整数规划模型

Haofeng Yuan, Jianing Peng, Jieyi Bi, Ni Zhang, Shiji Song, Zhiguang Cao

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 FormuEvo是LLM引导的进化框架,将MIP模型设计转化为符号空间的进化优化,结合求解器感知诊断与结构化内存,发现的MIP模型性能远超专家设计及现有LLM方法,求解加速最高达5.5倍且知识可跨场景迁移。

Comments 27 pages, 6 figures, and 9 tables. To appear in the Proceedings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18503 2026-08-20 cs.LG 新提交 90%

LLM-Powered Predictive Decision-Making for Sustainable Data Center Operations

基于大语言模型的可持续数据中心运行预测决策

Hanzhao Wang, Jingxuan Wu, Yumeng Li, Yu Pan, Guanting Chen

机构 * The University of Sydney Business School, The University of Sydney(悉尼大学商学院,悉尼大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Purdue University(普渡大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究针对数据中心高能耗问题,提出基于LLM的预测调度系统,经合作验证可降低32%能耗、30%等待时间,为数据中心可持续运行提供实用方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15127 2026-08-18 cs.OS cs.AI cs.DC cs.MA 新提交 90%

From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems

从大语言模型(LLM)推理到智能体工作负载:特征分析与服务系统启示

Chaokun Chang, Yukun Zhou, Kaihua Fu, Dakai An, Tianyu Feng, Hanfeng Lu, Sheng Yao, Pu Guo, Yinghao Yu, Yizhou Shan, Bo Li, Binhang Yuan, Wei Wang

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出AgentSysBench基准套件,分析智能体工作负载与传统LLM服务的6项差异,据此开展的4项设计探索可实现延迟降低、效率提升、内存减少及冗余调用节省等效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12915 2026-08-14 cs.DC cs.AI 新提交 90%

InFactPlanner: Planning Sustainable Geo-Distributed LLM Data Centers

InFactPlanner:可持续地理分布式大语言模型(LLM)数据中心规划

Nicoletta Tsiopani, Moysis Symeonides, George Pallis, Marios D. Dikaiakos

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 InFactPlanner是用于LLM推理的可持续地理分布式数据中心部署假设分析的决策支持框架,可通过多维度建模分析得出可持续性与延迟最优选择存在差异等结论。

Comments Author copy of paper published at 34th International Symposium on the Modeling, Analysis, and Simulation of Computer and Telecommunication System (MASCOTS2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07583 2026-08-11 stat.ML cs.LG 新提交 90%

RouteGuard: Certifying Routing Gain in LLM Multi-Agent Systems When Complementarity Is Not Enough

RouteGuard:当互补性不足时,对LLM多智能体系统中的路由增益进行认证

Anchen Sun, Kaiqi Yang

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.LG

AI总结 针对LLM多智能体路由的部署问题,提出RouteGuard框架,通过分解增益、结合Le Cam下界等实现认证,在两个基准中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09577 2026-08-11 cs.AI 新提交 90%

ElasticBack: Stealthy Conditional Backdoor in LLM-Agent Skills via Coupled Trigger-Rule Optimization

ElasticBack:通过耦合触发-规则优化实现LLM智能体技能中的隐蔽条件后门

Hao Sui, Simeng Qin, Jie Liao, Xiaojun Jia, Bing Chen, Yang Liu

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究提出ElasticBack,通过耦合触发-规则优化在LLM智能体技能中植入条件性单技能后门,实验显示其攻击性能优异且隐蔽性强,可推动技能供应链的防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09555 2026-08-11 cs.AI 新提交 90%

Bidirectional Context Self-Distillation for Reinforcement Learning of Skill-Based LLM Agents

面向基于技能的大语言模型智能体强化学习的双向上下文自蒸馏

Tianjun Pan, Yuan Li, Hongda Wang, Linbo Jin, Mengfei Song, Lei Gao, Qiming Shi, Shaokang Fu, Jiarong Zhao, Chengyu Wang, Chengfu Huo

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究针对基于技能的LLM智能体技能利用不足问题,提出BCSD框架,通过双向上下文自蒸馏结合强化学习,在ALFWorld和WebShop上取得最优性能,验证了互补视角的有效性。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09225 2026-08-11 cs.CR cs.AI 新提交 90%

Governing the KV Cache: Preventing Timing Side-Channel Leakage in Multi-Tenant LLM Inference

管控KV缓存:防止多租户大语言模型推理中的时序侧信道泄露

Tejasvi C. Addagada

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文针对多租户LLM推理中KV缓存引发的时序侧信道泄露问题,提出KVGov治理层,结合盐值机制与ORIGAMI调度器,可抵御三类攻击,同时保留93%的缓存效率,在真实硬件与模拟环境中验证了防御效果。

Comments 12 pages, 5 figures, 9 tables. Measurements on NVIDIA A100 with vLLM 0.26.0, independently replicated on llama.cpp/Apple Metal. Experimental scripts and raw results available from the author on request

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08382 2026-08-11 cs.AI cs.DC 新提交 90%

LLMVisor: A Real-Time Latency Attribution Model for Multi-Tenant LLM Serving

LLMVisor:面向多租户大语言模型(LLM)服务的实时延迟归因模型

Shuowei Jin, Xueshen Liu, Jiaxin Shan, Le Xu, Tieying Zhang, Liguang Xie, Z. Morley Mao

机构 * University of Michigan(密歇根大学) ByteDance(字节跳动)

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 针对多租户LLM服务中联合批处理导致的延迟归因难题,提出基于屋顶线模型的LLMVisor实时延迟归因模型,在微秒级高效运行,相比基线方法大幅降低预填充和解码阶段的相对误差

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07974 2026-08-11 cs.LG cs.DC 新提交 90%

ZeroLock: Concurrent Memory-Efficient LLM Training via Modular Update Decoupling

ZeroLock:通过模块化更新解耦实现并发内存高效的大语言模型训练

Wentao Dai, Xuanran Li, Yuxiang Zhang, Ming Tang, Chao Huang

机构 * Southern University of Science and Technology(南方科技大学) Montclair State University(蒙特克莱尔州立大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对边缘LLM微调的BP训练存在更新锁定瓶颈,本研究提出ZeroLock无BP算法,通过模块化更新解耦突破局限,经实验验证可降内存26.5%、提吞吐量4.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07126 2026-08-10 cs.HC cs.AI 新提交 90%

PHOENIX: Fine-Tuned SLM-Powered Autonomous Satellite Lifetime Extension via Predictive Self-Healing and Multi-Agent AI Recovery

PHOENIX:通过预测性自修复与多智能体AI恢复实现的经微调小型语言模型驱动的自主卫星寿命延长

Sumaiya Islam, Harsha Kumara Moraliyage

专题命中 效率与部署 :SLM(title,summary_cn);language model(abstract);small language model(abstract);分类 cs.AI

AI总结 该研究针对CubeSat在轨故障无法及时修复导致寿命不足的问题,提出PHOENIX系统,利用微调SLM与多智能体AI实现自主故障修复,基于ESA基准验证了初步效果。

Comments 6 pages, 2 figures. Accepted at IEEE IRAI 2026 (International Conference on Responsible Artificial Intelligence)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07091 2026-08-10 cs.HC cs.AI 新提交 90%

Human-Centered Explainable AI for TinyML Edge Devices: A Pareto-Based Selection Framework with LLM-Guided Design

面向TinyML边缘设备的以人为中心的可解释人工智能:基于帕累托的选择框架与大语言模型引导设计

Zeinab Dehghani, Dhavalkumar Thakker, Koorosh Aslansefat, Kuniko Paxton, Bhupesh Kumar Mishra, Baseer Ahmad, Rameez Raja Kureshi

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出一种整合LLM引导设计与帕累托优化的以人为中心XAI选择框架,用于TinyML边缘设备部署,经皮肤病变分类任务验证可识别帕累托有效权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04065 2026-08-06 cs.CR cs.AI 新提交 90%

An Inline Control Architecture for Language Models in Intelligent Transportation Systems

智能交通系统中语言模型的内联控制架构

Narendra Kumar Dewangan, Mounira Msahli

专题命中 效率与部署 :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 针对V2X系统中LLM的提示级攻击问题,提出Guarded-V2X内联语义护栏架构,经四阶段实验验证其可降低入侵成功率且不超延迟预算。

Comments 18 pages, under minor revision (IEEE transactions)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03961 2026-08-05 cs.AI 新提交 90%

Interpretable Adaptive Sampling for LLM Test-Time Scaling

面向大语言模型测试时缩放的可解释自适应采样

Mobina Kashaniyan, Ali Jannesari

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对LLM测试时推理的固定计算预算不灵活、不可解释的问题,提出带轻量级模糊控制器的自适应采样方法,在问答和数学任务上提升性能并减少平均采样数,为高效测试时推理提供实用方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03463 2026-08-05 cs.AI 新提交 90%

LeanMem: Simple and Efficient Long-Term Memory for LLM Agents

LeanMem:面向LLM智能体的简单高效长期记忆系统

Yuxin Liao, Le Wu, Min Hou, Hao Liu, Han Wu, Zishu Wang

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 LeanMem是面向LLM智能体的轻量级长期记忆框架,通过差异化处理历史内容、动态分配资源,在两个数据集上提升了记忆基线的准确率,同时降低了成本与延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01536 2026-08-04 cs.AR cs.LG 新提交 90%

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference

Celty:用于高效双稀疏大语言模型推理的SpMspV GPU内核与SIMT协同设计

Ruokai Yin, Priyadarshini Panda

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对双稀疏LLM推理中spMspV workload处理低效问题,提出协同设计的Celty稀疏格式、GPU内核与SIMT微架构,实现最高5.3倍加速。

Comments ICCAD 2026. Will update with the camera-ready version once ready. The code is available on Github at https://github.com/RuokaiYin/Celty

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00303 2026-08-04 cs.AI 新提交 90%

CrystalMem: Elastic Memory for Self-Evolving LLM Agents via Knowledge Crystallization

CrystalMem:基于知识结晶的自进化大语言模型智能体弹性内存

Beining Wu, Jun Huang

机构 * South Dakota State University(南达科他州立大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对LLM智能体的内存滞后问题,提出弹性内存组件CrystalMem,通过知识结晶策略恢复能力,在多环境实验中性能优于基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00026 2026-08-04 cs.AI cs.DC 新提交 90%

Request-Level Energy Attribution for Batched LLM Serving

批量大语言模型(LLM)服务的请求级能耗归因

Qi Luo, Kunlin Li, Ziwen Wang, Dongsheng Wang, Yun Chen

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究提出JouleShare框架,通过计算Shapley能耗建立请求级基准,用JCalib校准模型提升批量LLM服务的请求级能耗归因精度,验证了token比例归因的偏差及JCalib的有效性。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28268 2026-07-31 cs.AI 新提交 90%

LLM-Guided Evolutionary Search for Constraint Model Reformulation to Improve Solver Efficiency

基于大语言模型引导的进化搜索的约束模型重构以提升求解器效率

Kostis Michailidis, Dimos Tsouros, Nguyen Dang, Tias Guns

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出LLM引导的进化框架,引入PDR策略保留多样化上下文,在8个CSPLib问题上验证迭代重构可提升求解速度,且多样化上下文策略和验证选择均能增强加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27090 2026-07-30 cs.DC cs.LG 新提交 90%

InferScale: GPU-Native KV Injection for Personalized LLM Serving

InferScale:面向个性化大语言模型服务的原生GPU KV注入方案

Peter Li, Prashant Pandey

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 InferScale是原生GPU的LLM内存系统,通过可复用KV状态替代重复提示词预填充,引入Chunked RoPE与上下文窗口编码,在LoCoMo数据集上显著降低TTFT、提升吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26967 2026-07-30 cs.CL 新提交 90%

Generation or Judgement? A Paradigm Perspective on LLM-Based Emotion-Cause Pair Extraction in Conversation

生成还是判断?基于范式视角的对话中基于大语言模型(LLM)的情感-原因对抽取

Weijie Feng, Hongchuang Wang, Binbin Liu, Zhiyong Cheng

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.CL

AI总结 该研究针对对话情感-原因对抽取,对比LLM的生成与判断范式,发现对级判断更优,引入辅助检索器后在三个数据集上实现F1提升,明确任务分解与候选范围的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26631 2026-07-30 cs.LG cs.IR 新提交 90%

RAG-HAR+: Towards Cost-Efficient LLM-Based Human Activity Recognition for Edge Deployment

RAG-HAR+: 面向边缘部署的成本高效型基于大语言模型(LLM)的人类活动识别

Hansi Karunarathna, Nirhoshan Sivaroopan, Chamara Madarasingha, Anura Jayasumana, Kanchana Thilakarathna

机构 * University of Sydney(悉尼大学) Curtin University(科廷大学) Colorado State University(科罗拉多州立大学)

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.LG

AI总结 RAG-HAR+是面向边缘部署的成本高效型LLM辅助HAR方案,通过检索设计智能体优化特征、对确定样本用多数投票、仅不确定样本用LLM,在六基准上性能相当或更优且降低了LLM相关开销。

Comments Submitted to IEEE Transactions on Mobile Computing. Extended version of the IEEE PerCom 2026 paper "RAG-HAR: Retrieval Augmented Generation-based Human Activity Recognition." (https://doi.org/10.1109/PerCom67906.2026.11524560)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20483 2026-07-24 cs.AI 新提交 90%

Tractable Hierarchical Control of Autoregressive Language Models

自回归语言模型的可处理分层控制

Max Scribner, Antonio Vergari, Vaishak Belle

机构 * University of Edinburgh(爱丁堡大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 研究如何约束自回归大语言模型生成,核心方法是将其提炼为可处理概率模型,利用有限时长$LR(k)$文法可多项式时间计算满足情况的特性,实现对LLM生成的有效约束与引导,确保输出满足形式句法约束。

Comments 21 pages, 4 figures, 2 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19490 2026-07-23 cs.CR cs.AI 新提交 90%

Integrity of peer-to-peer distributed LLM inference under malicious nodes

恶意节点下对等分布式大语言模型推理的完整性

Mert Cihangiroglu, Antonino Nocera

机构 * DCALab, Department of Electrical, Computer and Biomedical Engineering, University of Pavia, Italy(DCALab,电气、计算机与生物医学工程系,帕维亚大学)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究对等分布式LLM推理在恶意节点下的完整性问题,提出通过测量节点激活值变化检查输出完整性的方法,即混入秘密金丝雀输入,利用与已知参考的偏差识别恶意节点,实验中检测器AUROC达1.0。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17715 2026-07-21 cs.CL 新提交 90%

C$^2$KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference

C$^2$KV:用于高效大语言模型推理的压缩可组合键值缓存重用

Chuheng Du, Junyi Chen, Hanlin Tang, Kan Liu, Tao Lan, Lin Qu, Chaoyue Niu, Shengzhong Liu, Guihai Chen, Fan Wu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究针对长上下文LLM推理成本高问题,提出C$^2$KV框架,联合优化KV提取与推理拼接,学习可组合压缩的KV缓存流形,引入轻量级边车提取器及协同训练策略,显著降低缓存成本,实现推理加速并保持生成质量。

Comments 12 pages, 9 figures, accepted by ACM SIGKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08774 2026-07-13 cs.AI cs.HC 新提交 90%

CogniConsole: Externalizing Inference-Time Control as a Formal Abstraction for Reliable LLM Interactions

CogniConsole:将推理时控制作为可靠大语言模型交互的形式化抽象进行外化

Vanessa Figueiredo, Wilter Franceschi

机构 * University of Regina(里贾纳大学) Orbital Sea(轨道海)

专题命中 效率与部署 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究挑战大语言模型可靠性仅取决于模型能力的观点,引入CogniConsole将推理时控制外化为结构化接口,通过489个探针实验表明增加结构支架可降低输出方差和故障率,为LLM系统设计评估开辟新方向。

Comments Revised version focusing on the CogniConsole system architecture and empirical evaluation of inference-time control probes (N=489)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24245 2026-07-08 cs.SE cs.AI cs.CR 新提交 90%

AutoSpec: Safety Rule Evolution for LLM Agents via Inductive Logic Programming

AutoSpec: 通过归纳逻辑编程实现LLM智能体的安全规则演化

Pingchuan Ma, Zhaoyu Wang, Zimo Ji, Yuguang Zhou, Zhantong Xue, Zongjie Li, Shuai Wang, Xiaoqin Zhang

机构 * Zhejiang University of Technology(浙江工业大学)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出AutoSpec框架,利用归纳逻辑编程引导的CEGIS自动演化专家定义的安全规则,平衡精确率和召回率,在代码执行和具身智能体领域将F1提升至0.98和0.93,减少高达94%的误报。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02043 2026-07-03 cs.DC cs.AI 新提交 90%

Towards Load-Aware Prefill Deflection for Disaggregated LLM Serving

面向负载感知的预填充偏转用于分离式LLM服务

Shrikara Arun, Anjaly Parayil, Srikant Bharadwaj, Renee St. Amant, Victor Rühle

机构 * Microsoft(微软)

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 针对分离式LLM服务中预填充节点过载而解码节点空闲的问题,提出一种主动预填充偏转调度器,通过将预填充作为分块步骤在解码节点上交错执行,消除节点间KV传输,显著降低P95 TTFT并提高SLO达标率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01601 2026-07-03 cs.AI 新提交 90%

SemHash-LLM: A Multi-Granularity Semantic Hashing Framework for Document Deduplication

SemHash-LLM:一种用于文档去重的多粒度语义哈希框架

Xinyi Fang, Kejian Tong, Jiabei Liu, Tao Ning, Yuhang He

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI

AI总结 提出多粒度语义哈希框架SemHash-LLM,融合语义投影哈希、注意力加权MinHash、对比边界学习和选择性LLM裁决,实现高效的大规模文档去重。

详情

展开后加载摘要…

URL PDF HTML 收藏