arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-16 至 2025-12-16 共收录 269 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 42 篇

2511.06029 2025-12-16 cs.LG 83%

Lethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM Serving

Lethe:面向推理密集型大语言模型服务的层和时间自适应KV缓存剪枝

Hui Zeng, Daming Zhao, Pengfei Yang, WenXuan Hou, Tianyang Zheng, Hui Li, Weiye Ji, Jidong Zhai

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Lethe通过引入时空自适应的KV缓存管理框架,在推理密集型大语言模型服务中实现高效的缓存剪枝,提升吞吐量的同时保持生成质量。

Comments aaai26 camera-ready version, 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09963 2025-12-16 cs.DC 80%

GoodSpeed: Optimizing Fair Goodput with Adaptive Speculative Decoding in Distributed Edge Inference

GoodSpeed: 通过自适应猜测解码优化公平的好吞吐量在分布式边缘推断中

Phuong Tran, Tzu-Hao Liu, Long Tan Le, Tung-Anh Nguyen, Van Quan La, Eason Yu, Han Shu, Choong Seon Hong, Nguyen H. Tran

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

AI总结 GOODSPEED通过自适应猜测解码优化分布式边缘推断中的公平好吞吐量,采用梯度调度算法实现资源高效分配。

Comments Accepted at INFOCOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13526 2025-12-16 cs.LG 79%

Async Control: Stress-testing Asynchronous Control Measures for LLM Agents

异步控制:对LLM代理的异步控制措施进行压力测试

Asa Cooper Stickland, Jan Michelfeit, Arathi Mani, Charlie Griffin, Ollie Matthews, Tomek Korbak, Rogan Inglis, Oliver Makins, Alan Cooney

机构 * UK AI Security Institute(英国人工智能安全研究所)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

AI总结 本研究通过模拟对抗游戏,开发异步监控系统以检测和防止LLM代理的破坏行为,并评估其在实际部署中的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06256 2025-12-16 eess.SP cs.AI 79%

SpectrumFM: A Foundation Model for Intelligent Spectrum Management

SpectrumFM:一种智能频谱管理的基础模型

Fuhui Zhou, Chunyu Liu, Hao Zhang, Wei Wu, Qihui Wu, Tony Q. S. Quek, Chan-Byoung Chae

机构 * College of Artificial Intelligence and the Key Laboratory of Dynamic Cognitive System of Electromagnetic Spectrum Space(人工智能学院和电磁频谱空间动态认知系统重点实验室)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 SpectrumFM通过创新的编码器架构和自监督学习任务,提升频谱管理任务的准确性和鲁棒性,实现高效且可迁移的频谱表示。

Comments This manuscript has been accepted for publication in the IEEE Journal of Selected Areas in Communications (JSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12089 2025-12-16 cs.CV cs.CL 79%

VEGAS: Mitigating Hallucinations in Large Vision-Language Models via Vision-Encoder Attention Guided Adaptive Steering

VEGAS: 通过视觉编码器注意力引导的自适应转向来缓解大视觉-语言模型中的幻觉

Zihu Wang, Boxun Xu, Yuxuan Xia, Peng Li

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 VEGAS通过整合视觉编码器注意力图并自适应引导标记,有效缓解大视觉-语言模型中的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21720 2025-12-16 cs.AI cs.HC cs.LG 79%

A Multi-Component AI Framework for Computational Psychology: From Robust Predictive Modeling to Deployed Generative Dialogue

面向计算心理学的多组件AI框架:从稳健的预测建模到部署的生成对话

Anant Pareek

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个多组件AI框架,结合预测建模与生成对话,实现从心理状态分析到实际应用的完整研究到部署流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13576 2025-12-16 cs.NE 78%

Reproducing and Dissecting Denoising Language Models for Speech Recognition

重现并解析用于语音识别的去噪语言模型

Dorian Koch, Albert Zeyer, Nick Rossenbach, Ralf Schlüter, Hermann Ney

专题命中 效率与部署 :language model(title,abstract)

AI总结 本文研究了去噪语言模型在语音识别中的表现,发现其在特定计算条件下优于传统语言模型,提出DLM-sum方法提升解码性能。

Comments Equal contribution of first two authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10611 2025-12-16 cs.AI cs.NE 77%

Phythesis: Physics-Guided Evolutionary Scene Synthesis for Energy-Efficient Data Center Design via LLMs

Phythesis: 通过LLMs实现物理引导的进化场景合成,用于高效能数据中心设计

Minghao LI, Ruihang Wang, Rui Tan, Yonggang Wen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Phythesis通过结合LLMs和物理引导的进化优化,实现高效能数据中心设计的自动化场景合成,提升生成成功率和能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12806 2025-12-16 cs.AI 77%

Fault-Tolerant Sandboxing for AI Coding Agents: A Transactional Approach to Safe Autonomous Execution

面向AI编码代理的容错沙盒:一种用于安全自主执行的事务方法

Boyang Yan

机构 * University of Virginia(弗吉尼亚大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于事务的容错沙盒框架,通过事务性文件系统快照和策略拦截层,实现对AI编码代理自主执行的安全保障,显著降低延迟并提高安全性。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13313 2025-12-16 cs.CV 75%

KlingAvatar 2.0 Technical Report

KlingAvatar 2.0 技术报告

Kling Team, Jialu Chen, Yikang Ding, Zhixue Fang, Kun Gai, Yuan Gao, Kang He, Jingyun Hua, Boyuan Jiang, Mingming Lao, Xiaohan Li, Hui Liu, Jiwen Liu, Xiaoqiang Liu, Yuan Liu, Shun Lu, Yongsen Mao, Yingchao Shao, Huafeng Shi, Xiaoyu Shi, Peiqin Sun, Songlin Tang, Pengfei Wan, Chao Wang, Xuebo Wang, Haoxian Zhang, Yuanxing Zhang, Yan Zhou

机构 * Kuaishou Technology(快手科技)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 KlingAvatar 2.0 通过时空级联框架和多模态指令融合技术,实现了高效且高质量的长视频生成,提升了视觉清晰度和多模态对齐能力。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10947 2025-12-16 cs.CV 75%

Towards Efficient and Effective Multi-Camera Encoding for End-to-End Driving

迈向高效且有效的多摄像头编码以实现端到端驾驶

Jiawei Yang, Ziyu Chen, Yurong You, Yan Wang, Yiming Li, Yuxiao Chen, Boyi Li, Boris Ivanovic, Marco Pavone, Yue Wang

机构 * USC Physical Superintelligence (PSI) Lab(USC物理超智能实验室) Stanford University(斯坦福大学) NVIDIA Research(NVIDIA研究)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出Flex,一种高效多摄像头编码方法,通过紧凑的场景令牌提升端到端驾驶性能,无需依赖3D先验。

Comments Project Page: https://jiawei-yang.github.io/Flex/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12701 2025-12-16 cs.CV cs.CL cs.LG 73%

Efficient Vision-Language Reasoning via Adaptive Token Pruning

通过自适应令牌修剪实现高效的视觉语言推理

Xue Li, Xiaonan Song, Henry Hu

机构 * Scholar42(学者42) InfiniPouch LLC(InfiniPouch公司) Labelbox, Inc.(Labelbox公司)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出自适应令牌修剪方法,通过动态保留关键令牌提升视觉语言模型的推理效率和稳定性,减少计算量并保持精度。

Comments 10 pages, 3 figures. Expanded version of an extended abstract accepted at NeurIPS 2025 Workshop on VLM4RWD. Presents methodology and preliminary experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04467 2025-12-16 cs.CL cs.AI 73%

PDTrim: Targeted Pruning for Prefill-Decode Disaggregation in Inference

PDTrim: 针对预填解码分离的定向剪枝

Hao Zhang, Mengsi Lyu, Zhuo Chen, Xingrun Xing, Yulong Ao, Yonghua Lin

机构 * Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PDTrim通过整合预填解码分离特性,实现更精确的块剪枝,提升推理性能和效率。

Comments Minor revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00507 2025-12-16 cs.DC 71%

Towards Resource-Efficient Serverless LLM Inference with SLINFER

面向资源高效的服务器less LLM推断的SLINFER

Chuhao Xu, Zijun Li, Quan Chen, Han Zhao, Xueyan Tang, Minyi Guo

专题命中 效率与部署 :LLM(title)

AI总结 SLINFER通过在异构硬件上实现弹性共享,提高小型至中型LLM推断的资源效率,实验显示服务容量提升达86%-154%

Comments To appear at HPCA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13074 2025-12-16 cs.IR cs.AI 70%

A Simple and Effective Framework for Symmetric Consistent Indexing in Large-Scale Dense Retrieval

一种用于大规模密集检索中对称一致索引的有效框架

Huimu Wang, Yiming Qiu, Xingzhi Yao, Zhiguo Chen, Guoyu Tang, Songlin Wang, Sulong Xu, Mingming Li

机构 * JD.com China(京东中国) Institute of Information Engineering, Chinese Academy of Sciences China(中国科学院信息工程研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SCI框架,通过双塔协同和对称表示对齐,解决大规模密集检索中表示空间错位和索引不一致问题,提升检索精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12560 2025-12-16 cs.CV cs.AI 70%

StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding

StreamingAssistant: 为加速在线视频理解的高效视觉标记修剪

Xinqi Jin, Hanxun Yu, Bohan Yu, Kebin Liu, Jian Liu, Keda Tao, Yixuan Pei, Huan Wang, Fan Dang, Jiangchuan Liu, Weiqiang Wang

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Westlake University(西湖大学) Beijing Jiaotong University(北京交通大学) Simon Fraser University(西蒙弗雷泽大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 StreamingAssistant通过高效视觉标记修剪技术,提升在线视频理解的准确性和效率,减少GPU内存使用和计算延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12552 2025-12-16 cs.AI 70%

Large Language Newsvendor: Decision Biases and Cognitive Mechanisms

大语言新闻供应商:决策偏差与认知机制

Jifei Liu, Zhi Chen, Yuanguang Zhong

机构 * School of Business Administration, South China University of Technology(华南理工大学商学院) Department of Decisions, Operations and Technology, The Chinese University of Hong Kong(香港中文大学决策、运营与技术系)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究分析大语言模型在新闻供应商问题中的决策偏差,发现其放大人类认知偏差,提出通过结构化提示优化AI决策可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05951 2025-12-16 cs.CR cs.AI cs.MA 70%

Trusted AI Agents in the Cloud

云中的可信AI代理

Teofil Bodea, Masanori Misono, Julian Pritzi, Patrick Sabanic, Thore Sommer, Harshavardhan Unnibhavi, David Schall, Nuno Santos, Dimitrios Stavrakakis, Pramod Bhatotia

机构 * Technical University of Munich(慕尼黑技术大学) INESC-ID/Instituto Superior Tecnico, University of Lisbon(里斯本大学技术学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Omega系统通过端到端隔离和可验证信任建立,实现云中可信AI代理的安全运行与高效多代理部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15455 2025-12-16 cs.LG 70%

CoopQ: Cooperative Game Inspired Layerwise Mixed Precision Quantization for LLMs

CoopQ: 一种受合作博弈启发的分层混合精度量化方法用于大语言模型

Junchen Zhao, Ali Derakhshan, Jayden Kana Hyman, Junhao Dong, Sangeetha Abdu Jyothi, Ian Harris

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 CoopQ通过合作博弈理论优化层间交互,实现低比特精度下的大语言模型高效混合量化,显著降低困惑度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12326 2025-12-16 cs.SE 67%

The Role of AI in Modern Penetration Testing

人工智能在现代渗透测试中的作用

J. Alexander Curtis, Nasir U. Eisty

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文探讨人工智能在渗透测试中的应用,指出强化学习在其中的主导地位,并指出AI在自动化任务和优化攻击策略方面的潜力,同时指出现有模型在灵活性和后利用阶段的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16841 2025-12-16 eess.AS cs.SD 67%

SAC: Neural Speech Codec with Semantic-Acoustic Dual-Stream Quantization

SAC:具有语义-声学双流量化神经语音编解码器

Wenxi Chen, Xinsheng Wang, Ruiqi Yan, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiquan Li, Yuzhe Liang, Hanlin Wen, Shunshun Yin, Ming Tao, Xie Chen

机构 * X-LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai Innovation Institute, China(上海创新研究院) Soul AI Lab, China(Soul AI实验室)

专题命中 效率与部署 :LLM(abstract);language model(abstract)

AI总结 SAC通过语义-声学双流量化提升语音编解码器的重建与语义表示能力,实现更自然的语音生成和更高效的文本到语音转换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12793 2025-12-16 cs.CV 67%

ViCO: A Training Strategy towards Semantic Aware Dynamic High-Resolution

ViCO: 一种面向语义感知动态高分辨率的训练策略

Long Cui, Weiyun Wang, Jie Shao, Zichen Wen, Gen Luo, Linfeng Zhang, Yanting Zhang, Yu Qiao, Wenhai Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Nanjing University(南京大学) Donghua University(东华大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 ViCO通过动态调整视觉标记数量以适应图像语义复杂度,有效降低推理成本的同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10149 2025-12-16 cs.IR cs.LG 57%

STARS: Semantic Tokens with Augmented Representations for Recommendation at Scale

STARS:用于大规模推荐的语义令牌与增强表示

Han Chen, Steven Zhu, Yingrui Li

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

AI总结 STARS通过语义增强、多意图建模和部署优化,实现大规模电子商务推荐的高效率与高质量。

Comments Identified an issue with AB testing results, Withdrew temporarily

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01341 2025-12-16 stat.ML cs.LG 57%

Debiasing Machine Learning Predictions for Causal Inference Without Additional Ground Truth Data: "One Map, Many Trials" in Satellite-Driven Poverty Analysis

消除机器学习预测偏差以进行因果推断而无需额外真实数据:卫星驱动的贫困分析中的'一张地图,多次试验'

Markus B. Pettersson, Connor T. Jerzak, Adel Daoud

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

AI总结 本文提出两种无需额外数据的后处理方法,用于减少机器学习预测中的收缩偏见,从而提升因果推断的准确性,适用于贫困分析等多领域应用。

Comments To appear in the Proceedings of AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13055 2025-12-16 cs.CV 50%

Towards Test-time Efficient Visual Place Recognition via Asymmetric Query Processing

通过非对称查询处理实现测试时高效的视觉位置识别

Jaeyoon Kim, Yoonki Cho, Sung-Eui Yoon

专题命中 效率与部署 :foundation model(abstract)

AI总结 本文提出一种非对称VPR框架,通过地理记忆库和隐式嵌入增强技术,实现低计算成本的高效视觉位置识别。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12246 2025-12-16 cs.CV 50%

Moment and Highlight Detection via MLLM Frame Segmentation

通过MLLM帧分割进行时刻和亮点检测

I Putu Andika Bagas Jiwanta, Ayu Purwarianti

机构 * School of Electrical Engineering and Informatics(电气工程与信息学院) Institut Teknologi Bandung(万隆技术大学)

专题命中 效率与部署 :LLM(abstract)

AI总结 本文提出通过MLLM帧分割实现视频时刻和亮点检测,利用分割损失与因果LM损失结合,提升检测精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 27 篇

2510.02967 2025-12-16 cs.CL cs.AI cs.IR 90%

Grounding Large Language Models in Clinical Evidence: A Retrieval-Augmented Generation System for Querying UK NICE Clinical Guidelines

将大语言模型 grounded 在临床证据中:一种用于查询英国 NICE 临床指南的检索增强生成系统

Matthew Lewis, Samuel Thio, Amy Roberts, Catherine Siju, Whoasif Mukit, Rebecca Kuruvilla, Zhangshu Joshua Jiang, Niko Möller-Grell, Aditya Borakati, Richard JB Dobson, Spiros Denaxas

机构 * Institute of Health Informatics, University College London(健康信息学研究所,伦敦大学学院) Department of Biostatistics and Health Informatics, King’s College London(生物统计学与健康信息学系,伦敦国王学院) EPSRC DRIVE-Health CDT, London, U.K.(EPSRC DRIVE-Health CDT,伦敦,英国) Imperial College Healthcare NHS Trust(帝国学院医疗 NHS 信托) Black Country Healthcare NHS Foundation Trust(黑斯廷斯地区医疗 NHS 基础信托) Feldon Lane Surgery, The Dudley Group NHS Foundation Trust(费尔顿车道诊所,德比集团 NHS 基础信托) The Cleveland Clinic, London, U.K.(克利夫兰诊所,伦敦,英国) CogStack Limited(CogStack 有限公司)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于RAG的系统,用于查询英国NICE临床指南,通过检索增强生成技术提升回答的准确性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07916 2025-12-16 cs.CR cs.HC 89%

Can Large Language Models Automate Phishing Warning Explanations? A Controlled Experiment on Effectiveness and User Perception

大型语言模型能否自动化钓鱼警告解释?对有效性和用户感知的受控实验

Federico Maria Cau, Giuseppe Desolda, Francesco Greco, Lucio Davide Spano, Luca Viganò

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文研究了大型语言模型在生成钓鱼警告解释中的有效性,发现其能提供与专家编写的解释相当的保护效果,且具有可扩展性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13001 2025-12-16 cs.IR 89%

Are Large Language Models Really Effective for Training-Free Cold-Start Recommendation?

大型语言模型真的适合无训练冷启动推荐吗?

Genki Kusano, Kenya Abe, Kunihiro Takeoka

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文通过对比LLMs和TEMs在无训练冷启动推荐中的表现,发现TEMs在冷启动和暖启动设置中均优于LLMs,挑战了LLM是唯一可行选项的普遍看法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12447 2025-12-16 cs.CL 88%

Large language models have learned to use language

大型语言模型已学会使用语言

Gary Lupyan

专题命中 领域大模型 :language model(title,abstract);large language model(title,abstract);分类 cs.CL

AI总结 本文探讨大型语言模型在语言使用上的学习能力,指出其可能推动语言科学的突破,并挑战传统评估观念。

Comments Commentary on Futrell & Mahowald's How Linguistics Learned to Stop Worrying and Love the Language Models (BBS, Forthcoming)

详情

展开后加载摘要…

URL PDF HTML 收藏