arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-05 至 2025-12-05 共收录 134 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 20 篇

2512.04550 2025-12-05 cs.CL cs.AI 79%

AdmTree: Compressing Lengthy Context with Adaptive Semantic Trees

AdmTree: 通过自适应语义树压缩长上下文

Yangning Li, Shaoshen Chen, Yinghui Li, Yankai Chen, Hai-Tao Zheng, Hui Wang, Wenhao Jiang, Philip S. Yu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 AdmTree通过自适应语义树实现高效上下文压缩,保留高语义保真度并减少计算开销。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03762 2025-12-05 cs.AI 77%

RoCo: Role-Based LLMs Collaboration for Automatic Heuristic Design

RoCo:基于角色的LLM协作用于自动启发式设计

Jiawei Xu, Feng-Feng Wei, Wei-Neng Chen

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 RoCo通过多角色协作提升自动启发式设计的多样性和质量,实现高绩效的组合优化解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04268 2025-12-05 cs.LG cs.AI 73%

The Initialization Determines Whether In-Context Learning Is Gradient Descent

初始化决定了上下文学习是否是梯度下降

Shifeng Xie, Rui Yuan, Simone Rossi, Thomas Hannagan

机构 * Telecom Paris Institut Polytechnique de Paris(巴黎理工电信学院) Lexsi Labs(Lexsi实验室) EURECOM Stellantis

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了初始化对上下文学习是否等同于梯度下降的影响,提出yq-LSA方法改进了多头LSA的性能,并在回归任务和语义相似性任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22758 2025-12-05 cs.LG cs.CL 73%

FlashFormer: Whole-Model Kernels for Efficient Low-Batch Inference

FlashFormer: 整体模型内核用于高效低批次推理

Aniruddha Nrusimha, William Brandon, Mayank Mishra, Yikang Shen, Rameswar Panda, Jonathan Ragan-Kelley, Yoon Kim

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 FlashFormer通过将Transformer前向传递融合为单个内核,实现大语言模型低批次推理的高效加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04476 2025-12-05 cs.LG cs.AR 70%

Context-Aware Mixture-of-Experts Inference on CXL-Enabled GPU-NDP Systems

基于上下文的混合专家推理在支持CXL的GPU-NDP系统中

Zehao Fan, Zhenyu Liu, Yunzhen Liu, Yayue Hou, Hadjer Benmeziane, Kaoutar El Maghraoui, Liu Liu

机构 * Rensselaer Polytechnic Institute(罗切斯特理工学院) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) IBM Research Europe(IBM欧洲研究院) IBM T. J. Watson Research Center(IBM托马斯·贾诺斯·沃森研究中心)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种基于上下文的混合专家推理系统,利用CXL-NDP减少内存传输成本,提升解码吞吐量8.7倍,精度仅下降0.13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08003 2025-12-05 cs.CV cs.AI 70%

Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM Reasoning

锐眼与记忆:视频大语言模型的信息感知视觉标记修剪方法

Jialong Qin, Xin Zou, Di Lu, Yibo Yan, Xuming Hu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SharpV通过自适应视觉标记修剪和键值缓存修剪,提升视频大语言模型的效率与可靠性,是首个无需暴露注意力分数的两阶段修剪框架。

Comments The 40th Annual AAAI Conference on Artificial Intelligence (AAAI-26) Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05000 2025-12-05 cs.CV cs.AI 57%

Reflection Removal through Efficient Adaptation of Diffusion Transformers

通过高效适应扩散变换器实现反射去除

Daniyar Zakarin, Thiemo Wandel, Anton Obukhov, Dengxin Dai

机构 * ETH Zürich(苏黎世联邦理工学院) HUAWEI Bayer Lab(华为拜耳实验室)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文提出了一种基于扩散变换器的高效反射去除方法,通过物理驱动的数据合成和LoRA适应,实现了高保真的反射去除性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04711 2025-12-05 cs.SD cs.AI 57%

Large Speech Model Enabled Semantic Communication

基于大语音模型的语义通信

Yun Tian, Zhijin Qin, Guocheng Lv, Ye Jin, Kaibin Huang, Zhu Han

机构 * School of Electronics, Peking University(北京大学电子学院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Department of Computer Science and Engineering, Kyung Hee University(庆熙大学计算机科学与工程系)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文提出基于大语音模型的语义通信系统,利用Mimi编解码器和LoRA微调技术,实现适应性压缩与鲁棒传输,支持低带宽下的高质量语音传输。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04405 2025-12-05 eess.SP cs.AI 57%

Towards 6G Native-AI Edge Networks: A Semantic-Aware and Agentic Intelligence Paradigm

迈向6G原生AI边缘网络:一种语义感知和代理智能范式

Chenyuan Feng, Anbang Zhang, Geyong Min, Yongming Huang, Tony Q. S. Quek, Xiaohu You

机构 * College of Computer Science, University of Exeter, Exeter, U.K.(埃克塞特大学计算机科学学院) Sony China Research Laboratory, Beijing, China(索尼中国研究实验室) School of Information Science and Engineering, Southeast University, Nanjing, China(东南大学信息科学与工程学院) Purple Mountain Laboratories, Nanjing, China(紫金山实验室) Information System Technology and Design Pillar, Singapore University of Technology and Design, Singapore(新加坡科技设计大学信息系统技术与设计支柱)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文提出语义感知和代理智能范式,旨在通过统一分类法和促进技术推动6G原生AI边缘网络的发展。

Comments submitted to Digital Communications and Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04939 2025-12-05 cs.CV 50%

LiteVGGT: Boosting Vanilla VGGT via Geometry-aware Cached Token Merging

LiteVGGT: 通过几何感知的缓存标记合并提升基础VGGT

Zhijian Shu, Cheng Lin, Tao Xie, Wei Yin, Ben Li, Zhiyuan Pu, Weize Li, Yao Yao, Xun Cao, Xiaoyang Guo, Xiao-Xiao Long

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) Horizon Robotics Nanjing University(南京大学) Zhejiang University(浙江大学) Macau University of Science and Technology(澳门科技大学) TARS Robotics China Mobile Zijin Innovation Institute(中国移动吉林创新研究院)

专题命中 效率与部署 :foundation model(abstract)

AI总结 LiteVGGT通过几何感知的缓存标记合并提升基础VGGT的效率,实现10倍加速和内存减少,适用于大规模3D重建场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04901 2025-12-05 physics.optics astro-ph.IM physics.ins-det 50%

Adaptive Optics-Enhanced Michelson Interferometer for Spectroscopy of Narrow-Band Light Sources

自适应光学增强的米歇尔逊干涉仪用于窄带光源光谱学

Jesneil Lauren Lewis, Ayan Banerjee

专题命中 效率与部署 :SLM(abstract)

AI总结 利用自适应光学增强的米歇尔逊干涉仪,通过条纹图案实现快速单次快照窄带光源光谱学,提升光谱分析效率与精度。

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01903 2025-12-05 cs.SD eess.AS 50%

MelTok: 2D Tokenization for Single-Codebook Audio Compression

MelTok:单代码本音频压缩的2D分token化

Jingyi Li, Zhiyuan Zhao, Zhisheng Zhang, Yunfei Liu, Lijian Lin, Ye Zhu, Jiahao Wu, Qiuqiang Kong, Yu Li

机构 * International Digital Economy Academy (IDEA)(国际数字经济学院) Chinese University of Hong Kong(香港中文大学) Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院)

专题命中 效率与部署 :language model(abstract)

AI总结 MelTok通过二维分token化和基于分token的vocoder,实现单代码本下的高效音频压缩与高质量重建。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 13 篇

2511.19730 2025-12-05 cs.LG cond-mat.mtrl-sci 90%

Training-Free Active Learning Framework in Materials Science with Large Language Models

材料科学中基于大语言模型的无需训练主动学习框架

Hongchen Wang, Rafael Espinosa Castañeda, Jay R. Werber, Yao Fehlis, Edward Kim, Jason Hattrick-Simpers

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出基于大语言模型的无需训练主动学习框架,通过两种提示策略在多个材料科学数据集中显著提升实验效率和搜索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04273 2025-12-05 cs.SE cs.AI 89%

Quantitative Analysis of Technical Debt and Pattern Violation in Large Language Model Architectures

大语言模型架构中技术债务与模式违规的定量分析

Tyler Slater

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本研究通过对比分析三种大语言模型在实现标准化微服务时的架构一致性与技术债务积累情况,揭示了开源模型在架构合规性方面的不足及潜在的技术债务风险。

Comments Under review at the Journal of Systems and Software (Special Issue on Impactful Software Architecture)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04228 2025-12-05 cs.AI 88%

Addressing Logical Fallacies In Scientific Reasoning From Large Language Models: Towards a Dual-Inference Training Framework

解决大型语言模型在科学推理中的逻辑谬误:一种双推理训练框架

Peter B. Walker, Hannah Davidson, Aiden Foster, Matthew Lienert, Thomas Pardue, Dale Russell

机构 * Intelligenesis LLC Uniformed Services University(美国武装部队服务大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出一种双推理训练框架,旨在解决大型语言模型在科学推理中的逻辑谬误问题,通过整合肯定生成与反事实否定,提升模型的鲁棒性和可解释性。

Comments 12 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05066 2025-12-05 cs.LG cs.AI cs.CL 87%

Multi-LLM Collaboration for Medication Recommendation

多LLM协作用于药物推荐

Huascar Sanchez, Briland Hitaj, Jules Bergmann, Linda Briesemeister

机构 * Computer Science Laboratory, SRI International(SRI国际计算机科学实验室) University of Maryland St. Joseph Medical Center(马里兰大学圣约瑟夫医疗中心)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出基于LLM化学的多模型协作方法,通过增强互补性、稳定性和校准性,提高药物推荐的可靠性与可信度。

Comments 8 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09495 2025-12-05 cs.CL cs.LG 81%

Bridging Online Behavior and Clinical Insight: A Longitudinal LLM-based Study of Suicidality on YouTube Reveals Novel Digital Markers

弥合在线行为与临床洞察:一项基于长期LLM研究的YouTube自杀性行为揭示了新的数字标记

Ilanit Sobol, Shir Lissak, Refael Tikochinski, Tal Nakash, Anat Brunstein Klomek, Eyal Fruchter, Roi Reichart

机构 * Technion – Israel Institute of Technology(技术学院–以色列理工学院)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.CL、cs.LG

AI总结 本研究通过分析YouTube自杀尝试者的语言模式,结合LLM和临床专家方法,揭示了新的数字标记,揭示了自杀行为与心理健康之间的关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13238 2025-12-05 cs.LG cs.AI cs.CL cs.CY 80%

Computational Measurement of Political Positions: A Review of Text-Based Ideal Point Estimation Algorithms

政治立场的计算测量:基于文本的理想点估计算法综述

Patrick Parschan, Charlott Jakob

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文综述了基于文本的理想点估计算法,分析了四种方法家族的优缺点,为应用研究提供指导。

Comments 46 pages, 8 figures, 2 tables, accepted for publication in Quality & Quantity

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04210 2025-12-05 cs.AI cs.CL cs.CY 79%

Balancing Safety and Helpfulness in Healthcare AI Assistants through Iterative Preference Alignment

通过迭代偏好对齐平衡医疗AI助手的安全性与帮助性

Huy Nghiem, Swetasudha Panda, Devashish Khatwani, Huy V. Nguyen, Krishnaram Kenthapadi, Hal Daumé

机构 * University of Maryland(马里兰大学) Oracle Labs(Oracle实验室) Oracle Health AI(Oracle健康AI)

专题命中 领域大模型 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过迭代偏好对齐框架提升医疗AI助手的安全性与帮助性,通过KTO和DPO优化改进模型,提升有害查询检测性能并平衡安全与效用。

Comments ML4H 2025 Proceedings, Best Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09414 2025-12-05 cs.SE 75%

Multi-agent Assisted Automatic Test Generation for Java JSON Libraries

多智能体辅助的Java JSON库自动测试生成

Sinan Wang, Zhiyuan Zhong, Shaojin Wen, Yepang Liu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 JsonATG通过多智能体系统生成Java JSON库的多样化测试用例,有效提升测试覆盖率并发现多个bug。

Comments In the 32nd Asia-Pacific Software Engineering Conference (APSEC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04716 2025-12-05 physics.flu-dyn cs.AI 74%

Towards an AI Fluid Scientist: LLM-Powered Scientific Discovery in Experimental Fluid Mechanics

迈向人工智能流体科学家:基于LLM的实验流体力学中的科学发现

Haodong Feng, Lugang Ye, Dixia Fan

机构 * Westlake University(西湖大学)

专题命中 领域大模型 :LLM(title);分类 cs.AI

AI总结 本文提出基于LLM的AI流体科学家框架,实现自主实验流程,提升流体力学研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04834 2025-12-05 cs.AI cs.CL cs.IR 73%

Are LLMs Truly Multilingual? Exploring Zero-Shot Multilingual Capability of LLMs for Information Retrieval: An Italian Healthcare Use Case

LLMs真的多语言吗?探索LLMs在信息检索中的零样本多语言能力:一个意大利医疗应用案例

Vignesh Kumar Kembu, Pierandrea Morandini, Marta Bianca Maria Ranzini, Antonino Nocera

机构 * Department of Electrical, Computer and Biomedical Engineering(电气、计算机与生物医学工程系) University of Pavia(帕维亚大学) IRCCS Humanitas Research Hospital(人类itas研究医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了开源多语言LLMs在零样本条件下处理意大利语电子健康记录信息提取的能力,发现部分模型在泛化能力上存在不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04113 2025-12-05 cs.CY cs.AI cs.HC cs.LG 73%

AI-Enabled grading with near-domain data for scaling feedback with human-level accuracy

基于近域数据的AI评阅:实现人类水平准确性的反馈扩展

Shyam Agarwal, Ali Moghimi, Kevin C. Haudek

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于近域数据的AI评阅方法,实现人类水平的准确反馈,优于现有机器学习模型和大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04116 2025-12-05 cs.CY 67%

Mapping the Probabilistic AI Ecosystem in Criminal Justice in England and Wales

映射英格兰和威尔士刑事司法系统中的概率AI生态系统

Evdoxia Taka, Temitope Lawal, Muffy Calder, Michele Sevegnani, Kyriakos Kotsoglou, Elizabeth McClory-Tiarks, Marion Oswald

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文研究了英格兰和威尔士刑事司法系统中概率AI工具的映射,分析其应用现状、潜在影响及未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04520 2025-12-05 cs.CV 50%

Boundary-Aware Test-Time Adaptation for Zero-Shot Medical Image Segmentation

面向边界的测试时适应用于零样本医学图像分割

Chenlin Xu, Lei Zhang, Lituan Wang, Xinyu Pu, Pengfei Ma, Guangwu Qian, Zizhou Wang, Yan Wang

机构 * School of Computer Science, Sichuan University(四川大学计算机学院) Pittsburgh Institute, Sichuan University(四川大学匹兹堡学院) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(科技研究局高性能计算研究所)

专题命中 领域大模型 :foundation model(abstract)

AI总结 BA-TTA-SAM通过测试时适应提升SAM在医学图像零样本分割中的性能,采用高斯提示注入和边界感知注意力对齐机制,实现12.4%的Dice分数提升。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 11 篇

2512.04425 2025-12-05 cs.CV cs.AI 89%

Explainable Parkinsons Disease Gait Recognition Using Multimodal RGB-D Fusion and Large Language Models

可解释的帕金森病步态识别:基于多模态RGB-D融合与大语言模型

Manar Alnaasan, Md Selim Sarowar, Sungho Kim

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出基于多模态RGB-D融合与大语言模型的帕金森病步态识别框架,通过增强时空表示和语言解释提高识别准确性和临床可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04691 2025-12-05 cs.AI cs.CL cs.MA 88%

Towards Ethical Multi-Agent Systems of Large Language Models: A Mechanistic Interpretability Perspective

迈向伦理化的大型语言模型多智能体系统:从机制可解释性视角出发

Jae Hee Lee, Anne Lauscher, Stefano V. Albrecht

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文从机制可解释性视角出发,提出确保大型语言模型多智能体系统伦理行为的研究议程,聚焦于伦理评估框架、内部机制解析及参数高效对齐技术。

Comments Accepted to LaMAS 2026@AAAI'26 (https://sites.google.com/view/lamas2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04841 2025-12-05 cs.CR cs.AI 88%

SoK: a Comprehensive Causality Analysis Framework for Large Language Model Security

SoK:面向大语言模型安全的综合因果分析框架

Wei Zhao, Zhe Li, Jun Sun

机构 * Singapore Management University(新加坡管理大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出一个综合因果分析框架,用于研究大语言模型安全问题,通过系统分析因果因素提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15555 2025-12-05 cs.LG cs.AI stat.ML 86%

Bayesian Concept Bottleneck Models with LLM Priors

具有LLM先验的贝叶斯概念瓶颈模型

Jean Feng, Avni Kothari, Luke Zier, Chandan Singh, Yan Shuo Tan

机构 * University of California, San Francisco(加州大学旧金山分校) Microsoft Research(微软研究院) National University of Singapore(新加坡国立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出BC-LLM模型,利用贝叶斯框架和LLM作为先验,实现高效的概念提取和可解释性提升。

Comments 2025 Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00030 2025-12-05 cs.CL cs.CV 85%

SignBind-LLM: Multi-Stage Modality Fusion for Sign Language Translation

SignBind-LLM:多阶段模态融合用于手语翻译

Marshall Thomas, Edward Fish, Richard Bowden

机构 * CVSSP, University of Surrey(计算机视觉与模式识别研究所,萨里大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SignBind-LLM通过多阶段模态融合提升手语翻译的准确性和鲁棒性,实现高保真翻译效果。

详情

展开后加载摘要…

URL PDF HTML 收藏