arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-14 至 2025-10-14 共收录 399 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 63 篇

2505.19147 2025-10-14 cs.CL cs.AI cs.CV 73%

Shifting AI Efficiency From Model-Centric to Data-Centric Compression

Xuyang Liu, Zichen Wen, Shaobo Wang, Junjie Chen, Zhishan Tao, Yubo Wang, Tailai Chen, Xiangqi Jin, Chang Zou, Yiyu Wang, Chenfei Liao, Xu Zheng, Honggang Chen, Weijia Li, Xuming Hu, Conghui He, Linfeng Zhang

机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Sichuan University(四川大学) University of Electronic Science & Technology of China(电子科技大学) Shanghai AI Laboratory(上海人工智能实验室) Sun Yat-sen University(中山大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Project: \url{https://github.com/xuyang-liu16/Awesome-Token-level-Model-Compression}

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11236 2025-10-14 cs.CL 70%

XQuant: Achieving Ultra-Low Bit KV Cache Quantization with Cross-Layer Compression

Haoqi Yang, Yao Yao, Zuchao Li, Baoyuan Qi, Guoming Liu, Hai Zhao

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院) Xiaomi Inc.(小米公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments To be published in The 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03134 2025-10-14 cs.LG 70%

Enhancing XAI Narratives through Multi-Narrative Refinement and Knowledge Distillation

Flavio Giorgi, Matteo Silvestri, Cesare Campagnano, Fabrizio Silvestri, Gabriele Tolomei

机构 * Sapienza University of Rome(罗马大学)

专题命中 效率与部署 :language model(abstract);small language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17178 2025-10-14 cs.CL 70%

Attention Consistency for LLMs Explanation

Tian Lan, Jinyuan Xu, Xue He, Jenq-Neng Hwang, Lei Li

机构 * Milkuya Studio(Milkuya工作室) ERTIM, INALCO(ERTIM与INALCO) Sorbonne University(索邦大学) IRD(国家农业与食品研究所) University of Washington(华盛顿大学) VitaSight

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10290 2025-10-14 cs.SE cs.LG 70%

Grounded AI for Code Review: Resource-Efficient Large-Model Serving in Enterprise Pipelines

Sayan Mandal, Hua Jiang

专题命中 效率与部署 :LLM(abstract);prompting(abstract);分类 cs.LG

Comments Submitted to MLSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04429 2025-10-14 cs.DC 67%

IntentContinuum: Using LLMs to Support Intent-Based Computing Across the Compute Continuum

Negin Akbari, John Grundy, Aamir Cheema, Adel N. Toosi

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments 11 pages, 10 figures

Journal ref 2025 IEEE International Conference on Web Services (ICWS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11632 2025-10-14 quant-ph 67%

Attention to Quantum Complexity

Hyejin Kim, Yiqing Zhou, Yichen Xu, Kaarthik Varma, Amir H. Karamlou, Ilan T. Rosen, Jesse C. Hoke, Chao Wan, Jin Peng Zhou, William D. Oliver, Yuri D. Lensky, Kilian Q. Weinberger, Eun-Ah Kim

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Journal ref Science Advances 11, eadu0059 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10560 2025-10-14 cs.CL cs.AI cs.CV 62%

BitMar: Low-Bit Multimodal Fusion with Episodic Memory for Edge Devices

Euhid Aman, Esteban Carlin, Hsing-Kuo Pao, Giovanni Beltrame, Ghaluh Indah Permata Sari, Yie-Tarng Chen

机构 * NTUST(国立台湾科技大学) Polytechnique Montréal(蒙特利尔理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments 6 pages, BabyLM Workshop, EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10497 2025-10-14 cs.CL cs.AI 62%

QUITO-X: A New Perspective on Context Compression from the Information Bottleneck Theory

Yihang Wang, Xu Huang, Bowen Tian, Yueyang Su, Lei Yu, Huaming Liao, Yixing Fan, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, ICT, CAS(人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10293 2025-10-14 cs.CL cs.AI 62%

MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning

Hongwei Chen, Yishu Lei, Dan Zhang, Bo Ke, Danxiang Zhu, Xuyi Chen, Yuxiang Lu, Zhengjie Huang, Shikun Feng, Jingzhou He, Yu Sun, Hua Wu, Haifeng Wang

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10655 2025-10-14 q-bio.OT 60%

Isotropy and Geometry of Pretrained Protein LMs

Sheikh Azizul Hakim, Kowshic Roy, M Saifur Rahman

专题命中 效率与部署 :language model(abstract,comments);large language model(comments)

Comments Published in the Proceedings of the ICML 2025 Workshop on Multi-modal Foun- dation Models and Large Language Models for Life Sciences, Vancouver, Canada. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11561 2025-10-14 cs.LG cs.SC 57%

Ontolearn-A Framework for Large-scale OWL Class Expression Learning in Python

Caglar Demir, Alkid Baci, N'Dah Jean Kouagou, Leonie Nora Sieger, Stefan Heindorf, Simon Bin, Lukas Blübaum, Alexander Bigerl, Axel-Cyrille Ngonga Ngomo

机构 * Paderborn University(帕德博恩大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

Journal ref Journal of Machine Learning Research 26 (2025) 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11484 2025-10-14 cs.LG cs.AR 57%

Rescaling-Aware Training for Efficient Deployment of Deep Learning Models on Full-Integer Hardware

Lion Mueller, Alberto Garcia-Ortiz, Ardalan Najafi, Adam Fuks, Lennart Bamberg

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

Comments Submitted to IEEE Embedded Systems Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09815 2025-10-14 cs.CV cs.AI 57%

Towards Understanding Ambiguity Resolution in Multimodal Inference of Meaning

Yufei Wang, Adriana Kovashka, Loretta Fernández, Marc N. Coutanche, Seth Wiener

机构 * University of Pittsburgh(匹兹堡大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :prompting(abstract);分类 cs.AI

Comments Accepted to International Conference on Development and Learning (ICDL) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09684 2025-10-14 cs.LG stat.ME 57%

Using LLMs to Directly Guess Conditional Expectations Can Improve Efficiency in Causal Estimation

Chris Engh, P. M. Aronow

机构 * Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10917 2025-10-14 quant-ph 50%

Dominant spin-spin relaxation mechanism at clock transition of the $Ho_{x}Y_{1-x}W_{10}$ complex at different concentrations

Xiao Chen, Haechan Park, Silas Hoffman, Shuanglong Liu, Hai-Ping Cheng

专题命中 效率与部署 :prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01185 2025-10-14 cs.RO 50%

HoMeR: Learning In-the-Wild Mobile Manipulation via Hybrid Imitation and Whole-Body Control

Priya Sundaresan, Rhea Malhotra, Phillip Miao, Jingyun Yang, Jimmy Wu, Hengyuan Hu, Rika Antonova, Francis Engelmann, Dorsa Sadigh, Jeannette Bohg

专题命中 效率与部署 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09667 2025-10-14 cs.CV cs.RO 50%

OmniSAT: Compact Action Token, Faster Auto Regression

Huaihai Lyu, Chaofan Chen, Senwei Xie, Pengwei Wang, Xiansheng Chen, Shanghang Zhang, Changsheng Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Institute of Computation, Chinese Academy of Sciences(中国科学院计算研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Peking University(北京大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 34 篇

2510.11556 2025-10-14 cs.CY 91%

Personalized and Constructive Feedback for Computer Science Students Using the Large Language Model (LLM)

Javed Ali Khan, Muhammad Yaqoob, Mamoona Tasadduq, Hafsa Shareef Dar, Aitezaz Ahsan

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09279 2025-10-14 cs.CV cs.AI cs.CL 90%

Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models

Anita Kriz, Elizabeth Laura Janes, Xing Shen, Tal Arbel

机构 * McGill University(麦吉尔大学) Mila – Quebec AI Institute(魁北克AI研究所)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to ICCV 2025 Workshop CVAMD

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10278 2025-10-14 cs.LG cs.AI 90%

Simulating Viva Voce Examinations to Evaluate Clinical Reasoning in Large Language Models

Christopher Chiu, Silviu Pitis, Mihaela van der Schaar

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Toronto(多伦多大学) University of Cambridge(剑桥大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10475 2025-10-14 cs.CL cs.AI 85%

Assessing Large Language Models for Structured Medical Order Extraction

A H M Rezaul Karim, Ozlem Uzuner

机构 * George Mason University(乔治·马歇尔大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10955 2025-10-14 cs.IR 85%

HatLLM: Hierarchical Attention Masking for Enhanced Collaborative Modeling in LLM-based Recommendation

Yu Cui, Feng Liu, Jiawei Chen, Canghong Jin, Xingyu Lou, Changwang Zhang, Jun Wang, Yuegang Sun, Can Wang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09635 2025-10-14 cs.CR 85%

A Method for Quantifying Human Risk and a Blueprint for LLM Integration

Giuseppe Canale

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25626 2025-10-14 cs.AR 85%

LLM-Powered Code Analysis and Optimization for Gaussian Splatting Kernels

Yi Hu, Huiyang Zhou

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Updated Figure 12

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15800 2025-10-14 q-fin.TR 85%

LLM Agents Do Not Replicate Human Market Traders: Evidence From Experimental Finance

Thomas Henning, Siddhartha M. Ojha, Ross Spoon, Jiatong Han, Colin F. Camerer

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 51 pages, 33 figures, 12 tables, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09557 2025-10-14 cs.IR 80%

Doc2Query++: Topic-Coverage based Document Expansion and its Application to Dense Retrieval via Dual-Index Fusion

Tzu-Lin Kuo, Wei-Ning Chiu, Wei-Yun Ma, Pu-Jen Cheng

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04861 2025-10-14 cs.LG 79%

A Clinical-grade Universal Foundation Model for Intraoperative Pathology

Zihan Zhao, Fengtao Zhou, Ronggang Li, Bing Chu, Xinke Zhang, Xueyi Zheng, Ke Zheng, Xiaobo Wen, Jiabo Ma, Yihui Wang, Jiewei Chen, Chengyou Zheng, Jiangyu Zhang, Yongqin Wen, Jiajia Meng, Ziqi Zeng, Xiaoqing Li, Jing Li, Dan Xie, Yaping Ye, Yu Wang, Hao Chen, Muyan Cai

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21625 2025-10-14 cs.CL cs.AI cs.IR 79%

Doc2SAR: A Synergistic Framework for High-Fidelity Extraction of Structure-Activity Relationships from Scientific Documents

Jiaxi Zhuang, Kangning Li, Jue Hou, Mingjun Xu, Zhifeng Gao, Hengxing Cai

专题命中 领域大模型 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11076 2025-10-14 cs.SE 78%

DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education

Lingyue Fu, Haowei Yuan, Datong Chen, Xinyi Dai, Qingyao Li, Weinan Zhang, Weiwen Liu, Yong Yu

专题命中 领域大模型 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏