arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-04 至 2025-08-04 共收录 106 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 26 篇

2506.06854 2025-08-04 cs.CV 50%

DONUT: A Decoder-Only Model for Trajectory Prediction

Markus Knoche, Daan de Geus, Bastian Leibe

机构 * RWTH Aachen University(亚琛工业大学) Eindhoven University of Technology(埃因霍温理工大学)

专题命中 评测与基准 :language model(abstract)

Comments ICCV 2025. Project page at https://vision.rwth-aachen.de/donut

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11172 2025-08-04 cs.CV 50%

TerraMesh: A Planetary Mosaic of Multimodal Earth Observation Data

Benedikt Blumenstiel, Paolo Fraccaro, Valerio Marsocci, Johannes Jakubik, Stefano Maurogiovanni, Mikolaj Czerkawski, Rocco Sedona, Gabriele Cavallaro, Thomas Brunschwiler, Juan Bernabe-Moreno, Nicolas Longépé

机构 * IBM Research – Europe(IBM欧洲研究院) European Space Agency(欧洲航天局) roman_Φ -Lab(Φ实验室) Forschungszentrum Jülich(尤利奇研究中心) University of Iceland(冰岛大学)

专题命中 评测与基准 :foundation model(abstract)

Comments Proceedings of the Computer Vision and Pattern Recognition Conference (CVPR) Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 15 篇

2508.00185 2025-08-04 cs.CL 89%

Comparison of Large Language Models for Deployment Requirements

Alper Yaman, Jannik Schwab, Christof Nitsche, Abhirup Sinha, Marco Huber

机构 * Fraunhofer Institute for Manufacturing Engineering and Automation IPA(弗劳恩霍夫智能制造与自动化研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref Proceedings of the First International Conference on Generative Pre-trained Transformer Models and Beyond (GPTMB 2024), Porto, Portugal, Jun. 2024, pp. 41-44, ISBN: 978-1-68558-182-4

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13205 2025-08-04 quant-ph 89%

Quantum Knowledge Distillation for Large Language Models

Lingxiao Li, Yihao Wang, Jiacheng Fan, Jing Li, Sujuan Qin, Qiaoyan Wen, Fei Gao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02443 2025-08-04 cs.CL 88%

AILS-NTUA at SemEval-2025 Task 4: Parameter-Efficient Unlearning for Large Language Models using Data Chunking

Iraklis Premptis, Maria Lymperaiou, Giorgos Filandrianos, Orfeas Menis Mastromichalakis, Athanasios Voulodimos, Giorgos Stamou

机构 * National Technical University of Athens(希腊国家技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Journal ref The 19th International Workshop on Semantic Evaluation (SemEval 2025) - Best paper award

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21170 2025-08-04 cs.CR cs.AI cs.CL 86%

OneShield -- the Next Generation of LLM Guardrails

Chad DeLuca, Anna Lisa Gentile, Shubhi Asthana, Bing Zhang, Pawan Chowdhary, Kellen Cheng, Basel Shbita, Pengyuan Li, Guang-Jie Ren, Sandeep Gopisetty

机构 * IBM Research(IBM研究院) Princeton University(普林斯顿大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00234 2025-08-04 cs.NI cs.AI cs.DC cs.MA 85%

Quality-of-Service Aware LLM Routing for Edge Computing with Multiple Experts

Jin Yang, Qiong Wu, Zhiying Feng, Zhi Zhou, Deke Guo, Xu Chen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学计算机科学与工程系) College of Systems Engineering, National University of Defense Technology(国防科技大学系统工程学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19693 2025-08-04 cs.CL 85%

AdaptiVocab: Enhancing LLM Efficiency in Focused Domains through Lightweight Vocabulary Adaptation

Itay Nakash, Nitay Calderon, Eyal Ben David, Elad Hoffer, Roi Reichart

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00260 2025-08-04 cs.CV cs.MM 82%

Instruction-Grounded Visual Projectors for Continual Learning of Generative Vision-Language Models

Hyundong Jin, Hyung Jin Chang, Eunwoo Kim

机构 * School of Computer Science and Engineering, Chung-Ang University(Chung-Ang 大学计算机科学与工程学院) School of Computer Science, University of Birmingham(布拉德福德大学计算机科学学院)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00041 2025-08-04 cs.LG cs.AI cs.DC 79%

Learning Like Humans: Resource-Efficient Federated Fine-Tuning through Cognitive Developmental Stages

Yebo Wu, Jingguang Li, Zhijiang Guo, Li Li

机构 * University of Macau(澳门大学) HKUST(香港科技大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13180 2025-08-04 cs.CV 78%

Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration

Mark Endo, Xiaohan Wang, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学)

专题命中 效率与部署 :language model(title,abstract)

Comments ICCV 2025, project page: https://web.stanford.edu/~markendo/projects/feather

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00478 2025-08-04 cs.CR cs.AI 70%

CyGATE: Game-Theoretic Cyber Attack-Defense Engine for Patch Strategy Optimization

Yuning Jiang, Nay Oo, Qiaoran Meng, Lu Lin, Dusit Niyato, Zehui Xiong, Hoon Wei Lim, Biplab Sikdar

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Queen's University Belfast(女王大学贝尔法斯特分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00220 2025-08-04 cs.CL 70%

Semantic Compression for Word and Sentence Embeddings using Discrete Wavelet Transform

Rana Aref Salama, Abdou Youssef, Mona Diab

机构 * School of Engineering and Applied Science, George Washington University(工程与应用科学学院,乔治华盛顿大学) Faculty of Computers and Artificial Intelligence, Cairo University(计算机与人工智能学院,开罗大学) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref https://aclanthology.org/2024.findings-acl.945/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00128 2025-08-04 cs.SE 67%

How Quantization Impacts Privacy Risk on LLMs for Code?

Md Nazmul Haque, Hua Yang, Zhou Yang, Bowen Xu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00324 2025-08-04 cs.AI cs.CL 62%

R1-ACT: Efficient Reasoning Model Safety Alignment by Activating Safety Knowledge

Yeonjun In, Wonjoong Kim, Sangwu Park, Chanyoung Park

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00180 2025-08-04 cs.LG cs.AI stat.ML 62%

EMA Without the Lag: Bias-Corrected Iterate Averaging Schemes

Adam Block, Cyril Zhang

机构 * Columbia University(哥伦比亚大学) Microsoft Research NYC(微软研究院纽约)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00746 2025-08-04 cs.CV 50%

GECO: Geometrically Consistent Embedding with Lightspeed Inference

Regine Hartwig, Dominik Muhle, Riccardo Marin, Daniel Cremers

机构 * TU Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 领域大模型 11 篇

2508.00581 2025-08-04 cs.AI 85%

From EMR Data to Clinical Insight: An LLM-Driven Framework for Automated Pre-Consultation Questionnaire Generation

Ruiqing Ding, Qianfang Sun, Yongkang Leng, Hui Yin, Xiaojian Li

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00614 2025-08-04 cs.CL cs.AI 84%

Prompting Science Report 3: I'll pay you or I'll kill you -- but will you care?

Lennart Meincke, Ethan Mollick, Lilach Mollick, Dan Shapiro

专题命中 领域大模型 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00331 2025-08-04 cs.LG 79%

Embryology of a Language Model

George Wang, Garrett Baker, Andrew Gordon, Daniel Murfet

专题命中 领域大模型 :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10845 2025-08-04 cs.LG 79%

Panopticon: Advancing Any-Sensor Foundation Models for Earth Observation

Leonard Waldmann, Ando Shah, Yi Wang, Nils Lehmann, Adam J. Stewart, Zhitong Xiong, Xiao Xiang Zhu, Stefan Bauer, John Chuang

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

Comments First two authors contributed equally. Code is available at: https://github.com/Panopticon-FM/panopticon. Accepted to CVPR 2025

Journal ref Proceedings of the Computer Vision and Pattern Recognition Conference (2025) 2204-2214

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00238 2025-08-04 cs.CL cs.AI 79%

Model Misalignment and Language Change: Traces of AI-Associated Language in Unscripted Spoken English

Bryce Anderson, Riley Galpin, Tom S. Juzek

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at AIES 2025. To appear in the AIES Proceedings. 14 pages, 2 figures, 2 tables. Licensed under CC BY-SA 4.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07556 2025-08-04 cs.SE cs.AI 77%

Novice Developers' Perspectives on Adopting LLMs for Software Development: A Systematic Literature Review

Samuel Ferino, Rashina Hoda, John Grundy, Christoph Treude

机构 * Monash University(墨尔本大学) Singapore Management University(新加坡管理大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00669 2025-08-04 cs.CL cs.AI cs.CV cs.LG 75%

Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications

Wenxuan Wang, Zizhan Ma, Meidan Ding, Shiyi Zheng, Shengyuan Liu, Jie Liu, Jiaming Ji, Wenting Chen, Xiang Li, Linlin Shen, Yixuan Yuan

机构 * Renmin University of China(中国人民大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen University(深圳大学) City University of Hong Kong(香港城市大学) Peking University(北京大学) Massachusetts General Hospital and Harvard Medical School(麻省总医院和哈佛医学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00013 2025-08-04 cs.PL 67%

From Provable Correctness to Probabilistic Generation: A Comparative Review of Program Synthesis Paradigms

Zurabi Kobaladze, Anna Arnania, Tamar Sanikidze

专题命中 领域大模型 :large language model(abstract);language model(abstract)

Comments 78 pages. Undergraduate thesis project submitted in partial fulfillment of the requirements for the Bachelor's degree in Computer Science at Kutaisi International University

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02364 2025-08-04 cs.LG cs.AI cs.CL 67%

Loss Landscape Degeneracy and Stagewise Development in Transformers

Jesse Hoogland, George Wang, Matthew Farrugia-Roberts, Liam Carroll, Susan Wei, Daniel Murfet

机构 * Timaeus Department of Computer Science, University of Oxford(计算机科学系,牛津大学) Department of Econometrics and Business Statistics, Monash University(计量经济学与商业统计系,墨尔本大学) School of Mathematics and Statistics, the University of Melbourne(数学与统计学系,墨尔本大学)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear, TMLR. Material on essential dynamics from v1 of this preprint has been removed and developed in arXiv:2501.17745

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00171 2025-08-04 cs.CV cs.CL 65%

On the Risk of Misleading Reports: Diagnosing Textual Biases in Multimodal Clinical AI

David Restrepo, Ira Ktena, Maria Vakalopoulou, Stergios Christodoulidis, Enzo Ferrante

机构 * MICS, CentraleSupélec - Université Paris-Saclay, France(MICS,中央圣艾尔布兰大学-巴黎萨克雷大学,法国) Google DeepMind, London, UK(谷歌DeepMind,伦敦,英国) CONICET, Universidad de Buenos Aires, Argentina(CONICET,布宜诺斯艾利斯大学,阿根廷)

专题命中 领域大模型 :language model(abstract,comments);分类 cs.CL;large language model(comments)

Comments Accepted to MICCAI 2025 1st Workshop on Multimodal Large Language Models (MLLMs) in Clinical Practice

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19651 2025-08-04 cs.LG cs.CL 62%

Unlocking Multi-Modal Potentials for Link Prediction on Dynamic Text-Attributed Graphs

Yuanyuan Xu, Wenjie Zhang, Ying Zhang, Xuemin Lin, Xiwei Xu

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 知识编辑与模型理解 5 篇

2503.02442 2025-08-04 cs.CL 88%

AILS-NTUA at SemEval-2025 Task 3: Leveraging Large Language Models and Translation Strategies for Multilingual Hallucination Detection

Dimitra Karkani, Maria Lymperaiou, Giorgos Filandrianos, Nikolaos Spanos, Athanasios Voulodimos, Giorgos Stamou

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) AILS Laboratory(AILS实验室) National Technical University of Athens(雅典国家技术大学)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Journal ref The 19th International Workshop on Semantic Evaluation (SemEval 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23628 2025-08-04 cs.CL cs.AI 79%

AutoSchemaKG: Autonomous Knowledge Graph Construction through Dynamic Schema Induction from Web-Scale Corpora

Jiaxin Bai, Wei Fan, Qi Hu, Qing Zong, Chunyang Li, Hong Ting Tsang, Hongyu Luo, Yauwai Yim, Haoyu Huang, Xiao Zhou, Feng Qin, Tianshi Zheng, Xi Peng, Xin Yao, Huiwen Yang, Leijie Wu, Yi Ji, Gong Zhang, Renhai Chen, Yangqiu Song

机构 * CSE, HKUST(香港科技大学计算机科学与工程系) CSE, CUHK(香港城市大学计算机科学与工程系) Theory Lab, Huawei(华为理论实验室)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, preprint, code: https://github.com/HKUST-KnowComp/AutoSchemaKG

详情

展开后加载摘要…

URL PDF HTML 收藏