arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-25 至 2025-08-25 共收录 138 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 34 篇

2409.04598 2025-08-25 cs.CV 50%

A Novel Dataset for Video-Based Neurodivergent Classification Leveraging Extra-Stimulatory Behavior

Manuel Serna-Aguilera, Xuan Bac Nguyen, Han-Seok Seo, Khoa Luu

机构 * Dept. of EECS University of Arkansas Fayetteville, United States(电子工程与计算机科学系 美国阿肯色大学富特海德分校) Dept. of Food Science University of Arkansas Fayetteville, United States(食品科学系 美国阿肯色大学富特海德分校)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 8 篇

2508.15828 2025-08-25 cs.LG cs.CL 92%

Z-Pruner: Post-Training Pruning of Large Language Models for Efficiency without Retraining

Samiul Basir Bhuiyan, Md. Sazzad Hossain Adib, Mohammed Aman Bhuiyan, Muhammad Rafsan Kabir, Moshiur Farazi, Shafin Rahman, Nabeel Mohammed

机构 * Department of Electrical and Computer Engineering, North South University, Dhaka, 1229, Bangladesh(电气与计算机工程系,北南大学,达卡,孟加拉国) Data Science and AI, University of Doha for Science and Technology, Doha, Qatar(数据科学与人工智能,多哈科学技术大学,多哈,卡塔尔)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);LLM(abstract)

Comments Accepted at AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16456 2025-08-25 cs.CL 85%

A Probabilistic Inference Scaling Theory for LLM Self-Correction

Zhe Yang, Yichang Zhang, Yudong Wang, Ziyao Xu, Junyang Lin, Zhifang Sui

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16449 2025-08-25 cs.PF 85%

GreenLLM: SLO-Aware Dynamic Frequency Scaling for Energy-Efficient LLM Serving

Qunyou Liu, Darong Huang, Marina Zapater, David Atienza

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16059 2025-08-25 cs.AI cs.CL cs.LG 83%

Integrating Time Series into LLMs via Multi-layer Steerable Embedding Fusion for Enhanced Forecasting

Zhuomin Chen, Dan Li, Jiahui Zhou, Shunyu Wu, Haozheng Ye, Jian Lou, See-Kiong Ng

机构 * School of Software Engineering Sun Yat-Sen University(软件工程学院中山大学) Institute of Data Science(数据科学研究院) School of Computing(计算机学院) National University of Singapore(新加坡国立大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments To be published in CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12937 2025-08-25 cs.AI cs.CL 82%

HypER: Literature-grounded Hypothesis Generation and Distillation with Provenance

Rosni Vasu, Chandrayee Basu, Bhavana Dalvi Mishra, Cristina Sarasua, Peter Clark, Abraham Bernstein

专题命中 效率与部署 :large language model(abstract);language model(abstract);small language model(abstract);SLM(abstract)

Comments EMNLP 2025, 26 pages (9 pages: main paper body)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15877 2025-08-25 cs.CL cs.AI cs.IR cs.LG 75%

Annif at the GermEval-2025 LLMs4Subjects Task: Traditional XMTC Augmented by Efficient LLMs

Osma Suominen, Juho Inkinen, Mona Lehtinen

机构 * National Library of Finland, University of Helsinki(芬兰国家图书馆,赫尔辛基大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 5 pages, 4 figures, accepted at KONVENS 2025. arXiv admin note: substantial text overlap with arXiv:2504.19675

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16279 2025-08-25 cs.AI 70%

AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications

Dawei Gao, Zitao Li, Yuexiang Xie, Weirui Kuang, Liuyi Yao, Bingchen Qian, Zhijian Ma, Yue Cui, Haohao Luo, Shen Li, Lu Yi, Yi Yu, Shiqi He, Zhiling Luo, Wenmeng Zhou, Zhicheng Zhang, Xuguang He, Ziqian Chen, Weikai Liao, Farruh Isakulovich Kushnazarov, Yaliang Li, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00015 2025-08-25 cs.CY cs.AI 70%

Ethical Concerns of Generative AI and Mitigation Strategies: A Systematic Mapping Study

Yutan Huang, Chetan Arora, Wen Cheng Houng, Tanjila Kanij, Anuradha Madulgalla, John Grundy

机构 * Faculty of Information Technology, Monash University(墨尔本大学信息科技学院) School of Science, Computing and Engineering Technologies, Swinburne University(斯威本大学科学与工程技术学院) School of Information Technology, Deakin University(德肯大学信息科技学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 领域大模型 19 篇

2508.16357 2025-08-25 cs.CL cs.AI cs.IR 90%

MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering

Adil Bahaj, Mounir Ghogho

机构 * Mohammed 6 Polytechnic University(穆莱·马哈茂德六世理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03427 2025-08-25 cs.CL cs.AI cs.HC 90%

MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks

Mouath Abu Daoud, Chaimae Abouzahir, Leen Kharouf, Walid Al-Eisawi, Nizar Habash, Farah E. Shamout

机构 * New York University Abu Dhabi(纽约大学阿布扎克分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19744 2025-08-25 cs.CR cs.AI 89%

PrivComp-KG : Leveraging Knowledge Graph and Large Language Models for Privacy Policy Compliance Verification

Leon Garza, Lavanya Elluri, Anantaa Kotal, Aritran Piplai, Deepti Gupta, Anupam Joshi

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15797 2025-08-25 cs.CL cs.AI cs.LG 89%

Benchmarking the Medical Understanding and Reasoning of Large Language Models in Arabic Healthcare Tasks

Nouar AlDahoul, Yasir Zaki

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13227 2025-08-25 cs.CL cs.AI cs.LG 89%

DIDS: Domain Impact-aware Data Sampling for Large Language Model Training

Weijie Shi, Jipeng Zhang, Yaguang Wu, Jingzhi Fang, Ruiyuan Zhang, Jiajie Xu, Jia Zhu, Hao Chen, Yao Zhao, Sirui Han, Xiaofang Zhou

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) MetaX Alibaba Group(阿里巴巴集团) Zhejiang Normal University(浙江师范大学) Soochow University(苏州大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15802 2025-08-25 cs.CL cs.AI 88%

MAC: A Live Benchmark for Multimodal Large Language Models in Scientific Understanding

Mohan Jiang, Jin Gao, Jiahao Zhan, Dequan Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16065 2025-08-25 cs.CL 88%

Ethical Considerations of Large Language Models in Game Playing

Qingquan Zhang, Yuchen Li, Bo Yuan, Julian Togelius, Georgios N. Yannakakis, Jialin Liu

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Southern University of Science and Technology(南方科技大学) Tandon School of Engineering(Tandon工程学院) New York University(纽约大学) Institute of Digital Games(数字游戏研究所) University of Malta(马耳他大学) School of Data Science(数据科学学院) Lingnan University(岭南大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 19 pages

Journal ref Frontiers of Computer Science (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00998 2025-08-25 cs.SI cs.AI 85%

Are LLM-Powered Social Media Bots Realistic?

Lynnette Hui Xian Ng, Kathleen M. Carley

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted into SBP-BRiMS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10868 2025-08-25 cs.CL 85%

NitiBench: A Comprehensive Study of LLM Framework Capabilities for Thai Legal Question Answering

Pawitsapak Akarajaradwong, Pirat Pothavorn, Chompakorn Chaksangchaichot, Panuthep Tasawong, Thitiwat Nopparatbundit, Keerakiat Pratai, Sarana Nutanong

机构 * VISAI AI(VISAI人工智能) Vidyasirimedhi Institute of Science and Technology(维达亚西米德希科学与技术研究院) Faculty of Law, Thammasat University(朱拉隆功大学法学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02725 2025-08-25 cs.HC 85%

Leveraging LLM Tutoring Systems for Non-Native English Speakers in Introductory CS Courses

Ismael Villegas Molina, Audria Montalvo, Benjamin Ochoa, Paul Denny, Leo Porter

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 11 pages, 5 tables, 4 figures, 2025 ASEE Annual Conference & Exposition

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16225 2025-08-25 cs.CV cs.AI cs.LG 81%

An Investigation of Visual Foundation Models Robustness

Sandeep Gupta, Roberto Passerone

机构 * Centre for Secure Information Technologies (CSIT)(安全信息科技中心) Queen’s University Belfast(贝尔法斯特女王大学) Department of Information Engineering and Computer Science(信息工程与计算机科学系) University of Trento(特伦托大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15716 2025-08-25 cs.HC cs.AI 79%

Foundation Models for Cross-Domain EEG Analysis Application: A Survey

Hongqi Li, Yitong Chen, Yujuan Wang, Weihang Ni, Haodong Zhang

机构 * School of Software, Northwestern Polytechnical University(软件学院,西北工业大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

Comments Submitted to IEEE Journals

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15849 2025-08-25 cs.CL cs.IR 77%

MedCoT-RAG: Causal Chain-of-Thought RAG for Medical Question Answering

Ziyu Wang, Elahe Khatibi, Amir M. Rahmani

机构 * University of California, Irvine(加州大学 Irvine 分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02128 2025-08-25 cs.LG 77%

CROP: Circuit Retrieval and Optimization with Parameter Guidance using LLMs

Jingyu Pan, Isaac Jacobson, Zheng Zhao, Tung-Chieh Chen, Guanglei Zhou, Chen-Chia Chang, Vineet Rashingkar, Yiran Chen

机构 * Electrical and Computer Engineering, Duke University(电气与计算机工程系,杜克大学) Synopsys Inc.(Synopsys公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by ICCAD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16445 2025-08-25 cs.SE 75%

Using LLMs and Essence to Support Software Practice Adoption

Sonia Nicoletti, Paolo Ciancarini

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15796 2025-08-25 cs.CL cs.AI cs.CY cs.LG 75%

Benchmarking the Legal Reasoning of LLMs in Arabic Islamic Inheritance Cases

Nouar AlDahoul, Yasir Zaki

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13824 2025-08-25 cs.CL cs.AI 73%

Can Hallucinations Help? Boosting LLMs for Drug Discovery

Shuzhou Yuan, Zhan Qu, Ashish Yashwanth Kangen, Michael Färber

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16320 2025-08-25 physics.ed-ph 67%

AI-Supported Mini-Labs: Combining Smartphone-Based Experiments and Multimodal AI

Jochen Kuhn, David J. Rakestraw, Stefan Küchemann, Patrik Vogt

专题命中 领域大模型 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16126 2025-08-25 cs.IR cs.AI 57%

Spacetime-GR: A Spacetime-Aware Generative Model for Large Scale Online POI Recommendation

Haitao Lin, Zhen Yang, Jiawei Xue, Ziji Zhang, Luzhu Wang, Yikun Gu, Yao Xu, Xin Li

机构 * AMAP, Alibaba Group(阿里集团AMAP)

专题命中 领域大模型 :post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 知识编辑与模型理解 8 篇

2508.15841 2025-08-25 cs.CL cs.LG 90%

A Review of Developmental Interpretability in Large Language Models

Ihor Kendiukhov

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15847 2025-08-25 cs.CL cs.LG 88%

Mechanistic Exploration of Backdoored Large Language Model Attention Patterns

Mohammed Abu Baker, Lakshmi Babu-Saheer

机构 * Department of Computer Science, Anglia Ruskin University(计算机科学系,安格利亚 Ruskin 大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 13 pages. Mechanistic analysis of backdoored LLMs (Qwen2.5-3B). Code: https://github.com/mshahoyi/sa_attn_analysis. Base model: unsloth/Qwen2.5-3B-Instruct-unsloth-bnb-4bit. Finetuned models: https://huggingface.co/collections/mshahoyi/simple-sleeper-agents-68a1df3a7aaff310aa0e5336

详情

展开后加载摘要…

URL PDF HTML 收藏