arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-26 至 2025-08-26 共收录 302 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 63 篇

2410.17859 2025-08-26 cs.AI 57%

DataTales: A Benchmark for Real-World Intelligent Data Narration

Yajing Yang, Qian Liu, Min-Yen Kan

机构 * National University of Singapore(新加坡国立大学) Rio Tinto(里奥·廷特公司) Sea AI Lab(Sea AI实验室)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Accepted at EMNLP 2024 (main conference, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16788 2025-08-26 cs.CL 57%

Assess and Prompt: A Generative RL Framework for Improving Engagement in Online Mental Health Communities

Bhagesh Gaur, Karan Gupta, Aseem Srivastava, Manish Gupta, Md Shad Akhtar

机构 * IIIT Delhi, India(德里印度理工学院) Microsoft, India(微软印度)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments Full Paper accepted in EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17844 2025-08-26 cs.CV cs.AI 57%

SV3.3B: A Sports Video Understanding Model for Action Recognition

Sai Varun Kodathala, Yashwanth Reddy Vutukoori, Rakesh Vunnam

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments 8 pages, 6 figures, 4 tables. Submitted to AIxSET 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17726 2025-08-26 cs.CV 50%

Few-shot Human Action Anomaly Detection via a Unified Contrastive Learning Framework

Koichiro Kamide, Shunsuke Sakai, Shun Maeda, Chunzhi Gu, Chao Zhang

机构 * University of Toyama(东大大学) University of Fukui(福井大学)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17719 2025-08-26 cs.SE 50%

DocFetch - Towards Generating Software Documentation from Multiple Software Artifacts

Akhila Sri Manasa Venigalla, Sridhar Chimalakonda

专题命中 评测与基准 :LLM(abstract)

Comments 12 pages, 7 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16942 2025-08-26 cs.CV 50%

HieroAction: Hierarchically Guided VLM for Fine-Grained Action Analysis

Junhao Wu, Xiuer Gu, Zhiying Li, Yeying Jin, Yunfeng Diao, Zhiyu Li, Zhenbo Song, Xiaomei Zhang, Zhaoxin Fan

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02259 2025-08-26 cs.CV 50%

T*: Re-thinking Temporal Search for Long-Form Video Understanding

Jinhui Ye, Zihan Wang, Haosen Sun, Keshigeyan Chandrasegaran, Zane Durante, Cristobal Eyzaguirre, Yonatan Bisk, Juan Carlos Niebles, Ehsan Adeli, Li Fei-Fei, Jiajun Wu, Manling Li

专题命中 评测与基准 :language model(abstract)

Comments Accepted by CVPR 2025; A real-world long video needle-in-haystack benchmark; long-video QA with human ref frames

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16812 2025-08-26 cs.CV 50%

Towards Open-Vocabulary Multimodal 3D Object Detection with Attributes

Xinhao Xiang, Kuan-Chuan Peng, Suhas Lohit, Michael J. Jones, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校) Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室)

专题命中 评测与基准 :foundation model(abstract)

Comments This paper is accepted to BMVC 2025 as an oral paper. The OVAD dataset is available at https://doi.org/10.5281/zenodo.16904069

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06764 2025-08-26 cs.SE 50%

Rethinking Cognitive Complexity for Unit Tests: Toward a Readability-Aware Metric Grounded in Developer Perception

Wendkûuni C. Ouédraogo, Yinghua Li, Xueqi Dang, Xin Zhou, Anil Koyuncu, Jacques Klein, David Lo, Tegawendé F. Bissyandé

专题命中 评测与基准 :LLM(abstract)

Comments **Note:** This paper has been accepted for presentation at the 41st International Conference on Software Maintenance and Evolution (ICSME) 2025 conference - New Ideas and Emerging Results (NIER) Track

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 44 篇

2503.03182 2025-08-26 cs.DC 90%

Enhancing Memory Efficiency in Large Language Model Training Through Chronos-aware Pipeline Parallelism

Xinyuan Lin, Chenlu Li, Zongle Huang, Chunyu Wang, Bo Xiao, Huazhong Yang, Shishi Duan, Yongpan Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17250 2025-08-26 cs.CL cs.IR 89%

Routing Distilled Knowledge via Mixture of LoRA Experts for Large Language Model based Bundle Generation

Kaidong Feng, Zhu Sun, Hui Fang, Jie Yang, Wenyuan Liu, Yew-Soon Ong

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17209 2025-08-26 cs.DC 89%

Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning

Yebo Wu, Jingguang Li, Chunlin Tian, Zhijiang Guo, Li Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16678 2025-08-26 cs.SE cs.MA 89%

Cognitive Agents Powered by Large Language Models for Agile Software Project Management

Konrad Cinkusz, Jarosław A. Chudziak, Ewa Niewiadomska-Szynkiewicz

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18182 2025-08-26 cs.LG cs.AI math.OC 88%

AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models

Nikolay Kutuzov, Makar Baderko, Stepan Kulibaba, Artem Dzhalilov, Daniel Bobrov, Maxim Mashtaler, Alexander Gasnikov

机构 * Moscow Institute of Physics and Technology(莫斯科物理技术学院) The School of the Center for Teacher Excellence(教师卓越中心学校) Research Center of the Artificial Intelligence Institute(人工智能研究所研究部) Innopolis University(因诺波利斯大学) Sirius University of Science and Technology(西里乌斯科学技术大学) Steklov Institute(斯捷克洛夫研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17860 2025-08-26 cs.CV cs.AI 88%

AVAM: Universal Training-free Adaptive Visual Anchoring Embedded into Multimodal Large Language Model for Multi-image Question Answering

Kang Zeng, Guojin Zhong, Jintao Cheng, Jin Yuan, Zhiyong Li

机构 * Hunan University(湖南大学) South China Normal University(华南师范大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17480 2025-08-26 cs.CL 88%

Unified attacks to large language model watermarks: spoofing and scrubbing in unauthorized knowledge distillation

Xin Yi, Yue Li, Shunfan Zheng, Linlin Wang, Xiaoling Wang, Liang He

机构 * Lab of Artificial Intelligence for Education, East China Normal University, Shanghai 200062, China(教育人工智能实验室,华东师范大学,上海200062,中国) Shanghai Institute of Artificial Intelligence for Education, East China Normal University, Shanghai 200062, China(教育人工智能研究所,华东师范大学,上海200062,中国) School of Computer Science and Technology, East China Normal University, Shanghai 200062, China(计算机科学与技术学院,华东师范大学,上海200062,中国)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18023 2025-08-26 cs.CL 88%

Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference

Zhuo Chen, Xinyu Wang, Yong Jiang, Zhen Zhang, Xinyu Geng, Pengjun Xie, Fei Huang, Kewei Tu

机构 * School of Information Science and Technology, ShanghaiTech University(信息科学与技术学院,上海科技大学) Shanghai Engineering Research Center of Intelligent Vision and Imaging(智能视觉与成像上海工程研究中心) Institute for Intelligent Computing, Alibaba Group(智能计算研究院,阿里巴巴集团)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16713 2025-08-26 cs.SE cs.AI hep-ex 88%

CelloAI: Leveraging Large Language Models for HPC Software Development in High Energy Physics

Mohammad Atif, Kriti Chopra, Ozgur Kilic, Tianle Wang, Zhihua Dong, Charles Leggett, Meifeng Lin, Paolo Calafiura, Salman Habib

机构 * Brookhaven National Laboratory(布鲁克海文国家实验室) Lawrence Berkeley National Laboratory(伯克利国家实验室) Argonne National Laboratory(阿贡国家实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16712 2025-08-26 cs.PF cs.AI cs.AR cs.DC cs.LG 88%

Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective

Tianyao Shi, Yi Ding

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 14 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16646 2025-08-26 cs.DC cs.AI 86%

Equinox: Holistic Fair Scheduling in Serving Large Language Models

Zhixiang Wei, James Yen, Jingyi Chen, Ziyang Zhang, Zhibai Huang, Chen Chen, Xingzi Yu, Yicheng Gu, Chenggang Wu, Yun Wang, Mingyuan Xia, Jie Wu, Hao Wang, Zhengwei Qi

机构 * Shanghai Jiao Tong University(上海交通大学) Cloud Computing Research Institute, China Telecom(云计算研究所,中国电信) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00850 2025-08-26 cs.LG cs.AI 86%

ICQuant: Index Coding enables Low-bit LLM Quantization

Xinlin Li, Osama Hanna, Christina Fragouli, Suhas Diggavi

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Meta, GenAI(Meta)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16597 2025-08-26 q-bio.NC cs.AI cs.LG 86%

Bridging Foundation Models and Efficient Architectures: A Modular Brain Imaging Framework with Local Masking and Pretrained Representation Learning

Yanwen Wang, Xinglin Zhao, Yijin Song, Xiaobo Liu, Yanrong Hao, Rui Cao, Xin Wen

机构 * AAAI Press(AAAI 压力)

专题命中 效率与部署 :foundation model(title,abstract);LLM(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17814 2025-08-26 cs.DC cs.AI 85%

Scalable Engine and the Performance of Different LLM Models in a SLURM based HPC architecture

Anderson de Lima Luiz, Shubham Vijay Kurlekar, Munir Georges

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted in ESSV 2025 - https://www.essv.de/paper.php?id=1265

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17715 2025-08-26 cs.IR cs.CL 85%

How Do LLM-Generated Texts Impact Term-Based Retrieval Models?

Wei Huang, Keping Bi, Yinqiong Cai, Wei Chen, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences University of Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院大学) Baidu Inc.(百度公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16962 2025-08-26 cs.RO cs.AI 85%

LLM-based Human-like Traffic Simulation for Self-driving Tests

Wendi Li, Hao Wu, Han Gao, Bing Mao, Fengyuan Xu, Sheng Zhong

机构 * National Key Lab for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01070 2025-08-26 cs.LG cs.PF 85%

An Inquiry into Datacenter TCO for LLM Inference with FP8

Jiwoo Kim, Joonhyung Lee, Gunho Park, Byeongwook Kim, Se Jung Kwon, Dongsoo Lee, Youngjoo Lee

机构 * POSTECH NAVER Cloud(NAVER云) KAIST(韩国科学技术院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18089 2025-08-26 cs.SE 85%

LLM-Guided Genetic Improvement: Envisioning Semantic Aware Automated Software Evolution

Karine Even-Mendoza, Alexander Brownlee, Alina Geiger, Carol Hanna, Justyna Petke, Federica Sarro, Dominik Sobania

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17720 2025-08-26 cs.SE 85%

RepoTransAgent: Multi-Agent LLM Framework for Repository-Aware Code Translation

Ziqi Guan, Xin Yin, Zhiyuan Peng, Chao Ni

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16684 2025-08-26 cs.SE cs.HC 85%

Democratizing AI Development: Local LLM Deployment for India's Developer Ecosystem in the Era of Tokenized APIs

Vikranth Udandarao, Nipun Misra

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments for survey results, check https://docs.google.com/spreadsheets/d/1t0eV9oURaiu2HfARWo6sriBO0eC8bHUyZNN7CgK2NAk/edit?usp=sharing

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14148 2025-08-26 cs.CL cs.LG 84%

DPad: Efficient Diffusion Language Models with Suffix Dropout

Xinhua Chen, Sitao Huang, Cong Guo, Chiyue Wei, Yintao He, Jianyi Zhang, Hai "Helen" Li, Yiran Chen

机构 * Duke University(杜克大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏