arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-18 至 2025-08-18 共收录 108 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 30 篇

2508.11414 2025-08-18 cs.CL 70%

Survey-to-Behavior: Downstream Alignment of Human Values in LLMs via Survey Questions

Shangrui Nie, Florian Mai, David Kaczér, Charles Welch, Zhixue Zhao, Lucie Flek

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 7 pages 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11163 2025-08-18 cs.CL 70%

MobQA: A Benchmark Dataset for Semantic Understanding of Human Mobility Data through Question Answering

Hikaru Asano, Hiroki Ouchi, Akira Kasuga, Ryo Yonetani

机构 * The University of Tokyo \ AIP Japan Tokyo Nara Institute of Science The University of Tokyo \ AIP

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10955 2025-08-18 cs.CV cs.CL cs.MM 70%

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey

Wenbin An, Jiahao Nie, Yaqiang Wu, Feng Tian, Shijian Lu, Qinghua Zheng

机构 * School of Automation Science and Engineering, Xi’an Jiaotong University(自动化科学与工程学院,西安交通大学) Interdisciplinary Graduate Programme, Nanyang Technological University(跨学科研究生项目,南洋理工大学) Lenovo Research, Lenovo(联想研究院,联想) School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 21 pages, 361 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16636 2025-08-18 cs.CL cs.CV 70%

Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries

Yin Wu, Quanyu Long, Jing Li, Jianfei Yu, Wenya Wang

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 21 pages, 6 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11412 2025-08-18 cs.HC 67%

Towards Embodied Conversational Agents for Reducing Oral Exam Anxiety in Extended Reality

Jens Grubert, Yvonne Sedelmaier, Dieter Landes

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted to the IEEE ISMAR-Adjunct Proceedings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11192 2025-08-18 cs.CV 67%

Generating Dialogues from Egocentric Instructional Videos for Task Assistance: Dataset, Method and Benchmark

Lavisha Aggarwal, Vikas Bahirwani, Lin Li, Andrea Colaco

机构 * Google(谷歌)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11247 2025-08-18 cs.CL cs.AI 62%

Cross-Granularity Hypergraph Retrieval-Augmented Generation for Multi-hop Question Answering

Changjian Wang, Weihong Deng, Weili Guan, Quan Lu, Ning Jiang

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00184 2025-08-18 cs.LG cs.AI 62%

Text-to-Level Diffusion Models With Various Text Encoders for Super Mario Bros

Jacob Schrum, Olivia Kilday, Emilio Salas, Bess Hagan, Reid Williams

专题命中 评测与基准 :language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to appear in The 21st AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (November 10-14, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09057 2025-08-18 cs.CL 57%

MVISU-Bench: Benchmarking Mobile Agents for Real-World Tasks by Multi-App, Vague, Interactive, Single-App and Unethical Instructions

Zeyu Huang, Juyuan Wang, Longfeng Chen, Boyi Xiao, Leng Cai, Yawen Zeng, Jin Xu

机构 * South China University of Technology(华南理工大学) Pazhou Lab(Pazhou 实验室)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18932 2025-08-18 cs.MM cs.CL 57%

MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks

Lei Zhang, Xin Zhou, Chaoyue He, Di Wang, Yi Wu, Hong Xu, Wei Liu, Chunyan Miao

机构 * Nanyang Technological University(南洋理工大学) University College London(伦敦大学学院) Alibaba Group(阿里巴巴集团)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10030 2025-08-18 cs.RO cs.AI 57%

EmbodiedAgent: A Scalable Hierarchical Approach to Overcome Practical Challenge in Multi-Robot Control

Hanwen Wan, Yifei Chen, Yixuan Deng, Zeyu Wei, Dongrui Li, Zexin Lin, Donghao Wu, Jiu Cheng, Xiaoqiang Ji

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)科学与工程学院) Shenzhen Institute of Artificial Intelligence and Robotics for Society, China(社会人工智能与机器人研究所) The School of Computer Science, The University of Sydney, Australia(悉尼大学计算机科学学院) Faculty of Computer and Mathematical Sciences, The Hong Kong Polytechnic University, China(香港理工大学计算机与数学科学学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 16 篇

2310.06500 2025-08-18 cs.AI 89%

MetaAgents: Large Language Model Based Agents for Decision-Making on Teaming

Yuan Li, Lichao Sun, Yixuan Zhang

机构 * University of Cambridge(剑桥大学) Lehigh University(莱斯利大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11152 2025-08-18 q-fin.ST cs.AI 88%

AlphaAgents: Large Language Model based Multi-Agents for Equity Portfolio Constructions

Tianjiao Zhao, Jingrao Lyu, Stokes Jones, Harrison Garber, Stefano Pasquali, Dhagash Mehta

机构 * BlackRock, Inc.(BlackRock公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11454 2025-08-18 cs.CL cs.AI 86%

Reference Points in LLM Sentiment Analysis: The Role of Structured Context

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN(理化学研究所) AIP(Advanced Institute for Particle Physics)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11291 2025-08-18 cs.IT cs.AI cs.LG math.IT 84%

Dynamic Quality-Latency Aware Routing for LLM Inference in Wireless Edge-Device Networks

Rui Bao, Nan Xue, Yaping Sun, Zhiyong Chen

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学 Cooperative Medianet Innovation Center) Department of Broadband Communication, Pengcheng Laboratory, Shenzhen 518000, China(鹏城实验室宽带通信系) Future Network of Intelligence Institute (FNii), CUHK (Shenzhen), Shenzhen 518172, China(CUHK(深圳)未来网络智能研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments accepted by IEEE/CIC ICCC workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11287 2025-08-18 cs.IT cs.AI cs.LG math.IT 84%

CSGO: Generalized Optimization for Cold Start in Wireless Collaborative Edge LLM Systems

Xuran Liu, Nan Xue, Rui Bao, Yaping Sun, Zhiyong Chen, Meixia Tao, Xiaodong Xu, Shuguang Cui

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments submitted to Journal of Communications and Information Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11318 2025-08-18 cs.CL 83%

LLM Compression: How Far Can We Go in Balancing Size and Performance?

Sahil Sk, Debasish Dhal, Sonal Khosla, Sk Shahid, Sambit Shekhar, Akash Dhaka, Shantipriya Parida, Dilip K. Prasad, Ondřej Bojar

机构 * Odia Generative AI, India(奥迪生成人工智能,印度) AMD Silo AI, Finland(AMD Silo AI,芬兰) The Arctic University of Norway, Norway(挪威北极大学,挪威) Charles University, MFF, ÚFAL, Czech Republic(查尔斯大学,捷克共和国)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper has been accepted for presentation at the RANLP 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09023 2025-08-18 cs.DB cs.AI cs.CL 79%

E3-Rewrite: Learning to Rewrite SQL for Executability, Equivalence,and Efficiency

Dongjie Xu, Yue Cui, Weijie Shi, Qingzhi Ma, Hanghui Guo, Jiaming Li, Yao Zhao, Ruiyuan Zhang, Shimin Di, Jia Zhu, Kai Zheng, Jiajie Xu

机构 * stu.suda.edu.cn(苏州大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10111 2025-08-18 cs.LG cs.FL cs.PL cs.SE 77%

Constrained Decoding of Diffusion LLMs with Context-Free Grammars

Niels Mündler, Jasper Dekoninck, Martin Vechev

机构 * Department of Computer Science ETH Zurich(计算机科学系 高等理工大学苏黎世分校)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09615 2025-08-18 cs.LG cs.AI cs.PF 76%

SLiM: One-shot Quantization and Sparsity with Low-rank Approximation for LLM Weight Compression

Mohammad Mozaffari, Amir Yazdanbakhsh, Maryam Mehri Dehnavi

机构 * University of Toronto(多伦多大学) Google DeepMind(谷歌DeepMind) NVIDIA Research(NVIDIA研究)

专题命中 效率与部署 :LLM(title);分类 cs.AI、cs.LG

Comments Published at Proceedings of the 42 nd International Conference on Machine Learning (ICML 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11269 2025-08-18 cs.PF 75%

Inference performance evaluation for LLMs on edge devices with a novel benchmarking framework and metric

Hao Chen, Cong Tian, Zixuan He, Bin Yu, Yepang Liu, Jialun Cao

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07088 2025-08-18 cs.CL 70%

SPA: Towards A Computational Friendly Cloud-Base and On-Devices Collaboration Seq2seq Personalized Generation with Casual Inference

Yanming Liu, Xinyue Peng, Ningjing Sang, Yafeng Yan, Xiaolan Ke, Zhiting Zheng, Shaobo Liu, Songhang Deng, Jiannan Cao, Le Dai, Xingzu Liu, Ruilin Nong, Weihao Liu

机构 * Zhejiang University(浙江大学) Southeast University(东南大学) The Fu Foundation School of Engineering and Applied Science, Columbia University(哥伦比亚大学工程与应用科学学院) Stevens Institute of Technology(斯蒂文斯理工学院) Harvard University(哈佛大学) MIT(麻省理工学院) UCLA(加州大学洛杉矶分校) Beijing Institute of Technology(北京理工大学) Tianjin University(天津大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Update for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21569 2025-08-18 cs.SE 67%

A Systematic Literature Review of Parameter-Efficient Fine-Tuning for Large Code Models

Saima Afrin, Md Zahidul Haque, Antonio Mastropaolo

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22402 2025-08-18 cs.DB cs.AI cs.CL 62%

EllieSQL: Cost-Efficient Text-to-SQL with Complexity-Aware Routing

Yizhang Zhu, Runzhi Jiang, Boyan Li, Nan Tang, Yuyu Luo

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11511 2025-08-18 eess.IV cs.CV cs.LG 57%

Semi-Supervised Learning with Online Knowledge Distillation for Skin Lesion Classification

Siyamalan Manivannan

机构 * Department of Computer Science, Faculty of Science, University of Jaffna, Sri Lanka(计算机科学系,科学学院,贾夫纳大学,斯里兰卡)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11224 2025-08-18 cs.SD cs.CL eess.AS 57%

Benchmarking Prosody Encoding in Discrete Speech Tokens

Kentaro Onda, Satoru Fukayama, Daisuke Saito, Nobuaki Minematsu

机构 * The University of Tokyo, Japan(东京大学) National Institute of Advanced Industrial Science(国家工业科学与技术研究院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments Accepted by ASRU2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10557 2025-08-18 cs.CV cs.AI 57%

PTQAT: A Hybrid Parameter-Efficient Quantization Algorithm for 3D Perception Tasks

Xinhao Wang, Zhiwei Lin, Zhongyu Xia, Yongtao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机系研究所)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

Comments 8 pages, Accepted by ICCVW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 领域大模型 11 篇

2507.20122 2025-08-18 cs.SE 89%

From Prompt to Pipeline: Large Language Models for Scientific Workflow Development in Bioinformatics

Khairul Alam, Banani Roy

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

Comments 46pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10450 2025-08-18 cs.IR cs.AI cs.CL 84%

TokenRec: Learning to Tokenize ID for LLM-based Generative Recommendation

Haohao Qu, Wenqi Fan, Zihuai Zhao, Qing Li

机构 * Department of Computing, The Hong Kong Polytechnic University(计算机系,香港理工大学)

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IEEE TKDE. Codes and data are available at https://github.com/Quhaoh233/TokenRec

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11052 2025-08-18 cs.HC cs.AI 77%

AI That Helps Us Help Each Other: A Proactive System for Scaffolding Mentor-Novice Collaboration in Entrepreneurship Coaching

Evey Jiaxin Huang, Matthew Easterday, Elizabeth Gerber

机构 * Northwestern University(西北大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments To appear in CSCW 2025 Volume 9

详情

展开后加载摘要…

URL PDF HTML 收藏