arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-13 至 2025-11-13 共收录 183 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 48 篇

2507.12844 2025-11-13 cs.IR 50%

Machine-Readable Ads: Accessibility and Trust Patterns for AI Web Agents interacting with Online Advertisements

Joel Nitu, Heidrun Mühle, Andreas Stöckl

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.16975 2025-11-13 cs.CV 50%

EgoTV: Egocentric Task Verification from Natural Language Task Descriptions

Rishi Hazra, Brian Chen, Akshara Rai, Nitin Kamra, Ruta Desai

机构 * Örebro University(奥雷布罗大学) Meta

专题命中 评测与基准 :language model(abstract)

Comments Accepted at ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 22 篇

2409.16694 2025-11-13 cs.AI cs.CL cs.LG 89%

A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms

Ruihao Gong, Yifu Ding, Zining Wang, Chengtao Lv, Xingyu Zheng, Jinyang Du, Haotong Qin, Jinyang Guo, Michele Magno, Xianglong Liu

机构 * Beihang University(北京航空航天大学) ETH Zurich(苏黎世联邦理工学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Ruihao Gong leads the overall organization of the survey, with Yifu Ding and Jinyang Du contributing to Sections 2 and 3. Xingyu Zheng is responsible for authoring Section 4, while Chengtao Lv and Zining Wang collaborate on Section 5. Haotong Qin, Jinyang Guo, Michele Magno, and Xianglong Liu provide guidance during the whole process and assist in refining the final manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25979 2025-11-13 cs.CL cs.LG 86%

AttnCache: Accelerating Self-Attention Inference for LLM Prefill via Attention Cache

Dinghong Song, Yuan Feng, Yiwei Wang, Shangye Chen, Cyril Guyot, Filip Blagojevic, Hyeran Jeon, Pengfei Su, Dong Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14884 2025-11-13 cs.LG cs.AI 86%

Polar Sparsity: High Throughput Batched LLM Inferencing with Scalable Contextual Sparsity

Susav Shrestha, Brad Settlemyer, Nikoli Dryden, Narasimha Reddy

机构 * Texas A&M University(德克萨斯大学) NVIDIA(英伟达) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025, 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09025 2025-11-13 cs.LG 85%

FLAD: Federated Learning for LLM-based Autonomous Driving in Vehicle-Edge-Cloud Networks

Tianao Xiang, Mingjian Zhi, Yuanguo Bi, Lin Cai, Yuhao Chen

机构 * Northeastern University(东北大学) University of Victoria(维多利亚大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09223 2025-11-13 cs.SE 85%

AILINKPREVIEWER: Enhancing Code Reviews with LLM-Powered Link Previews

Panya Trakoolgerntong, Tao Xiao, Masanari Kondo, Chaiyong Ragkhitwetsagul, Morakot Choetkiertikul, Pattaraporn Sangaroonsilp, Yasutaka Kamei

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09084 2025-11-13 eess.AS 85%

Towards Effective and Efficient Non-autoregressive decoders for Conformer and LLM-based ASR using Block-based Attention Mask

Tianzi Wang, Xurong Xie, Zengrui Jin, Mengzhe Geng, Jiajun Deng, Zhaoqing Li, Shoukang Hu, Shujie Hu, Guinan Li, Mingyu Cui, Helen Meng, Xunying Liu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by regular paper in the IEEE Transactions on Audio, Speech and Language Processing (TASLP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04277 2025-11-13 cs.LG cs.AI cs.CL stat.AP 85%

Beyond the Hype: Embeddings vs. Prompting for Multiclass Classification Tasks

Marios Kokkodis, Richard Demsyn-Jones, Vijay Raghavan

机构 * Thumbtack(Thumbtack公司)

专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00229 2025-11-13 cs.AI cs.LG 79%

AgentFlux: Decoupled Fine-Tuning & Inference for On-Device Agentic Systems

Rohan Kadekodi, Zhan Jin, Keisuke Kamahori, Yile Gu, Sean Khatiri, Noah H. Bayindirli, Sergey Gorbunov, Baris Kasikci

机构 * University of Washington(华盛顿大学) Peking University(北京大学) University of Waterloo(滑铁卢大学) Interop Labs(Interop实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22506 2025-11-13 cs.CL cs.LG 79%

Representing LLMs in Prompt Semantic Task Space

Idan Kashani, Avi Mendelson, Yaniv Nemcovsky

机构 * Technion - Israel Institute of Technology(技术离子-以色列理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09101 2025-11-13 cs.CV 78%

Ultra-Light Test-Time Adaptation for Vision--Language Models

Byunghyun Kim

机构 * Kyungpook National University(庆尚国立大学)

专题命中 效率与部署 :language model(title,abstract)

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15212 2025-11-13 cs.CL cs.AI cs.LG 75%

SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning

Huanxuan Liao, Yixing Xu, Shizhu He, Guanchen Li, Xuanwu Yin, Dong Li, Emad Barsoum, Jun Zhao, Kang Liu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09323 2025-11-13 cs.LG 70%

Mixture-of-Channels: Exploiting Sparse FFNs for Efficient LLMs Pre-Training and Inference

Tong Wu, Yutong He, Bin Wang, Kun Yuan

机构 * Peking University(北京大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09158 2025-11-13 cs.AI 70%

Efficient Reasoning via Reward Model

Yuhao Wang, Xiaopeng Li, Cheng Gong, Ziru Liu, Suiyun Zhang, Rui Liu, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Huawei Research(华为研究)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10675 2025-11-13 cs.AI 70%

Simpliflow: A Lightweight Open-Source Framework for Rapid Creation and Deployment of Generative Agentic AI Workflows

Deven Panchal

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08914 2025-11-13 cs.CV 67%

SPEED-Q: Staged Processing with Enhanced Distillation towards Efficient Low-bit On-device VLM Quantization

Tianyu Guo, Shanwei Zhao, Shiai Zhu, Chenguang Ma

机构 * Tianyu Guo, Shanwei Zhao, Shiai Zhu, Chenguang Ma(作者)

专题命中 效率与部署 :LLM(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08923 2025-11-13 cs.CL cs.AI 62%

TiDAR: Think in Diffusion, Talk in Autoregression

Jingyu Liu, Xin Dong, Zhifan Ye, Rishabh Mehta, Yonggan Fu, Vartika Singh, Jan Kautz, Ce Zhang, Pavlo Molchanov

机构 * NVIDIA

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments NVIDIA-Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08821 2025-11-13 cs.LG cs.CL cs.CV 62%

BayesQ: Uncertainty-Guided Bayesian Quantization

Ismail Lamaakal, Chaymae Yahyati, Yassine Maleh, Khalid El Makkaoui, Ibrahim Ouahbi

机构 * Multidisciplinary Faculty of Nador, Mohammed Premier University, Oujda 60000, Morocco(摩洛哥奥伊达大学多学科学院) Laboratory LaSTI, ENSAK, Sultan Moulay Slimane University, Khouribga 54000, Morocco(摩洛哥库尔希布加大学LaSTI实验室)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08587 2025-11-13 cs.CY cs.AI cs.CL 62%

Conversational Agents for Building Energy Efficiency -- Advising Housing Cooperatives in Stockholm on Reducing Energy Consumption

Shadaab Ghani, Anne Håkansson, Oleksii Pasichnyi, Hossein Shahrokni

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09085 2025-11-13 cs.CL 57%

Context-Aware Dynamic Chunking for Streaming Tibetan Speech Recognition

Chao Wang, Yuqing Cai, Renzeng Duojie, Jin Zhang, Yutong Liu, Nyima Tashi

机构 * Qinghai Normal University(青海师范大学) University of Electronic Science and Technology of China(电子科技大学) Xizang University(西藏大学) The State Key Laboratory of Tibetan Intelligence(藏语智能 state key laboratory)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.09286 2025-11-13 cs.CV cs.LG 57%

Background Invariance Testing According to Semantic Proximity

Zukang Liao, Min Chen

机构 * University of Oxford(牛津大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09272 2025-11-13 cs.CV 50%

GRACE: Designing Generative Face Video Codec via Agile Hardware-Centric Workflow

Rui Wan, Qi Zheng, Ruoyu Zhang, Bu Chen, Jiaming Liu, Min Li, Minge Jing, Jinjia Zhou, Yibo Fan

机构 * State Key Laboratory of Integrated Chips and Systems(集成电路与系统集成国家重点实验室) Fudan University(复旦大学) Department of Electronic Engineering(电子工程系)

专题命中 效率与部署 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08977 2025-11-13 cs.CV 50%

Efficient and Effective In-context Demonstration Selection with Coreset

Zihua Wang, Jiarui Wang, Haiyang Xu, Ming Yan, Fei Huang, Xu Yang, Xiu-Shen Wei, Siya Mi, Yu Zhang

专题命中 效率与部署 :language model(abstract)

Comments This paper is accepted by AAAI26

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 领域大模型 21 篇

2511.08621 2025-11-13 q-fin.ST cs.AI q-fin.CP 92%

The LLM Pro Finance Suite: Multilingual Large Language Models for Financial Applications

Gaëtan Caillaut, Raheel Qader, Jingshu Liu, Mariam Nakhlé, Arezki Sadoune, Massinissa Ahmim, Jean-Gabriel Barthelemy

机构 * Dragon LLM

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04381 2025-11-13 cs.CL cs.AI 90%

Limitations of Large Language Models in Clinical Problem-Solving Arising from Inflexible Reasoning

Jonathan Kim, Anna Podlasek, Kie Shidara, Feng Liu, Ahmed Alaa, Danilo Bernardo

机构 * Department of Neurology and Neurologic Sciences(神经病学与神经科学系) Stanford University(斯坦福大学) Image Guided Therapy and Research Facility(影像引导治疗与研究设施) University of Dundee(邓迪大学) Weill Institute of Neurology and Neurosciences(韦尔神经病学与神经科学研究所) University of California, San Francisco(加州大学旧金山分校) Department of Systems and Enterprises(系统与企业系) Stevens Institute of Technology(史蒂文斯理工学院) Department of EECS(电子工程与计算机科学系) University of California Berkeley(加州大学伯克利分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

Journal ref Sci Rep 15, 39426 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21348 2025-11-13 cs.CL cs.AI 90%

Large Language Model Benchmarks in Medical Tasks

Lawrence K. Q. Yan, Qian Niu, Ming Li, Yichao Zhang, Caitlyn Heqi Yin, Cheng Fei, Benji Peng, Ziqian Bi, Pohsun Feng, Keyu Chen, Tianyang Wang, Yunze Wang, Silin Chen, Ming Liu, Junyu Liu, Xinyuan Song, Riyang Bao, Zekun Jiang, Ziyuan Qin

机构 * Hong Kong University of Science and Technology(香港科技大学) Kyoto University(京都大学) Georgia Institute of Technology(佐治亚理工学院) The University of Texas at Dallas(德克萨斯大学达拉斯分校) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Cornell University(康奈尔大学) Indiana University(印第安纳大学) National Taiwan Normal University(台湾师范大学) University of Liverpool(利物浦大学) University of Edinburgh(爱丁堡大学) Zhejiang University(浙江大学) Purdue University(普渡大学) Emory University(埃默里大学) West China Biomedical Big Data Center, West China Hospital, Sichuan University(西京生物大数据中心,西京医院,四川大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 25 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01159 2025-11-13 cs.CL cs.AI 88%

Asking the Right Questions: Benchmarking Large Language Models in the Development of Clinical Consultation Templates

Liam G. McCoy, Fateme Nateghi Haredasht, Kanav Chopra, David Wu, David JH Wu, Abass Conteh, Sarita Khemani, Saloni Kumar Maharaj, Vishnu Ravi, Arth Pahwa, Yingjie Weng, Leah Rosengaus, Lena Giang, Kelvin Zhenghao Li, Olivia Jee, Daniel Shirvani, Ethan Goh, Jonathan H. Chen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08970 2025-11-13 astro-ph.SR 88%

JW-Flare: Accurate Solar Flare Forecasting Method Based on Multimodal Large Language Models

Mingfu Shao, Hui Wang, Yuyang Li, Jiaben Lin, Jifeng Liu, Baolin Tan, Juan Guo, Yin Zhang, Jing Huang, Jiangtao Su, Yingzi Sun, Haiqing Xu, Jie Chen, Suo Liu, Yuanyong Deng, Liyue Tong, Yang Bai, Cunshi Wang, Kaifan Ji, Yuqing Zhou

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04498 2025-11-13 cs.CL cs.AI 84%

Where Should I Study? Biased Language Models Decide! Evaluating Fairness in LMs for Academic Recommendations

Krithi Shailya, Akhilesh Kumar Mishra, Gokul S Krishnan, Balaraman Ravindran

机构 * Centre for Responsible AI (CeRAI), Wadhwani School of Data Science and AI (WSAI)(负责任人工智能中心(CeRAI)、Wadhwani数据科学与人工智能学校(WSAI)) Indian Institute of Technology Madras(印度理工学院马德拉斯学院)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏