arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-09 至 2025-12-09 共收录 291 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 49 篇

2507.23334 2025-12-09 cs.CL cs.AI cs.IR cs.LG 75%

MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation

MUST-RAG: 基于检索增强生成的音乐文本问答

Daeyong Kwon, SeungHeon Doh, Juhan Nam

机构 * Graduate School of Culture Technology, KAIST, South Korea(文化科技研究生院,韩国釜山科学技术院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MUST-RAG通过引入音乐专用数据库和检索增强生成技术,提升通用语言模型在音乐问答任务中的表现。

Comments This is an earlier version of the paper - ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering. The latest version is available at: (arXiv:2512.05430)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04598 2025-12-09 cs.CL cs.AI cs.LG 75%

HybridNorm: Towards Stable and Efficient Transformer Training via Hybrid Normalization

HybridNorm: 一种通过混合归一化实现稳定和高效Transformer训练的方法

Zhijian Zhuo, Yutao Zeng, Ya Wang, Sijun Zhang, Jian Yang, Xiaoqing Li, Xun Zhou, Jinwen Ma

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Beihang University(北航) Capital University of Economics and Business(首都经济贸易大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 HybridNorm通过结合Pre-Norm和Post-Norm的优势,提升Transformer训练的稳定性与效率。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06334 2025-12-09 cs.IR 75%

Enhanced Multimodal Video Retrieval System: Integrating Query Expansion and Cross-modal Temporal Event Retrieval

增强多模态视频检索系统:整合查询扩展与跨模态时间事件检索

Van-Thinh Vo, Minh-Khoi Nguyen, Minh-Huy Tran, Anh-Quan Nguyen-Tran, Duy-Tan Nguyen, Khanh-Loi Nguyen, Anh-Minh Phan

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种增强多模态视频检索系统,通过整合查询扩展和跨模态时间事件检索,提升检索精度和效率。

Comments 11 pages, 6 figures, SOICT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05731 2025-12-09 cs.AI cs.CL 73%

InfiGUI-G1: Advancing GUI Grounding with Adaptive Exploration Policy Optimization

InfiGUI-G1: 通过自适应探索策略优化推进GUI接地

Yuhang Liu, Zeyu Liu, Shuanghe Zhu, Pengxiang Li, Congkai Xie, Jiasheng Wang, Xavier Hu, Xiaotian Han, Jianbo Yuan, Xinyao Wang, Shengyu Zhang, Hongxia Yang, Fei Wu

机构 * Amazon(亚马逊)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 InfiGUI-G1通过自适应探索策略优化改进GUI接地,实现显著的语义对齐和性能提升。

Comments Accepted to AAAI 2026 (Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01268 2025-12-09 cs.CL cs.LG 73%

Deep Learning and Machine Learning, Advancing Big Data Analytics and Management: Unveiling AI's Potential Through Tools, Techniques, and Applications

深度学习与机器学习:推动大数据分析与管理,通过工具、技术和应用揭示人工智能的潜力

Pohsun Feng, Ziqian Bi, Yizhu Wen, Xuanhe Pan, Benji Peng, Ming Liu, Jiawei Xu, Keyu Chen, Junyu Liu, Caitlyn Heqi Yin, Sen Zhang, Jinlang Wang, Qian Niu, Ming Li, Tianyang Wang, Xinyuan Song, Zekun Jiang

机构 * National Taiwan Normal University(国立台湾师范大学) Indiana University(印第安纳大学) University of Hawaii(夏威夷大学) Kyoto University(京都大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Georgia Institute of Technology(佐治亚理工学院) Rutgers University(罗格斯大学) Purdue University(普渡大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Emory University(埃默里大学) Sichuan University(四川大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文探讨深度学习与机器学习在大数据分析中的应用,通过工具和技术揭示AI潜力,强调伦理与公平性,推动各领域创新。

Comments This book contains 155 pages and 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06457 2025-12-09 cs.LG eess.SP 70%

BitStopper: An Efficient Transformer Attention Accelerator via Stage-fusion and Early Termination

BitStopper: 一种通过阶段融合和提前终止的高效Transformer注意力加速器

Huizheng Wang, Hongbin Wang, Shaojun Wei, Yang Hu, Shouyi Yin

机构 * School of Integrated Circuits Tsinghua University Beijing, China(集成电路学院清华大学北京中国) School of Integrated Circuits Tsinghua University Beijing, China Shanghai Artificial Intelligence Laboratory Shanghai, China(集成电路学院清华大学北京中国上海人工智能实验室上海中国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 BitStopper通过阶段融合和提前终止技术,提升Transformer注意力加速器的效率和能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07350 2025-12-09 cs.DC 67%

Communication-Efficient Serving for Video Diffusion Models with Latent Parallelism

面向视频扩散模型的通信高效服务与潜在并行性

Zhiyuan Wu, Shuai Wang, Li Chen, Kaihui Gao, Dan Li, Yanyu Ren, Qiming Zhang, Yong Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出潜在并行性策略,通过动态旋转潜在空间维度,显著降低视频扩散模型服务的通信开销,同时保持生成质量。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03930 2025-12-09 eess.AS cs.AI cs.CL cs.LG cs.SD 67%

DiTAR: Diffusion Transformer Autoregressive Modeling for Speech Generation

DiTAR:基于扩散变换器的语音生成自回归建模

Dongya Jia, Zhuo Chen, Jiawei Chen, Chenpeng Du, Jian Wu, Jian Cong, Xiaobin Zhuang, Chumin Li, Zhen Wei, Yuping Wang, Yuxuan Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DiTAR通过结合语言模型和扩散变换器,提出一种基于补丁的自回归框架,有效提升连续语音生成的效率与质量。

Comments ByteDance Seed template, ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06577 2025-12-09 cs.IR 67%

Prompt Tuning as User Inherent Profile Inference Machine

提示调优作为用户固有属性推断机器

Yusheng Lu, Zhaocheng Du, Xiangyang Li, Pengyue Jia, Yejing Wang, Weiwen Liu, Yichao Wang, Huifeng Guo, Ruiming Tang, Zhenhua Dong, Yongrui Duan, Xiangyu Zhao

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 UserIP-Tuning通过提示调优推断用户档案,结合因果关系和EM算法减少噪声,提升推荐系统效率与效果。

Comments This paper has been accepted by CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06421 2025-12-09 cs.CV cs.AI cs.CL cs.LG 67%

Rethinking Training Dynamics in Scale-wise Autoregressive Generation

重新思考规模级自回归生成的训练动态

Gengze Zhou, Chongjian Ge, Hao Tan, Feng Liu, Yicong Hong

机构 * Australian Institute for Machine Learning, Adelaide University(澳大利亚机器学习研究所,阿德莱德大学) Adobe Research(Adobe研究)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SAR方法,通过引入SSR机制和CSFL损失,解决自回归生成模型中的曝光偏差问题,提升生成质量并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07631 2025-12-09 cs.AI cs.CC cs.IT cs.LG math.IT 62%

The Agent Capability Problem: Predicting Solvability Through Information-Theoretic Bounds

代理能力问题:通过信息论界限预测可解性

Shahar Lutati

机构 * Blavatnik School of Computer Science(布拉瓦特尼克计算机科学学院) Tel Aviv University(特拉维夫大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出代理能力问题框架,通过信息论界限预测代理解决任务的资源需求,结合主动学习、贝叶斯优化和强化学习原理,提升搜索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06861 2025-12-09 cs.LG cs.AI eess.SP 62%

CSI-BERT2: A BERT-inspired Framework for Efficient CSI Prediction and Classification in Wireless Communication and Sensing

CSI-BERT2:一种基于BERT的高效CSI预测与分类框架,用于无线通信与传感

Zijian Zhao, Fanyi Meng, Zhonghao Lyu, Hang Li, Xiaoyang Li, Guangxu Zhu

机构 * Shenzhen Research Institute of Big Data(深圳大数据研究院) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Department of Electrical and Electronic Engineering(电子与电气工程系) Department of Information Science and Engineering(信息科学与工程系) KTH Royal Institute of Technology(皇家理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

AI总结 CSI-BERT2基于BERT提出,通过双向自注意力机制和改进的结构,实现高效CSI预测与分类,适用于无线通信与传感场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04829 2025-12-09 cs.AI 57%

Model-Based and Sample-Efficient AI-Assisted Math Discovery in Sphere Packing

基于模型和样本效率的AI辅助球面 packing 发现

Rasul Tutunov, Alexandre Maraval, Antoine Grosnit, Xihan Li, Jun Wang, Haitham Bou-Ammar

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

AI总结 本文提出基于模型和样本效率的方法,通过SDP游戏在4-16维中获得新的上界,展示了AI在长期几何问题中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06641 2025-12-09 cs.IR cs.CL 57%

An Index-based Approach for Efficient and Effective Web Content Extraction

基于索引的方法用于高效有效的网络内容提取

Yihan Chen, Benfeng Xu, Xiaorui Wang, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(Metastone技术)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

AI总结 本文提出基于索引的方法,用于高效提取网络相关内容,提升RAG系统查询准确性与处理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06288 2025-12-09 cs.LG math.ST stat.TH 57%

Theoretical Compression Bounds for Wide Multilayer Perceptrons

宽多层感知机的理论压缩界限

Houssam El Cheairi, David Gamarnik, Rahul Mazumder

机构 * MIT(麻省理工学院)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本文提出了一种随机贪心算法,用于宽多层感知机的剪枝和量化,证明了其在保持性能的同时实现网络压缩的理论界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06243 2025-12-09 cs.LG cs.CR 57%

Quantization Blindspots: How Model Compression Breaks Backdoor Defenses

量化盲区:模型压缩如何破坏后门防御

Rohan Pandey, Eric Ye

机构 * University of Washington(华盛顿大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本研究发现量化过程显著降低后门防御的检测率,揭示了现有防御在实际部署中面临的关键挑战。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01211 2025-12-09 cs.MM eess.AS 50%

Iola Walker: A Mobile Footfall Detection System for Music Composition

Iola Walker:一款用于音乐创作的移动步态检测系统

William B. James

专题命中 效率与部署 :LLM(abstract)

AI总结 Iola Walker是一款基于LSTM的Android应用程序,通过实时推断检测用户步态,用于音乐创作中的步态数据采集与处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06131 2025-12-09 cs.RO 50%

LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical Planning

LOG-Nav: 面向复杂多房间室内环境的高效布局感知物体目标导航方法

Jiawei Hou, Yuting Xiao, Xiangyang Xue, Taiping Zeng

专题命中 效率与部署 :LLM(abstract)

AI总结 LOG-Nav通过层次化规划和大语言模型智能体实现高效布局感知导航,实验显示其在复杂室内环境中的导航成功率显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06793 2025-12-09 cs.CV 50%

Generalized Geometry Encoding Volume for Real-time Stereo Matching

通用几何编码体积用于实时立体匹配

Jiaxin Liu, Gangwei Xu, Xianqi Wang, Chengliang Zhang, Xin Yang

专题命中 效率与部署 :foundation model(abstract)

AI总结 本文提出GGEV,一种实时立体匹配网络,通过深度感知特征和动态成本聚合模块提升泛化能力,在多个基准测试中取得最佳性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06353 2025-12-09 cs.CV 50%

TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search

TreeQ: 通过树结构混合精度搜索推动扩散变换器的量化边界

Kaicheng Yang, Kaisen Yang, Baiting Wu, Xun Zhang, Qianrui Yang, Haotong Qin, He Zhang, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) Adobe Research(Adobe研究院)

专题命中 效率与部署 :post-training(abstract)

AI总结 TreeQ通过树结构混合精度搜索方法,首次在DiT模型上实现接近无损的4位PTQ性能,解决了DiT量化中的关键挑战。

Comments Code and Supplementary Material could be found at https://github.com/racoonykc/TreeQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06209 2025-12-09 physics.optics 50%

Lensless and Lossless HoloVAM

无镜头和无损耗的HoloVAM

Andreas Erik Gejl Madsen, Jesper Glückstad

专题命中 效率与部署 :SLM(abstract)

AI总结 无镜头HoloVAM通过相位-only空间光调制器生成断层光场,实现无光学元件的体积制造,展示高光子效率和复杂几何结构的可重复制造。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06022 2025-12-09 cs.SD cs.MM 50%

DreamFoley: Scalable VLMs for High-Fidelity Video-to-Audio Generation

DreamFoley: 用于高保真视频到音频生成的可扩展视觉-语言模型

Fu Li, Weichao Zhao, You Li, Zhichao Zhou, Dongliang He

机构 * Bytedance Intelligent Creation Lab(字节跳动智能创作实验室) Zhejiang University(浙江大学)

专题命中 效率与部署 :language model(abstract)

AI总结 DreamFoley通过结合视觉-语言模型,提出了一种可扩展的视频到音频生成方法,实现了高保真音频生成并优化了训练效率与质量的平衡。

Comments 10 pages; Bytedance

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 20 篇

2512.06502 2025-12-09 cs.CE q-bio.QM 91%

Small Language Models Can Use Nuanced Reasoning For Health Science Research Classification: A Microbial-Oncogenesis Case Study

小型语言模型可以用于健康科学研究分类的细致推理:微生物肿瘤发生案例研究

Muhammed Muaaz Dawood, Mohammad Zaid Moonsamy, Kaela Kokkas, Hairong Wang, Robert F. Breiman, Richard Klein, Emmanuel K. Sekyi, Bruce A. Bassett

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

AI总结 本文研究小型语言模型在健康科学文献分类中的表现,发现其通过细致推理可达到大型语言模型的性能,但需结合有效提示策略以提高准确性。

Comments 43 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06812 2025-12-09 cs.CL 89%

Large Language Model-Based Generation of Discharge Summaries

基于大型语言模型的出院小结生成

Tiago Rodrigues, Carla Teixeira Lopes

机构 * INESC TEC

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在生成出院小结中的应用,发现专有模型在性能上优于开源模型,尽管存在幻觉和信息缺失的问题,但专有模型在生成准确的出院小结方面表现出色。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06001 2025-12-09 physics.ed-ph cs.CL 89%

Small Language Models Reshape Higher Education: Courses, Textbooks, and Teaching

小型语言模型重塑高等教育:课程、教材和教学

Jian Zhang, Jia Shao

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究利用小型语言模型重新设计大气物理课程,通过构建高维向量库实现教学资源的动态化与智能化,推动教育模式的变革。

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06405 2025-12-09 cs.IR 85%

TOOL4POI: A Tool-Augmented LLM Framework for Next POI Recommendation

TOOL4POI: 一种增强工具的LLM框架用于下一步POI推荐

Dongsheng Wang, Shen Gao, Chengrui Huang, Yuxi Huang, Ruixiang Feng, Shuo Shang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Tool4POI通过外部检索和推理提升POI推荐性能,无需微调即可兼容现成LLM,实现对OOH场景的显著改进。

Comments A critical technical error was discovered during our internal review, leading to unreliable experimental results. The issue cannot be resolved, and the paper has also been formally withdrawn from AAAI 2026. We therefore request withdrawal of the arXiv version to maintain scientific accuracy

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06659 2025-12-09 cs.CR 85%

The Evolution of Agentic AI in Cybersecurity: From Single LLM Reasoners to Multi-Agent Systems and Autonomous Pipelines

代理AI在网络安全中的演变:从单一LLM推理者到多代理系统和自主流水线

Vaishali Vinay

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了网络安全中代理AI从单一LLM到多代理系统的发展,分析了五代分类法及各代在推理深度、工具使用等维度的差异,并总结了当前面临的挑战。

Comments Accepted at ICAIC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21933 2025-12-09 cs.CL cs.AI 82%

Why Chain of Thought Fails in Clinical Text Understanding

为什么链式思维在临床文本理解中失效

Jiageng Wu, Kevin Xie, Bowen Gu, Nils Krüger, Kueiyu Joshua Lin, Jie Yang

机构 * Harvard Medical School(哈佛医学院) MIT(麻省理工学院) Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究发现链式思维在临床文本理解中导致性能下降,揭示了其在临床任务中可靠性与可解释性的矛盾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05993 2025-12-09 cs.CV cs.AI 79%

Domain-Specific Foundation Model Improves AI-Based Analysis of Neuropathology

领域特定基础模型提升基于人工智能的神经病理科分析

Ruchika Verma, Shrishtee Kandoi, Robina Afzal, Shengjia Chen, Jannes Jegminat, Michael W. Karlovich, Melissa Umphlett, Timothy E. Richardson, Kevin Clare, Quazi Hossain, Jorge Samanamud, Phyllis L. Faust, Elan D. Louis, Ann C. McKee, Thor D. Stein, Jonathan D. Cherry, Jesse Mez, Anya C. McGoldrick, Dalilah D. Quintana Mora, Melissa J. Nirenberg, Ruth H. Walker, Yolfrankcis Mendez, Susan Morgello, Dennis W. Dickson, Melissa E. Murray, Carlos Cordon-Cardo, Nadejda M. Tsankova, Jamie M. Walker, Diana K. Dangoor, Stephanie McQuillan, Emma L. Thorn, Claudia De Sanctis, Shuying Li, Thomas J. Fuchs, Kurt Farrell, John F. Crary, Gabriele Campanella

机构 * Windreich Department of AI and Human Health(AI与人类健康部门) Icahn School of Medicine at Mount Sinai(辛克医学院(梅奥医院)) Hasso Plattner Institute for Digital Health at Mount Sinai(梅奥医院数字健康研究所) Department of Neurology(神经病学部门) Department of Pathology(病理学部门) Columbia University(哥伦比亚大学) Memorial Sloan-Kettering Cancer Center(纪念斯隆凯特林癌症中心) Department of Neuroscience(神经科学部门) Mayo Clinic College of Medicine(梅奥诊所医学院) University of Texas Southwestern Medical Center(德克萨斯西南医学中心) Peter O’Donnell Jr. Brain Institute(彼得·奥多尼尔 Jr. 脑研究所) VA Boston Healthcare System(波士顿退伍军人医疗系统)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 NeuroFM通过专门训练于脑组织的领域特定基础模型,提升神经病理学AI分析的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20549 2025-12-09 cs.LG cs.AI 79%

MedGR$^2$: Breaking the Data Barrier for Medical Reasoning via Generative Reward Learning

MedGR$^2$: 通过生成奖励学习突破医学推理的数据壁垒

Weihai Zhi, Jiayan Guo, Shangyang Li

专题命中 领域大模型 :language model(abstract);foundation model(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 MedGR$^2$通过生成奖励学习解决医学推理中的数据稀缺问题,实现高效训练和泛化,优于现有方法。

Comments 8 pages, 5 figures

Journal ref AAAI'2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏