arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-03 至 2025-09-03 共收录 358 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 59 篇

2509.02129 2025-09-03 cs.LG cs.CV 77%

Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time

Jintao Cheng, Weibin Li, Jiehao Luo, Xiaoyu Tang, Zhijian He, Jin Wu, Yao Zou, Wei Zhang

机构 * Hong Kong University of Science(香港科学与技术大学) South China Normal University, Shanwei, Guangdong, China(华南师范大学,汕尾,广东,中国) Shenzhen Technology University, Shenzhen, Guangdong, China(深圳科技大学,深圳,广东,中国) University of Science(科学大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00883 2025-09-03 cs.DC cs.AI 77%

Accelerating Latency-Critical Applications with AI-Powered Semi-Automatic Fine-Grained Parallelization on SMT Processors

Denis Los, Igor Petushkov

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref International Journal of Open Information Technologies, vol. 13, no. 9, pp. 129-134, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00366 2025-09-03 cs.MA cs.CL cs.MM 77%

KG-RAG: Enhancing GUI Agent Decision-Making via Knowledge Graph-Driven Retrieval-Augmented Generation

Ziyi Guan, Jason Chun Lok Li, Zhijian Hou, Pingping Zhang, Donglai Xu, Yuzhi Zhao, Mengyang Wu, Jinpeng Chen, Thanh-Toan Nguyen, Pengfei Xian, Wenao Ma, Shengchao Qin, Graziano Chesi, Ngai Wong

机构 * Huawei Hong Kong Research Center(华为香港研究部) The University of Hong Kong(香港大学) City University of Hong Kong(城市大学) Guangzhou Institute of Technology, Xidian University(广州技术学院,西安电子科技大学) ICTT and ISN Laboratory, Xidian University(ICTT和ISN实验室,西安电子科技大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by the EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00085 2025-09-03 cs.CR cs.AI cs.CY 77%

Private, Verifiable, and Auditable AI Systems

Tobin South

机构 * MIT Media Lab(麻省理工学院媒体实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23427 2025-09-03 cs.CL cs.IR 77%

CoRanking: Collaborative Ranking with Small and Large Ranking Agents

Wenhan Liu, Xinyu Ma, Yutao Zhu, Lixin Su, Shuaiqiang Wang, Dawei Yin, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Baidu Inc.(百度公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12928 2025-09-03 cs.CL 77%

Truthful Text Sanitization Guided by Inference Attacks

Ildikó Pilán, Benet Manzanares-Salor, David Sánchez, Pierre Lison

机构 * Norwegian Computing Center(挪威计算中心) Department of Computer Engineering and Mathematics. CYBERCAT(计算机工程与数学系.CYBERCAT)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14444 2025-09-03 cs.CL cs.AI cs.LG 75%

NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model

NVIDIA, :, Aarti Basant, Abhijit Khairnar, Abhijit Paithankar, Abhinav Khattar, Adithya Renduchintala, Aditya Malte, Akhiad Bercovich, Akshay Hazare, Alejandra Rico, Aleksander Ficek, Alex Kondratenko, Alex Shaposhnikov, Alexander Bukharin, Ali Taghibakhshi, Amelia Barton, Ameya Sunil Mahabaleshwarkar, Amy Shen, Andrew Tao, Ann Guan, Anna Shors, Anubhav Mandarwal, Arham Mehta, Arun Venkatesan, Ashton Sharabiani, Ashwath Aithal, Ashwin Poojary, Ayush Dattagupta, Balaram Buddharaju, Banghua Zhu, Barnaby Simkin, Bilal Kartal, Bita Darvish Rouhani, Bobby Chen, Boris Ginsburg, Brandon Norick, Brian Yu, Bryan Catanzaro, Charles Wang, Charlie Truong, Chetan Mungekar, Chintan Patel, Chris Alexiuk, Christian Munley, Christopher Parisien, Dan Su, Daniel Afrimi, Daniel Korzekwa, Daniel Rohrer, Daria Gitman, David Mosallanezhad, Deepak Narayanan, Dima Rekesh, Dina Yared, Dmytro Pykhtar, Dong Ahn, Duncan Riach, Eileen Long, Elliott Ning, Eric Chung, Erick Galinkin, Evelina Bakhturina, Gargi Prasad, Gerald Shen, Haifeng Qian, Haim Elisha, Harsh Sharma, Hayley Ross, Helen Ngo, Herman Sahota, Hexin Wang, Hoo Chang Shin, Hua Huang, Iain Cunningham, Igor Gitman, Ivan Moshkov, Jaehun Jung, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jian Zhang, Jiaqi Zeng, Jimmy Zhang, Jinze Xue, Jocelyn Huang, Joey Conway, John Kamalu, Jonathan Cohen, Joseph Jennings, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kari Briski, Katherine Cheung, Katherine Luna, Keith Wyss, Keshav Santhanam, Kezhi Kong, Krzysztof Pawelec, Kumar Anik, Kunlun Li, Kushan Ahmadian, Lawrence McAfee, Laya Sleiman, Leon Derczynski, Luis Vega, Maer Rodrigues de Melo, Makesh Narsimhan Sreedhar, Marcin Chochowski, Mark Cai, Markus Kliegl, Marta Stepniewska-Dziubinska, Matvei Novikov, Mehrzad Samadi, Meredith Price, Meriem Boubdir, Michael Boone, Michael Evans, Michal Bien, Michal Zawalski, Miguel Martinez, Mike Chrzanowski, Mohammad Shoeybi, Mostofa Patwary, Namit Dhameja, Nave Assaf, Negar Habibi, Nidhi Bhatia, Nikki Pope, Nima Tajbakhsh, Nirmal Kumar Juluru, Oleg Rybakov, Oleksii Hrinchuk, Oleksii Kuchaiev, Oluwatobi Olabiyi, Pablo Ribalta, Padmavathy Subramanian, Parth Chadha, Pavlo Molchanov, Peter Dykas, Peter Jin, Piotr Bialecki, Piotr Januszewski, Pradeep Thalasta, Prashant Gaikwad, Prasoon Varshney, Pritam Gundecha, Przemek Tredak, Rabeeh Karimi Mahabadi, Rajen Patel, Ran El-Yaniv, Ranjit Rajan, Ria Cheruvu, Rima Shahbazyan, Ritika Borkar, Ritu Gala, Roger Waleffe, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Sahil Jain, Samuel Kriman, Sanjeev Satheesh, Saori Kaji, Sarah Yurick, Saurav Muralidharan, Sean Narenthiran, Seonmyeong Bak, Sepehr Sameni, Seungju Han, Shanmugam Ramasamy, Shaona Ghosh, Sharath Turuvekere Sreenivas, Shelby Thomas, Shizhe Diao, Shreya Gopal, Shrimai Prabhumoye, Shubham Toshniwal, Shuoyang Ding, Siddharth Singh, Siddhartha Jain, Somshubra Majumdar, Soumye Singhal, Stefania Alborghetti, Syeda Nahida Akter, Terry Kong, Tim Moon, Tomasz Hliwiak, Tomer Asida, Tony Wang, Tugrul Konuk, Twinkle Vashishth, Tyler Poon, Udi Karpas, Vahid Noroozi, Venkat Srinivasan, Vijay Korthikanti, Vikram Fugro, Vineeth Kalluru, Vitaly Kurin, Vitaly Lavrukhin, Wasi Uddin Ahmad, Wei Du, Wonmin Byeon, Ximing Lu, Xin Dong, Yashaswi Karnati, Yejin Choi, Yian Zhang, Ying Lin, Yonggan Fu, Yoshi Suhara, Zhen Dong, Zhiyu Li, Zhongbo Zhu, Zijia Chen

机构 * NVIDIA

专题命中 效率与部署 :language model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17671 2025-09-03 cs.CL cs.AI cs.LG 75%

TPTT: Transforming Pretrained Transformers into Titans

Fabien Furfaro

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 2 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02309 2025-09-03 cs.LG cs.AI cs.CL 75%

Optimizing LLMs for Resource-Constrained Environments: A Survey of Model Compression Techniques

Sanjay Surendranath Girija, Shashank Kapoor, Lakshit Arora, Dipen Pradhan, Aman Raj, Ankit Shetgaonkar

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to IEEE COMPSAC 2025

Journal ref 2025 IEEE 49th Annual Computers, Software, and Applications Conference (COMPSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03598 2025-09-03 cs.CL cs.AI 73%

Auto prompt sql: a resource-efficient architecture for text-to-sql translation in constrained environments

Zetong Tang, Qian Ma, Di Wu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 4 pages,2 figures,EITCE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12984 2025-09-03 cs.LG cs.AI cs.PL 73%

Tilus: A Tile-Level GPGPU Programming Language for Low-Precision Computation

Yaoyao Ding, Bohan Hou, Xiao Zhang, Allan Lin, Tianqi Chen, Cody Yu Hao, Yida Wang, Gennady Pekhimenko

机构 * University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学) Amazon Web Services(亚马逊网络服务) Carnegie Mellon University(卡内基梅隆大学) Independent Researcher(独立研究者) Vector Institute(向量研究所) NVIDIA(英伟达)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 14 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01215 2025-09-03 cs.CV 71%

POINTS-Reader: Distillation-Free Adaptation of Vision-Language Models for Document Conversion

Yuan Liu, Zhongyin Zhao, Le Tian, Haicheng Wang, Xubing Ye, Yangxiu You, Zilin Yu, Chuhan Wu, Xiao Zhou, Yang Yu, Jie Zhou

专题命中 效率与部署 :language model(title)

Comments Accepted by EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02494 2025-09-03 cs.AI 70%

GridMind: LLMs-Powered Agents for Power System Analysis and Operations

Hongwei Jin, Kibaek Kim, Jonghwan Kwon

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 11 pages, 9 figures, 2 tables. Work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01277 2025-09-03 cs.AI 70%

Communicative Agents for Slideshow Storytelling Video Generation based on LLMs

Jingxing Fan, Jinrong Shen, Yusheng Yao, Shuangqing Wang, Qian Wang, Yuling Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12122 2025-09-03 cs.LG 70%

Minimal Ranks, Maximum Confidence: Parameter-efficient Uncertainty Quantification for LoRA

Patryk Marszałek, Klaudia Bałazy, Jacek Tabor, Tomasz Kuśmierczyk

机构 * Jagiellonian University(雅盖隆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19338 2025-09-03 cs.LG cs.CR 70%

Membership Inference Attacks on Large-Scale Models: A Survey

Hengyu Wu, Yang Cao

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Preprint. Submitted for peer review. The final version may differ

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15779 2025-09-03 cs.LG cs.AI cs.CL 67%

Rotate, Clip, and Partition: Towards W2A4KV4 Quantization by Integrating Rotation and Learnable Non-uniform Quantizer

Euntae Choi, Sumin Song, Woosang Lim, Sungjoo Yoo

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00599 2025-09-03 cs.AR cs.DC 67%

COMET: A Framework for Modeling Compound Operation Dataflows with Explicit Collectives

Shubham Negi, Manik Singhal, Aayush Ankit, Sudeep Bhoja, Kaushik Roy

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00419 2025-09-03 cs.CV 67%

LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression

Lianyu Hu, Fanhua Shang, Wei Feng, Liang Wan

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学)

专题命中 效率与部署 :LLM(abstract);language model(abstract)

Comments EMNLP2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00935 2025-09-03 cs.LG cs.AI 62%

SCOUT: Toward Sub-Quadratic Attention via Segment Compression for Optimized Utility in Transformers

Aref Jafari, Yuhe Fan, Benyamin Jamialahmadi, Parsa Farinneya, Boxing Chen, Marzieh S. Tahaei

机构 * AAAI Press(AAAI出版社)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02512 2025-09-03 cs.LG 57%

MoPEQ: Mixture of Mixed Precision Quantized Experts

Krishna Teja Chitty-Venkata, Jie Ye, Murali Emani

机构 * Argonne National Laboratory(阿贡国家实验室) Illinois Institute of Technology(伊利诺伊理工学院)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

Comments Accepted by ICCV Bivision Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05254 2025-09-03 cs.CV cs.AI 57%

CF3: Compact and Fast 3D Feature Fields

Hyunjoon Lee, Joonkyu Min, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

Comments ICCV 2025, Project Page: https://jjoonii.github.io/cf3-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12608 2025-09-03 cs.CL 57%

UniBERT: Adversarial Training for Language-Universal Representations

Andrei-Marius Avram, Marian Lupaşcu, Dumitru-Clementin Cercel, Ionuţ Mironică, Ştefan Trăuşan-Matu

机构 * National University of Science and Technology POLITEHNICA Bucharest(波兰技术大学科学与技术国立大学) University of Bucharest(布加勒斯特大学) Adobe Research(Adobe研究) Academy of Romanian Scientists (AOSR)(罗马尼亚科学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00531 2025-09-03 cs.MA cs.LG 57%

MobiAgent: A Systematic Framework for Customizable Mobile Agents

Cheng Zhang, Erhu Feng, Xi Zhao, Yisheng Zhao, Wangbo Gong, Jiahui Sun, Dong Du, Zhichao Hua, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems (IPADS)(并行与分布式系统研究所)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00202 2025-09-03 cs.LG 57%

From TLinFormer to TConstFormer: The Leap to Constant-Time Transformer Attention: Achieving O(1) Computation and O(1) KV Cache during Autoregressive Inference

Zhongpan Tang

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02425 2025-09-03 cs.RO cs.HC 50%

OpenGuide: Assistive Object Retrieval in Indoor Spaces for Individuals with Visual Impairments

Yifan Xu, Qianwei Wang, Vineet Kamat, Carol Menassa

机构 * Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系) College of Literature, Science, and the Arts, University of Michigan(密歇根大学文学、科学与艺术学院)

专题命中 效率与部署 :foundation model(abstract)

Comments 32 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12918 2025-09-03 cs.DB 50%

Query Rewriting via LLMs

Sriram Dharwada, Himanshu Devrani, Jayant Haritsa, Harish Doraiswamy

专题命中 效率与部署 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00370 2025-09-03 physics.optics 50%

All-optical classification of real biomedical cell images using a diffractive neural network: a simulation study

Norihide Sagami, Yueyun Weng, Cheng Lei, Ryosuke Oketani, Kotaro Hiramatsu

专题命中 效率与部署 :SLM(abstract)

Comments 4 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 38 篇

2509.02446 2025-09-03 cs.CL cs.LG 90%

An Ensemble Classification Approach in A Multi-Layered Large Language Model Framework for Disease Prediction

Ali Hamdi, Malak Mohamed, Rokaia Emad, Khaled Shaban

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02036 2025-09-03 cs.CL cs.AI 90%

DeepSeek performs better than other Large Language Models in Dental Cases

Hexian Zhang, Xinyu Yan, Yanqi Yang, Lijian Jin, Ping Yang, Junwen Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Abstract word count: 171; Total word count: 3130; Total number of tables: 2; Total number of figures: 3; Number of references: 32

详情

展开后加载摘要…

URL PDF HTML 收藏