arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-05 至 2025-09-05 共收录 137 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 19 篇

2502.14791 2025-09-05 cs.CL cs.AI cs.LG 80%

Rapid Word Learning Through Meta In-Context Learning

Wentao Wang, Guangyuan Jiang, Tal Linzen, Brenden M. Lake

机构 * New York University(纽约大学) MIT(麻省理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04185 2025-09-05 cs.LG 79%

Set Block Decoding is a Language Model Inference Accelerator

Itai Gat, Heli Ben-Hamu, Marton Havasi, Daniel Haziza, Jeremy Reizenstein, Gabriel Synnaeve, David Lopez-Paz, Brian Karrer, Yaron Lipman

机构 * FAIR at Meta(Meta的FAIR)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03746 2025-09-05 cs.IR 78%

Efficient Item ID Generation for Large-Scale LLM-based Recommendation

Anushya Subbiah, Vikram Aggarwal, James Pine, Steffen Rendle, Krishna Sayana, Kun Su

专题命中 效率与部署 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03956 2025-09-05 cs.AI 77%

World Model Implanting for Test-time Adaptation of Embodied Agents

Minjong Yoo, Jinwoo Jang, Sihyung Yoon, Honguk Woo

机构 * Department of Computer Science and Engineering, Sungkyunkwan University(计算机科学与工程系,顺天大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref Forty-second International Conference on Machine Learning, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00073 2025-09-05 cs.LG 77%

Mitigating Clinician Information Overload: Generative AI for Integrated EHR and RPM Data Analysis

Ankit Shetgaonkar, Dipen Pradhan, Lakshit Arora, Sanjay Surendranath Girija, Shashank Kapoor, Aman Raj

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted at IEEE COMPSAC 2025

Journal ref 2025 IEEE 49th Annual Computers, Software, and Applications Conference (COMPSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04356 2025-09-05 cs.HC cs.RO 75%

SRWToolkit: An Open Source Wizard of Oz Toolkit to Create Social Robotic Avatars

Atikkhan Faridkhan Nilgar, Kristof Van Laerhoven, Ayub Kinoti

机构 * University of Siegen(施皮格恩大学) Honda Research Institute Europe GmbH(本田欧洲研究院) Dedan Kimathi University of Technology(德丹·基马蒂技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Journal ref 2025 International Conference on Social Robotics (ICSR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05122 2025-09-05 cs.DB cs.LG 70%

Text2Cypher: Data Pruning using Hard Example Selection

Makbule Gulcin Ozsoy

机构 * Neo4j

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05118 2025-09-05 cs.DB cs.LG 70%

Enhancing Text2Cypher with Schema Filtering

Makbule Gulcin Ozsoy

机构 * Neo4j

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04326 2025-09-05 cs.CV 67%

Efficient Odd-One-Out Anomaly Detection

Silvio Chito, Paolo Rabino, Tatiana Tommasi

机构 * Politecnico di Torino(托斯尼亚理工学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted at ICIAP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03615 2025-09-05 cs.CL cs.AI 62%

E-ARMOR: Edge case Assessment and Review of Multilingual Optical Character Recognition

Aryan Gupta, Anupam Purwar

机构 * Sprinklr

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments Sprinklr OCR provides a fast and compute light way of performing OCR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04180 2025-09-05 cs.CV cs.AI 57%

VisioFirm: Cross-Platform AI-assisted Annotation Tool for Computer Vision

Safouane El Ghazouali, Umberto Michelucci

机构 * TOELT LLC AI lab(TOELT LLC人工智能实验室)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04162 2025-09-05 cs.AR 50%

Real Time FPGA Based Transformers & VLMs for Vision Tasks: SOTA Designs and Optimizations

Safa Mohammed Sali, Mahmoud Meribout, Ashiyana Abdul Majeed

专题命中 效率与部署 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 16 篇

2509.01221 2025-09-05 cs.CL cs.AI cs.LG 90%

DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression

Wei Huang, Huang Wei, Yinggui Wang

机构 * Ant Group, China(蚂蚁集团)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18158 2025-09-05 cs.CR cs.LG 89%

Large Language Models for Cryptocurrency Transaction Analysis: A Bitcoin Case Study

Yuchen Lei, Yuexin Xiang, Qin Wang, Rafael Dowsley, Tsz Hon Yuen, Kim-Kwang Raymond Choo, Jiangshan Yu

机构 * School of Cyber Science and Engineering, Wuhan University(武汉大学计算机科学与工程学院) Faculty of Information Technology, Monash University(莫纳什大学信息技术学院) CSIRO’s Data61(CSIRO数据61研究所) Department of Information Systems and Cybersecurity, University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校信息系统与网络安全系) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04304 2025-09-05 cs.CL cs.AI 88%

Facts Fade Fast: Evaluating Memorization of Outdated Medical Knowledge in Large Language Models

Juraj Vladika, Mahdi Dhaini, Florian Matthes

机构 * Technical University of Munich(慕尼黑技术大学) School of Computation, Information and Technology(计算、信息与技术学院) Department of Computer Science(计算机科学系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08193 2025-09-05 cs.CY cs.AI 86%

Street-Level AI: Are Large Language Models Ready for Real-World Judgments?

Gaurab Pokharel, Shafkat Farabi, Patrick J. Fowler, Sanmay Das

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

Comments This work has been accepted for publication as a full paper at the AAAI/ACM Conference on AI, Ethics, and Society (AIES 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17882 2025-09-05 cs.AI cs.CL 86%

Science Across Languages: Assessing LLM Multilingual Translation of Scientific Papers

Hannah Calzi Kleidermacher, James Zou

机构 * Department of Electrical Engineering, Stanford University(电气工程系,斯坦福大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00406 2025-09-05 cs.CY 85%

Partnering with AI: A Pedagogical Feedback System for LLM Integration into Programming Education

Niklas Scholz, Manh Hung Nguyen, Adish Singla, Tomohiro Nagashima

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments ECTEL 2025 Preprint. This is an extended version of a poster paper accepted and published at ECTEL-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06289 2025-09-05 eess.IV cs.AI cs.CV 79%

Is an Ultra Large Natural Image-Based Foundation Model Superior to a Retina-Specific Model for Detecting Ocular and Systemic Diseases?

Qingshan Hou, Yukun Zhou, Jocelyn Hui Lin Goh, Ke Zou, Samantha Min Er Yew, Sahana Srinivasan, Meng Wang, Thaddaeus Lo, Xiaofeng Lei, Siegfried K. Wagner, Mark A. Chia, Dawei Yang, Hongyang Jiang, An Ran Ran, Rui Santos, Gabor Mark Somfai, Juan Helen Zhou, Haoyu Chen, Qingyu Chen, Carol Y. Cheung, Pearse A. Keane, Yih Chung Tham

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

Comments Accepted by Ophthalmology Science and is currently in press

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16561 2025-09-05 cs.CL cs.LG 79%

FutureGen: A RAG-based Approach to Generate the Future Work of Scientific Article

Ibrahim Al Azher, Miftahul Jannat Mokarrama, Zhishuai Guo, Sagnik Ray Choudhury, Hamed Alhoori

机构 * Dept of Computer Science Northern Illinois University(计算机科学系 北伊利诺伊大学) Dept of Computer Science University of North Texas(计算机科学系 德克萨斯大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 12 pages, 6 figures, Accepted for publication at the Workshop on AI Principles in Science Communication (Ai4SC'25), held in conjunction with the IEEE eScience Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04066 2025-09-05 cs.CL 77%

Arabic Chatbot Technologies in Education: An Overview

Hicham Bourhil, Yacine El Younoussi

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Published as a book chapter in: Transformación Digital en la Educación: Innovaciones y Desafíos desde los Campus Virtuales (UA Journals, 2024), pp. 11-14

Journal ref In: Transformación Digital en la Educación: Innovaciones y Desafíos desde los Campus Virtuales. UA Journals, 2024. pp. 11-14

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03787 2025-09-05 cs.IR cs.CL 77%

Evaluating the Robustness of Retrieval-Augmented Generation to Adversarial Evidence in the Health Domain

Shakiba Amirshahi, Amin Bigdeli, Charles L. A. Clarke, Amira Ghenai

机构 * University of Waterloo(滑铁卢大学) Toronto Metropolitan University(多伦多 Metropolitan 大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04340 2025-09-05 cs.HC 75%

Write on Paper, Wrong in Practice: Why LLMs Still Struggle with Writing Clinical Notes

Kristina L. Kupferschmidt, Kieran O'Doherty, Joshua A. Skorburg

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03828 2025-09-05 cs.AI 70%

An Agentic Model Context Protocol Framework for Medical Concept Standardization

Jaerong Ahn, Andrew Wen, Nan Wang, Heling Jia, Zhiyi Yue, Sunyang Fu, Hongfang Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00680 2025-09-05 cs.CL 70%

Better Call Claude: Can LLMs Detect Changes of Writing Style?

Johannes Römisch, Svetlana Gorovaia, Mariia Halchynska, Gleb Schmidt, Ivan P. Yamshchikov

机构 * Center for Artificial Intelligence, Technical University of Applied Sciences Würzburg-Schweinfurt(人工智能中心,应用技术大学Würzburg-Schweinfurt) Humanities Lab, Faculaty of Arts, Radboud University(人文实验室,艺术学院,拉德博德大学) LEYA Lab, School of Computer Science, Physics and Technology, HSE University(LEYA实验室,计算机科学、物理与技术学院,俄罗斯高等经济大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref CLEF 2025. Lecture Notes in Computer Science, vol 16089. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05248 2025-09-05 cs.AI cs.CL cs.IR 62%

Enhancing FKG.in: automating Indian food composition analysis

Saransh Kumar Gupta, Lipika Dey, Partha Pratim Das, Geeta Trilok-Kumar, Ramesh Jain

机构 * Ashoka University(阿什oka大学) Institute of Future Health(未来健康研究所) UC Irvine

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 5 figures, 30 references, International Conference on Pattern Recognition 2024 - Multimedia Assisted Dietary Management Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04056 2025-09-05 physics.chem-ph cs.HC 50%

The MolecularWeb Universe: Web-Based, Immersive, Multiuser Molecular Graphics And Modeling, for Education and Work in Chemistry, Structural Biology, and Materials Sciences

Luciano A. Abriata

专题命中 领域大模型 :language model(abstract)

Comments 37 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03860 2025-09-05 cs.CR 50%

KGBERT4Eth: A Feature-Complete Transformer Powered by Knowledge Graph for Multi-Task Ethereum Fraud Detection

Yifan Jia, Ye Tian, Liguo Zhang, Yanbin Wang, Jianguo Sun, Liangliang Song

专题命中 领域大模型 :language model(abstract)

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 7 篇

2509.04442 2025-09-05 cs.LG cs.AI cs.CL cs.IR 89%

Delta Activations: A Representation for Finetuned Large Language Models

Zhiqiu Xu, Amish Sethi, Mayur Naik, Ser-Nam Lim

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Central Florida(佛罗里达中央大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03816 2025-09-05 physics.ao-ph cs.LG 79%

Finetuning AI Foundation Models to Develop Subgrid-Scale Parameterizations: A Case Study on Atmospheric Gravity Waves

Aman Gupta, Aditi Sheshadri, Sujit Roy, Johannes Schmude, Vishal Gaur, Wei Ji Leong, Manil Maskey, Rahul Ramachandran

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏