arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-16 至 2025-09-16 共收录 266 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 40 篇

2509.11782 2025-09-16 cs.LG q-bio.BM 57%

Multimodal Regression for Enzyme Turnover Rates Prediction

Bozhen Hu, Cheng Tan, Siyuan Li, Jiangbin Zheng, Sizhe Qiu, Jun Xia, Stan Z. Li

机构 * AI Division, School of Engineering, Westlake University(西拉丘学院人工智能系,西湖大学) Zhejiang University(浙江大学) Oxford University(牛津大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

Comments 9 pages, 5 figures. This paper was withdrawn from the IJCAI 2025 proceedings due to the lack of participation in the conference and presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11724 2025-09-16 cs.LG cs.CV 57%

DRAG: Data Reconstruction Attack using Guided Diffusion

Wa-Kin Lei, Jun-Cheng Chen, Shang-Tse Chen

机构 * Research Center for Information Technology Innovation, Academia Sinica(中国科学院信息科技创新研究中心) National Taiwan University(国立台湾大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11466 2025-09-16 cs.CL 57%

Improving LLMs' Learning for Coreference Resolution

Yujian Gan, Yuan Liang, Yanni Lin, Juntao Yu, Massimo Poesio

机构 * Queen Mary University of London(伦敦皇后玛丽大学) Guangxi Normal University(广西师范大学) University of Utrecht(乌得勒支大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11191 2025-09-16 cs.CL cs.IR 57%

RanAT4BIE: Random Adversarial Training for Biomedical Information Extraction

Jian Chen, Shengyi Lv, Leilei Su

机构 * Department of Data Science and Big Data Technology, Hainan University, Haikou 570228, China(数据科学与大数据技术学院,海南大学,海口570228,中国) Department of Mathematics, Hainan University, Haikou 570228, China(数学学院,海南大学,海口570228,中国)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments Accepted for publication at the International Joint Conference on Neural Networks (IJCNN) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15313 2025-09-16 cs.CV cs.AI 57%

First RAG, Second SEG: A Training-Free Paradigm for Camouflaged Object Detection

Wutao Liu, YiDan Wang, Pan Gao

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01064 2025-09-16 cs.CV cs.AI 57%

Fighting Fire with Fire (F3): A Training-free and Efficient Visual Adversarial Example Purification Method in LVLMs

Yudong Zhang, Ruobing Xie, Yiqing Huang, Jiansheng Chen, Xingwu Sun, Zhanhui Kang, Di Wang, Yu Wang

机构 * Tsinghua University, Tencent(清华大学,腾讯) Tencent(腾讯) University of Science and Technology Beijing(北京科技大学) Tencent, University of Macau(腾讯,澳门大学) Tsinghua University(清华大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments Accepted by ACM Multimedia 2025 BNI track (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03235 2025-09-16 cs.CV cs.AI 57%

Enhancing Traffic Incident Response through Sub-Second Temporal Localization with HybridMamba

Ibne Farabi Shihab, Sanjeda Akter, Anuj Sharma

机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(计算机科学系,爱荷华州立大学) Department of Civil, Construction and Environmental Engineering, Iowa State University, Ames, IA, USA(土木、建设与环境工程系,爱荷华州立大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09493 2025-09-16 stat.ML cs.LG 57%

C-Learner: Constrained Learning for Causal Inference

Tiffany Tianhui Cai, Yuri Fonseca, Kaiwen Hou, Hongseok Namkoong

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10561 2025-09-16 cs.CR cs.AI 57%

AVEC: Bootstrapping Privacy for Local LLMs

Madhava Gaikwad

机构 * Microsoft(微软)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11840 2025-09-16 cs.CV 50%

Synthetic Captions for Open-Vocabulary Zero-Shot Segmentation

Tim Lebailly, Vijay Veerabadran, Satwik Kottur, Karl Ridgeway, Michael Louis Iuzzolino

机构 * Meta KU Leuven(鲁汶大学)

专题命中 效率与部署 :language model(abstract)

Comments ICCV 2025 CDEL Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10123 2025-09-16 cs.RO cs.CV 50%

Learning Precise Affordances from Egocentric Videos for Robotic Manipulation

Gen Li, Nikolaos Tsagkas, Jifei Song, Ruaridh Mon-Williams, Sethu Vijayakumar, Kun Shao, Laura Sevilla-Lara

机构 * University of Edinburgh(爱丁堡大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :foundation model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11063 2025-09-16 cs.CV 50%

Organoid Tracker: A SAM2-Powered Platform for Zero-shot Cyst Analysis in Human Kidney Organoid Videos

Xiaoyu Huang, Lauren M Maxson, Trang Nguyen, Cheng Jack Song, Yuankai Huo

机构 * Vanderbilt University(范德比尔特大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10489 2025-09-16 eess.SP cs.SY eess.SY 50%

Development of AI-integrated infrastructure with biomedical device and mobile app for neonatal vital monitoring during and in between kangaroo care sessions

Saptarshi Purkayastha, Hrishikesh Bhagwat, Keerthika Sunchu, Orlando Hoilett, Eddy Odari, Reuben Thuo, Martin Wafula, Celia Kariuki, Sherri Bucher

专题命中 效率与部署 :foundation model(abstract)

Comments Presented at EMBC 2025, July 14-17, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 30 篇

2503.16974 2025-09-16 q-fin.GN cs.AI cs.CE cs.CL cs.LG 90%

Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks

Julian Junyan Wang, Victor Xiaoqi Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 76 pages, 20 tables, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10584 2025-09-16 cs.CY cs.AI cs.CL 90%

Smart Trial: Evaluating the Use of Large Language Models for Recruiting Clinical Trial Participants via Social Media

Xiaofan Zhou, Zisu Wang, Janice Krieger, Mohan Zalake, Lu Cheng

机构 * University of Illinois at Chicago(伊利诺伊大学香槟分校) Colorado State University(科罗拉多州立大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10843 2025-09-16 cs.CL 89%

Evaluating Large Language Models for Evidence-Based Clinical Question Answering

Can Wang, Yiqun Chen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10744 2025-09-16 cs.CL cs.AI 88%

Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models

Ozan Gokdemir, Neil Getty, Robert Underwood, Sandeep Madireddy, Franck Cappello, Arvind Ramanathan, Ian T. Foster, Rick L. Stevens

机构 * Argonne National Laboratory(阿贡国家实验室) The University of Chicago(芝加哥大学)

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);分类 cs.CL、cs.AI

Comments This manuscript has been accepted for publication at the Supercomputing 25 (SC '25) Conference (Frontiers in Generative AI for HPC Science and Engineering: Foundations, Challenges, and Opportunities Workshop) in St. Louis, MO, USA on November 16th, 2025. It will appear in the SC25 Workshop Proceedings after that date

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11065 2025-09-16 cs.SE cs.PL 88%

ViScratch: Using Large Language Models and Gameplay Videos for Automated Feedback in Scratch

Yuan Si, Daming Li, Hanyuan Shi, Jialu Zhang

专题命中 领域大模型 :language model(title,abstract);large language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12104 2025-09-16 cs.AI 85%

JustEva: A Toolkit to Evaluate LLM Fairness in Legal Knowledge Inference

Zongyue Xue, Siyuan Zheng, Shaochun Wang, Yiran Hu, Shenran Wang, Yuxin Yao, Haitao Li, Qingyao Ai, Yiqun Liu, Yun Liu, Weixing Shen

机构 * Tsinghua University(清华大学) Yale Law School(耶鲁法学院) Shanghai Jiaotong University(上海交通大学) University of Waterloo(滑铁卢大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This paper has been accepted at CIKM 2025 (Demo Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11507 2025-09-16 cs.AI 85%

MedicalOS: An LLM Agent based Operating System for Digital Healthcare

Jared Zhu, Junde Wu

机构 * University of Oxford(牛津大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11889 2025-09-16 cs.IR cs.CL 85%

Rethinking LLM-Based Recommendations: A Personalized Query-Driven Parallel Integration

Donghee Han, Hwanjun Song, Mun Yong Yi

机构 * KAIST(韩国科学技术院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12080 2025-09-16 cs.LG cs.AI 81%

A Time-Series Foundation Model by Universal Delay Embedding

Zijian Wang, Peng Tao, Jifan Shi, Rui Bao, Rui Liu, Luonan Chen

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10748 2025-09-16 cs.CV 80%

SCOPE: Speech-guided COllaborative PErception Framework for Surgical Scene Segmentation

Jecia Z. Y. Mao, Francis X Creighton, Russell H Taylor, Manish Sahu

机构 * LCSR, Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11365 2025-09-16 cs.CL 79%

!MSA at AraHealthQA 2025 Shared Task: Enhancing LLM Performance for Arabic Clinical Question Answering through Prompt Engineering and Ensemble Learning

Mohamed Tarek, Seif Ahmed, Mohamed Basem

机构 * Faculty of Computer Science, MSA University(计算机科学学院,MSA大学)

专题命中 领域大模型 :LLM(title);prompting(abstract);分类 cs.CL

Comments 8 Pages , ArabicNLP 2025 , Co-located with EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10620 2025-09-16 cs.CV cs.LG 79%

Building a General SimCLR Self-Supervised Foundation Model Across Neurological Diseases to Advance 3D Brain MRI Diagnoses

Emily Kaczmarek, Justin Szeto, Brennan Nichyporuk, Tal Arbel

机构 * McGill University(麦吉尔大学) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

Comments Accepted to ICCV 2025 Workshop CVAMD

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12110 2025-09-16 cs.AI 79%

Towards LLM Agents for Earth Observation

Chia Hsiang Kao, Wenting Zhao, Shreelekha Revankar, Samuel Speas, Snehal Bhagat, Rajeev Datta, Cheng Perng Phoo, Utkarsh Mall, Carl Vondrick, Kavita Bala, Bharath Hariharan

机构 * Cornell University(康奈尔大学) Columbia University(哥伦比亚大学)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

Comments Accepted at ICML 2025 Workshop TerraBytes

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11847 2025-09-16 cs.LG cs.AI 79%

A Survey on Memory-Efficient Transformer-Based Model Training in AI for Science

Kaiyuan Tian, Linbo Qiao, Baihui Liu, Gongqingjian Jiang, Shanshan Li, Dongsheng Li

机构 * College of Computer Science and Technology, National University of Defense Technology, Changsha 410073, China(计算机科学与技术学院,国防科技大学,长沙410073,中国)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-025-50302-6}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11752 2025-09-16 cs.CV 78%

A Fully Open and Generalizable Foundation Model for Ultrasound Clinical Applications

Hongyuan Zhang, Yuheng Wu, Mingyang Zhao, Zhiwei Chen, Rebecca Li, Fei Zhu, Haohan Zhao, Xiaohua Yuan, Meng Yang, Chunli Qiu, Xiang Cong, Haiyan Chen, Lina Luan, Randolph H. L. Wong, Huai Liao, Colin A Graham, Shi Chang, Guowei Tao, Dong Yi, Zhen Lei, Nassir Navab, Sebastien Ourselin, Jiebo Luo, Hongbin Liu, Gaofeng Meng

机构 * Center for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong, China(人工智能与机器人中心,香港科学创新研究所,中国科学院,香港,中国) State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing, China(数学科学国家重点实验室,数学与系统科学研究院,中国科学院,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Division of Electronic Engineering, Faculty of Engineering, The Chinese University of Hong Kong, Hong Kong, China(电子工程系,工程学院,香港中文大学,香港,中国) Accident and Emergency Medicine Academic Unit, The Chinese University of Hong Kong, Hong Kong, China(急诊医学学术单位,香港中文大学,香港,中国) Xiangya Hospital Central South University, Changsha, China(湘雅医院,中南大学,长沙,中国) Hunan Frontline Medical Technology Co., Ltd, Changsha, China(湖南前线医疗技术有限公司,长沙,中国) Qilu Hospital of Shandong University, Jinan, China(山东大学齐鲁医院,济南,中国) Zhongshan Hospital of Fudan University, Shanghai, China(复旦大学中山医院,上海,中国) Shanghai Geriatric Medical Center, Shanghai, China(上海老年医学中心,上海,中国)

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08575 2025-09-16 cs.DB 78%

SQLGovernor: An LLM-powered SQL Toolkit for Real World Application

Jie Jiang, Siqi Shen, Haining Xie, Yang Li, Yu Shen, Danqing Huang, Bo Qian, Yinjun Wu, Wentao Zhang, Bin Cui, Peng Chen

专题命中 领域大模型 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12107 2025-09-16 cs.HC cs.AI 77%

Exploring Conversational Design Choices in LLMs for Pedagogical Purposes: Socratic and Narrative Approaches for Improving Instructor's Teaching Practice

Si Chen, Isabel R. Molnar, Peiyu Li, Adam Acunin, Ting Hua, Alex Ambrose, Nitesh V. Chawla, Ronald Metoyer

机构 * University of Notre Dame(诺丁汉大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏