arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12705 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12705 篇

2409.13727 2025-01-29 cs.CL cs.IR 77%

Classification performance and reproducibility of GPT-4 omni for information extraction from veterinary electronic health records

Judit M Wulcan, Kevin L Jacques, Mary Ann Lee, Samantha L Kovacs, Nicole Dausend, Lauren E Prince, Jonatan Wulcan, Sina Marsilio, Stefan M Keller

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 24 pages, 3 figures, 8 supplementary figures

Journal ref Frontiers in Veterinary Science, Vol. 11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07272 2025-01-29 cs.AI cs.HC 77%

Abstract Operations Research Modeling Using Natural Language Inputs

Junxuan Li, Ryan Wickman, Sahil Bhatnagar, Raj Kumar Maity, Arko Mukherjee

机构 * Microsoft(微软公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15310 2025-01-28 cs.CL cs.SD eess.AS 77%

The Multicultural Medical Assistant: Can LLMs Improve Medical ASR Errors Across Borders?

Ayo Adedeji, Mardhiyah Sanni, Emmanuel Ayodele, Sarita Joshi, Tobi Olatunji

机构 * Google Cloud(谷歌云) Intron Health(英创健康)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14998 2025-01-28 cs.CL 77%

Federated Retrieval Augmented Generation for Multi-Product Question Answering

Parshin Shojaee, Sai Sree Harsha, Dan Luo, Akash Maharaj, Tong Yu, Yunyao Li

机构 * Virginia Tech(弗吉尼亚理工大学) Adobe(奥多比公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10782 2025-01-22 cs.AI 77%

ML-SceGen: A Multi-level Scenario Generation Framework

Yicheng Xiao, Yangyang Sun, Yicheng Lin

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10775 2025-01-22 cs.CV cs.AI 77%

MedFILIP: Medical Fine-grained Language-Image Pre-training

Xinjie Liang, Xiangyu Li, Fanding Li, Jie Jiang, Qing Dong, Wei Wang, Kuanquan Wang, Suyu Dong, Gongning Luo, Shuo Li

机构 * School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) No. 4 Affiliated Hospital, Harbin Medical University(哈尔滨医科大学附属第四医院) College of computer and control engineering, Northeast Forestry University(东北林业大学计算机与控制工程学院) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Case Western Reserve University(凯斯西储大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

Comments 10 pages, 5 figures, IEEE Journal of Biomedical and Health Informatics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10186 2025-01-20 cs.AI 77%

Generative Artificial Intelligence: Implications for Biomedical and Health Professions Education

William Hersh

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02957 2025-01-20 cs.AI 77%

Agent Hospital: A Simulacrum of Hospital with Evolvable Medical Agents

Junkai Li, Yunghwei Lai, Weitao Li, Jingyi Ren, Meng Zhang, Xinhui Kang, Siyu Wang, Peng Li, Ya-Qin Zhang, Weizhi Ma, Yang Liu

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09709 2025-01-17 cs.CY cs.AI 77%

CyberMentor: AI Powered Learning Tool Platform to Address Diverse Student Needs in Cybersecurity Education

Tianyu Wang, Nianjun Zhou, Zhixiong Chen

机构 * Mercy University(梅西大学) IBM Research AI(IBM研究院人工智能部门)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09316 2025-01-17 cs.AI 77%

SOP-Agent: Empower General Purpose AI Agent with Domain-Specific SOPs

Anbang Ye, Qianran Ma, Jia Chen, Muqi Li, Tong Li, Fujiao Liu, Siqi Mai, Meichen Lu, Haitao Bao, Yang You

机构 * HPC-AI Tech(HPC-AI科技) Grab Holdings Inc(Grab控股公司) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 35 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07931 2025-01-15 cs.AI 77%

Advice for Diabetes Self-Management by ChatGPT Models: Challenges and Recommendations

Waqar Hussain, John Grundy

机构 * CSIRO’s Data61(联邦科学与工业研究组织数据61) Monash University(莫纳什大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06964 2025-01-14 cs.AI cs.HC 77%

Enhancing Patient-Centric Communication: Leveraging LLMs to Simulate Patient Perspectives

Xinyao Ma, Rui Zhu, Zihao Wang, Jingwei Xiong, Qingyu Chen, Haixu Tang, L. Jean Camp, Lucila Ohno-Machado

机构 * Indiana University Bloomington(印第安纳大学伯明顿分校) Yale University(耶鲁大学) University of California, Davis(加利福尼亚大学戴维斯分校)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06314 2025-01-14 cs.AI cs.MA 77%

BioAgents: Democratizing Bioinformatics Analysis with Multi-Agent Systems

Nikita Mehandru, Amanda K. Hall, Olesya Melnichenko, Yulia Dubinina, Daniel Tsirulnikov, David Bamman, Ahmed Alaa, Scott Saponas, Venkat S. Malladi

专题命中 领域大模型 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16133 2025-01-07 cs.LG cs.IR 77%

Context Awareness Gate For Retrieval Augmented Generation

Mohammad Hassan Heydari, Arshia Hemmat, Erfan Naman, Afsaneh Fatemi

机构 * University of Isfahan(伊斯法罕大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00083 2025-01-03 cs.MA cs.AI cs.CY 77%

AI Agent for Education: von Neumann Multi-Agent System Framework

Yuan-Hao Jiang, Ruijia Li, Yizhou Zhou, Changyong Qi, Hanglei Hu, Yuang Wei, Bo Jiang, Yonghe Wu

机构 * East China Normal University(华东师范大学) Shanghai Institute of Artificial Intelligence for Education, East China Normal University(华东师范大学上海人工智能教育研究院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) Department of Educational Information Technology, East China Normal University(华东师范大学教育信息技术系) School of Design and Engineering, National University of Singapore(新加坡国立大学设计与工程学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Conference Proceedings of the 28th Global Chinese Conference on Computers in Education, GCCCE 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20440 2024-12-31 cs.CL 77%

Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs

Pratik Rakesh Singh, Mohammadi Zaki, Pankaj Wasnik

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to AAAI'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18176 2024-12-31 cs.IR cs.AI 77%

Molar: Multimodal LLMs with Collaborative Filtering Alignment for Enhanced Sequential Recommendation

Yucong Luo, Qitao Qin, Hao Zhang, Mingyue Cheng, Ruiran Yan, Kefan Wang, Jie Ouyang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17171 2024-12-24 cs.LG cs.IR 77%

Enhancing Item Tokenization for Generative Recommendation through Self-Improvement

Runjin Chen, Mingxuan Ju, Ngoc Bui, Dimosthenis Antypas, Stanley Cai, Xiaopeng Wu, Leonardo Neves, Zhangyang Wang, Neil Shah, Tong Zhao

机构 * Snap Inc.(斯奈普公司) Yale University(耶鲁大学) Cardiff University(卡迪夫大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12116 2024-12-18 cs.CY cs.AI 77%

AI in Education: Rationale, Principles, and Instructional Implications

Eyvind Elstad

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07880 2024-12-13 cs.AI 77%

Towards Foundation-model-based Multiagent System to Accelerate AI for Social Impact

Yunfan Zhao, Niclas Boehmer, Aparna Taneja, Milind Tambe

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07781 2024-12-12 cs.HC cs.LG 77%

Can LLMs faithfully generate their layperson-understandable 'self'?: A Case Study in High-Stakes Domains

Arion Das, Asutosh Mishra, Amitesh Patel, Soumilya De, V. Gurucharan, Kripabandhu Ghosh

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00129 2024-12-11 cs.LG hep-ex physics.data-an 77%

Scaling Particle Collision Data Analysis

Hengkui Wu, Panpan Chi, Yongfeng Zhu, Liujiang Liu, Shuyang Hu, Yuexin Wang, Chen Zhou, Qihao Wang, Yingsi Xin, Bruce Liu, Dahao Liang, Xinglong Jia, Manqi Ruan

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13713 2024-12-10 cs.CL 77%

Comparison of Open-Source and Proprietary LLMs for Machine Reading Comprehension: A Practical Analysis for Industrial Applications

Mahaman Sanoussi Yahaya Alassan, Jessica López Espejel, Merieme Bouhandi, Walid Dahhane, El Hassane Ettifouri

专题命中 领域大模型 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL

Comments Preprint submitted to Natural Language Processing Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04573 2024-12-09 cs.CL 77%

Give me Some Hard Questions: Synthetic Data Generation for Clinical QA

Fan Bai, Keith Harrigian, Joel Stremmel, Hamid Hassanzadeh, Ardavan Saeedi, Mark Dredze

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments Accepted to ML4H 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03856 2024-12-06 cs.AI cs.ET 77%

How Good is ChatGPT in Giving Adaptive Guidance Using Knowledge Graphs in E-Learning Environments?

Patrick Ocheja, Brendan Flanagan, Yiling Dai, Hiroaki Ogata

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17855 2024-12-03 cs.CY cs.AI cs.ET cs.HC 77%

"Give me the code" -- Log Analysis of First-Year CS Students' Interactions With GPT

Pedro Alves, Bruno Pereira Cipriano

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments This is the author's version of the work. It is posted here for your personal use. Not for redistribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01444 2024-12-03 cs.CY cs.AI 77%

No Size Fits All: The Perils and Pitfalls of Leveraging LLMs Vary with Company Size

Ashok Urlana, Charaka Vinayak Kumar, Bala Mallikarjunarao Garlapati, Ajeet Kumar Singh, Rahul Mishra

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments COLING2025 Industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15484 2024-12-02 cs.CL 77%

"What is the value of {templates}?" Rethinking Document Information Extraction Datasets for LLMs

Ran Zmigrod, Pranav Shetty, Mathieu Sibue, Zhiqiang Ma, Armineh Nourbakhsh, Xiaomo Liu, Manuela Veloso

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments Accepted to EMNLP Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17722 2024-11-28 cs.DC cs.AI cs.NI 77%

When IoT Meet LLMs: Applications and Challenges

Ibrahim Kok, Orhan Demirci, Suat Ozdemir

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted in 2024 IEEE International Conference on Big Data (IEEE BigData), 10 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14427 2024-11-28 cs.CL 77%

Learning and communication pressures in neural networks: Lessons from emergent communication

Lukas Galke, Limor Raviv

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments camera-ready version, as published in Language Development Research

Journal ref Language Development Research 5(1), 116-143 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏