arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12637 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12637 篇

2511.23235 2025-12-01 cs.CL cs.AI 86%

Tourism Question Answer System in Indian Language using Domain-Adapted Foundation Models

使用领域适应基础模型的印度语言旅游问答系统

Praveen Gatla, Anushka, Nikita Kanwar, Gouri Sahoo, Rajesh Kumar Mundotiya

机构 * Department of Linguistics Banaras Hindu University(语言学系班加罗尔 Hindu 大学) Department of Humanistic Studies Indian Institute of Technology (BHU)(人文科学系印度理工学院(BHU)) Department of Computer Science and Engineering Indian Institute of Technology Bhilai(计算机科学与工程系印度理工学院 Bhilai)

专题命中 领域大模型 :foundation model(title,abstract);SFT(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出使用领域适应基础模型构建印地语旅游问答系统,通过LoRA微调提升效率与准确性,验证RoBERTa在捕捉文化术语上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20798 2025-12-01 cs.LG cs.AI physics.comp-ph 86%

Physics Steering: Causal Control of Cross-Domain Concepts in a Physics Foundation Model

物理引导:在物理基础模型中实现跨领域概念的因果控制

Rio Alexa Fear, Payel Mukhopadhyay, Michael McCabe, Alberto Bietti, Miles Cranmer

机构 * University of Cambridge(剑桥大学) NYU(纽约大学) Simons Foundation(Simons基金会) Flatiron Institute(Flatiron研究所)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过物理基础模型的激活空间分析,揭示了因果控制物理行为的机制,展示了对物理概念的跨领域操控能力。

Comments 16 Pages, 9 Figures. Code available soon at https://github.com/DJ-Fear/walrus_steering

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18585 2025-12-01 cs.AI cs.CL cs.LO 86%

RvLLM: LLM Runtime Verification with Domain Knowledge

RvLLM: 基于领域知识的LLM运行时验证

Yedi Zhang, Sun Yi Emma, Annabelle Lee Jia En, Jin Song Dong

机构 * National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 RvLLM通过整合领域知识,提供了一种轻量且灵活的LLM运行时验证框架,有效检测各类LLM的错误输出。

Comments 24 pages, 11 tables, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20729 2025-11-27 cs.LG cs.AI 86%

Spatio-Temporal Trajectory Foundation Model - Recent Advances and Future Directions

时空轨迹基础模型——近期进展与未来方向

Sean Bin Yang, Ying Sun, Yunyao Cheng, Yan Lin, Kristian Torp, Jilin Hu

机构 * Aalborg University(奥尔堡大学) Chongqing University of Posts and Telecomunications(重庆邮电大学) East China Normal University(华东师范大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了时空轨迹基础模型的最新进展与未来方向,分析了现有方法的优缺点,并提出了提升时空通用智能的研究路径。

Comments This paper has been accepted by CIKM 2025 STIntelligence Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20679 2025-11-27 cs.AI cs.LG 86%

Minimizing Hyperbolic Embedding Distortion with LLM-Guided Hierarchy Restructuring

最小化双曲嵌入扭曲与LLM引导的层次重构

Melika Ayoughi, Pascal Mettes, Paul Groth

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文利用LLM引导重构层次结构,以优化双曲嵌入质量,提升嵌入效果和可解释性。

Journal ref K-CAP2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18578 2025-11-25 q-fin.CP cs.AI cs.LG q-fin.PM q-fin.PR 86%

Re(Visiting) Time Series Foundation Models in Finance

重新审视金融领域的时序基础模型

Eghbal Rahimikia, Hao Ni, Weiguan Wang

机构 * Alliance Manchester Business School University of Manchester(曼彻斯特大学阿利安斯商学院) Department of Mathematics University College London (UCL)(伦敦大学学院数学系) School of Economics Shanghai University(上海大学经济学院)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了金融领域时序基础模型的性能,发现从头预训练模型在预测和经济改进上优于现成预训练模型,强调了领域特定适应的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22006 2025-11-25 cs.CL cs.LG 86%

Enhancing Domain-Specific Encoder Models with LLM-Generated Data: How to Leverage Ontologies, and How to Do Without Them

通过LLM生成数据增强领域特定编码器模型:如何利用本体论,以及如何不依赖本体论

Marc Brinner, Tarek Al Mustafa, Sina Zarrieß

机构 * Computational Linguistics Department of Linguistics(计算语言学系) Institute of Computer Science(计算机科学研究所) Bielefeld University(比勒菲尔德大学)

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

AI总结 通过LLM生成数据增强领域特定编码器模型,利用本体论或自动提取概念,实现低资源环境下的高效预训练。

Comments Published in the Findings of the Association for Computational Linguistics: EMNLP 2025

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025 (pp. 22740-22754). Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10900 2025-11-20 cs.CL cs.AI 86%

Expert-Guided Prompting and Retrieval-Augmented Generation for Emergency Medical Service Question Answering

Xueren Ge, Sahil Murtaza, Anthony Cortez, Homa Alemzadeh

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12922 2025-11-18 cs.IR cs.AI cs.LG cs.NE cs.SI 86%

Tokenize Once, Recommend Anywhere: Unified Item Tokenization for Multi-domain LLM-based Recommendation

Yu Hou, Won-Yong Shin

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 8 figures, 9 tables; Annual AAAI Conference on Artificial Intelligence (AAAI-26) (to appear) (Please cite our conference version.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02104 2025-11-18 cs.LG cs.AI 86%

Foundation Model in Biomedicine

Xiangrui Liu, Yuanyuan Zhang, Qianyu Shang, Yingzhou Lu, Changchang Yin, Xiaoling Hu, Xiaoou Liu, Lulu Chen, Alexander Rodríguez, Yezhou Yang, Ping Zhang, Jintai Chen, Shan Du, Huaxiu Yao, Sheng Wang, Tianfan Fu, Xiao Wang

机构 * Arizona State University(亚利桑那州立大学) Purdue University(普渡大学) University of British Columbia(不列颠哥伦比亚大学) Stanford University(斯坦福大学) The Ohio State University(俄亥俄州立大学) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) Virginia Polytechnic Institute(弗吉尼亚多项技术学院) University of Michigan(密歇根大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Nanjing University(南京大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17506 2025-11-17 cs.LG cs.AI 86%

RAG-Enhanced Collaborative LLM Agents for Drug Discovery

Namkyeong Lee, Edward De Brouwer, Ehsan Hajiramezanali, Tommaso Biancalani, Chanyoung Park, Gabriele Scalia

机构 * Genentech(基因泰克)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Machine Learning, Drug Discovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06645 2025-11-11 stat.ML cs.CL cs.LG 86%

Adaptive Testing for Segmenting Watermarked Texts From Language Models

Xingchi Li, Xiaochi Liu, Guanxun Li

机构 * Department of Statistics Texas A&M University(统计学系德克萨斯A&M大学) Department of Statistics Beijing Normal University at Zhuhai(统计学系北京师范大学珠海分校)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 13 pages, 3 figures, accepted for publication in STAT, October 28, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05527 2025-11-11 cs.CL cs.AI 86%

Bridging Industrial Expertise and XR with LLM-Powered Conversational Agents

Despina Tomkou, George Fatouros, Andreas Andreou, Georgios Makridis, Fotis Liarokapis, Dimitrios Dardanis, Athanasios Kiourtis, John Soldatos, Dimosthenis Kyriazis

机构 * Innov-Acts Ltd.(Innov-Acts有限公司) CYENS Centre of Excellence(CYENS卓越中心) University of Piraeus(比雷埃克斯大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 7 figures

Journal ref 2025 21st International Conference on Distributed Computing in Smart Systems and the Internet of Things (DCOSS-IoT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16335 2025-11-11 cs.AI cs.CL 86%

Explainable Rule Application via Structured Prompting: A Neural-Symbolic Approach

Albert Sadowski, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology(电子与信息技术学院) Warsaw University of Technology(华沙技术大学)

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at the 29th International Conference on Knowledge-Based and Intelligent Information \& Engineering Systems (KES 2025)

Journal ref Procedia Computer Science 270 (2025) 2166-2175

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05311 2025-11-10 cs.AI cs.LG cs.RO cs.SE 86%

Cleaning Maintenance Logs with LLM Agents for Improved Predictive Maintenance

Valeriu Dimidov, Faisal Hawlader, Sasan Jafarnejad, Raphaël Frank

机构 * Interdisciplinary Centre for Security, Reliability Trust (SnT) University of Luxembourg 29 Avenue J.F. Kennedy L-1855, Luxembourg

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14846 2025-11-04 cs.AI cs.CL cs.LO 86%

Where to Search: Measure the Prior-Structured Search Space of LLM Agents

Zhuo-Yang Song

机构 * School of Physics, Peking University(物理学院,北京大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24442 2025-10-29 cs.AI cs.CL cs.CY cs.MA 86%

Law in Silico: Simulating Legal Society with LLM-Based Agents

Yiding Wang, Yuxuan Chen, Fanxu Meng, Xifan Chen, Xiaolei Yang, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究所) Yuanpei College, Peking University(北京大学元培学院) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) Law School, Peking University(北京大学法学院) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19209 2025-10-28 cs.CL cs.AI cs.CE stat.ML 86%

MOOSE-Chem2: Exploring LLM Limits in Fine-Grained Scientific Hypothesis Discovery via Hierarchical Search

Zonglin Yang, Wanhao Liu, Ben Gao, Yujie Liu, Wei Li, Tong Xie, Lidong Bing, Wanli Ouyang, Erik Cambria, Dongzhan Zhou

机构 * Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Wuhan University(武汉大学) National University of Singapore(新加坡国立大学) University of New South Wales(新南威尔士大学) MiroMind The Chinese University of Hong Kong(香港中文大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00711 2025-10-23 cs.LG cs.AI cs.CV 86%

QoQ-Med: Building Multimodal Clinical Foundation Models with Domain-Aware GRPO Training

Wei Dai, Peilin Chen, Chanakya Ekbote, Paul Pu Liang

机构 * MIT Media Lab(MIT媒体实验室) MIT EECS(MIT电子工程与计算机科学系)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

Comments Accepted as Oral at NeurIPS 2025. Revision after camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12217 2025-10-17 cs.CL cs.AI 86%

HALF: Harm-Aware LLM Fairness Evaluation Aligned with Deployment

Ali Mekky, Omar El Herraoui, Preslav Nakov, Yuxia Wang

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18630 2025-10-13 cs.CL cs.AI cs.MA 86%

DDO: Dual-Decision Optimization for LLM-Based Medical Consultation via Multi-Agent Collaboration

Zhihao Jia, Mingyi Jia, Junwen Duan, Jianxin Wang

机构 * Hunan Provincial Key Lab on Bioinformatics, School of Computer Science and Engineering, Central South University(湖南生物信息省级重点实验室,计算机科学与工程学院,中南大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01605 2025-10-13 cs.CL cs.AI 86%

Medchain: Bridging the Gap Between LLM Agents and Clinical Practice with Interactive Sequence

Jie Liu, Wenxuan Wang, Zizhan Ma, Guolin Huang, Yihang SU, Kao-Jung Chang, Wenting Chen, Haoliang Li, Linlin Shen, Michael Lyu

机构 * The City University of Hong Kong(香港城市大学) Renmin University of China(中国人民大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen University(深圳大学) National Yang Ming Chiao Tung University(阳明交通大学) Taipei Veterans General Hospital(台北荣民总医院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS25 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05393 2025-10-10 cs.LG cs.AI cs.AR 86%

HiVeGen -- Hierarchical LLM-based Verilog Generation for Scalable Chip Design

Jinwei Tang, Jiayin Qin, Kiran Thorat, Chen Zhu-Tian, Yu Cao, Yang, Zhao, Caiwen Ding

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05087 2025-10-07 cs.CL cs.AI 86%

TeachLM: Post-Training LLMs for Education Using Authentic Learning Data

Janos Perczel, Jin Chow, Dorottya Demszky

机构 * Polygence Stanford University(斯坦福大学)

专题命中 领域大模型 :post-training(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 28 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21815 2025-10-07 cs.IR cs.AI cs.CL 86%

Scientific Paper Retrieval with LLM-Guided Semantic-Based Ranking

Yunyi Zhang, Ruozhen Yang, Siqi Jiao, SeongKu Kang, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Korea University(韩国大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07044 2025-10-06 cs.CL cs.AI 86%

DatawiseAgent: A Notebook-Centric LLM Agent Framework for Adaptive and Robust Data Science Automation

Ziming You, Yumiao Zhang, Dexuan Xu, Yiwei Lou, Yandong Yan, Wei Wang, Huaming Zhang, Yu Huang

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) School of Software & Microelectronics, Peking University(软件与微电子学院,北京大学) School of Computer Science, Peking University(计算机科学学院,北京大学) Xi’an Jiaotong University(西安交通大学) Institute of Basic Theory of Chinese Medicine, China Academy of Chinese Medical Sciences(中医基础理论研究所,中国中医科学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The camera-ready version for EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11191 2025-10-06 cs.CR cs.AI cs.CL 86%

Primus: A Pioneering Collection of Open-Source Datasets for Cybersecurity LLM Training

Yao-Ching Yu, Tsun-Han Chiang, Cheng-Wei Tsai, Chien-Ming Huang, Wen-Kwang Tsao

机构 * AI Lab, TrendMicro(TrendMicro人工智能实验室)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02200 2025-10-03 cs.CL cs.AI 86%

ARUQULA -- An LLM based Text2SPARQL Approach using ReAct and Knowledge Graph Exploration Utilities

Felix Brei, Lorenz Bühmann, Johannes Frey, Daniel Gerber, Lars-Peter Meyer, Claus Stadler, Kirill Bulert

机构 * Institute for Applied Informatics at Leipzig University(莱比锡大学应用信息学院) Leipzig University(莱比锡大学) Chemnitz Technical University(Chemnitz技术大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments peer reviewed publication at Text2SPARQL Workshop @ ESWC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00261 2025-10-02 cs.CL cs.AI cs.MM 86%

Retrieval-Augmented Generation for Electrocardiogram-Language Models

Xiaoyu Song, William Han, Tony Chen, Chaojing Duan, Michael A. Rosenberg, Emerson Liu, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) Columbia University(哥伦比亚大学) Allegheny Health Network(阿勒格尼医疗网络) University of Colorado(科罗拉多大学)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures; Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07117 2025-09-30 cs.CL cs.LG 86%

Continuous Language Model Interpolation for Dynamic and Controllable Text Generation

Sara Kangaslahti, David Alvarez-Melis

机构 * School of Engineering and Applied Sciences(工程与应用科学学院) Harvard University(哈佛大学) Kempner Institute(凯普纳研究所)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 20 pages, 22 figures

Journal ref Transactions on Machine Learning Research (2025) 2835-8856

详情

展开后加载摘要…

URL PDF HTML 收藏