arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12705 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12705 篇

2506.10086 2025-06-13 cs.CL 77%

Chat-of-Thought: Collaborative Multi-Agent System for Generating Domain Specific Information

Christodoulos Constantinides, Shuxin Lin, Nianjun Zhou, Dhaval Patel

机构 * IBM IBM Research(IBM研究院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08932 2025-06-13 cs.SE cs.AI 77%

PyGen: A Collaborative Human-AI Approach to Python Package Creation

Saikat Barua, Mostafizur Rahman, Md Jafor Sadek, Rafiul Islam, Shehenaz Khaled, Md. Shohrab Hossain

机构 * North South University(北南大学) SpontAlign Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09634 2025-06-12 cs.CV cs.AI 77%

HSENet: Hybrid Spatial Encoding Network for 3D Medical Vision-Language Understanding

Yanzhao Shi, Xiaodan Zhang, Junzhong Ji, Haoning Jiang, Chengxin Zheng, Yinong Wang, Liangqiong Qu

机构 * The University of Hong Kong(香港大学) Beijing University of Technology(北京工业大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 27 pages, 9 figures. arXiv admin note: text overlap with arXiv:2410.14200 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09247 2025-06-12 cs.LG 77%

Agent-based Condition Monitoring Assistance with Multimodal Industrial Database Retrieval Augmented Generation

Karl Löwenmark, Daniel Strömbergsson, Chang Liu, Marcus Liwicki, Fredrik Sandin

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17294 2025-06-11 cs.SE cs.AI cs.IR 77%

Enhancing Open-Domain Task-Solving Capability of LLMs via Autonomous Tool Integration from GitHub

Bohan Lyu, Xin Cong, Heyang Yu, Pan Yang, Yujia Qin, Yining Ye, Yaxi Lu, Zhong Zhang, Yukun Yan, Yankai Lin, Zhiyuan Liu, Maosong Sun

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19501 2025-06-04 cs.AI 77%

Toward Scientific Reasoning in LLMs: Training from Expert Discussions via Reinforcement Learning

Ming Yin, Yuanhao Qu, Ling Yang, Le Cong, Mengdi Wang

机构 * Princeton University(普林斯顿大学) Stanford University(斯坦福大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07784 2025-06-03 cs.CL 77%

Domain Regeneration: How well do LLMs match syntactic properties of text domains?

Da Ju, Hagen Blix, Adina Williams

机构 * Meta AI New York University(纽约大学) FAIR

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01463 2025-06-03 cs.MA cs.AI 77%

Agentic AI and Multiagentic: Are We Reinventing the Wheel?

V. Botti

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14318 2025-06-03 cs.CV cs.CL 77%

RADAR: Enhancing Radiology Report Generation with Supplementary Knowledge Injection

Wenjun Hou, Yi Cheng, Kaishuai Xu, Heng Li, Yan Hu, Wenjie Li, Jiang Liu

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Research Institute of Trustworthy Autonomous Systems and Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学可信自主系统研究院和计算机科学与工程系) School of Computer Science, University of Nottingham Ningbo China(宁波大学计算机学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00448 2025-06-03 cs.CL 77%

Fact-Controlled Diagnosis of Hallucinations in Medical Text Summarization

Suhas BN, Han-Chin Shing, Lei Xu, Mitch Strong, Jon Burnsky, Jessica Ofor, Jordan R. Mason, Susan Chen, Sundararajan Srinivasan, Chaitanya Shivade, Jack Moriarty, Joseph Paul Cohen

机构 * AmazonUSA(亚马逊公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments https://github.com/amazon-science/acibench-hallucination-annotations

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23982 2025-06-02 cs.AI 77%

MSQA: Benchmarking LLMs on Graduate-Level Materials Science Reasoning and Knowledge

Jerry Junyang Cheung, Shiyao Shen, Yuchen Zhuang, Yinghao Li, Rampi Ramprasad, Chao Zhang

机构 * College of Computing(计算学院) School of Materials Science and Engineering(材料科学与工程学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21582 2025-05-29 cs.CY cs.AI cs.HC 77%

AITEE -- Agentic Tutor for Electrical Engineering

Christopher Knievel, Alexander Bernhardt, Christian Bernhardt

机构 * Department of Electrical Engineering and Information Technology, HTWG Hochschule Konstanz, University of Applied Sciences(电气工程与信息技术系,HTWG 科隆茨应用科学大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 12 pages, 11 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21575 2025-05-29 cs.DB cs.AI 77%

StreamLink: Large-Language-Model Driven Distributed Data Engineering System

Dawei Feng, Di Mei, Huiri Tan, Lei Ren, Xianying Lou, Zhangxi Tan

机构 * Tsinghua University(清华大学) King & Wood Mallesons(金杜律师事务所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by CIKM Workshop 2024, https://sites.google.com/view/cikm2024-rag/papers?authuser=0#h.ddm5fg2z885t

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20356 2025-05-28 cs.PL cs.AI cs.SE 77%

LEGO-Compiler: Enhancing Neural Compilation Through Translation Composability

Shuoming Zhang, Jiacheng Zhao, Chunwei Xia, Zheng Wang, Yunji Chen, Xiaobing Feng, Huimin Cui

机构 * SKLP, Institute of Computing Technology, CAS University of Chinese Academy of Sciences, Beijing, China(SKLP,计算技术研究所,中国科学院大学,北京,中国) University of Leeds, UK(利兹大学,英国) Zhongguancun Laboratory, Beijing, China(中关村实验室,北京,中国)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 30 pages, 8 figures, 4 tables. Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20050 2025-05-27 cs.IR cs.AI 77%

AutoMIR: Effective Zero-Shot Medical Information Retrieval without Relevance Labels

Lei Li, Xiangxu Zhang, Xiao Zhou, Zheng Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02172 2025-05-27 cs.CL 77%

Identifying Legal Holdings with LLMs: A Systematic Study of Performance, Scale, and Memorization

Chuck Arvin

机构 * USC Gould School of Law(USC法学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments Presented as a short paper at International Conference on Artificial Intelligence and Law 2025 (Chicago, IL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18220 2025-05-27 cs.CY cs.AI 77%

Navigating Pitfalls: Evaluating LLMs in Machine Learning Programming Education

Smitha Kumar, Michael A. Lones, Manuel Maarek, Hind Zantout

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17037 2025-05-26 cs.CL 77%

Prompt Engineering: How Prompt Vocabulary affects Domain Knowledge

Dimitri Schreiter

机构 * Institute of Computer Science(计算机科学研究所) Center for Computational Sciences at the Georg-August-Universität Göttingen(哥廷根乔治-亚历山大大学计算科学中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14963 2025-05-22 cs.CL 77%

MedBrowseComp: Benchmarking Medical Deep Research and Computer Use

Shan Chen, Pedro Moreira, Yuxin Xiao, Sam Schmidgall, Jeremy Warner, Hugo Aerts, Thomas Hartvigsen, Jack Gallifant, Danielle S. Bitterman

机构 * Harvard(哈佛大学) Mass General Brigham(麻省总医院) Boston Children’s Hospital(波士顿儿童医院) MIT(麻省理工学院) Universitat Pompeu Fabra(庞培法华大学) Johns Hopkins University(约翰霍普金斯大学) Brown University(布朗大学) Maastricht University(马斯特里赫特大学) University of Virginia(弗吉尼亚大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments You can visit our project page at: https://moreirap12.github.io/mbc-browse-app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14163 2025-05-21 cs.AI 77%

DSMentor: Enhancing Data Science Agents with Curriculum Learning and Online Knowledge Accumulation

He Wang, Alexander Hanbo Li, Yiqun Hu, Sheng Zhang, Hideo Kobayashi, Jiani Zhang, Henry Zhu, Chung-Wei Hang, Patrick Ng

机构 * Carnegie Mellon University(卡内基梅隆大学) AWS AI(AWS人工智能)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12888 2025-05-20 cs.CL 77%

GAP: Graph-Assisted Prompts for Dialogue-based Medication Recommendation

Jialun Zhong, Yanzeng Li, Sen Hu, Yang Zhang, Teng Xu, Lei Zou

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国) Ant Group(蚂蚁集团)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12334 2025-05-20 cs.AI 77%

Enhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance

Yufeng Wang, Jinwu Hu, Ziteng Huang, Kunyang Lin, Zitian Zhang, Peihao Chen, Yu Hu, Qianyue Wang, Zhuliang Yu, Bin Sun, Xiaofen Xing, Qingfang Zheng, Mingkui Tan

机构 * South China University of Technology(华南理工大学) Peng Cheng Laboratory(鹏城实验室) Pazhou Laboratory(琶洲实验室) Tencent AI Lab(腾讯AI实验室) Tencent Robotics X Lab(腾讯机器人X实验室) Hong Kong Polytechnic University(香港理工大学) Hunan University(湖南大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11855 2025-05-20 cs.CL 77%

When AI Co-Scientists Fail: SPOT-a Benchmark for Automated Verification of Scientific Research

Guijin Son, Jiwoo Hong, Honglu Fan, Heejeong Nam, Hyunwoo Ko, Seungwon Lim, Jinyeop Song, Jinha Choi, Gonçalo Paulo, Youngjae Yu, Stella Biderman

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10003 2025-05-16 cs.LG eess.SP 77%

AI2MMUM: AI-AI Oriented Multi-Modal Universal Model Leveraging Telecom Domain Large Model

Tianyu Jiao, Zhuoran Xiao, Yihang Huang, Chenhui Ye, Yijia Feng, Liyu Cai, Jiang Chang, Fangkun Liu, Yin Xu, Dazhi He, Yunfeng Guan, Wenjun Zhang

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学 cooperative medianet innovation center) Nokia Bell Labs(诺基亚贝尔实验室) Institute of Intelligent Communications and Network Security, Chongqing University of Posts and Telecommunications(重庆邮电大学智能通信与网络安全研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09787 2025-05-16 cs.AI 77%

A Multimodal Multi-Agent Framework for Radiology Report Generation

Ziruo Yi, Ting Xiao, Mark V. Albert

机构 * University of North Texas(北卡罗来纳州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06394 2025-05-13 cs.CR cs.AI 77%

Towards AI-Driven Human-Machine Co-Teaming for Adaptive and Agile Cyber Security Operation Centers

Massimiliano Albanese, Xinming Ou, Kevin Lybarger, Daniel Lende, Dmitry Goldgof

机构 * George Mason University(乔治·马歇尔大学) University of South Florida(佛罗里达州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04084 2025-05-08 cs.SE cs.AI 77%

An Empirical Study of OpenAI API Discussions on Stack Overflow

Xiang Chen, Jibin Wang, Chaoyang Gao, Xiaolin Ju, Zhanqi Cui

机构 * School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学) State Key Lab. for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Chang Chien College, Nantong University(长进学院,南通大学) Computer School, Beijing Information Science and Technology University(计算机学院,北京信息科技大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18504 2025-05-08 cs.CV cs.AI cs.NE 77%

CLEAR: Cue Learning using Evolution for Accurate Recognition Applied to Sustainability Data Extraction

Peter J. Bentley, Soo Ling Lim, Fuyuki Ishikawa

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 9 pages plus 2 pages of supplemental material

Journal ref Proceedings of the Genetic and Evolutionary Computation Conference 2025 (GECCO 25). ACM, Malaga, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01955 2025-05-06 cs.AI 77%

Generative AI in clinical practice: novel qualitative evidence of risk and responsible use of Google's NotebookLM

Max Reuter, Maura Philippone, Bond Benton, Laura Dilley

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Eye (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01560 2025-05-06 cs.CL 77%

AI agents may be worth the hype but not the resources (yet): An initial exploration of machine translation quality and costs in three language pairs in the legal and news domains

Vicent Briva Iglesias, Gokhan Dogru

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏