arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12705 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12705 篇

2511.01265 2025-11-26 cs.CL 77%

AraFinNews: Arabic Financial Summarisation with Domain-Adapted LLMs

AraFinNews: 基于领域适应大语言模型的阿拉伯语金融摘要

Mo El-Haj, Paul Rayson

机构 * School of Computing(计算学院) Lancaster University(兰卡斯特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 AraFinNews通过领域适应大语言模型提升阿拉伯语金融文本摘要的连贯性和准确性。

Comments 9 pages

Journal ref IEEE BigData 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19046 2025-11-25 cs.CV cs.AI 77%

MedSAM3: Delving into Segment Anything with Medical Concepts

MedSAM3:深入探索医学概念中的分割任务

Anglin Liu, Rundong Xue, Xu R. Cao, Yifan Shen, Yi Lu, Xiang Li, Qianqian Chen, Jintai Chen

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

AI总结 MedSAM3通过引入可文本提示的医学分割模型,实现了基于开放词汇文本描述的精准解剖结构分割,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10659 2025-11-25 cs.CL cs.IR 77%

Information Extraction From Fiscal Documents Using LLMs

从财政文件中提取信息使用大语言模型

Vikram Aggarwal, Jay Kulkarni, Aditi Mascarenhas, Aakriti Narang, Siddarth Raman, Ajay Shah, Susan Thomas

机构 * Google Inc(谷歌公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用大语言模型从多页财政文件中提取结构化数据的方法,通过多阶段流程实现高准确性,利用财政表格的层次结构进行内部验证,为发展中国家的财政数据处理提供新方案。

Comments 6 pages. Presented at the AI for Financial Inclusion, Risk Modeling and Resilience in Emerging Markets workshop at ACM ICAIF 2025 Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05012 2025-11-25 cs.SE cs.AI cs.HC 77%

LLMs' Reshaping of People, Processes, Products, and Society in Software Development: A Comprehensive Exploration with Early Adopters

大型语言模型对软件开发中人、过程、产品和社会的重塑:与早期采用者的综合探索

Benyamin Tabarsi, Heidi Reichert, Sam Gilson, Ally Limke, Sandeep Kuttal, Tiffany Barnes

机构 * North Carolina State University(北卡罗来纳州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过访谈早期采用者,探讨LLMs对软件开发中人、过程、产品和社会的影响,揭示其在不同阶段的应用差异及对开发者技能的新要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16201 2025-11-21 cs.AI cs.NE 77%

From Performance to Understanding: A Vision for Explainable Automated Algorithm Design

从性能到理解:可解释的自动算法设计愿景

Niki van Stein, Anna V. Kononova, Thomas Bäck

机构 * LIACS, Leiden University, The Netherlands(莱顿大学莱顿信息与计算科学研究所,荷兰)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过系统性基准测试结合自动化,实现可解释的自动算法设计,强调算法变体发现、可解释基准测试和问题类描述符的整合,以提升算法设计的可解释性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14366 2025-11-21 cs.CL 77%

ATLAS: A High-Difficulty, Multidisciplinary Benchmark for Frontier Scientific Reasoning

ATLAS:面向前沿科学推理的高难度、多学科基准

Hongwei Liu, Junnan Liu, Shudong Liu, Haodong Duan, Yuqiang Li, Mao Su, Xiaohong Liu, Guangtao Zhai, Xinyu Fang, Qianhong Ma, Taolin Zhang, Zihan Ma, Yufeng Zhao, Peiheng Zhou, Linchen Xiao, Wenlong Zhang, Shijie Zhou, Xingjian Ma, Siqi Sun, Jiaye Ge, Meng Li, Yuhong Liu, Jianxin Dong, Jiaying Li, Hui Wu, Hanwen Liang, Jintai Lin, Yanting Wang, Jie Dong, Tong Zhu, Tianfan Fu, Conghui He, Qi Zhang, Songyang Zhang, Lei Bai, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ATLAS是一个由领域专家开发的高难度、跨学科科学推理基准,通过原创问题和严格质量控制,评估模型在多领域知识整合和复杂推理能力上的表现。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02495 2025-11-21 cs.LG cs.CV 77%

Rep-GLS: Report-Guided Generalized Label Smoothing for Robust Disease Detection

Rep-GLS:基于报告的通用标签平滑用于稳健的疾病检测

Kunyu Zhang, Fukang Ge, Binyang Wang, Yingke Chen, Kazuma Kobayashi, Lin Gu, Jinhao Bi, Yingying Zhu

机构 * Arizona State University(亚利桑那州立大学) Guangzhou Institutes of Biomedicine and Health, Chinese Academy of Sciences(广州生物医学研究院,中国科学院) Kunming Medical University(昆明医科大学) Northumbria University(北umbria大学) NII, Tokyo Institute of Technology(东京技术大学国家研究所) RIKEN(理化学研究所) Westlake University(西湖大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Rep-GLS通过利用大语言模型挖掘医学报告中的不确定性表达,提出了一种通用标签平滑方法,以提升医学疾病检测的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15791 2025-11-20 cs.AI cs.MA 77%

Harnessing Diverse Perspectives: A Multi-Agent Framework for Enhanced Error Detection in Knowledge Graphs

Yu Li, Yi Huang, Guilin Qi, Junlan Feng, Nan Hu, Songlin Zhai, Haohan Xue, Yongrui Chen, Ruoyan Shen, Tongtong Wu

机构 * Southeast University(东南大学) China Mobile Research Institute(中国移动研究院) Monash University(墨尔本大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This paper has been ACCEPTED as a FULL PAPER at DASFAA 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23273 2025-11-18 cs.AI 77%

FinStat2SQL: A Text2SQL Pipeline for Financial Statement Analysis

Quang Hung Nguyen, Phuong Anh Trinh, Phan Quoc Hung Mai, Tuan Phong Trinh

机构 * College of Technology, National Economics University(技术学院,国家经济大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.AI

Comments Accepted for The 18th International Natural Language Generation Conference (INLG)

Journal ref https://aclanthology.org/2025.inlg-main.27/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09804 2025-11-14 cs.AI 77%

SlideBot: A Multi-Agent Framework for Generating Informative, Reliable, Multi-Modal Presentations

Eric Xie, Danielle Waterfield, Michael Kennedy, Aidong Zhang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 32 pages, 14 figures, accepted into EAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10776 2025-11-13 cs.LG 77%

Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial Feedback

Qiwei Di, Jiafan He, Quanquan Gu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 33pages, 2 figures, 1 table, ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16447 2025-11-10 cs.LG 77%

Boardwalk: Towards a Framework for Creating Board Games with LLMs

Álvaro Guglielmin Becker, Gabriel Bauer de Oliveira, Lana Bertoldo Rossato, Anderson Rocha Tavares

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Presented at SBGames 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03563 2025-11-06 cs.CL 77%

ASVRI-Legal: Fine-Tuning LLMs with Retrieval Augmented Generation for Enhanced Legal Regulation

One Octadion, Bondan Sapta Prakoso, Nanang Yudi Setiawan, Novanto Yudistira

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 11 pages (including references), 2 figures, 4 tables, published in Atlantis Press (Open Access under CC BY-NC 4.0 license)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01956 2025-11-05 cs.CY cs.AI 77%

Vibe Learning: Education in the age of AI

Marcos Florencio, Francielle Prieto

机构 * INTELI – Instituto de Tecnologia e Liderança(INTELI技术与领导力研究所) FGV - Fundação Getúlio Vargas(弗洛里奥·瓦格斯基金会)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26994 2025-11-05 cs.LG 77%

HADSF: Aspect Aware Semantic Control for Explainable Recommendation

Zheng Nie, Peijie Sun

机构 * National University of Singapore(新加坡国立大学) Nanjing University of Posts and Telecommunications(南京邮电大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00686 2025-11-04 cs.CV cs.AI 77%

Evolve to Inspire: Novelty Search for Diverse Image Generation

Alex Inch, Passawis Chaiyapattanaporn, Yuchen Zhu, Yuan Lu, Ting-Wen Ko, Davide Paglieri

机构 * University College London(伦敦大学学院) University of Oxford(牛津大学) Tesco Technology(百事科技) Microsoft Research(微软研究院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 14 pages, 10 figures, Accepted to Neurips 2025 GenProCC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27630 2025-11-04 cs.AI 77%

Interaction as Intelligence Part II: Asynchronous Human-Agent Rollout for Long-Horizon Task Training

Dayuan Fu, Yunze Wu, Xiaojie Cai, Lyumanshan Ye, Shijie Xia, Zhen Huang, Weiye Si, Tianze Xu, Jie Sun, Keyu Li, Mohan Jiang, Junfei Wang, Qishuo Hua, Pengrui Lu, Yang Xiao, Pengfei Liu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13957 2025-11-04 cs.IR cs.CL 77%

Enhancing Time Awareness in Generative Recommendation

Sunkyung Lee, Seongmin Park, Jonghyo Kim, Mincheol Yoon, Jongwuk Lee

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00924 2025-11-04 cs.CL 77%

The Biased Oracle: Assessing LLMs' Understandability and Empathy in Medical Diagnoses

Jianzhou Yao, Shunchang Liu, Guillaume Drui, Rikard Pettersson, Alessandro Blasimme, Sara Kijewski

机构 * Department of Chemistry and Applied Biosciences, ETH Zurich(应用生物科学系,苏黎世联邦理工学院) Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院) Department of Health Sciences and Technology, ETH Zurich(健康科学与技术系,苏黎世联邦理工学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27628 2025-11-03 cs.AI 77%

Validity Is What You Need

Sebastian Benthall, Andrew Clark

机构 * International Computer Science Institute(国际计算机科学研究所) New York University School of Law(纽约大学法学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27535 2025-11-03 cs.CL 77%

Patient-Centered Summarization Framework for AI Clinical Summarization: A Mixed-Methods Design

Maria Lizarazo Jimenez, Ana Gabriela Claros, Kieran Green, David Toro-Tobon, Felipe Larios, Sheena Asthana, Camila Wenczenovicz, Kerly Guevara Maldonado, Luis Vilatuna-Andrango, Cristina Proano-Velez, Satya Sai Sri Bandi, Shubhangi Bagewadi, Megan E. Branda, Misk Al Zahidy, Saturnino Luz, Mirella Lapata, Juan P. Brito, Oscar J. Ponce-Ponte

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments The first two listed authors contributed equally Pages: 21; Figures:2; Tables:3

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26824 2025-11-03 cs.DL cs.AI cs.IR 77%

LeMat-Synth: a multi-modal toolbox to curate broad synthesis procedure databases from scientific literature

Magdalena Lederbauer, Siddharth Betala, Xiyao Li, Ayush Jain, Amine Sehaba, Georgia Channing, Grégoire Germain, Anamaria Leonescu, Faris Flaifil, Alfonso Amayuelas, Alexandre Nozadze, Stefan P. Schmid, Mohd Zaki, Sudheesh Kumar Ethirajan, Elton Pan, Mathilde Franckel, Alexandre Duval, N. M. Anoop Krishnan, Samuel P. Gleason

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages, 13 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26461 2025-10-31 cs.IR cs.LG 77%

Vectorized Context-Aware Embeddings for GAT-Based Collaborative Filtering

Danial Ebrat, Sepideh Ahmadian, Luis Rueda

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Journal ref Proceedings of the Canadian Conference on Artificial Intelligence (2025). https://caiac.pubpub.org/pub/ji8cbfbp

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26354 2025-10-31 cs.CL 77%

On the Role of Context for Discourse Relation Classification in Scientific Writing

Stephen Wan, Wei Liu, Michael Strube

机构 * CSIRO Sydney, Australia(澳大利亚悉尼CSIRO) Heidelberg Institute for Theoretical Studies(海德堡理论研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at Joint Sixth Workshop on Computational Approaches to Discourse, Context and Document-Level Inferences (CODI 2025) and Eighth Workshop on Computational Models of Reference, Anaphora and Coreference (CRAC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13229 2025-10-31 cs.CL 77%

IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation

Zijie Lin, Yang Zhang, Xiaoyan Zhao, Fengbin Zhu, Fuli Feng, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) University of Science and Technology of China(中国科学技术大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24339 2025-10-30 cs.AI 77%

VDSAgents: A PCS-Guided Multi-Agent System for Veridical Data Science Automation

Yunxuan Jiang, Silan Hu, Xiaoning Wang, Yuanyuan Zhang, Xiangyu Chang

机构 * School of Management, Xi’an Jiaotong University(西安交通大学管理学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Data Science and Media Intelligence, Communication University of China(中国传媒大学数据科学与媒体智能学院) Beijing Baixingkefu Network Technology Co., Ltd.(北京百星科技网络技术有限公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages, 6 figures. Yunxuan Jiang and Silan Hu contributed equally. Code available at https://github.com/fengzer/VDSAgents . Submitted to Stat (manuscript ID: STAT-25-0222.R1, under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24431 2025-10-29 cs.IR cs.AI 77%

MiniOneRec: An Open-Source Framework for Scaling Generative Recommendation

Xiaoyu Kong, Leheng Sheng, Junfei Tan, Yuxin Chen, Jiancan Wu, An Zhang, Xiang Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05818 2025-10-28 cs.AI 77%

Chatbot To Help Patients Understand Their Health

Won Seok Jang, Hieu Tran, Manav Mistry, SaiKiran Gandluri, Yifan Zhang, Sharmin Sultana, Sunjae Kown, Yuan Zhang, Zonghai Yao, Hong Yu

机构 * Center for Healthcare Organization and Implementation Research, VA Bedford Health Care(VA贝德福德医疗中心健康组织与实施研究中心) Miner School of Computer and Information Sciences, University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校计算机与信息科学学院) Manning College of Information and Computer Sciences, University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校信息与计算机科学学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted in EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21228 2025-10-27 cs.CL cs.HC 77%

DispatchMAS: Fusing taxonomy and artificial intelligence agents for emergency medical services

Xiang Li, Huizi Yu, Wenkong Wang, Yiran Wu, Jiayan Zhou, Wenyue Hua, Xinxin Lin, Wenjia Tan, Lexuan Zhu, Bingyi Chen, Guang Chen, Ming-Li Chen, Yang Zhou, Zhao Li, Themistocles L. Assimes, Yongfeng Zhang, Qingyun Wu, Xin Ma, Lingyao Li, Lizhou Fan

机构 * Shandong University(山东大学) The Chinese University of Hong Kong(香港中文大学) Pennsylvania State University(宾夕法尼亚州立大学) Stanford University School of Medicine(斯坦福大学医学院) University of California(加州大学) University of Macau(澳门大学) New York University(纽约大学) Broad Institute of MIT(MITBroad研究所) The University of Hong Kong(香港大学) Chinese Academy of Medical Sciences(中国医学科学院) Peking Union Medical College(北京协和医学院) Rutgers University(罗格斯大学) University of South Florida(佛罗里达州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 27 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20279 2025-10-27 cs.LG 77%

ResearchGPT: Benchmarking and Training LLMs for End-to-End Computer Science Research Workflows

Penghao Wang, Yuhao Zhou, Mengxuan Wu, Ziheng Qin, Bangyuan Zhu, Shengbin Huang, Xuanlei Zhao, Panpan Zhang, Xiaojiang Peng, Yuzhang Shang, Jianfei Yang, Zheng Zhu, Tianlong Chen, Zhangyang Wang, Kai Wang

机构 * NUS(国立新加坡大学) NTU(国立科技大学) SZTU(深圳技术大学) UCF(佛罗里达大学) GigaAI(GigaAI研究所) UNC(北卡罗来纳大学教堂山分校) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏