arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12705 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12705 篇

2512.10178 2025-12-12 cs.LG cs.CL 79%

CIEGAD: Cluster-Conditioned Interpolative and Extrapolative Framework for Geometry-Aware and Domain-Aligned Data Augmentation

CIEGAD:基于几何感知和领域对齐的数据增强的聚类条件插值与外推框架

Keito Inoshita, Xiaokang Zhou, Akira Kawai, Katsutoshi Yada

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 CIEGAD通过聚类条件插值与外推,结合几何感知和领域对齐,有效增强数据分布外围,提升分类任务的F1和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20549 2025-12-09 cs.LG cs.AI 79%

MedGR$^2$: Breaking the Data Barrier for Medical Reasoning via Generative Reward Learning

MedGR$^2$: 通过生成奖励学习突破医学推理的数据壁垒

Weihai Zhi, Jiayan Guo, Shangyang Li

专题命中 领域大模型 :language model(abstract);foundation model(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 MedGR$^2$通过生成奖励学习解决医学推理中的数据稀缺问题,实现高效训练和泛化,优于现有方法。

Comments 8 pages, 5 figures

Journal ref AAAI'2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21615 2025-12-09 cs.CL cs.AI cs.IR 79%

Refine Medical Diagnosis Using Generation Augmented Retrieval and Clinical Practice Guidelines

通过生成增强检索和临床实践指南提升医学诊断

Wenhao Li, Hongkuan Zhang, Hongwei Zhang, Zhengxu Li, Zengjie Dong, Yafan Chen, Niranjan Bidargaddi, Hong Liu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出GARMLE-G框架,通过生成增强检索和临床指南整合,提升医学诊断的准确性和临床实用性。

Journal ref Journal of Biomedical and Health Informatics (JBHI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04210 2025-12-05 cs.AI cs.CL cs.CY 79%

Balancing Safety and Helpfulness in Healthcare AI Assistants through Iterative Preference Alignment

通过迭代偏好对齐平衡医疗AI助手的安全性与帮助性

Huy Nghiem, Swetasudha Panda, Devashish Khatwani, Huy V. Nguyen, Krishnaram Kenthapadi, Hal Daumé

机构 * University of Maryland(马里兰大学) Oracle Labs(Oracle实验室) Oracle Health AI(Oracle健康AI)

专题命中 领域大模型 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过迭代偏好对齐框架提升医疗AI助手的安全性与帮助性,通过KTO和DPO优化改进模型,提升有害查询检测性能并平衡安全与效用。

Comments ML4H 2025 Proceedings, Best Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01010 2025-12-02 cs.MA cs.AI cs.LG cs.SE physics.comp-ph physics.flu-dyn 79%

Chain of Unit-Physics: A Primitive-Centric Approach to Scientific Code Synthesis

单元物理链:一种以基础原理为中心的科学代码合成方法

Vansh Sharma, Venkat Raman

机构 * University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出单元物理链框架,通过以基础原理为中心的多代理系统,有效解决科学代码生成中的可靠性问题,实现高精度和高效能的代码生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20669 2025-11-27 cs.CL cs.AI 79%

Structured Definitions and Segmentations for Legal Reasoning in LLMs: A Study on Indian Legal Data

结构化定义与分割在大语言模型法律推理中的应用:对印度法律数据的研究

Mann Khatri, Mirza Yusuf, Rajiv Ratn Shah, Ponnurangam Kumaraguru

机构 * Indraprastha Institute of Information Technology(印度普拉斯塔学院信息科技研究所) International Institute of Information Technology Hyderabad(国际信息科技研究所(海得拉巴))

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 本文通过结构化定义与分割方法提升大语言模型在法律推理中的性能,实验显示在印度法律数据集上模型性能提升达1.5%-4.36%。

Comments Accepted at BDA 2025 as short paper; This paper is long version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18640 2025-11-25 cs.CV cs.AI cs.LG 79%

Health system learning achieves generalist neuroimaging models

健康系统学习实现通用神经影像模型

Akhil Kondepudi, Akshay Rao, Chenhui Zhao, Yiwei Lyu, Samir Harake, Soumyanil Banerjee, Rushikesh Joshi, Anna-Katharina Meissner, Renly Hou, Cheng Jiang, Asadur Chowdury, Ashok Srinivasan, Brian Athey, Vikas Gulani, Aditya Pandey, Honglak Lee, Todd Hollon

机构 * Machine Learning in Neurosurgery Lab University of Michigan(密歇根大学机器学习神经外科实验室) University of Michigan Computational Medicine and Bioinformatics(密歇根大学计算医学与生物信息学) University of Michigan Computer Science and Engineering(密歇根大学计算机科学与工程) University of Michigan Radiology(密歇根大学放射学)

专题命中 领域大模型 :language model(abstract);foundation model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

AI总结 NeuroVFM通过健康系统学习范式,在临床MRI和CT影像上训练,实现高性能通用神经影像模型,提升放射学诊断和报告生成的准确性与临床实用性。

Comments 53 pages, 4 main figures, 10 extended data figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12443 2025-11-19 cs.SE cs.AI cs.DC cs.LG 79%

From Legacy Fortran to Portable Kokkos: An Autonomous Agentic AI Workflow

Sparsh Gupta, Kamalavasan Kamalakkannan, Maxim Moraru, Galen Shipman, Patrick Diehl

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) Franklin W. Olin College of Engineering(弗兰克林·W·奥林工程学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21341 2025-11-18 cs.AI cs.CL 79%

Magellan: Guided MCTS for Latent Space Exploration and Novelty Generation

Lufan Chang

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to 1st Open Conference on AI Agents for Science (agents4science 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11340 2025-11-17 cs.CL cs.AI 79%

M-DAIGT: A Shared Task on Multi-Domain Detection of AI-Generated Text

Salima Lamsiyah, Saad Ezzini, Abdelkader El Mahdaouy, Hamza Alami, Abdessamad Benlahbib, Samir El Amrany, Salmane Chafik, Hicham Hammouchi

机构 * University of Luxembourg(卢森堡大学) King Fahd University of Petroleum and Minerals(国王法赫德石油与矿物大学) Mohammed VI Polytechnic University(穆莱·阿卜杜勒阿齐兹·本·阿卜杜勒阿齐兹技术大学) Sidi Mohamed Ben Abdellah University(西迪·穆罕默德·本·阿卜杜勒阿齐兹大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10067 2025-11-17 cs.AI cs.CL 79%

Enhancing the Medical Context-Awareness Ability of LLMs via Multifaceted Self-Refinement Learning

Yuxuan Zhou, Yubin Wang, Bin Wang, Chen Ning, Xien Liu, Ji Wu, Jianye Hao

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Huawei Noah’s Ark Lab(华为诺亚实验室) College of AI, Tsinghua University(清华大学人工智能学院) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09325 2025-11-13 cs.AI cs.CL 79%

Not Everything That Counts Can Be Counted: A Case for Safe Qualitative AI

Stine Beltoft, Lukas Galke

机构 * University of Southern Denmark(丹麦南丹麦大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at 3rd International Conference on Frontiers of Artificial Intelligence, Ethics, and Multidisciplinary Applications (FAIEMA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12475 2025-11-11 cs.CL cs.AI 79%

RareAgents: Autonomous Multi-disciplinary Team for Rare Disease Diagnosis and Treatment

Xuanzhong Chen, Ye Jin, Xiaohao Mao, Lun Wang, Shuyang Zhang, Ting Chen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments AAAI2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05766 2025-11-11 cs.AI cs.CL econ.GN q-fin.EC 79%

Anchors in the Machine: Behavioral and Attributional Evidence of Anchoring Bias in LLMs

Felipe Valencia-Clavijo

机构 * Dataplicada

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21700 2025-11-10 cs.CR cs.AI cs.LG 79%

XBreaking: Understanding how LLMs security alignment can be broken

Marco Arazzi, Vignesh Kumar Kembu, Antonino Nocera, Vinod P

机构 * Department of Electrical, Computer Biomedical Engineering, University of Pavia, Italy\ . Department of Computer Applications,\ University of Science \& Technology, India\ .

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03261 2025-11-06 cs.CL cs.AI 79%

Comparing the Performance of LLMs in RAG-based Question-Answering: A Case Study in Computer Science Literature

Ranul Dayarathne, Uvini Ranaweera, Upeksha Ganegoda

机构 * University of Moratuwa(穆塔瓦大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 4 figures, 5 tables, presented at the 5th International Conference on Artificial Intelligence in Education Technology

Journal ref Lecture Notes on Data Engineering and Communications Technologies, vol. 228, Springer, 2025, pp. 387--403

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23396 2025-10-28 cs.CL cs.AI 79%

EMTSF:Extraordinary Mixture of SOTA Models for Time Series Forecasting

Musleh Alharthi, Kaleel Mahmood, Sarosh Patel, Ausif Mahmood

机构 * Engineering, University of Bridgeport, Bridgeport, CT, USA(工程学院,布里奇波特大学) Department of Computer Science(计算机科学系) Statistics, University of Rhode Island, Kingston, RI, USA(统计学,罗德岛大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18439 2025-10-21 cs.CR cs.AI cs.CL cs.SE 79%

A Systematic Approach to Predict the Impact of Cybersecurity Vulnerabilities Using LLMs

Anders Mølmen Høst, Pierre Lison, Leon Moonen

机构 * Simula \& University of Oslo Oslo, Norway Norwegian Computing Center Oslo, Norway Simula Research Laboratory Oslo, Norway

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication in the 24th IEEE International Conference on Trust, Security and Privacy in Computing and Communications (TrustCom 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15929 2025-10-21 q-fin.ST cs.AI cs.CL 79%

Comparing LLMs for Sentiment Analysis in Financial Market News

Lucas Eduardo Pereira Teles, Carlos M. S. Figueiredo

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14400 2025-10-21 cs.CL cs.AI cs.IR 79%

MedTrust-RAG: Evidence Verification and Trust Alignment for Biomedical Question Answering

Yingpeng Ning, Yuanyuan Sun, Ling Luo, Yanhua Wang, Yuchen Pan, Hongfei Lin

机构 * College of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) Air Force Communications NCO Academy(空军通信NCO学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments Accepted as a short paper at BlBM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11344 2025-10-21 cs.LG cs.AI 79%

LinkedIn Post Embeddings: Industrial Scale Embedding Generation and Usage across LinkedIn

Sudarshan Srinivasa Ramanujam, Akanksha Bindal, Yu Jiang, Timothy J. Hazen, David Golland, Fengyu Zhang, Daqi Sun, Wanning Li, Birjodh Singh Tiwana, Siddharth Dangi, Peng Yan

机构 * LinkedIn Corporation(LinkedIn公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20957 2025-10-20 q-fin.PM cs.AI cs.CL 79%

Your AI, Not Your View: The Bias of LLMs in Investment Analysis

Hoyoung Lee, Junhyuk Seo, Suhwan Park, Junhyeong Lee, Wonbin Ahn, Chanyeol Choi, Alejandro Lopez-Lira, Yongjae Lee

机构 * LG AI Research(LG人工智能研究)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ACM International Conference on AI in Finance (ICAIF)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13843 2025-10-17 cs.CL cs.AI 79%

Serialized EHR make for good text representations

Zhirong Chou, Quan Qin, Shi Li

机构 * Southern China University(南方中国大学)

专题命中 领域大模型 :language model(abstract);foundation model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21625 2025-10-14 cs.CL cs.AI cs.IR 79%

Doc2SAR: A Synergistic Framework for High-Fidelity Extraction of Structure-Activity Relationships from Scientific Documents

Jiaxi Zhuang, Kangning Li, Jue Hou, Mingjun Xu, Zhifeng Gao, Hengxing Cai

专题命中 领域大模型 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01688 2025-10-07 cs.CL cs.AI 79%

Format Inertia: A Failure Mechanism of LLMs in Medical Pre-Consultation

Seungseop Lim, Gibaeg Kim, Wooseok Han, Jean Seo, Hyunkyung Lee, Jaehyo Yoo, Eunho Yang

专题命中 领域大模型 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02328 2025-10-06 cs.CL cs.AI cs.MA 79%

AMANDA: Agentic Medical Knowledge Augmentation for Data-Efficient Medical Visual Question Answering

Ziqing Wang, Chengsheng Mao, Xiaole Wen, Yuan Luo, Kaize Ding

机构 * Northwestern University(西北大学) Microsoft(微软公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00890 2025-10-02 cs.CL cs.AI 79%

Span-level Detection of AI-generated Scientific Text via Contrastive Learning and Structural Calibration

Zhen Yin, Shenghua Wang

机构 * Beijing Renhe Information Technology Co., Ltd.(北京润和信息技术有限公司) Key Laboratory of Digital Publishing and Total Process Management of Scientific and Technical Journals(科技期刊数字出版与全流程管理重点实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16495 2025-10-02 cs.LG cs.AI 79%

Post Hoc Regression Refinement via Pairwise Rankings

Kevin Tirta Wijaya, Michael Sun, Minghao Guo, Hans-Peter Seidel, Wojciech Matusik, Vahid Babaei

机构 * MPI-INF(马克斯·普朗克研究所信息部门) MIT(麻省理工学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025 camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24922 2025-10-01 cs.AI cs.CL 79%

MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning

Huihao Jing, Wenbin Hu, Hongyu Luo, Jianhui Yang, Wei Fan, Haoran Li, Yangqiu Song

机构 * Hong Kong University of Science and Technology(香港理工大学) Tsinghua University(清华大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26302 2025-10-01 cs.CL cs.AI 79%

QUARTZ : QA-based Unsupervised Abstractive Refinement for Task-oriented Dialogue Summarization

Mohamed Imed Eddine Ghebriout, Gaël Guibon, Ivan Lerner, Emmanuel Vincent

机构 * Université de Lorraine, CNRS, Inria, LORIA(法国洛林大学、法国国家科学研究中心、法国国家信息与自动化研究所、LORIA研究所) Université Sorbonne Paris Nord, CNRS, Laboratoire d’Informatique de Paris Nord, LIPN(法国巴黎北大学、法国国家科学研究中心、巴黎北信息学实验室、LIPN研究所) Inserm, Centre de Recherche des Cordeliers, Université Paris Cité, Sorbonne Université(法国国家医学研究院、cordeliers研究中心、巴黎城市大学、索邦大学) HeKA, Inria Paris(HeKA、法国国家信息与自动化研究所巴黎分所) Department of Medical Informatics, Assistance Publique Hôpitaux de Paris, Georges Pompidou European Hospital(医学信息学系、巴黎公共医院、乔治·蓬皮杜欧洲医院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to Empirical Methods in Natural Language Processing (EMNLP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏