arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-11 至 2025-11-11 共收录 355 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 25 篇

2412.13088 2025-11-11 physics.chem-ph cond-mat.mtrl-sci 78%

Taming Multi-Domain, -Fidelity Data: Towards Foundation Models for Atomistic Scale Simulations

Tomoya Shiota, Kenji Ishihara, Tuan Minh Do, Toshio Mori, Wataru Mizukami

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06201 2025-11-11 cs.CV cs.HC 78%

Scene-Aware Urban Design: A Human-AI Recommendation Framework Using Co-Occurrence Embeddings and Vision-Language Models

Rodrigo Gallardo, Oz Fishman, Alexander Htet Kyaw

机构 * Department of Architecture(建筑系) Department of EECS(电子工程与计算机科学系) Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :language model(title,abstract)

Comments Accepted to NEURIPS 2025 Creative AI Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02601 2025-11-11 cs.DL 78%

Using language models to label clusters of scientific documents

Dakota Murray, Chaoqun Ni, Weiye Gu, Trevor Hubbard

专题命中 领域大模型 :language model(title,abstract)

Comments 36 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02044 2025-11-11 cs.CV 78%

A multi-modal vision-language model for generalizable annotation-free pathology localization

Hao Yang, Hong-Yu Zhou, Jiarun Liu, Weijian Huang, Cheng Li, Zhihuan Li, Yuanxu Gao, Qiegen Liu, Yong Liang, Qi Yang, Song Wu, Tao Tan, Hairong Zheng, Kang Zhang, Shanshan Wang

机构 * Paul C. Lauterbur Research Center for Biomedical Imaging(生物医学成像研究中心) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Pengcheng Laboratory(鹏城实验室) University of Chinese Academy of Sciences(中国科学院大学) Chinese Medicine Guangdong Laboratory(广东中医药实验室) Beijing Chaoyang Hospital, Capital Medical University(首都医科大学北京朝阳医院)

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12104 2025-11-11 cs.LG cs.AI cs.CL 75%

Generative Medical Event Models Improve with Scale

Shane Waxler, Paul Blazek, Davis White, Daniel Sneider, Kevin Chung, Mani Nagarathnam, Patrick Williams, Hank Voeller, Karen Wong, Matthew Swanhorst, Sheng Zhang, Naoto Usuyama, Cliff Wong, Tristan Naumann, Hoifung Poon, Andrew Loza, Daniella Meeker, Seth Hain, Rahul Shah

机构 * Epic Systems(Epic系统) Microsoft Research(微软研究院) Yale School of Medicine(耶鲁医学院) Cosmos Governing Council(Cosmos管理委员会)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05968 2025-11-11 cs.CV cs.AI cs.LG 73%

DiA-gnostic VLVAE: Disentangled Alignment-Constrained Vision Language Variational AutoEncoder for Robust Radiology Reporting with Missing Modalities

Nagur Shareef Shaik, Teja Krishna Cherukuri, Adnan Masood, Dong Hye Ye

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for Oral Presentation at the 40th AAAI Conference on Artificial Intelligence (AAAI-26), Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02113 2025-11-11 cs.IR 71%

Enhancing Multimodal Recommendations with Vision-Language Models and Information-Aware Fusion

Hai-Dang Kieu, Min Xu, Thanh Trung Huynh, Dung D. Le

专题命中 领域大模型 :language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07311 2025-11-11 cs.CL 70%

ACE-ICD: Acronym Expansion As Data Augmentation For Automated ICD Coding

Tuan-Dung Le, Shohreh Haddadan, Thanh Q. Thieu

机构 * Moffitt Cancer Center and Research Institute(莫菲特癌症中心和研究所在) University of South Florida(佛罗里达州立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Camera ready version for IJCNLP-AACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11177 2025-11-11 cs.CL 70%

Retrieval-Augmented Feature Generation for Domain-Specific Classification

Xinhao Zhang, Jinghan Zhang, Fengran Mo, Dakshak Keerthi Chandra, Yu-Zhong Chen, Fei Xie, Kunpeng Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ICDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05696 2025-11-11 cs.LG 70%

AI-assisted workflow enables rapid, high-fidelity breast cancer clinical trial eligibility prescreening

Jacob T. Rosenthal, Emma Hahesy, Sulov Chalise, Menglei Zhu, Mert R. Sabuncu, Lior Z. Braunstein, Anyi Li

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05600 2025-11-11 cs.CV cs.AI 57%

Google-MedGemma Based Abnormality Detection in Musculoskeletal radiographs

Soumyajit Maity, Pranjal Kamboj, Sneha Maity, Rajat Singh, Sankhadeep Chatterjee

机构 * University of Texas at Arlington, Texas, United States(德克萨斯大学阿灵顿分校) University of Engineering and Management, Kolkata, India(工程与管理大学) Sardar Vallabhbhai National Institute of Technology, Surat, India(萨达尔·瓦拉布尔希国家理工学院)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI

Comments Proceedings of ICICT 2026, London, Springer (Forthcoming, February 2026; Accepted for Publication)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 24 篇

2511.04053 2025-11-11 cs.AI 89%

Interpreting Multi-Attribute Confounding through Numerical Attributes in Large Language Models

Hirohane Takagi, Gouki Minegishi, Shota Kizawa, Issey Sukeda, Hitomi Yanaka

机构 * The University of Tokyo(东京大学) RIKEN(日本研究机构) Tohoku University(东北大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted to IJCNLP-AACL 2025 (Main). Code available at https://github.com/htkg/num_attrs

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08878 2025-11-11 cs.NI cs.IT cs.LG eess.SP math.IT 89%

Large Language Model Empowered Next-Generation MIMO Networks: Fundamentals, Challenges, and Visions

Zhe Wang, Jiayi Zhang, Hongyang Du, Ruichen Zhang, Dusit Niyato, Bo Ai, Khaled B. Letaief

机构 * State Key Laboratory of Advanced Rail Autonomous Operation(先进轨道交通自主运行状态关键实验室) Beijing Jiaotong University(北京交通大学) School of Electronics and Information Engineering(电子与信息工程学院) University of Hong Kong(香港大学) College of Computing & Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 9 pages, 4 figures, 1 table, to appear in Digital Communications and Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02904 2025-11-11 cs.CL cs.AI cs.LG 88%

How Post-Training Reshapes LLMs: A Mechanistic View on Knowledge, Truthfulness, Refusal, and Confidence

Hongzhe Du, Weikai Li, Min Cai, Karim Saraipour, Zimin Zhang, Himabindu Lakkaraju, Yizhou Sun, Shichang Zhang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of Alberta(阿尔伯塔大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Harvard University(哈佛大学)

专题命中 知识编辑与模型理解 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06475 2025-11-11 cs.CV 88%

NOAH: Benchmarking Narrative Prior driven Hallucination and Omission in Video Large Language Models

Kyuho Lee, Euntae Kim, Jinwoo Choi, Buru Chang

机构 * Korea University(韩国大学) Kyung Hee University(庆熙大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments 18 pages, 9 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06700 2025-11-11 cs.CY cs.AI cs.CL 86%

Place Matters: Comparing LLM Hallucination Rates for Place-Based Legal Queries

Damian Curran, Vanessa Sporne, Lea Frermann, Jeannie Paterson

机构 * School of Computing and Information Systems, The University of Melbourne, Australia(计算与信息系统学院,墨尔本大学,澳大利亚) The Centre for Artificial Intelligence and Digital Ethics(人工智能与数字伦理中心) Melbourne Law School, The University of Melbourne, Australia(墨尔本法学院,墨尔本大学,澳大利亚)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07083 2025-11-11 cs.AI 85%

Increasing AI Explainability by LLM Driven Standard Processes

Marc Jansen, Marcel Pehlke

机构 * Computer Science Institute University of Applied Sciences Ruhr West Bottrop(应用科学鲁尔西贝特大学计算机科学研究所)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14496 2025-11-11 cs.AI 85%

LLM-Powered Swarms: A New Frontier or a Conceptual Stretch?

Muhammad Atta Ur Rahman, Melanie Schranz, Samira Hayat

机构 * Lakeside Labs GmbH(莱克西德实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This is the author's version of a paper submitted to IEEE Intelligent Systems. 2 Tables, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06073 2025-11-11 cs.CL cs.AI cs.LG cs.LO 83%

Stemming Hallucination in Language Models Using a Licensing Oracle

Simeon Emanuilov, Richard Ackermann

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 23 pages, 4 figures, 8 tables. Introduces the Licensing Oracle, an architectural solution for eliminating hallucinations in language models through formal SHACL validation against knowledge graphs. All datasets and models are available at https://huggingface.co/collections/s-emanuilov/licensing-oracle-experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05516 2025-11-11 cs.CL cs.AI cs.SD eess.AS 81%

Ming-UniAudio: Speech LLM for Joint Understanding, Generation and Editing with Unified Representation

Canxiang Yan, Chunxiang Jin, Dawei Huang, Haibing Yu, Han Peng, Hui Zhan, Jie Gao, Jing Peng, Jingdong Chen, Jun Zhou, Kaimeng Ren, Ming Yang, Mingxue Yang, Qiang Xu, Qin Zhao, Ruijie Xiong, Shaoxiong Lin, Xuezhi Wang, Yi Yuan, Yifei Wu, Yongjie Lyu, Zhengyu He, Zhihao Qiu, Zhiqiang Fang, Ziyuan Huang

机构 * Inclusion AI Ant Group(Inclusion AI Ant集团)

专题命中 知识编辑与模型理解 :LLM(title);language model(abstract);分类 cs.CL、cs.AI

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16795 2025-11-11 cs.LG cs.AI cs.CL 80%

Steering Out-of-Distribution Generalization with Concept Ablation Fine-Tuning

Helena Casademunt, Caden Juang, Adam Karvonen, Samuel Marks, Senthooran Rajamanoharan, Neel Nanda

机构 * Harvard University(哈佛大学) Northeastern University(东北大学) Anthropic ML Alignment & Theory Scholars (MATS) program(ML对齐与理论学者(MATS)计划)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06496 2025-11-11 cs.RO cs.AI cs.CV 79%

A Low-Rank Method for Vision Language Model Hallucination Mitigation in Autonomous Driving

Keke Long, Jiacheng Guo, Tianyun Zhang, Hongkai Yu, Xiaopeng Li

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11881 2025-11-11 cs.CL 79%

Evaluating Human-LLM Representation Alignment: A Case Study on Affective Sentence Generation for Augmentative and Alternative Communication

Shadab Choudhury, Asha Kumar, Lara J. Martin

专题命中 知识编辑与模型理解 :LLM(title);language model(abstract);分类 cs.CL

Comments Published at IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05498 2025-11-11 cs.IR cs.AI 77%

Biomedical Hypothesis Explainability with Graph-Based Context Retrieval

Ilya Tyagin, Saeideh Valipour, Aliaksandra Sikirzhytskaya, Michael Shtutman, Ilya Safro

机构 * Center for Bioinformatics and Computational Biology University of Delaware(生物信息学与计算生物学中心 大田纳西大学) Computer and Information Sciences University of Delaware(计算机与信息科学 大田纳西大学) Drug Discovery and Biomedical Sciences (DDBS) College of Pharmacy University of South Carolina(药物发现与生物医学科学(DDBS)药学院 美国南卡罗来纳大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 30 pages, 10 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06048 2025-11-11 cs.CL cs.LG 73%

Visual Exploration of Feature Relationships in Sparse Autoencoders with Curated Concepts

Xinyuan Yan, Shusen Liu, Kowshik Thopalli, Bei Wang

机构 * University of Utah(犹他大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages (5 main paper+3 refernce), 2 figures, pulished at Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20264 2025-11-11 cs.CL 70%

EMBRACE: Shaping Inclusive Opinion Representation by Aligning Implicit Conversations with Social Norms

Abeer Aldayel, Areej Alokaili

机构 * King Saud University, College of Computer and Information Sciences(沙特王后大学,计算机与信息科学学院)

专题命中 知识编辑与模型理解 :language model(abstract);post-training(abstract);分类 cs.CL

Comments Accepted, to appear IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07863 2025-11-11 cs.LG 70%

Robust Hallucination Detection in LLMs via Adaptive Token Selection

Mengjia Niu, Hamed Haddadi, Guansong Pang

机构 * Imperial College London, UK(伦敦帝国学院) Singapore Management University(新加坡管理大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16678 2025-11-11 cs.CL 70%

Mechanisms vs. Outcomes: Probing for Syntax Fails to Explain Performance on Targeted Syntactic Evaluations

Ananth Agarwal, Jasper Jian, Christopher D. Manning, Shikhar Murty

机构 * Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21412 2025-11-11 cs.CV 67%

Bridging the gap to real-world language-grounded visual concept learning

Whie Jung, Semin Kim, Junee Kim, Seunghoon Hong

机构 * School of Computing, KAIST(计算机学院,韩国科学技术院)

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract)

Journal ref Advances in Neural Information Processing Systems (NeurIPS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07006 2025-11-11 cs.LG cs.AI 62%

S$^2$Drug: Bridging Protein Sequence and 3D Structure in Contrastive Representation Learning for Virtual Screening

Bowei He, Bowen Gao, Yankai Chen, Yanyan Lan, Chen Ma, Philip S. Yu, Ya-Qin Zhang, Wei-Ying Ma

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted by AAAI 2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏