arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12705 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12705 篇

2512.01922 2025-12-02 cs.CV 78%

Med-VCD: Mitigating Hallucination for Medical Large Vision Language Models through Visual Contrastive Decoding

Med-VCD: 通过视觉对比解码缓解医疗大视觉语言模型的幻觉问题

Zahra Mahdavi, Zahra Khodakaramimaghsoud, Hooman Khaloo, Sina Bakhshandeh Taleshani, Erfan Hashemi, Javad Mirzapour Kaleybar, Omid Nejati Manzari

机构 * Department of computer science, University of Central Florida, Orlando, USA(计算机科学系,中央佛罗里达大学) Department of Bioengineering, University of Pennsylvania, Philadelphia, PA, USA(生物工程系,宾夕法尼亚大学) Department of electrical engineering, Columbia university, New York, NY, USA(电气工程系,哥伦比亚大学) Technical University of Applied Sciences Regensburg, Regensburg, Germany(应用科学技术大学(雷根斯堡)) Department of Surgery, University of Calgary, Calgary, Alberta, Canada(外科系,卡尔加里大学) University College of Nabi Akram, Tabriz, Iran(纳比阿克兰大学) School of Electrical Engineering, Iran University of Science and Technology, Tehran, Iran(电气工程学院,伊朗科学技术大学)

专题命中 领域大模型 :language model(title,abstract)

AI总结 Med-VCD通过视觉对比解码方法提升医疗大视觉语言模型的事实准确性与幻觉准确性,减少幻觉输出并提高推理效率。

Journal ref Computers in Biology and Medicine (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23157 2025-12-01 cs.SE cs.HC 78%

Amplifiers or Equalizers? A Longitudinal Study of LLM Evolution in Software Engineering Project-Based Learning

放大器还是均衡器?一项关于LLM在软件工程项目式学习中演化的纵向研究

Hana Kataoka, Jialong Li, Yutaka Matsuno

专题命中 领域大模型 :LLM(title,abstract)

AI总结 本文通过两年纵向研究,探讨LLM在软件工程项目式学习中的双重作用,发现其既能缩小学生差距,也能加剧表现差异,对教育公平提出新挑战。

Comments Accepted by ICSE-SEET (ACM/IEEE 48th International Conference on Software Engineering: Software Engineering Education and Training)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16450 2025-12-01 cs.IR 78%

360Brew: A Decoder-only Foundation Model for Personalized Ranking and Recommendation

360Brew:一种用于个性化排序和推荐的解码器-only基础模型

Hamed Firooz, Maziar Sanjabi, Adrian Englhardt, Aman Gupta, Ben Levine, Dre Olgiati, Gungor Polatkan, Iuliia Melnychuk, Karthik Ramgopal, Kirill Talanine, Kutta Srinivasan, Luke Simon, Natesh Sivasubramoniapillai, Necip Fazil Ayan, Qingquan Song, Samira Sriram, Souvik Ghosh, Tao Song, Vignesh Kothapalli, Xiaoling Zhai, Ya Xu, Yu Wang, Yun Dai

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 360Brew是一种基于解码器-only架构的大型基础模型,能够解决多个排序和推荐任务,无需特征工程,性能媲美现有系统。

Comments arXiv admin note: This version has been removed by arXiv administrators as the submitter did not have the right to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01194 2025-11-21 cs.CV 78%

Adaptive Query Prompting for Multi-Domain Landmark Detection

多领域地标检测的自适应查询提示

Yuhui Li, Qiusen Wei, Guoheng Huang, Xiaochen Yuan, Xuhang Chen, Guo Zhong, Jianwen Huang, Jiajie Huang

机构 * School of Computer Science and Technology, Guangdong University of Technology(广东技术大学计算机科学与技术学院) School of Automation, Guangdong University of Technology(广东技术大学自动化学院) Faculty of Applied Sciences, Macao Polytechnic University(澳门 polytechnic university 应用科学学院) School of Information Science and Technology, Guangdong University of Foreign Studies(广东外语外贸大学信息科学与技术学院) School of Computer Science and Engineering, Huizhou University(惠州市大学计算机科学与工程学院)

专题命中 领域大模型 :prompting(title,abstract)

AI总结 本文提出了一种通用的多领域地标检测模型,通过自适应查询提示和轻量级解码器实现高效且高精度的地标检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13523 2025-11-18 cs.IR 78%

Compact Multimodal Language Models as Robust OCR Alternatives for Noisy Textual Clinical Reports

Nikita Neveditsin, Pawan Lingras, Salil Patil, Swarup Patil, Vijay Mago

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12410 2025-11-18 cs.CV 78%

Self-Supervised Visual Prompting for Cross-Domain Road Damage Detection

Xi Xiao, Zhuxuanzi Wang, Mingqiao Mo, Chen Liu, Chenrui Ma, Yanshu Li, Smita Krishnaswamy, Xiao Wang, Tianyang Wang

机构 * University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Cornell University(康奈尔大学) Yale University(耶鲁大学) University of California Irvine(加州大学伊万哥罗市分校) Brown University(布朗大学) Oak Ridge National Laboratory(橡树岭国家实验室)

专题命中 领域大模型 :prompting(title,abstract)

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11984 2025-11-18 cs.CV 78%

From Classification to Cross-Modal Understanding: Leveraging Vision-Language Models for Fine-Grained Renal Pathology

Zhenhao Guo, Rachit Saluja, Tianyuan Yao, Quan Liu, Junchao Zhu, Haibo Wang, Daniel Reisenbüchler, Yuankai Huo, Benjamin Liechty, David J. Pisapia, Kenji Ikemura, Steven Salvatoree, Surya Seshane, Mert R. Sabuncu, Yihe Yang, Ruining Deng

机构 * New York University(纽约大学) Cornell Tech(康奈尔科技) Vanderbilt University(范德比大学) Carnegie Mellon University(卡内基梅隆大学) University of Regensburg(莱茵河畔大学) Weill Cornell Medicine(韦尔·科恩医学中心) Northwell Health(北well健康)

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11212 2025-11-17 cs.CV 78%

MAFM^3: Modular Adaptation of Foundation Models for Multi-Modal Medical AI

Mohammad Areeb Qazi, Munachiso S Nwadike, Ibrahim Almakky, Mohammad Yaqub, Numan Saeed

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫罕默德·本·扎耶德人工智能大学)

专题命中 领域大模型 :foundation model(title,abstract)

Comments 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07894 2025-11-12 eess.SY cs.SY 78%

From Natural Language to Certified H-infinity Controllers: Integrating LLM Agents with LMI-Based Synthesis

Shihao Li, Jiachen Li, Jiamin Xu, Dongmei Chen

专题命中 领域大模型 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13088 2025-11-11 physics.chem-ph cond-mat.mtrl-sci 78%

Taming Multi-Domain, -Fidelity Data: Towards Foundation Models for Atomistic Scale Simulations

Tomoya Shiota, Kenji Ishihara, Tuan Minh Do, Toshio Mori, Wataru Mizukami

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06201 2025-11-11 cs.CV cs.HC 78%

Scene-Aware Urban Design: A Human-AI Recommendation Framework Using Co-Occurrence Embeddings and Vision-Language Models

Rodrigo Gallardo, Oz Fishman, Alexander Htet Kyaw

机构 * Department of Architecture(建筑系) Department of EECS(电子工程与计算机科学系) Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :language model(title,abstract)

Comments Accepted to NEURIPS 2025 Creative AI Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02601 2025-11-11 cs.DL 78%

Using language models to label clusters of scientific documents

Dakota Murray, Chaoqun Ni, Weiye Gu, Trevor Hubbard

专题命中 领域大模型 :language model(title,abstract)

Comments 36 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02044 2025-11-11 cs.CV 78%

A multi-modal vision-language model for generalizable annotation-free pathology localization

Hao Yang, Hong-Yu Zhou, Jiarun Liu, Weijian Huang, Cheng Li, Zhihuan Li, Yuanxu Gao, Qiegen Liu, Yong Liang, Qi Yang, Song Wu, Tao Tan, Hairong Zheng, Kang Zhang, Shanshan Wang

机构 * Paul C. Lauterbur Research Center for Biomedical Imaging(生物医学成像研究中心) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Pengcheng Laboratory(鹏城实验室) University of Chinese Academy of Sciences(中国科学院大学) Chinese Medicine Guangdong Laboratory(广东中医药实验室) Beijing Chaoyang Hospital, Capital Medical University(首都医科大学北京朝阳医院)

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05718 2025-11-10 cs.HC 78%

Do Vision-Language Models See Visualizations Like Humans? Alignment in Chart Categorization

Péter Ferenc Gyarmati, Manfred Klaffenböck, Laura Koesten, Torsten Möller

专题命中 领域大模型 :language model(title,abstract)

Comments 2 pages, 2 figures. Accepted submission to the poster track of IEEE VIS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22023 2025-11-04 cs.IR 78%

Multimodal Item Scoring for Natural Language Recommendation via Gaussian Process Regression with LLM Relevance Judgments

Yifan Liu, Qianfeng Wen, Jiazhou Liang, Mark Zhao, Justin Cui, Anton Korikov, Armin Toroghi, Junyoung Kim, Scott Sanner

专题命中 领域大模型 :LLM(title,abstract)

Comments 16 pages,20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26703 2025-10-31 eess.IV cs.CV 78%

ProstNFound+: A Prospective Study using Medical Foundation Models for Prostate Cancer Detection

Paul F. R. Wilson, Mohamed Harmanani, Minh Nguyen Nhat To, Amoon Jamzad, Tarek Elghareb, Zhuoxin Guo, Adam Kinnaird, Brian Wodlinger, Purang Abolmaesumi, Parvin Mousavi

机构 * Queen’s University(女王大学) University of British Columbia(不列颠哥伦比亚大学) University of Alberta(阿尔伯塔大学) Exact Imaging(Exact影像)

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15256 2025-10-29 cs.CV 78%

Normal and Abnormal Pathology Knowledge-Augmented Vision-Language Model for Anomaly Detection in Pathology Images

Jinsol Song, Jiamu Wang, Anh Tien Nguyen, Keunho Byeon, Sangjeong Ahn, Sung Hak Lee, Jin Tae Kwak

机构 * Korea University(韩国大学) The Catholic University of Korea(韩国天主大学)

专题命中 领域大模型 :language model(title,abstract)

Comments Accepted to ICCV 2025. Code is available at: https://github.com/QuIIL/ICCV2025_Ano-NAViLa

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18796 2025-10-28 cs.RO 78%

MOSAIC: Modular Foundation Models for Assistive and Interactive Cooking

Huaxiaoyue Wang, Kushal Kedia, Juntao Ren, Rahma Abdullah, Atiksh Bhardwaj, Angela Chao, Kelly Y Chen, Nathaniel Chin, Prithwish Dan, Xinyi Fan, Gonzalo Gonzalez-Pumariega, Aditya Kompella, Maximus Adrian Pace, Yash Sharma, Xiangwan Sun, Neha Sunkara, Sanjiban Choudhury

专题命中 领域大模型 :foundation model(title,abstract)

Comments 22 pages, 13 figures; CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02601 2025-10-20 eess.IV cs.CV 78%

Foundation Model-Driven Classification of Atypical Mitotic Figures with Domain-Aware Training Strategies

Piotr Giedziun, Jan Sołtysik, Mateusz Górczany, Norbert Ropiak, Marcin Przymus, Piotr Krajewski, Jarosław Kwiecień, Artur Bartczak, Izabela Wasiak, Mateusz Maniewski

机构 * Wrocław University of Science and Technology(沃拉什大学科学与技术学院) Cancer Center Sp. z o. o.(癌症中心有限公司) Hospital for Lung Diseases - Rebirth(肺病医院-重生) Maria Sklodowska-Curie National Research Institute of Oncology(玛丽·斯克洛多夫斯卡国家癌症研究院) Pathology Department(病理部门) th Military Research Hospital in Bydgoszcz(比多斯茨第10军科研医院) Department of Tumor Pathology and Pathomorphology(肿瘤病理与组织病理学部门) Oncology Centre Prof. Franciszek Łukaszczyk Memorial Hospital(弗雷德里克·卢卡斯茨基纪念医院肿瘤中心) Doctoral School of Medical and Health Sciences, Nicolaus Copernicus University in Toruń(医学与健康科学博士学院,尼古拉斯·哥白尼大学图努恩分校) Department of Obstetrics, Gynaecology and Oncology, Collegium Medicum in Bydgoszcz, Nicolaus Copernicus University in Torun(妇产科与肿瘤学系,比多斯茨医学院,尼古拉斯·哥白尼大学图努恩分校)

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11076 2025-10-14 cs.SE 78%

DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education

Lingyue Fu, Haowei Yuan, Datong Chen, Xinyi Dai, Qingyao Li, Weinan Zhang, Weiwen Liu, Yong Yu

专题命中 领域大模型 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19877 2025-10-14 eess.SP 78%

A Systematic Review on Foundation Models for Electrocardiogram Analysis: Initial Strides and Expansive Horizons

Yu Han, Vittorio Murino, Xiaofeng Liu, Xiang Zhang, Cheng Ding

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10011 2025-10-14 cs.CV 78%

MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output

Yanyuan Chen, Dexuan Xu, Yu Huang, Songkun Zhan, Hanpin Wang, Dongxue Chen, Xueping Wang, Meikang Qiu, Hang Li

机构 * School of Software & Microelectronics, Peking University(软件与微电子学院,北京大学) School of Computer Science, Peking University(计算机学院,北京大学) National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) Peking University Sixth Hospital(北京大学第六医院) Augusta University(奥古斯塔大学) Peking University First Hospital(北京大学第一医院)

专题命中 领域大模型 :language model(title,abstract)

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11368 2025-10-07 cs.CV 78%

From Gaze to Insight: Bridging Human Visual Attention and Vision Language Model Explanation for Weakly-Supervised Medical Image Segmentation

Jingkun Chen, Haoran Duan, Xiao Zhang, Boyan Gao, Vicente Grau, Jungong Han

机构 * Department of Engineering Science, University of Oxford(工程科学系,牛津大学) Department of Automation, Tsinghua University(自动化系,清华大学) School of Information Science and Technology, Northwest University(信息科学与技术学院,西北大学)

专题命中 领域大模型 :language model(title,abstract)

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24896 2025-09-30 cs.CV 78%

DAM: Dual Active Learning with Multimodal Foundation Model for Source-Free Domain Adaptation

Xi Chen, Hongxun Yao, Zhaopan Xu, Kui Jiang

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :foundation model(title,abstract)

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24231 2025-09-30 cs.CV 78%

EVLF-FM: Explainable Vision Language Foundation Model for Medicine

Yang Bai, Haoran Cheng, Yang Zhou, Jun Zhou, Arun Thirunavukarasu, Yuhe Ke, Jie Yao, Kanae Fukutsu, Chrystie Wan Ning Quek, Ashley Hong, Laura Gutierrez, Zhen Ling Teo, Darren Shu Jeng Ting, Brian T. Soetikno, Christopher S. Nielsen, Tobias Elze, Zengxiang Li, Linh Le Dinh, Hiok Hong Chan, Victor Koh, Marcus Tan, Kelvin Z. Li, Leonard Yip, Ching Yu Cheng, Yih Chung Tham, Gavin Siew Wei Tan, Leopold Schmetterer, Marcus Ang, Rahat Hussain, Jod Mehta, Tin Aung, Lionel Tim-Ee Cheng, Tran Nguyen Tuan Anh, Chee Leong Cheng, Tien Yin Wong, Nan Liu, Iain Beehuat Tan, Soon Thye Lim, Eyal Klang, Tony Kiat Hon Lim, Rick Siow Mong Goh, Yong Liu, Daniel Shu Wei Ting

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21722 2025-09-29 cs.CV eess.IV 78%

On the Status of Foundation Models for SAR Imagery

Nathan Inkawhich

机构 * Nathan Inkawhich(独立研究者)

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21102 2025-09-26 cs.CV 78%

Mammo-CLIP Dissect: A Framework for Analysing Mammography Concepts in Vision-Language Models

Suaiba Amina Salahuddin, Teresa Dorszewski, Marit Almenning Martiniussen, Tone Hovda, Antonio Portaluri, Solveig Thrun, Michael Kampffmeyer, Elisabeth Wetzer, Kristoffer Wickstrøm, Robert Jenssen

机构 * UiT The Arctic University of Norway(乌塔大学极地大学) Technical University of Denmark(技术大学) Østfold Hospital Trust(奥斯fold医院信托) Vestre Viken Hospital Trust(维斯特维肯医院信托) Radboud University Nijmegen Medical Centre(拉德堡德大学奈梅亨医疗中心) The Netherlands Cancer Institute(荷兰癌症研究所) Antoni van Leeuwenhoek Hospital(安东尼·弗莱明医院) University of Copenhagen(哥本哈根大学)

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20479 2025-09-26 cs.CV 78%

Are Foundation Models Ready for Industrial Defect Recognition? A Reality Check on Real-World Data

Simon Baeuerle, Pratik Khanna, Nils Friederich, Angelo Jovin Yamachui Sitcheu, Damir Shakirov, Andreas Steimer, Ralf Mikut

专题命中 领域大模型 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22629 2025-09-24 cs.CV 78%

CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation

Ziyang Gong, Zhixiang Wei, Di Wang, Xiaoxing Hu, Xianzheng Ma, Hongruixuan Chen, Yuru Jia, Yupeng Deng, Zhenming Ji, Xiangwei Zhu, Xue Yang, Naoto Yokoya, Jing Zhang, Bo Du, Junchi Yan, Liangpei Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Key Laboratory of Cryospheric Science and Frozen Soil Engineering, Northwest Institute of Eco-Environment and Resources, Chinese Academy of Sciences(中国科学院寒区旱区环境与工程研究所冻土科学与冻土工程重点实验室) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Electronics and Communication Engineering, Sun Yat-sen University(中山大学电子与通信工程学院) School of Computer Science, Wuhan University(武汉大学计算机科学学院) Zhongguancun Academy(中关村学院) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室) School of Engineering Science, University of Science and Technology of China(中国科学技术大学工程科学学院) School of Information and Electronics, Beijing Institute of Technology(北京理工大学信息与电子学院)

专题命中 领域大模型 :foundation model(title,abstract)

Comments The codes and models will be available at https://github.com/Cuzyoung/CrossEarth

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15499 2025-09-22 cs.CR 78%

Adversarially Robust Assembly Language Model for Packed Executables Detection

Shijia Li, Jiang Ming, Lanqing Liu, Longwei Yang, Ni Zhang, Chunfu Jia

专题命中 领域大模型 :language model(title,abstract)

Comments Accepted by ACM CCS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏