arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2410.19482 2025-03-21 cs.LG 85%

Measuring memorization in language models via probabilistic extraction

Jamie Hayes, Marika Swanberg, Harsh Chaudhari, Itay Yona, Ilia Shumailov, Milad Nasr, Christopher A. Choquette-Choo, Katherine Lee, A. Feder Cooper

机构 * Google DeepMind(谷歌DeepMind) Northeastern(东北大学) Microsoft Research(微软研究院) Stanford(斯坦福大学)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

Comments NAACL 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18042 2025-03-21 cs.CV cs.CL 85%

EMOVA: Empowering Language Models to See, Hear and Speak with Vivid Emotions

Kai Chen, Yunhao Gou, Runhui Huang, Zhili Liu, Daxin Tan, Jing Xu, Chunwei Wang, Yi Zhu, Yihan Zeng, Kuo Yang, Dingdong Wang, Kun Xiang, Haoyuan Li, Haoli Bai, Jianhua Han, Xiaohui Li, Weike Jin, Nian Xie, Yu Zhang, James T. Kwok, Hengshuang Zhao, Xiaodan Liang, Dit-Yan Yeung, Xiao Chen, Zhenguo Li, Wei Zhang, Qun Liu, Jun Yao, Lanqing Hong, Lu Hou, Hang Xu

机构 * Hong Kong University of Science and Technology(香港科技大学) The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) The Chinese University of Hong Kong(香港中文大学) Sun Yat-sen University(中山大学) Southern University of Science and Technology(南方科技大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.CL

Comments Accepted by CVPR 2025. Project Page: https://emova-ollm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15571 2025-03-21 cs.SE cs.ET cs.IR cs.LG cs.PL 85%

LLM-Aided Customizable Profiling of Code Data Based On Programming Language Concepts

Pankaj Thorat, Adnan Qidwai, Adrija Dhar, Aishwariya Chakraborty, Anand Eswaran, Hima Patel, Praveen Jayachandran

机构 * IBM Research(IBM研究院) IIIT Hyderabad(印度信息技术学院海得拉巴分校) NIT Durgapur(杜尔加普尔国家理工学院)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00057 2025-03-21 cs.CV cs.CL 85%

Improved YOLOv12 with LLM-Generated Synthetic Data for Enhanced Apple Detection and Benchmarking Against YOLOv11 and YOLOv10

Ranjan Sapkota, Manoj Karkee

机构 * Cornell University(康奈尔大学) Washington State University(华盛顿州立大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 5 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09481 2025-03-13 cs.CL 85%

BAMBI: Developing Baby Language Models for Italian

Alice Suozzi, Luca Capone, Gianluca E. Lebani, Alessandro Lenci

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17954 2025-03-13 cs.AI 85%

Enhancing elusive clues in knowledge learning by contrasting attention of language models

Jian Gao, Xiao Zhang, Ji Wu, Miao Li

专题命中 预训练与数据 :language model(title,abstract);small language model(abstract);pretraining(abstract);分类 cs.AI

Comments Oral presentation in AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04429 2025-03-05 cs.CV cs.LG 85%

VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation

Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu

机构 * Tsinghua University(清华大学) MIT(麻省理工学院) NVIDIA(英伟达公司) UC Berkeley(加州大学伯克利分校) UC San Diego(加州大学圣迭戈分校)

专题命中 预训练与数据 :foundation model(title,abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Comments Code: https://github.com/mit-han-lab/vila-u. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16533 2025-03-05 cs.CL 85%

Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents

Zhengliang Shi, Shen Gao, Lingyong Yan, Yue Feng, Xiuyi Chen, Zhumin Chen, Dawei Yin, Suzan Verberne, Zhaochun Ren

机构 * Shandong University(山东大学) University of Electronic Science and Technology of China(电子科技大学) Baidu Inc.(百度公司) University of Birmingham(伯明翰大学) Leiden University(莱顿大学)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted by WWW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01768 2025-03-04 cs.LG cs.CV 85%

SHADE-AD: An LLM-Based Framework for Synthesizing Activity Data of Alzheimer's Patients

Heming Fu, Hongkai Chen, Shan Lin, Guoliang Xing

机构 * Stony Brook University(石溪大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 7 pages, 6 figures, ACM SenSys'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04286 2025-03-04 cs.CL 85%

Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScore

Junchao Wu, Runzhe Zhan, Derek F. Wong, Shu Yang, Xuebo Liu, Lidia S. Chao, Min Zhang

机构 * University of Macau(澳门大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11285 2025-03-03 cs.CV cs.AI 85%

Zero-Shot Automatic Annotation and Instance Segmentation using LLM-Generated Datasets: Eliminating Field Imaging and Manual Annotation for Deep Learning Model Development

Ranjan Sapkota, Achyut Paudel, Manoj Karkee

机构 * Washington State University(华盛顿州立大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05432 2025-02-26 cs.CV cs.LG 85%

MoFM: A Large-Scale Human Motion Foundation Model

Mohammadreza Baharani, Ghazal Alinezhad Noghre, Armin Danesh Pazho, Gabriel Maldonado, Hamed Tabkhi

机构 * The UNC at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16290 2025-02-25 cs.CY cs.CL 85%

Interrogating LLM design under a fair learning doctrine

Johnny Tian-Zheng Wei, Maggie Wang, Ameya Godbole, Jonathan H. Choi, Robin Jia

机构 * University of Southern California(南加州大学) Princeton University(普林斯顿大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03862 2025-02-25 cs.CL 85%

Verifiable by Design: Aligning Language Models to Quote from Pre-Training Data

Jingyu Zhang, Marc Marone, Tianjian Li, Benjamin Van Durme, Daniel Khashabi

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments NAACL 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12886 2025-02-19 cs.CL 85%

Are Multilingual Language Models an Off-ramp for Under-resourced Languages? Will we arrive at Digital Language Equality in Europe in 2030?

Georg Rehm, Annika Grützner-Zahn, Fabio Barth

机构 * DFKI GmbH(德国人工智能研究中心) Humboldt-Universität zu Berlin(柏林洪堡大学)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12746 2025-02-18 cs.LG 85%

TabuLa: Harnessing Language Models for Tabular Data Synthesis

Zilong Zhao, Robert Birke, Lydia Chen

机构 * National University of Singapore(新加坡国立大学) University of Turin(都灵大学) Delft University of Technology(代尔夫特理工大学)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08827 2025-02-10 cs.LG 85%

Do Unlearning Methods Remove Information from Language Model Weights?

Aghyad Deeb, Fabien Roger

机构 * Harvard University(哈佛大学) Anthropic(Anthropic公司) Redwood Research(红杉研究机构)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00808 2025-02-04 cs.LG cs.CR cs.CY 85%

Synthetic Artifact Auditing: Tracing LLM-Generated Synthetic Data Usage in Downstream Applications

Yixin Wu, Ziqing Yang, Yun Shen, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心) Netapp(Netapp公司)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments To Appear in the 34th USENIX Security Symposium, August 13-15, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18914 2025-02-03 cs.LG cs.CR 85%

Scaling Laws for Differentially Private Language Models

Ryan McKenna, Yangsibo Huang, Amer Sinha, Borja Balle, Zachary Charles, Christopher A. Choquette-Choo, Badih Ghazi, George Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, Chiyuan Zhang

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13884 2025-01-24 eess.AS cs.AI cs.SD 85%

Exploring Finetuned Audio-LLM on Heart Murmur Features

Adrian Florea, Xilin Jiang, Nima Mesgarani, Xiaofan Jiang

机构 * Columbia University(哥伦比亚大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 1 figure, and 3 tables. Submitted to IEEE/ACM Conference on Connected Health: Applications, Systems , and Engineering Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05924 2025-01-22 cs.RO cs.AI 85%

Space-LLaVA: a Vision-Language Model Adapted to Extraterrestrial Applications

Matthew Foutter, Daniele Gammelli, Justin Kruger, Ethan Foss, Praneet Bhoj, Tommaso Guffanti, Simone D'Amico, Marco Pavone

机构 * Stanford University(斯坦福大学) NVIDIA Corporation(英伟达公司)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.AI

Comments Accepted to IEEE Aerospace Conference, 23 pages, 18 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08347 2025-01-16 cs.CV cs.AI 85%

SCOT: Self-Supervised Contrastive Pretraining For Zero-Shot Compositional Retrieval

Bhavin Jawade, Joao V. B. Soares, Kapil Thadani, Deen Dayal Mohan, Amir Erfan Eshratifar, Benjamin Culpepper, Paloma de Juan, Srirangaraj Setlur, Venu Govindaraju

机构 * Yahoo Research(雅虎研究院) University at Buffalo, SUNY(纽约州立大学布法罗分校)

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Paper accepted at WACV 2025 in round 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11006 2025-01-03 cs.CL cs.CR 85%

Security Attacks on LLM-based Code Completion Tools

Wen Cheng, Ke Sun, Xinyu Zhang, Wei Wang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Paper accepted at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19312 2024-12-31 cs.IR cs.AI 85%

From Interests to Insights: An LLM Approach to Course Recommendations Using Natural Language Queries

Hugh Van Deventer, Mark Mills, August Evrard

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12642 2024-12-30 cs.CV cs.AI 85%

Zero-shot Text-guided Infinite Image Synthesis with LLM guidance

Soyeong Kwon, Taegyeong Lee, Taehwan Kim

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This paper is being withdrawn due to issues of misconduct in the experiments presented in Table 2 and Figures 6, 7, and 8. We recognize this as an ethical concern and sincerely apologize to the research community for any inconvenience it may have caused

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16089 2024-12-23 cs.HC cs.AI 85%

The Evolution of LLM Adoption in Industry Data Curation Practices

Crystal Qian, Michael Xieyang Liu, Emily Reif, Grady Simon, Nada Hussein, Nathan Clement, James Wexler, Carrie J. Cai, Michael Terry, Minsuk Kahng

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages, 4 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09173 2024-12-13 cs.CL 85%

ReFF: Reinforcing Format Faithfulness in Language Models across Varied Tasks

Jiashu Yao, Heyan Huang, Zeming Liu, Haoyu Wen, Wei Su, Boao Qian, Yuhang Guo

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19159 2024-12-10 cs.CL 85%

What Drives Performance in Multilingual Language Models?

Sina Bagheri Nezhad, Ameeta Agrawal

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted at VarDial @ NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03275 2024-12-05 cs.CL 85%

AntLM: Bridging Causal and Masked Language Models

Xinru Yu, Bin Guo, Shiwei Luo, Jie Wang, Tao Ji, Yuanbin Wu

专题命中 预训练与数据 :language model(title,abstract);foundation model(abstract);pretraining(abstract);分类 cs.CL

Comments CoNLL Shared Task BabyLM Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01071 2024-12-03 cs.LG cs.CY cs.DB 85%

Chameleon: Foundation Models for Fairness-aware Multi-modal Data Augmentation to Enhance Coverage of Minorities

Mahdi Erfanian, H. V. Jagadish, Abolfazl Asudeh

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏