arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12452 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12452 篇

2410.07304 2024-10-11 cs.HC cs.AI 85%

The Moral Turing Test: Evaluating Human-LLM Alignment in Moral Decision-Making

Basile Garcia, Crystal Qian, Stefano Palminteri

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01882 2024-10-01 cs.CL 85%

Investigating Expert-in-the-Loop LLM Discourse Patterns for Ancient Intertextual Analysis

Ray Umphrey, Jesse Roberts, Lindsey Roberts

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02727 2024-09-06 cs.CL cs.IR 85%

Pooling And Attention: What Are Effective Designs For LLM-Based Embedding Models?

Yixuan Tang, Yi Yang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments https://github.com/yixuantt/PoolingAndAttn

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11746 2024-08-22 cs.LG 85%

Mixed Sparsity Training: Achieving 4$\times$ FLOP Reduction for Transformer Pretraining

Pihe Hu, Shaolong Li, Longbo Huang

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09215 2024-08-20 eess.AS cs.CL cs.SD 85%

Generating Data with Text-to-Speech and Large-Language Models for Conversational Speech Recognition

Samuele Cornell, Jordan Darefsky, Zhiyao Duan, Shinji Watanabe

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments To appear at SynData4GenAI 2024 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01749 2024-07-25 cs.CL 85%

Differentially Private Synthetic Data via Foundation Model APIs 2: Text

Chulin Xie, Zinan Lin, Arturs Backurs, Sivakanth Gopi, Da Yu, Huseyin A Inan, Harsha Nori, Haotian Jiang, Huishuai Zhang, Yin Tat Lee, Bo Li, Sergey Yekhanin

专题命中 预训练与数据 :foundation model(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments ICML'24 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00322 2024-07-02 cs.CL 85%

LLM-Generated Natural Language Meets Scaling Laws: New Explorations and Data Augmentation Methods

Zhenhua Wang, Guang Xu, Ming Ren

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05506 2024-06-26 cs.CL 85%

Cross-Care: Assessing the Healthcare Implications of Pre-training Data on Language Model Bias

Shan Chen, Jack Gallifant, Mingye Gao, Pedro Moreira, Nikolaj Munch, Ajay Muthukkumar, Arvind Rajan, Jaya Kolluri, Amelia Fiske, Janna Hastings, Hugo Aerts, Brian Anthony, Leo Anthony Celi, William G. La Cava, Danielle S. Bitterman

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Submitted for review, data visualization tool available at: www.crosscare.net

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06408 2024-06-24 cs.CL 85%

AboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters

Li Lucy, Suchin Gururangan, Luca Soldaini, Emma Strubell, David Bamman, Lauren F. Klein, Jesse Dodge

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 28 pages, 13 figures. Association for Computational Linguistics (ACL) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05163 2024-06-21 cs.CV cs.AI 85%

MISS: A Generative Pretraining and Finetuning Approach for Med-VQA

Jiawei Chen, Dingkang Yang, Yue Jiang, Yuxuan Lei, Lihua Zhang

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments ICANN, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12423 2024-06-21 cs.CV cs.AI 85%

Jack of All Tasks, Master of Many: Designing General-purpose Coarse-to-Fine Vision-Language Model

Shraman Pramanick, Guangxing Han, Rui Hou, Sayan Nag, Ser-Nam Lim, Nicolas Ballas, Qifan Wang, Rama Chellappa, Amjad Almahairi

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.AI

Comments CVPR 2024 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07750 2024-06-10 cs.CV cs.AI 85%

Synth$^2$: Boosting Visual-Language Models with Synthetic Captions and Image Embeddings

Sahand Sharifzadeh, Christos Kaplanis, Shreya Pathak, Dharshan Kumaran, Anastasija Ilic, Jovana Mitrovic, Charles Blundell, Andrea Banino

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09676 2024-05-29 cs.RO cs.AI 85%

Mastering Robot Manipulation with Multimodal Prompts through Pretraining and Multi-task Fine-tuning

Jiachen Li, Qiaozi Gao, Michael Johnston, Xiaofeng Gao, Xuehai He, Suhaila Shakiah, Hangjie Shi, Reza Ghanadan, William Yang Wang

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by ICML 2024. Project page: https://midas-icml.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16910 2024-05-27 cs.SE cs.AI 85%

NeSy is alive and well: A LLM-driven symbolic approach for better code comment data generation and classification

Hanna Abi Akl

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages, 5 figures, accepted for the GeNeSy workshop at the Extended Semantic Web Conference (ESWC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00396 2024-05-20 cs.CL 85%

RAGTruth: A Hallucination Corpus for Developing Trustworthy Retrieval-Augmented Language Models

Cheng Niu, Yuanhao Wu, Juno Zhu, Siliang Xu, Kashun Shum, Randy Zhong, Juntong Song, Tong Zhang

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09335 2024-05-16 cs.CL 85%

Prompting-based Synthetic Data Generation for Few-Shot Question Answering

Maximilian Schmidt, Andrea Bartezzaghi, Ngoc Thang Vu

专题命中 预训练与数据 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08502 2024-05-15 cs.CL 85%

Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure

Odysseas S. Chlapanis, Ion Androutsopoulos, Dimitrios Galanis

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments To be published in SemEval-2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08134 2024-05-15 cs.CL 85%

Many-Shot Regurgitation (MSR) Prompting

Shashank Sonkar, Richard G. Baraniuk

专题命中 预训练与数据 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05737 2024-04-01 cs.CV cs.AI cs.MM 85%

Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation

Lijun Yu, José Lezama, Nitesh B. Gundavarapu, Luca Versari, Kihyuk Sohn, David Minnen, Yong Cheng, Vighnesh Birodkar, Agrim Gupta, Xiuye Gu, Alexander G. Hauptmann, Boqing Gong, Ming-Hsuan Yang, Irfan Essa, David A. Ross, Lu Jiang

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15842 2024-03-26 cs.CV cs.AI 85%

LCV2: An Efficient Pretraining-Free Framework for Grounded Visual Question Answering

Yuhan Chen, Lumei Su, Lihua Chen, Zhiwei Lin

专题命中 预训练与数据 :pretraining(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 21 pages,9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02626 2024-03-21 cs.CV cs.LG 85%

Modeling Collaborator: Enabling Subjective Vision Classification With Minimal Human Effort via LLM Tool-Use

Imad Eddine Toubal, Aditya Avinash, Neil Gordon Alldrin, Jan Dlabal, Wenlei Zhou, Enming Luo, Otilia Stretcu, Hao Xiong, Chun-Ta Lu, Howard Zhou, Ranjay Krishna, Ariel Fuxman, Tom Duerig

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04004 2024-02-12 cs.LG 85%

Understanding the Effect of Noise in LLM Training Data with Algorithmic Chains of Thought

Alex Havrilla, Maia Iyer

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18582 2024-02-12 cs.CL 85%

Information Association for Language Model Updating by Mitigating LM-Logical Discrepancy

Pengfei Yu, Heng Ji

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07207 2024-01-12 cs.LG physics.geo-ph 85%

EarthPT: a time series foundation model for Earth Observation

Michael J. Smith, Luke Fleming, James E. Geach

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 7 pages, 4 figures, accepted to NeurIPS CCAI workshop at https://www.climatechange.ai/papers/neurips2023/2 . Code available at https://github.com/aspiaspace/EarthPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08629 2023-12-15 cs.AI 85%

ChatSOS: LLM-based knowledge Q&A system for safety engineering

Haiyang Tang, Zhenyi Liu, Dongping Chen, Qingzhao Chu

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08552 2023-11-16 cs.CL 85%

UT5: Pretraining Non autoregressive T5 with unrolled denoising

Mahmoud G. Salem, Jiayu Ye, Chu-Cheng Lin, Frederick Liu

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.13060 2023-10-31 cs.CL 85%

Injecting structural hints: Using language models to study inductive biases in language learning

Isabel Papadimitriou, Dan Jurafsky

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

Comments Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16958 2023-10-27 cs.LG physics.chem-ph 85%

Transferring a molecular foundation model for polymer property predictions

Pei Zhang, Logan Kearney, Debsindhu Bhowmik, Zachary Fox, Amit K. Naskar, John Gounley

专题命中 预训练与数据 :foundation model(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.03350 2023-10-19 cs.CL 85%

Measuring and Narrowing the Compositionality Gap in Language Models

Ofir Press, Muru Zhang, Sewon Min, Ludwig Schmidt, Noah A. Smith, Mike Lewis

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);prompting(abstract);分类 cs.CL

Comments To appear at Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02363 2023-09-11 cs.CL 85%

Entity Tracking in Language Models

Najoung Kim, Sebastian Schuster

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

Comments ACL 2023 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏