arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-25 至 2025-07-25 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12 篇

2507.18044 2025-07-25 cs.CL cs.AI 90%

Synthetic Data Generation for Phrase Break Prediction with Large Language Model

Hoyeon Lee, Sejung Son, Ye-Eun Kang, Jong-Hwan Kim

机构 * NAVER Cloud NHNSouth Korea Yale University(耶鲁大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14445 2025-07-25 cs.LG cs.AI cs.CL 89%

A Multi-Faceted Evaluation Framework for Assessing Synthetic Data Generated by Large Language Models

Yefeng Yuan, Yuhong Liu, Liang Cheng

机构 * Santa Clara University(圣克拉拉大学) eBay Inc.(eBay公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18009 2025-07-25 cs.CV cs.AI cs.CL 86%

GRR-CoCa: Leveraging LLM Mechanisms in Multimodal Model Architectures

Jake R. Patock, Nicole Catherine Lewis, Kevin McCoy, Christina Gomez, Canling Chen, Lorenzo Luzi

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21676 2025-07-25 cs.CL cs.LG 85%

How do language models learn facts? Dynamics, curricula and hallucinations

Nicolas Zucchet, Jörg Bornschein, Stephanie Chan, Andrew Lampinen, Razvan Pascanu, Soham De

机构 * ETH Zürich(苏黎世联邦理工学院) Google DeepMind(谷歌DeepMind)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at the 2nd Conference on Language Modeling (2025)

Journal ref Conference on Language Modeling (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18455 2025-07-25 cs.IR cs.CL 79%

LLM-based Embedders for Prior Case Retrieval

Damith Premasiri, Tharindu Ranasinghe, Ruslan Mitkov

机构 * School of Computing and Communications, Lancaster University, UK(计算与通讯学院,兰卡斯特大学)

专题命中 预训练与数据 :LLM(title,abstract);分类 cs.CL

Comments Accepted in Recent Advancements in Natural Language Processing (RANLP 2025) conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17924 2025-07-25 cs.LG cs.AI 79%

UrbanPulse: A Cross-City Deep Learning Framework for Ultra-Fine-Grained Population Transfer Prediction

Hongrong Yang, Markus Schlaepfer

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17766 2025-07-25 cs.DC cs.LG 77%

Incentivised Orchestrated Training Architecture (IOTA): A Technical Primer for Release

Felix Quinque, Alan Aboudib, Szymon Fonau, Rodrigo Lopez Portillo Alcocer, Brian McCrindle, Steffen Cruz

机构 * Macrocosmos AI

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18583 2025-07-25 cs.IR cs.AI cs.CL 73%

DR.EHR: Dense Retrieval for Electronic Health Record with Knowledge Injection and Synthetic Data

Zhengyun Zhao, Huaiyuan Ying, Yue Zhong, Sheng Yu

机构 * Tsinghua University(清华大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Model and code released upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18055 2025-07-25 cs.CL cs.CR cs.LG 73%

Privacy-Preserving Synthetic Review Generation with Diverse Writing Styles Using LLMs

Tevin Atwal, Chan Nam Tieu, Yefeng Yuan, Zhan Shi, Yuhong Liu, Liang Cheng

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Santa Clara University(圣克拉拉大学) eBay(eBay公司)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18022 2025-07-25 cs.AI cs.HC cs.LG 62%

Does visualization help AI understand data?

Victoria R. Li, Johnathan Sun, Martin Wattenberg

机构 * Harvard University(哈佛大学) Google Research(谷歌研究)

专题命中 预训练与数据 :language model(abstract);分类 cs.AI、cs.LG

Comments 5 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13180 2025-07-25 cs.CV cs.AI cs.LG 62%

PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding

Jang Hyun Cho, Andrea Madotto, Effrosyni Mavroudi, Triantafyllos Afouras, Tushar Nagarajan, Muhammad Maaz, Yale Song, Tengyu Ma, Shuming Hu, Suyog Jain, Miguel Martin, Huiyu Wang, Hanoona Rasheed, Peize Sun, Po-Yao Huang, Daniel Bolya, Nikhila Ravi, Shashank Jain, Tammy Stark, Shane Moon, Babak Damavandi, Vivian Lee, Andrew Westbury, Salman Khan, Philipp Krähenbühl, Piotr Dollár, Lorenzo Torresani, Kristen Grauman, Christoph Feichtenhofer

专题命中 预训练与数据 :language model(abstract);分类 cs.AI、cs.LG

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18512 2025-07-25 cs.CV cs.AI 57%

Explaining How Visual, Textual and Multimodal Encoders Share Concepts

Clément Cornet, Romaric Besançon, Hervé Le Borgne

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏