arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138791 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12393 篇

2505.04284 2025-05-08 cs.CL cs.AI 79%

GASCADE: Grouped Summarization of Adverse Drug Event for Enhanced Cancer Pharmacovigilance

Sofia Jamil, Aryan Dabad, Bollampalli Areen Reddy, Sriparna Saha, Rajiv Misra, Adil A. Shakur

机构 * Department of Computer Science & Engineering, Indian Institute of Technology Patna(印度理工学院帕纳布分校计算机科学与工程系) Indira Gandhi Institute of Medical Sciences, Patna(英伽丁医学科学学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14397 2025-05-05 cs.CL cs.CY cs.LG 79%

RTP-LX: Can LLMs Evaluate Toxicity in Multilingual Scenarios?

Adrian de Wynter, Ishaan Watts, Tua Wongsangaroonsri, Minghui Zhang, Noura Farra, Nektar Ege Altıntoprak, Lena Baur, Samantha Claudet, Pavel Gajdusek, Can Gören, Qilong Gu, Anna Kaminska, Tomasz Kaminski, Ruby Kuo, Akiko Kyuba, Jongho Lee, Kartik Mathur, Petter Merok, Ivana Milovanović, Nani Paananen, Vesa-Matti Paananen, Anna Pavlenko, Bruno Pereira Vidal, Luciano Strika, Yueh Tsao, Davide Turcato, Oleksandr Vakhno, Judit Velcsov, Anna Vickers, Stéphanie Visser, Herdyan Widarmanto, Andrey Zaikin, Si-Qing Chen

机构 * Microsoft Research India(微软印度研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL、cs.LG

Comments AAAI 2025--camera ready + extended abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18762 2025-05-01 cs.CL cs.LG 79%

SynLexLM: Scaling Legal LLMs with Synthetic Data and Curriculum Learning

Ojasw Upadhyay, Abishek Saravanakumar, Ayman Ismail

机构 * Georgia Institue of Technology(佐治亚理工学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 9 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15208 2025-04-22 cs.LG cs.AI 79%

Compute-Optimal LLMs Provably Generalize Better With Scale

Marc Finzi, Sanyam Kapoor, Diego Granziol, Anming Gu, Christopher De Sa, J. Zico Kolter, Andrew Gordon Wilson

机构 * Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学) PureStrength AI Boston University(波士顿大学) Cornell University(康奈尔大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10397 2025-04-15 cs.AI cs.LG 79%

Can LLMs Assist Expert Elicitation for Probabilistic Causal Modeling?

Olha Shaposhnyk, Daria Zahorska, Svetlana Yanushkevich

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10281 2025-04-15 cond-mat.mtrl-sci cond-mat.mes-hall cs.AI cs.CV cs.LG 79%

Zero-shot Autonomous Microscopy for Scalable and Intelligent Characterization of 2D Materials

Jingyun Yang, Ruoyan Avery Yin, Chi Jiang, Yuepeng Hu, Xiaokai Zhu, Xingjian Hu, Sutharsika Kumar, Xiao Wang, Xiaohua Zhai, Keran Rong, Yunyue Zhu, Tianyi Zhang, Zongyou Yin, Jing Kong, Neil Zhenqiang Gong, Zhichu Ren, Haozhe Wang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03598 2025-04-07 cs.CL cs.AI cs.IR 79%

EnrichIndex: Using LLMs to Enrich Retrieval Indices Offline

Peter Baile Chen, Tomer Wolfson, Michael Cafarella, Dan Roth

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Dataset and code are available at https://peterbaile.github.io/enrichindex/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00310 2025-04-02 cs.CL cs.AI 79%

Detecting and Mitigating Bias in LLMs through Knowledge Graph-Augmented Training

Rajeev Kumar, Harishankar Kumar, Kumari Shalini

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00048 2025-04-02 cs.CL cs.AI 79%

Distill-C: Enhanced NL2SQL via Distilled Customization with LLMs

Cong Duy Vu Hoang, Gioacchino Tangari, Clemence Lanfranchi, Dalu Guo, Paul Cayet, Steve Siu, Don Dharmasiri, Yuan-Fang Li, Long Duong, Damien Hilloulin, Rhicheek Patra, Sungpack Hong, Hassan Chafi

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint, accepted at NAACL 2025 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23303 2025-04-01 cs.LG cs.AI 79%

SalesRLAgent: A Reinforcement Learning Approach for Real-Time Sales Conversion Prediction and Optimization

Nandakishor M

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22145 2025-03-31 cs.LG cs.CL cs.CV cs.HC 79%

Tokenization of Gaze Data

Tim Rolff, Jurik Karimian, Niklas Hypki, Susanne Schmidt, Markus Lappe, Frank Steinicke

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21557 2025-03-28 cs.AI cs.CL cs.PL cs.SE 79%

debug-gym: A Text-Based Environment for Interactive Debugging

Xingdi Yuan, Morgane M Moss, Charbel El Feghali, Chinmay Singh, Darya Moldavskaya, Drew MacPhee, Lucas Caccia, Matheus Pereira, Minseon Kim, Alessandro Sordoni, Marc-Alexandre Côté

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20903 2025-03-28 cs.LG cs.AI 79%

Assessing Generative Models for Structured Data

Reilly Cannon, Nicolette M. Laird, Caesar Vazquez, Andy Lin, Amy Wagler, Tony Chiang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18212 2025-03-25 cs.CL cs.LG 79%

LakotaBERT: A Transformer-based Model for Low Resource Lakota Language

Kanishka Parankusham, Rodrigue Rizk, KC Santosh

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14703 2025-03-20 cs.CL cs.AI 79%

Do LLMs Have Distinct and Consistent Personality? TRAIT: Personality Testset designed for LLMs with Psychometrics

Seungbeen Lee, Seungwon Lim, Seungju Han, Giyeong Oh, Hyungjoo Chae, Jiwan Chung, Minju Kim, Beong-woo Kwak, Yeonsoo Lee, Dongha Lee, Jinyoung Yeo, Youngjae Yu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13882 2025-03-19 cs.LG cs.AI 79%

MoK-RAG: Mixture of Knowledge Paths Enhanced Retrieval-Augmented Generation for Embodied AI Environments

Zhengsheng Guo, Linwei Zheng, Xinyang Chen, Xuefeng Bai, Kehai Chen, Min Zhang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12107 2025-03-18 cs.LG cs.AI 79%

ChronosX: Adapting Pretrained Time Series Models with Exogenous Variables

Sebastian Pineda Arango, Pedro Mercado, Shubham Kapoor, Abdul Fatir Ansari, Lorenzo Stella, Huibin Shen, Hugo Senetaire, Caner Turkmen, Oleksandr Shchur, Danielle C. Maddix, Michael Bohlke-Schneider, Yuyang Wang, Syama Sundar Rangapuram

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted at the 28th International Conference on Artificial Intelligence and Statistics (AISTATS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05039 2025-03-14 cs.CL cs.AI 79%

YouTube Comments Decoded: Leveraging LLMs for Low Resource Language Classification

Aniket Deroy, Subhankar Maity

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Updated and Final Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02056 2025-03-13 eess.AS cs.AI cs.CL 79%

Synthio: Augmenting Small-Scale Audio Classification Datasets with Synthetic Data

Sreyan Ghosh, Sonal Kumar, Zhifeng Kong, Rafael Valle, Bryan Catanzaro, Dinesh Manocha

专题命中 预训练与数据 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments Accepted at ICLR 2025. Code and Checkpoints available here: https://github.com/Sreyan88/Synthio

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02155 2025-03-11 cs.AI cs.CL cs.CV 79%

From Pixels to Tokens: Byte-Pair Encoding on Quantized Visual Modalities

Wanpeng Zhang, Zilong Xie, Yicheng Feng, Yijiang Li, Xingrun Xing, Sipeng Zheng, Zongqing Lu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05919 2025-03-11 cs.CL cs.LG 79%

From Style to Facts: Mapping the Boundaries of Knowledge Injection with Finetuning

Eric Zhao, Pranjal Awasthi, Nika Haghtalab

专题命中 预训练与数据 :language model(abstract);instruction tuning(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07220 2025-03-10 cs.IR cs.AI cs.CL 79%

Blended RAG: Improving RAG (Retriever-Augmented Generation) Accuracy with Semantic Search and Hybrid Query-Based Retrievers

Kunal Sawarkar, Abhilasha Mangal, Shivam Raj Solanki

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Paper accepted by MIPR and presented at The 7th IEEE International Conference on Multimedia Information. Processing and Retrieval (IEEE-MIPR 2024)

Journal ref IEEE 15 October 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00385 2025-02-27 cs.CL cs.AI 79%

The Impact of Persona-based Political Perspectives on Hateful Content Detection

Stefano Civelli, Pietro Bernardelle, Gianluca Demartini

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Companion Proceedings of the ACM Web Conference 2025 (WWW Companion'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17121 2025-02-25 cs.LG cs.AI 79%

Adversarial Training for Defense Against Label Poisoning Attacks

Melis Ilayda Bal, Volkan Cevher, Michael Muehlebach

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments Accepted at the International Conference on Learning Representations (ICLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16130 2025-02-20 cs.CL cs.AI cs.IR 79%

From Local to Global: A Graph RAG Approach to Query-Focused Summarization

Darren Edge, Ha Trinh, Newman Cheng, Joshua Bradley, Alex Chao, Apurva Mody, Steven Truitt, Dasha Metropolitansky, Robert Osazuwa Ness, Jonathan Larson

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16077 2025-02-19 cs.LG cs.CL 79%

CartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts

Zhenpeng Su, Xing Wu, Zijia Lin, Yizhe Xiong, Minxuan Lv, Guangyuan Ma, Hui Chen, Songlin Hu, Guiguang Ding

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NAACL2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11863 2025-02-18 cs.LG cs.AI 79%

FedEAT: A Robustness Optimization Framework for Federated LLMs

Yahao Pang, Xingyuan Wu, Xiaojin Zhang, Wei Chen, Hai Jin

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09886 2025-02-17 cs.RO cs.AI cs.LG 79%

Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos

Weirui Ye, Fangchen Liu, Zheng Ding, Yang Gao, Oleh Rybkin, Pieter Abbeel

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04421 2025-02-10 cs.CR cs.AI cs.LG 79%

Assessing and Prioritizing Ransomware Risk Based on Historical Victim Data

Spencer Massengale, Philip Huff

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03992 2025-02-07 cs.CL cs.AI 79%

Ontology-Guided, Hybrid Prompt Learning for Generalization in Knowledge Graph Question Answering

Longquan Jiang, Junbo Huang, Cedric Möller, Ricardo Usbeck

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted By ICSC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏