arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2407.01300 2024-10-04 cs.CL cs.AI cs.LG 89%

Collaborative Performance Prediction for Large Language Models

Qiyuan Zhang, Fuyuan Lyu, Xue Liu, Chen Ma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments In Proceedings of EMNLP 2024 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20309 2024-10-03 cs.LG cs.AI cs.CL 89%

Large Language Models Can Self-Improve At Web Agent Tasks

Ajay Patel, Markus Hofmarcher, Claudiu Leoveanu-Condrei, Marius-Constantin Dinu, Chris Callison-Burch, Sepp Hochreiter

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13450 2024-08-27 cs.HC 89%

vitaLITy 2: Reviewing Academic Literature Using Large Language Models

Hongye An, Arpit Narechania, Emily Wall, Kai Xu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 7 pages, 4 figures, NLVIZ Workshop 2024 (IEEE VIS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16383 2024-08-01 cs.IR 89%

Context-augmented Retrieval: A Novel Framework for Fast Information Retrieval based Response Generation using Large Language Model

Sai Ganesh, Anupam Purwar, Gautam B

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Because the dataset in which the model was trained upon wasn't consistent across different sections so it was preferred to delete this preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13031 2024-07-25 cs.CR cs.AI cs.CL cs.LG 89%

RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content

Zhuowen Yuan, Zidi Xiong, Yi Zeng, Ning Yu, Ruoxi Jia, Dawn Song, Bo Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03490 2024-07-02 eess.IV cs.CV 89%

PneumoLLM: Harnessing the Power of Large Language Model for Pneumoconiosis Diagnosis

Meiyue Song, Zhihua Yu, Jiaxin Wang, Jiarui Wang, Yuting Lu, Baicun Li, Xiaoxu Wang, Qinghua Huang, Zhijun Li, Nikolaos I. Kanellakis, Jiangfeng Liu, Jing Wang, Binglu Wang, Juntao Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

Comments Medical Image Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17990 2024-06-27 cs.CL cs.AI cs.LG 89%

Explicit Diversity Conditions for Effective Question Answer Generation with Large Language Models

Vikas Yadav, Hyuk Joon Kwon, Vijay Srinivasan, Hongxia Jin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08246 2024-06-13 cs.CL cs.AI cs.LG 89%

Leveraging Large Language Models for Web Scraping

Aman Ahluwalia, Suhrud Wani

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11196 2024-05-21 cs.SE 89%

Natural Is The Best: Model-Agnostic Code Simplification for Pre-trained Large Language Models

Yan Wang, Xiaoning Li, Tien Nguyen, Shaohua Wang, Chao Ni, Ling Ding

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05990 2024-05-21 cs.CR cs.AI cs.CL cs.LG 89%

Special Characters Attack: Toward Scalable Training Data Extraction From Large Language Models

Yang Bai, Ge Pei, Jindong Gu, Yong Yang, Xingjun Ma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.01215 2024-05-10 cs.CR 89%

Fixing Hardware Security Bugs with Large Language Models

Baleegh Ahmad, Shailja Thakur, Benjamin Tan, Ramesh Karri, Hammond Pearce

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15236 2024-04-24 cs.SE 89%

Revisiting Unnaturalness for Automated Program Repair in the Era of Large Language Models

Aidan Z. H. Yang, Sophia Kolak, Vincent J. Hellendoorn, Ruben Martins, Claire Le Goues

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08879 2024-04-18 cs.SE 89%

A Critical Review of Large Language Model on Software Engineering: An Example from ChatGPT and Automated Program Repair

Quanjun Zhang, Tongke Zhang, Juan Zhai, Chunrong Fang, Bowen Yu, Weisong Sun, Zhenyu Chen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments add EvalGPTFix URL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02650 2024-04-04 cs.LG cs.AI cs.CL 89%

Towards detecting unanticipated bias in Large Language Models

Anna Kruspe

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13073 2024-03-21 cs.CY 89%

A Canary in the AI Coal Mine: American Jews May Be Disproportionately Harmed by Intellectual Property Dispossession in Large Language Model Training

Heila Precel, Allison McDonald, Brent Hecht, Nicholas Vincent

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Preprint, to appear in CHI 2024 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00758 2024-03-21 cs.CL cs.AI cs.LG 89%

Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training

Qingyan Guo, Rui Wang, Junliang Guo, Xu Tan, Jiang Bian, Yujiu Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07874 2024-03-13 cs.CV 89%

Beyond Text: Frozen Large Language Models in Visual Signal Comprehension

Lei Zhu, Fangyun Wei, Yanye Lu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15313 2024-02-27 cs.CL cs.AI cs.LG 89%

ArabianGPT: Native Arabic GPT-based Large Language Model

Anis Koubaa, Adel Ammar, Lahouari Ghouti, Omar Najar, Serry Sibaee

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03471 2024-02-07 cs.LG cs.AI cs.CL cs.IT math.IT 89%

The Information of Large Language Model Geometry

Zhiquan Tan, Chenghai Li, Weiran Huang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15140 2023-12-15 cs.CR cs.AI cs.CL cs.LG 89%

AutoDAN: Interpretable Gradient-Based Adversarial Attacks on Large Language Models

Sicheng Zhu, Ruiyi Zhang, Bang An, Gang Wu, Joe Barrow, Zichao Wang, Furong Huang, Ani Nenkova, Tong Sun

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Version 2 updates: Added comparison of three more evaluation methods and their reliability check using human labeling. Added results for jailbreaking Llama2 (individual behavior) and included complexity and hyperparameter analysis. Revised objectives for prompt leaking. Other minor changes made

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13778 2023-11-27 cond-mat.mtrl-sci 89%

Accurate Prediction of Experimental Band Gaps from Large Language Model-Based Data Extraction

Samuel J. Yang, Shutong Li, Subhashini Venugopalan, Vahe Tshitoyan, Muratahan Aykol, Amil Merchant, Ekin Dogus Cubuk, Gowoon Cheon

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03012 2023-11-01 cs.SE 89%

On Extracting Specialized Code Abilities from Large Language Models: A Feasibility Study

Zongjie Li, Chaozheng Wang, Pingchuan Ma, Chaowei Liu, Shuai Wang, Daoyuan Wu, Cuiyun Gao, Yang Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13014 2023-10-23 cs.CY cs.AI cs.CL cs.LG 89%

Large Language Model Prediction Capabilities: Evidence from a Real-World Forecasting Tournament

Philipp Schoenegger, Peter S. Park

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, six visualizations (four figures, two tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08256 2023-10-13 cs.CL cs.AI cs.LG 89%

Impact of Co-occurrence on Factual Knowledge of Large Language Models

Cheongwoong Kang, Jaesik Choi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11732 2023-06-21 cs.CV 89%

Retrieving-to-Answer: Zero-Shot Video Question Answering with Frozen Large Language Models

Junting Pan, Ziyi Lin, Yuying Ge, Xiatian Zhu, Renrui Zhang, Yi Wang, Yu Qiao, Hongsheng Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09282 2023-06-06 cs.CL cs.AI cs.LG 89%

APOLLO: A Simple Approach for Adaptive Pretraining of Language Models for Logical Reasoning

Soumya Sanyal, Yichong Xu, Shuohang Wang, Ziyi Yang, Reid Pryzant, Wenhao Yu, Chenguang Zhu, Xiang Ren

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ACL 2023, code available at https://github.com/INK-USC/APOLLO

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12223 2023-05-24 cs.CV 89%

What Makes for Good Visual Tokenizers for Large Language Models?

Guangzhi Wang, Yixiao Ge, Xiaohan Ding, Mohan Kankanhalli, Ying Shan

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

Comments 15 pages, 3 figures. Project released at: https://github.com/TencentARC/GVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12268 2023-05-23 cs.CL cs.AI cs.LG 89%

Patton: Language Model Pretraining on Text-Rich Networks

Bowen Jin, Wentao Zhang, Yu Zhang, Yu Meng, Xinyang Zhang, Qi Zhu, Jiawei Han

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2023. (Code: https://github.com/PeterGriffinJin/Patton)

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.10475 2023-03-07 cs.CL cs.AI cs.LG 89%

DeepStruct: Pretraining of Language Models for Structure Prediction

Chenguang Wang, Xiao Liu, Zui Chen, Haoyun Hong, Jie Tang, Dawn Song

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04782 2023-02-14 cs.CL cs.AI cs.LG 89%

Robustification of Multilingual Language Models to Real-world Noise in Crosslingual Zero-shot Settings with Robust Contrastive Pretraining

Asa Cooper Stickland, Sailik Sengupta, Jason Krone, Saab Mansour, He He

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted and to be presented at the 17th Conference of the European Chapter of the Association for Computational Linguistics (EACL), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏