arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12403 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2503.04057 2025-03-07 cs.AR 89%

Insights from Rights and Wrongs: A Large Language Model for Solving Assertion Failures in RTL Design

Jie Zhou, Youshu Ji, Ning Wang, Yuchen Hu, Xinyao Jiao, Bingkun Yao, Xinwei Fang, Shuai Zhao, Nan Guan, Zhe Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10610 2025-02-25 physics.ed-ph 89%

Comparing large language models for supervised analysis of students' lab notes

Rebeckah K. Fussell, Megan Flynn, Anil Damle, Michael F. J. Fox, N. G. Holmes

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06589 2025-02-11 cs.CL cs.AI cs.LG 89%

Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training

Yuchen Zhuang, Jingfeng Yang, Haoming Jiang, Xin Liu, Kewei Cheng, Sanket Lokegaonkar, Yifan Gao, Qing Ping, Tianyi Liu, Binxuan Huang, Zheng Li, Zhengyang Wang, Pei Chen, Ruijie Wang, Rongzhi Zhang, Nasser Zalmout, Priyanka Nigam, Bing Yin, Chao Zhang

专题命中 预训练与数据 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments Accepted to NAACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01703 2025-02-03 cs.CL cs.AI cs.LG 89%

UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models

Sejoon Oh, Yiqiao Jin, Megha Sharma, Donghyun Kim, Eric Ma, Gaurav Verma, Srijan Kumar

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07295 2025-01-16 cs.RO 89%

GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction

Oleg Kobzarev, Artem Lykov, Dzmitry Tsetserukou

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19478 2024-12-31 cs.IR 89%

Zero-Indexing Internet Search Augmented Generation for Large Language Models

Guangxin He, Zonghong Dai, Jiangcheng Zhu, Binqiang Zhao, Qicheng Hu, Chenyue Li, You Peng, Chen Wang, Binhang Yuan

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00702 2024-12-25 cs.IR 89%

LLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start Recommendations

Wenlin Zhang, Chuhan Wu, Xiangyang Li, Yuhao Wang, Kuicai Dong, Yichao Wang, Xinyi Dai, Xiangyu Zhao, Huifeng Guo, Ruiming Tang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10909 2024-12-24 q-fin.CP 89%

FinDKG: Dynamic Knowledge Graphs with Large Language Models for Detecting Global Trends in Financial Markets

Xiaohui Victor Li, Francesco Sanna Passino

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 9 pages

Journal ref ICAIF '24: Proceedings of the 5th ACM International Conference on AI in Finance, 573-581 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14093 2024-12-23 cs.AI cs.CL cs.LG 89%

Alignment faking in large language models

Ryan Greenblatt, Carson Denison, Benjamin Wright, Fabien Roger, Monte MacDiarmid, Sam Marks, Johannes Treutlein, Tim Belonax, Jack Chen, David Duvenaud, Akbir Khan, Julian Michael, Sören Mindermann, Ethan Perez, Linda Petrini, Jonathan Uesato, Jared Kaplan, Buck Shlegeris, Samuel R. Bowman, Evan Hubinger

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12581 2024-12-23 cs.HC 89%

Understanding Emotional Body Expressions via Large Language Models

Haifeng Lu, Jiuyi Chen, Feng Liang, Mingkui Tan, Runhao Zeng, Xiping Hu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02980 2024-12-11 cs.LG cs.AI cs.CL 89%

Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models

Alex Havrilla, Andrew Dai, Laura O'Mahony, Koen Oostermeijer, Vera Zisler, Alon Albalak, Fabrizio Milo, Sharath Chandra Raparthy, Kanishk Gandhi, Baber Abbasi, Duy Phung, Maia Iyer, Dakota Mahan, Chase Blagden, Srishti Gureja, Mohammed Hamdy, Wen-Ding Li, Giovanni Paolini, Pawan Sasanka Ammanamanchi, Elliot Meyerson

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02775 2024-12-05 cs.CL cs.AI cs.LG 89%

Optimizing Large Language Models for Turkish: New Methodologies in Corpus Selection and Training

H. Toprak Kesgin, M. Kaan Yuce, Eren Dogan, M. Egemen Uzun, Atahan Uz, Elif Ince, Yusuf Erdem, Osama Shbib, Ahmed Zeer, M. Fatih Amasyali

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 2024 Innovations in Intelligent Systems and Applications Conference (ASYU)

Journal ref 2024 Innovations in Intelligent Systems and Applications Conference (ASYU) published in IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10946 2024-12-04 cs.CL cs.AI cs.LG 89%

CultureLLM: Incorporating Cultural Differences into Large Language Models

Cheng Li, Mengzhou Chen, Jindong Wang, Sunayana Sitaram, Xing Xie

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2024; Code is at https://github.com/Scarelette/CultureLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10665 2024-11-19 cs.CR 89%

AutoIoT: Automated IoT Platform Using Large Language Models

Ye Cheng, Minghui Xu, Yue Zhang, Kun Li, Ruoxi Wang, Lian Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 12 pages, 10 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17815 2024-11-05 cs.CV 89%

Visual Anchors Are Strong Information Aggregators For Multimodal Large Language Model

Haogeng Liu, Quanzeng You, Xiaotian Han, Yongfei Liu, Huaibo Huang, Ran He, Hongxia Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22182 2024-10-30 cs.IR 89%

Synthetic Data Generation with Large Language Models for Personalized Community Question Answering

Marco Braga, Pranav Kasela, Alessandro Raganato, Gabriella Pasi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted in WI-IAT '24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16973 2024-10-28 cs.CL cs.AI cs.LG 89%

Learning Mathematical Rules with Large Language Models

Antoine Gorceix, Bastien Le Chenadec, Ahmad Rammal, Nelson Vadori, Manuela Veloso

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS'24 MATH-AI, the 4th Workshop on Mathematical Reasoning and AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01300 2024-10-04 cs.CL cs.AI cs.LG 89%

Collaborative Performance Prediction for Large Language Models

Qiyuan Zhang, Fuyuan Lyu, Xue Liu, Chen Ma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments In Proceedings of EMNLP 2024 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20309 2024-10-03 cs.LG cs.AI cs.CL 89%

Large Language Models Can Self-Improve At Web Agent Tasks

Ajay Patel, Markus Hofmarcher, Claudiu Leoveanu-Condrei, Marius-Constantin Dinu, Chris Callison-Burch, Sepp Hochreiter

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13450 2024-08-27 cs.HC 89%

vitaLITy 2: Reviewing Academic Literature Using Large Language Models

Hongye An, Arpit Narechania, Emily Wall, Kai Xu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 7 pages, 4 figures, NLVIZ Workshop 2024 (IEEE VIS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16383 2024-08-01 cs.IR 89%

Context-augmented Retrieval: A Novel Framework for Fast Information Retrieval based Response Generation using Large Language Model

Sai Ganesh, Anupam Purwar, Gautam B

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Because the dataset in which the model was trained upon wasn't consistent across different sections so it was preferred to delete this preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13031 2024-07-25 cs.CR cs.AI cs.CL cs.LG 89%

RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content

Zhuowen Yuan, Zidi Xiong, Yi Zeng, Ning Yu, Ruoxi Jia, Dawn Song, Bo Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03490 2024-07-02 eess.IV cs.CV 89%

PneumoLLM: Harnessing the Power of Large Language Model for Pneumoconiosis Diagnosis

Meiyue Song, Zhihua Yu, Jiaxin Wang, Jiarui Wang, Yuting Lu, Baicun Li, Xiaoxu Wang, Qinghua Huang, Zhijun Li, Nikolaos I. Kanellakis, Jiangfeng Liu, Jing Wang, Binglu Wang, Juntao Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

Comments Medical Image Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17990 2024-06-27 cs.CL cs.AI cs.LG 89%

Explicit Diversity Conditions for Effective Question Answer Generation with Large Language Models

Vikas Yadav, Hyuk Joon Kwon, Vijay Srinivasan, Hongxia Jin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08246 2024-06-13 cs.CL cs.AI cs.LG 89%

Leveraging Large Language Models for Web Scraping

Aman Ahluwalia, Suhrud Wani

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11196 2024-05-21 cs.SE 89%

Natural Is The Best: Model-Agnostic Code Simplification for Pre-trained Large Language Models

Yan Wang, Xiaoning Li, Tien Nguyen, Shaohua Wang, Chao Ni, Ling Ding

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05990 2024-05-21 cs.CR cs.AI cs.CL cs.LG 89%

Special Characters Attack: Toward Scalable Training Data Extraction From Large Language Models

Yang Bai, Ge Pei, Jindong Gu, Yong Yang, Xingjun Ma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.01215 2024-05-10 cs.CR 89%

Fixing Hardware Security Bugs with Large Language Models

Baleegh Ahmad, Shailja Thakur, Benjamin Tan, Ramesh Karri, Hammond Pearce

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15236 2024-04-24 cs.SE 89%

Revisiting Unnaturalness for Automated Program Repair in the Era of Large Language Models

Aidan Z. H. Yang, Sophia Kolak, Vincent J. Hellendoorn, Ruben Martins, Claire Le Goues

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08879 2024-04-18 cs.SE 89%

A Critical Review of Large Language Model on Software Engineering: An Example from ChatGPT and Automated Program Repair

Quanjun Zhang, Tongke Zhang, Juan Zhai, Chunrong Fang, Bowen Yu, Weisong Sun, Zhenyu Chen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments add EvalGPTFix URL

详情

展开后加载摘要…

URL PDF HTML 收藏