arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 139420 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2405.08120 2024-05-15 cs.ET cs.AI 77%

From Questions to Insightful Answers: Building an Informed Chatbot for University Resources

Subash Neupane, Elias Hossain, Jason Keith, Himanshu Tripathi, Farbod Ghiasi, Noorbakhsh Amiri Golilarz, Amin Amirlatifi, Sudip Mittal, Shahram Rahimi

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19146 2024-05-01 cs.AI cs.IR 77%

Automated Construction of Theme-specific Knowledge Graphs

Linyi Ding, Sizhe Zhou, Jinfeng Xiao, Jiawei Han

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14361 2024-04-30 cs.CL 77%

Better Synthetic Data by Retrieving and Transforming Existing Datasets

Saumya Gandhi, Ritu Gala, Vijay Viswanathan, Tongshuang Wu, Graham Neubig

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments PDF fixed in v3

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11713 2024-04-26 cs.RO cs.AI 77%

Indoor and Outdoor 3D Scene Graph Generation via Language-Enabled Spatial Ontologies

Jared Strader, Nathan Hughes, William Chen, Alberto Speranzon, Luca Carlone

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 6 figures, accepted to Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00152 2024-04-24 cs.CL 77%

On-the-fly Definition Augmentation of LLMs for Biomedical NER

Monica Munnangi, Sergey Feldman, Byron C Wallace, Silvio Amir, Tom Hope, Aakanksha Naik

专题命中 预训练与数据 :LLM(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments To appear at NAACL 2024 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14530 2024-04-16 cs.CL 77%

Machine Translation for Ge'ez Language

Aman Kassahun Wassie

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10118 2024-04-09 cs.CL 77%

Learning to Rank Context for Named Entity Recognition Using a Synthetic Dataset

Arthur Amalvy, Vincent Labatut, Richard Dufour

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Conference on Empirical Methods in Natural Language Processing (EMNLP), ACL, Dec 2023, Singapore, Singapore. pp.10372-10382

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03301 2024-04-05 cs.CL 77%

Ziya2: Data-centric Learning is All LLMs Need

Ruyi Gan, Ziwei Wu, Renliang Sun, Junyu Lu, Xiaojun Wu, Dixiang Zhang, Kunhao Pan, Junqing He, Yuanhe Tian, Ping Yang, Qi Yang, Hao Wang, Jiaxing Zhang, Yan Song

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02755 2024-04-04 cs.CV cs.AI cs.MM 77%

DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement

Hao Wu, Huabin Liu, Yu Qiao, Xiao Sun

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00610 2024-04-02 cs.CL 77%

RQ-RAG: Learning to Refine Queries for Retrieval Augmented Generation

Chi-Min Chan, Chunpu Xu, Ruibin Yuan, Hongyin Luo, Wei Xue, Yike Guo, Jie Fu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00303 2024-04-02 cs.CL 77%

A Comprehensive Study on NLP Data Augmentation for Hate Speech Detection: Legacy Methods, BERT, and LLMs

Md Saroar Jahan, Mourad Oussalah, Djamila Romaissa Beddia, Jhuma kabir Mim, Nabil Arhab

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 31 page, Table 18, Figure 14

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15747 2024-03-26 cs.SE cs.AI 77%

CodeShell Technical Report

Rui Xie, Zhengran Zeng, Zhuohao Yu, Chang Gao, Shikun Zhang, Wei Ye

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15715 2024-03-26 cs.CL 77%

EDDA: A Encoder-Decoder Data Augmentation Framework for Zero-Shot Stance Detection

Daijun Ding, Li Dong, Zhichao Huang, Guangning Xu, Xu Huang, Bo Liu, Liwen Jing, Bowen Zhang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11335 2024-03-19 cs.IR cs.CL 77%

ConvSDG: Session Data Generation for Conversational Search

Fengran Mo, Bole Yi, Kelong Mao, Chen Qu, Kaiyu Huang, Jian-Yun Nie

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by WWW 2024 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00359 2024-03-19 cs.CL cs.CV 77%

Large Content And Behavior Models To Understand, Simulate, And Optimize Content And Behavior

Ashmit Khandelwal, Aditya Agrawal, Aanisha Bhattacharyya, Yaman K Singla, Somesh Singh, Uttaran Bhattacharya, Ishita Dasgupta, Stefano Petrangeli, Rajiv Ratn Shah, Changyou Chen, Balaji Krishnamurthy

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14824 2024-03-06 cs.CL 77%

Mitigating Temporal Misalignment by Discarding Outdated Facts

Michael J. Q. Zhang, Eunsol Choi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted into EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13740 2024-02-22 cs.CL 77%

From Text to CQL: Bridging Natural Language and Corpus Search Engine

Luming Lu, Jiyuan An, Yujie Wang, Liner yang, Cunliang Kong, Zhenghao Liu, Shuo Wang, Haozhe Lin, Mingwei Fang, Yaping Huang, Erhong Yang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02113 2024-02-06 cs.CL 77%

Zero-shot Sentiment Analysis in Low-Resource Languages Using a Multilingual Sentiment Lexicon

Fajri Koto, Tilman Beck, Zeerak Talat, Iryna Gurevych, Timothy Baldwin

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted at EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08777 2024-02-06 cs.CL 77%

Self-training Strategies for Sentiment Analysis: An Empirical Study

Haochen Liu, Sai Krishna Rallabandi, Yijing Wu, Parag Pravin Dakle, Preethi Raghavan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL

Comments Accepted by EACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00987 2024-02-05 cs.LG 77%

Self-Supervised Contrastive Pre-Training for Multivariate Point Processes

Xiao Shou, Dharmashankar Subramanian, Debarun Bhattacharjya, Tian Gao, Kristin P. Bennet

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17181 2024-01-31 cs.CL 77%

Transfer Learning for Text Diffusion Models

Kehang Han, Kathleen Kenealy, Aditya Barua, Noah Fiedel, Noah Constant

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01820 2024-01-17 cs.LG 77%

Concurrent Classifier Error Detection (CCED) in Large Scale Machine Learning Systems

Pedro Reviriego, Ziheng Wang, Alvaro Alonso, Zhen Gao, Farzad Niknia, Shanshan Liu, Fabrizio Lombardi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Journal ref IEEE Transactions on Reliability, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05727 2024-01-12 cs.CL 77%

Zero Resource Cross-Lingual Part Of Speech Tagging

Sahil Chopra

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08055 2024-01-09 cs.SE cs.LG 77%

Breaking the Silence: the Threats of Using LLMs in Software Engineering

June Sallou, Thomas Durieux, Annibale Panichella

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted at the ICSE'24 conference, NIER track

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08677 2024-01-09 cs.CL 77%

Natural Language Decomposition and Interpretation of Complex Utterances

Harsh Jhamtani, Hao Fang, Patrick Xia, Eran Levy, Jacob Andreas, Ben Van Durme

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11525 2023-12-20 cs.HC cs.AI 77%

Synocene, Beyond the Anthropocene: De-Anthropocentralising Human-Nature-AI Interaction

Isabelle Hupont, Marina Wainer, Sam Nester, Sylvie Tissot, Lucía Iglesias-Blanco, Sandra Baldassarri

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 9 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05531 2023-12-12 cs.AI cs.OS 77%

KEN: Kernel Extensions using Natural Language

Yusheng Zheng, Yiwei Yang, Maolin Chen, Andrew Quinn

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08899 2023-11-27 cs.CL 77%

Exploration with Principles for Diverse AI Supervision

Hao Liu, Matei Zaharia, Pieter Abbeel

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12315 2023-11-22 cs.CL 77%

AcademicGPT: Empowering Academic Research

Shufa Wei, Xiaolong Xu, Xianbiao Qi, Xi Yin, Jun Xia, Jingyi Ren, Peijun Tang, Yuxiang Zhong, Yihao Chen, Xiaoqin Ren, Yuxin Liang, Liankai Huang, Kai Xie, Weikang Gui, Wei Tan, Shuanglong Sun, Yongquan Hu, Qinxian Liu, Nanjin Li, Chihao Dai, Lihua Wang, Xiaohui Liu, Lei Zhang, Yutao Xie

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL

Comments Technical Report. arXiv admin note: text overlap with arXiv:2310.12081, arXiv:2310.10053 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08547 2023-11-16 cs.AI 77%

DeepThought: An Architecture for Autonomous Self-motivated Systems

Arlindo L. Oliveira, Tiago Domingos, Mário Figueiredo, Pedro U. Lima

专题命中 预训练与数据 :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏