arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2401.06712 2024-05-09 cs.CL cs.LG 73%

Few-Shot Detection of Machine-Generated Text using Style Representations

Rafael Rivera Soto, Kailin Koch, Aleem Khan, Barry Chen, Marcus Bishop, Nicholas Andrews

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03845 2024-05-08 cs.CL cs.AI 73%

Self-Improving Customer Review Response Generation Based on LLMs

Guy Azov, Tatiana Pelc, Adi Fledel Alon, Gila Kamhi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 4 figure, 8 figures in Appendix, accepted to LREC-COLING 2024 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02329 2024-05-07 cs.AR cs.AI cs.CL 73%

Digital ASIC Design with Ongoing LLMs: Strategies and Prospects

Maoyang Xiang, Emil Goh, T. Hui Teo

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18481 2024-05-06 cs.CL cs.AI cs.CV 73%

ESG Accountability Made Easy: DocQA at Your Service

Lokesh Mishra, Cesar Berrospi, Kasper Dinkla, Diego Antognini, Francesco Fusco, Benedikt Bothur, Maksym Lysak, Nikolaos Livathinos, Ahmed Nassar, Panagiotis Vagenas, Lucas Morin, Christoph Auer, Michele Dolfi, Peter Staar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at the Demonstration Track of the 38th Annual AAAI Conference on Artificial Intelligence (AAAI 24)

Journal ref AAAI 2024, 38, 23814-23816

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01556 2024-05-06 cs.SE cs.AI cs.CL 73%

Semantically Aligned Question and Code Generation for Automated Insight Generation

Ananya Singha, Bhavya Chopra, Anirudh Khatry, Sumit Gulwani, Austin Z. Henley, Vu Le, Chris Parnin, Mukul Singh, Gust Verbruggen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07342 2024-04-16 cs.CL cs.AI 73%

Rethinking ASTE: A Minimalist Tagging Scheme Alongside Contrastive Learning

Qiao Sun, Liujia Yang, Minghao Ma, Nanyang Ye, Qinying Gu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07792 2024-04-12 cs.CL cs.LG 73%

Nostra Domina at EvaLatin 2024: Improving Latin Polarity Detection through Data Augmentation

Stephen Bothwell, Abigail Swenor, David Chiang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Proceedings of the Third Workshop on Language Technologies for Historical and Ancient Languages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02406 2024-04-04 cs.CR cs.AI cs.CL 73%

Exploring Backdoor Vulnerabilities of Chat Models

Yunzhuo Hao, Wenkai Yang, Yankai Lin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Code and data are available at https://github.com/hychaochao/Chat-Models-Backdoor-Attacking

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08324 2024-04-04 cs.CL cs.AI 73%

Anti-LM Decoding for Zero-shot In-context Machine Translation

Suzanna Sia, Alexandra DeLucia, Kevin Duh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01907 2024-04-03 cs.CL cs.CR cs.LG 73%

Humanizing Machine-Generated Content: Evading AI-Text Detection through Adversarial Attack

Ying Zhou, Ben He, Le Sun

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01453 2024-04-03 cs.CL cs.AI 73%

Unveiling Divergent Inductive Biases of LLMs on Temporal Data

Sindhu Kishore, Hangfeng He

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14771 2024-04-02 cs.CL cs.AI 73%

Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context Learning

Jianing Wang, Chengyu Wang, Chuanqi Tan, Jun Huang, Ming Gao

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments naacl 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11558 2024-03-19 cs.CL cs.AI 73%

Reinforcement Learning with Token-level Feedback for Controllable Text Generation

Wendi Li, Wei Wei, Kaihe Xu, Wenfeng Xie, Dangyang Chen, Yu Cheng

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11499 2024-03-19 cs.CV cs.CL cs.LG 73%

DreamLLM: Synergistic Multimodal Comprehension and Creation

Runpei Dong, Chunrui Han, Yuang Peng, Zekun Qi, Zheng Ge, Jinrong Yang, Liang Zhao, Jianjian Sun, Hongyu Zhou, Haoran Wei, Xiangwen Kong, Xiangyu Zhang, Kaisheng Ma, Li Yi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03976 2024-03-12 cs.HC cs.AI cs.CL 73%

From Text to Self: Users' Perceptions of Potential of AI on Interpersonal Communication and Self

Yue Fu, Sami Foell, Xuhai Xu, Alexis Hiniker

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the CHI Conference on Human Factors in Computing Systems (CHI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18149 2024-03-06 cs.CL cs.AI 73%

Multiscale Positive-Unlabeled Detection of AI-Generated Texts

Yuchuan Tian, Hanting Chen, Xutao Wang, Zheyuan Bai, Qinghua Zhang, Ruifeng Li, Chao Xu, Yunhe Wang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ICLR2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14872 2024-02-28 cs.CL cs.AI cs.NE 73%

Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs

Xiaoxia Li, Siyuan Liang, Jiyi Zhang, Han Fang, Aishan Liu, Ee-Chien Chang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08164 2024-02-28 stat.ML cs.AI cs.LG 73%

On Limitations of the Transformer Architecture

Binghui Peng, Srini Narayanan, Christos Papadimitriou

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14858 2024-02-26 cs.CL cs.AI 73%

ChatEL: Entity Linking with Chatbots

Yifan Ding, Qingkai Zeng, Tim Weninger

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01330 2024-02-23 cs.IR cs.AI cs.CL 73%

TREC iKAT 2023: The Interactive Knowledge Assistance Track Overview

Mohammad Aliannejadi, Zahra Abbasiantaeb, Shubham Chatterjee, Jeffery Dalton, Leif Azzopardi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments TREC iKAT 2023 Overview Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09954 2024-02-20 cs.CL cs.LG 73%

Crafting a Good Prompt or Providing Exemplary Dialogues? A Study of In-Context Learning for Persona-based Dialogue Generation

Jiashu Pu, Yajing Wan, Yuru Zhang, Jing Chen, Ling Cheng, Qian Shao, Yongzhu Chang, Tangjie Lv, Rongsheng Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05941 2024-02-14 cs.IR cs.AI cs.CV cs.LG 73%

Character-based Outfit Generation with Vision-augmented Style Extraction via LLMs

Najmeh Forouzandehmehr, Yijie Cao, Nikhil Thakurdesai, Ramin Giahi, Luyi Ma, Nima Farrokhsiar, Jianpeng Xu, Evren Korpeoglu, Kannan Achan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 4 figures, IEEE Big Data 2023 3rd Workshop on Multimodal AI (MMAI 2023), IEEE BigData 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06549 2024-02-12 cs.CL cs.AI 73%

Bryndza at ClimateActivism 2024: Stance, Target and Hate Event Detection via Retrieval-Augmented GPT-4 and LLaMA

Marek Šuppa, Daniel Skala, Daniela Jašš, Samuel Sučík, Andrej Švec, Peter Hraška

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to the 7th Workshop on Challenges and Applications of Automated Extraction of Socio-political Events from Text (CASE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05318 2024-02-09 cs.IR cs.CL cs.LG 73%

Navigating the Knowledge Sea: Planet-scale answer retrieval using LLMs

Dipankar Sarkar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01765 2024-02-06 cs.CL cs.AI 73%

LLMs Simulate Big Five Personality Traits: Further Evidence

Aleksandra Sorokovikova, Natalia Fedorova, Sharwin Rezagholi, Ivan P. Yamshchikov

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09896 2024-02-05 cs.CL cs.AI cs.PL cs.SE 73%

Is Self-Repair a Silver Bullet for Code Generation?

Theo X. Olausson, Jeevana Priya Inala, Chenglong Wang, Jianfeng Gao, Armando Solar-Lezama

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ICLR 2024. Added additional Code Llama experiments and fixed a data processing error harming Code Llama's reported self-repair performance on HumanEval

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01685 2024-01-31 cs.LG cs.AI cs.CV math.OC 73%

MKOR: Momentum-Enabled Kronecker-Factor-Based Optimizer Using Rank-1 Updates

Mohammad Mozaffari, Sikan Li, Zhao Zhang, Maryam Mehri Dehnavi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Published at 37th Conference on Neural Information Processing Systems (NeurIPS 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11886 2024-01-30 cs.RO cs.AI cs.LG 73%

SPRINT: Scalable Policy Pre-Training via Language Instruction Relabeling

Jesse Zhang, Karl Pertsch, Jiahui Zhang, Joseph J. Lim

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 29 pages, 18 figures. Published at ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09127 2024-01-23 cs.CR cs.AI cs.LG 73%

Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts

Yuanwei Wu, Xiang Li, Yixin Liu, Pan Zhou, Lichao Sun

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07993 2024-01-18 cs.LG cs.AI 73%

Carrying over algorithm in transformers

Jorrit Kruthoff

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Comments welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏