arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2211.13709 2024-01-17 cs.CL cs.AI 73%

Undesirable Biases in NLP: Addressing Challenges of Measurement

Oskar van der Wal, Dominik Bachmann, Alina Leidinger, Leendert van Maanen, Willem Zuidema, Katrin Schulz

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Journal of Artificial Intelligence Research, 79, 1-40 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05199 2024-01-11 cs.CL cs.AI 73%

Monte Carlo Tree Search for Recipe Generation using GPT-2

Karan Taneja, Richard Segal, Richard Goodwin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 1 figure, ICCC 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07476 2024-01-10 cs.CL cs.AI 73%

Comparable Demonstrations are Important in In-Context Learning: A Novel Perspective on Demonstration Selection

Caoyun Fan, Jidong Tian, Yitian Li, Hao He, Yaohui Jin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04210 2024-01-10 cs.CV cs.AI cs.CL cs.MM cs.SD eess.AS 73%

FunnyNet-W: Multimodal Learning of Funny Moments in Videos in the Wild

Zhi-Song Liu, Robin Courant, Vicky Kalogeiton

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 22 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02997 2024-01-09 cs.CL cs.AI 73%

Blar-SQL: Faster, Stronger, Smaller NL2SQL

José Manuel Domínguez, Benjamín Errázuriz, Patricio Daher

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04695 2024-01-08 cs.CL cs.AI 73%

Code-Style In-Context Learning for Knowledge-Based Question Answering

Zhijie Nie, Richong Zhang, Zhongyuan Wang, Xudong Liu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments AAAI2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13301 2024-01-08 cs.LG cs.AI cs.CV 73%

Training Diffusion Models with Reinforcement Learning

Kevin Black, Michael Janner, Yilun Du, Ilya Kostrikov, Sergey Levine

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments 23 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09917 2023-12-18 cs.CL cs.AI 73%

Red AI? Inconsistent Responses from GPT3.5 Models on Political Issues in the US and China

Di Zhou, Yinxian Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18054 2023-12-12 cs.CL cs.AI 73%

I Know You Did Not Write That! A Sampling Based Watermarking Method for Identifying Machine Generated Text

Kaan Efe Keleş, Ömer Kaan Gürbüz, Mucahid Kutlu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04057 2023-12-12 cs.CL cs.LG stat.ML 73%

Bidirectional Attention as a Mixture of Continuous Word Experts

Kevin Christian Wibisono, Yixin Wang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 32 pages. Published in UAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03741 2023-12-08 cs.CL cs.AI cs.SE 73%

Comparing Generative Chatbots Based on Process Requirements

Luis Fernando Lins, Nathalia Nascimento, Paulo Alencar, Toacy Oliveira, Donald Cowan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments IEEE BigData

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18805 2023-12-01 cs.CL cs.AI 73%

Unnatural Error Correction: GPT-4 Can Almost Perfectly Handle Unnatural Scrambled Text

Qi Cao, Takeshi Kojima, Yutaka Matsuo, Yusuke Iwasawa

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 (with an additional analysis section in appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01286 2023-12-01 cs.CL cs.AI 73%

KL-Divergence Guided Temperature Sampling

Chung-Ching Chang, David Reitter, Renat Aksitov, Yun-Hsuan Sung

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07871 2023-11-27 cs.AI cs.LG 73%

The SocialAI School: Insights from Developmental Psychology Towards Artificial Socio-Cultural Agents

Grgur Kovač, Rémy Portelas, Peter Ford Dominey, Pierre-Yves Oudeyer

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Preprint, see v1 for a shorter version (accepted at the "Workshop on Theory-of-Mind" at ICML 2023) See project website for demo and code: https://sites.google.com/view/socialai-school

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10075 2023-11-17 cs.CL cs.AI 73%

ChatGPT-3.5, ChatGPT-4, Google Bard, and Microsoft Bing to Improve Health Literacy and Communication in Pediatric Populations and Beyond

Kanhai S. Amin, Linda Mayes, Pavan Khosla, Rushabh Doshi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 1 Table, 3 Figures, and 3 Supplemental Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07438 2023-11-17 cs.CL cs.AI 73%

Tractable Control for Autoregressive Language Generation

Honghua Zhang, Meihua Dang, Nanyun Peng, Guy Van den Broeck

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06513 2023-11-15 cs.CL cs.AI 73%

Step by Step to Fairness: Attributing Societal Bias in Task-oriented Dialogue Systems

Hsuan Su, Rebecca Qian, Chinnadhurai Sankar, Shahin Shayandeh, Shang-Tse Chen, Hung-yi Lee, Daniel M. Bikel

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01007 2023-11-09 cs.LG cs.AI cs.HC 73%

Effective Human-AI Teams via Learned Natural Language Rules and Onboarding

Hussein Mozannar, Jimin J Lee, Dennis Wei, Prasanna Sattigeri, Subhro Das, David Sontag

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14596 2023-11-02 cs.CL cs.LG 73%

Increasing Probability Mass on Answer Choices Does Not Always Improve Accuracy

Sarah Wiegreffe, Matthew Finlayson, Oyvind Tafjord, Peter Clark, Ashish Sabharwal

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.10385 2023-10-26 cs.CL cs.LG 73%

GPT Understands, Too

Xiao Liu, Yanan Zheng, Zhengxiao Du, Ming Ding, Yujie Qian, Zhilin Yang, Jie Tang

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15355 2023-10-25 cs.CL cs.AI 73%

Why LLMs Hallucinate, and How to Get (Evidential) Closure: Perceptual, Intensional, and Extensional Learning for Faithful Natural Language Generation

Adam Bouyamourn

专题命中 其他LLM :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14599 2023-10-24 cs.CL cs.AI 73%

Prefix-Tuning Based Unsupervised Text Style Transfer

Huiyu Mai, Wenhao Jiang, Zhihong Deng

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref EMNLP 2023 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14105 2023-10-24 cs.CL cs.AI 73%

CTQScorer: Combining Multiple Features for In-context Example Selection for Machine Translation

Aswanth Kumar, Ratish Puduppully, Raj Dabre, Anoop Kunchukuttan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2023 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06983 2023-10-24 cs.CL cs.LG 73%

Active Retrieval Augmented Generation

Zhengbao Jiang, Frank F. Xu, Luyu Gao, Zhiqing Sun, Qian Liu, Jane Dwivedi-Yu, Yiming Yang, Jamie Callan, Graham Neubig

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13408 2023-10-19 cs.CL cs.CR cs.LG 73%

Paraphrasing evades detectors of AI-generated text, but retrieval is an effective defense

Kalpesh Krishna, Yixiao Song, Marzena Karpinska, John Wieting, Mohit Iyyer

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2023 camera ready (32 pages). Code, models, data available in https://github.com/martiansideofthemoon/ai-detection-paraphrases

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09506 2023-10-17 cs.IT cs.AI cs.LG cs.NI math.IT 73%

Towards Semantic Communication Protocols for 6G: From Protocol Learning to Language-Oriented Approaches

Jihong Park, Seung-Woo Ko, Jinho Choi, Seong-Lyun Kim, Mehdi Bennis

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 13 figures, submitted to IEEE BITS the Information Theory Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11751 2023-10-17 cs.CV cs.AI cs.CR cs.LG 73%

How Robust is Google's Bard to Adversarial Image Attacks?

Yinpeng Dong, Huanran Chen, Jiawei Chen, Zhengwei Fang, Xiao Yang, Yichi Zhang, Yu Tian, Hang Su, Jun Zhu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08291 2023-10-13 cs.CL cs.AI 73%

Expanding the Vocabulary of BERT for Knowledge Base Construction

Dong Yang, Xu Wang, Remzi Celebi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00848 2023-10-11 cs.SE cs.AI cs.LG cs.PL 73%

Toward Trustworthy Neural Program Synthesis

Darren Key, Wen-Ding Li, Kevin Ellis

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04880 2023-10-10 cs.AI cs.LG 73%

Question-focused Summarization by Decomposing Articles into Facts and Opinions and Retrieving Entities

Krutika Sarode, Shashidhar Reddy Javaji, Vishal Kalakonnavar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏