arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2405.05285 2024-05-10 cs.HC cs.AI 70%

Generative AI as a metacognitive agent: A comparative mixed-method study with human participants on ICF-mimicking exam performance

Jelena Pavlovic, Jugoslav Krstic, Luka Mitrovic, Djordje Babic, Adrijana Milosavljevic, Milena Nikolic, Tijana Karaklic, Tijana Mitrovic

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11565 2024-05-07 cs.CV cs.AI cs.GR 70%

MoA: Mixture-of-Attention for Subject-Context Disentanglement in Personalized Image Generation

Kuan-Chieh Wang, Daniil Ostashev, Yuwei Fang, Sergey Tulyakov, Kfir Aberman

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments Project Website: https://snap-research.github.io/mixture-of-attention, Same as previous version, only updated metadata because bib was missing an author name

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02671 2024-05-07 math.OC cs.LG stat.ML 70%

Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods

Sara Klein, Simon Weissmann, Leif Döring

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments 54 pages, 2 figures, ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18415 2024-05-07 cs.LG math.CT 70%

The Topos of Transformer Networks

Mattia Jacopo Villani, Peter McBurney

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments Requires major revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01842 2024-05-06 cs.CL 70%

SGHateCheck: Functional Tests for Detecting Hate Speech in Low-Resource Languages of Singapore

Ri Chi Ng, Nirmalendu Prakash, Ming Shan Hee, Kenny Tsu Wei Choo, Roy Ka-Wei Lee

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18881 2024-04-30 cs.HC cs.LG cs.SE 70%

Human-in-the-Loop Synthetic Text Data Inspection with Provenance Tracking

Hong Jin Kang, Fabrice Harel-Canada, Muhammad Ali Gulzar, Violet Peng, Miryung Kim

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07384 2024-04-30 cs.CL 70%

An Interactive Framework for Profiling News Media Sources

Nikhil Mehta, Dan Goldwasser

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments NAACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15516 2024-04-25 cs.CV cs.AI 70%

Visual Delta Generator with Large Multi-modal Models for Semi-supervised Composed Image Retrieval

Young Kyun Jang, Donghyun Kim, Zihang Meng, Dat Huynh, Ser-Nam Lim

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15189 2024-04-24 cs.AI 70%

Text2Grasp: Grasp synthesis by text prompts of object grasping parts

Xiaoyun Chang, Yi Sun

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13855 2024-04-23 cs.CL 70%

Understanding the role of FFNs in driving multilingual behaviour in LLMs

Sunit Bhattacharya, Ondřej Bojar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18351 2024-04-23 cs.AI q-bio.QM 70%

BioImage.IO Chatbot: A Community-Driven AI Assistant for Integrative Computational Bioimaging

Wanlu Lei, Caterina Fuster-Barceló, Gabriel Reder, Arrate Muñoz-Barrutia, Wei Ouyang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11408 2024-04-18 cs.AI 70%

DUPE: Detection Undermining via Prompt Engineering for Deepfake Text

James Weichert, Chinecherem Dimobi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05636 2024-04-18 cs.SE cs.AI 70%

The Impact of AI Tool on Engineering at ANZ Bank An Empirical Study on GitHub Copilot within Corporate Environment

Sayan Chatterjee, Ching Louis Liu, Gareth Rowland, Tim Hogarth

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 16 pages, 4 figures. in proceeding for 10th International Conference on Software Engineering (SEC 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09375 2024-04-16 cs.HC cs.CL 70%

Deceptive Patterns of Intelligent and Interactive Writing Assistants

Karim Benharrak, Tim Zindulka, Daniel Buschek

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Published as a workshop paper to the In2Writing workshop at CHI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10473 2024-04-12 q-bio.QM cs.LG 70%

Predicting Side Effect of Drug Molecules using Recurrent Neural Networks

Collin Beaudoin, Koustubh Phalak, Swaroop Ghosh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments 6 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06201 2024-04-10 cs.SE cs.AI 70%

Open-Source AI-based SE Tools: Opportunities and Challenges of Collaborative Software Learning

Zhihao Lin, Wei Ma, Tao Lin, Yaowen Zheng, Jingquan Ge, Jun Wang, Jacques Klein, Tegawende Bissyande, Yang Liu, Li Li

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15873 2024-04-10 cs.CL 70%

SemEval-2024 Task 8: Weighted Layer Averaging RoBERTa for Black-Box Machine-Generated Text Detection

Ayan Datta, Aryan Chandramania, Radhika Mamidi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04268 2024-04-09 cs.IR cs.AI cs.CY cs.SI 70%

The Use of Generative Search Engines for Knowledge Work and Complex Tasks

Siddharth Suri, Scott Counts, Leijie Wang, Chacha Chen, Mengting Wan, Tara Safavi, Jennifer Neville, Chirag Shah, Ryen W. White, Reid Andersen, Georg Buscher, Sathish Manivannan, Nagu Rangan, Longqi Yang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 32 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02872 2024-04-04 cs.AI 70%

Integrating Explanations in Learning LTL Specifications from Demonstrations

Ashutosh Gupta, John Komp, Abhay Singh Rajput, Krishna Shankaranarayanan, Ashutosh Trivedi, Namrita Varshney

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 21 Pages, 13 Page Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00267 2024-04-04 cs.CL 70%

Secret Keepers: The Impact of LLMs on Linguistic Markers of Personal Traits

Zhivar Sourati, Meltem Ozcan, Colin McDaniel, Alireza Ziabari, Nuan Wen, Ala Tak, Fred Morstatter, Morteza Dehghani

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01651 2024-04-03 cs.CL cs.CY cs.HC cs.SI 70%

NLP Systems That Can't Tell Use from Mention Censor Counterspeech, but Teaching the Distinction Helps

Kristina Gligoric, Myra Cheng, Lucia Zheng, Esin Durmus, Dan Jurafsky

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL

Comments NAACL 2024 (Main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01449 2024-04-03 cs.CL 70%

TopicGPT: A Prompt-based Topic Modeling Framework

Chau Minh Pham, Alexander Hoyle, Simeng Sun, Philip Resnik, Mohit Iyyer

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to NAACL 2024 (Main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20134 2024-04-01 cs.CL 70%

User Modeling Challenges in Interactive AI Assistant Systems

Megan Su, Yuwei Bao

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01990 2024-03-29 cs.LG 70%

Conditions on Preference Relations that Guarantee the Existence of Optimal Policies

Jonathan Colaço Carr, Prakash Panangaden, Doina Precup

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments v2: replaced with accepted AISTATS 2024 version, containing a new summary figure and one extra example. Results and conclusions are unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16609 2024-03-26 cs.CL 70%

Conversational Grounding: Annotation and Analysis of Grounding Acts and Grounding Units

Biswesh Mohapatra, Seemab Hassan, Laurent Romary, Justine Cassell

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15273 2024-03-25 cs.CL 70%

Event Temporal Relation Extraction based on Retrieval-Augmented on LLMs

Xiaobin Zhang, Liangjun Zang, Qianwen Liu, Shuchong Wei, Songlin Hu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages,6 figures.Accepted to the International Joint Conference on Neural Networks (IJCNN2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12038 2024-03-25 cs.CL cs.CV 70%

Large Multilingual Models Pivot Zero-Shot Multimodal Learning across Languages

Jinyi Hu, Yuan Yao, Chongyi Wang, Shan Wang, Yinxu Pan, Qianyu Chen, Tianyu Yu, Hanghao Wu, Yue Zhao, Haoye Zhang, Xu Han, Yankai Lin, Jiao Xue, Dahai Li, Zhiyuan Liu, Maosong Sun

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments https://github.com/OpenBMB/VisCPM.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14298 2024-03-22 cs.SI cs.AI cs.HC 70%

From Perils to Possibilities: Understanding how Human (and AI) Biases affect Online Fora

Virginia Morini, Valentina Pansanella, Katherine Abramski, Erica Cau, Andrea Failla, Salvatore Citraro, Giulio Rossetti

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09820 2024-03-21 cs.CY cs.LG cs.SI 70%

Machine-Made Media: Monitoring the Mobilization of Machine-Generated Articles on Misinformation and Mainstream News Websites

Hans W. A. Hanley, Zakir Durumeric

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to ICWSM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03173 2024-03-20 cs.CL 70%

$\mathcal{B}$-Coder: Value-Based Deep Reinforcement Learning for Program Synthesis

Zishun Yu, Yunzhe Tao, Liyu Chen, Tao Sun, Hongxia Yang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏