arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2404.14462 2024-10-10 cs.LG 70%

Towards smaller, faster decoder-only transformers: Architectural variants and their implications

Sathya Krishnan Suresh, Shunmugapriya P

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05600 2024-10-10 cs.CL 70%

Bridging Modalities: Enhancing Cross-Modality Hate Speech Detection with Few-Shot In-Context Learning

Ming Shan Hee, Aditi Kumaresan, Roy Ka-Wei Lee

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at EMNLP'24 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05306 2024-10-10 cs.CR cs.AI 70%

Towards Assuring EU AI Act Compliance and Adversarial Robustness of LLMs

Tomas Bueno Momcilovic, Beat Buesser, Giulio Zizzo, Mark Purcell, Dian Balta

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted in the AI Act Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15884 2024-10-08 cs.CL 70%

Corrective Retrieval Augmented Generation

Shi-Qi Yan, Jia-Chen Gu, Yun Zhu, Zhen-Hua Ling

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Update results, add more analysis, and fix typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03303 2024-10-07 cs.LG cs.CV 70%

SELU: Self-Learning Embodied MLLMs in Unknown Environments

Boyu Li, Haobin Jiang, Ziluo Ding, Xinrun Xu, Haoran Li, Dongbin Zhao, Zongqing Lu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02783 2024-10-07 cs.CY cs.AI cs.HC 70%

Enhancing Mental Health Support through Human-AI Collaboration: Toward Secure and Empathetic AI-enabled chatbots

Rawan AlMakinah, Andrea Norcini-Pala, Lindsey Disney, M. Abdullah Canbaz

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 17 pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13443 2024-10-03 cs.CL 70%

Dual-Phase Accelerated Prompt Optimization

Muchen Yang, Moxin Li, Yongle Li, Zijun Chen, Chongming Gao, Junqi Zhang, Yangyang Li, Fuli Feng

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01307 2024-10-03 cs.AI 70%

FanCric : Multi-Agentic Framework for Crafting Fantasy 11 Cricket Teams

Mohit Bhatnagar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00593 2024-10-02 cs.CL 70%

Style-Specific Neurons for Steering LLMs in Text Style Transfer

Wen Lai, Viktor Hangya, Alexander Fraser

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at EMNLP 2024 main conference. The code is publicly available at https://github.com/wenlai-lavine/sNeuron-TST

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00423 2024-10-02 cs.CL 70%

Are LLMs Aware that Some Questions are not Open-ended?

Dongjie Yang, Hai Zhao

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00354 2024-10-02 cs.CL 70%

Hierarchical Organization Simulacra in the Investment Sector

Chung-Chi Chen, Hiroya Takamura, Ichiro Kobayashi, Yusuke Miyao

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19813 2024-10-01 cs.CL 70%

Transforming Hidden States into Binary Semantic Features

Tomáš Musil, David Mareček

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17287 2024-10-01 cs.CL 70%

When to Trust LLMs: Aligning Confidence with Response Quality

Shuchang Tao, Liuyi Yao, Hanxing Ding, Yuexiang Xie, Qi Cao, Fei Sun, Jinyang Gao, Huawei Shen, Bolin Ding

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ACL 2024. Code: https://github.com/TaoShuchang/CONQORD

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09848 2024-10-01 cs.CL 70%

Enhancing Stance Classification on Social Media Using Quantified Moral Foundations

Hong Zhang, Quoc-Nam Nguyen, Prasanta Bhattacharya, Wei Gao, Liang Ze Wong, Brandon Siyuan Loh, Joseph J. P. Simons, Jisun An

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18971 2024-10-01 cs.MM cs.AI cs.SD eess.AS 70%

Early Joint Learning of Emotion Information Makes MultiModal Model Understand You Better

Mengying Ge, Mingyang Li, Dongkai Tang, Pengbo Li, Kuo Liu, Shuhao Deng, Songbai Pu, Long Liu, Yang Song, Tao Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03137 2024-10-01 cs.LG stat.ML 70%

The AdEMAMix Optimizer: Better, Faster, Older

Matteo Pagliardini, Pierre Ablin, David Grangier

专题命中 其他LLM :LLM(abstract);language model(abstract);分类 cs.LG

Comments 38 pages, 33 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18678 2024-09-30 cs.CL 70%

Rehearsing Answers to Probable Questions with Perspective-Taking

Yung-Yu Shih, Ziwei Xu, Hiroya Takamura, Yun-Nung Chen, Chung-Chi Chen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05013 2024-09-27 cs.IR cs.CL 70%

CHIQ: Contextual History Enhancement for Improving Query Rewriting in Conversational Search

Fengran Mo, Abbas Ghaddar, Kelong Mao, Mehdi Rezagholizadeh, Boxing Chen, Qun Liu, Jian-Yun Nie

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17448 2024-09-27 cs.CL 70%

Enhancing Financial Sentiment Analysis with Expert-Designed Hint

Chung-Chi Chen, Hiroya Takamura, Ichiro Kobayashi, Yusuke Miyao

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16653 2024-09-26 cs.LG q-fin.GN 70%

The Credibility Transformer

Ronald Richman, Salvatore Scognamiglio, Mario V. Wüthrich

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04872 2024-09-26 cs.CL 70%

SCOI: Syntax-augmented Coverage-based In-context Example Selection for Machine Translation

Chenming Tang, Zhixiang Wang, Yunfang Wu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2024 main conference long paper. 16 pages, 2 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12139 2024-09-25 cs.SD cs.AI eess.AS 70%

Takin: A Cohort of Superior Quality Zero-shot Speech Generation Models

Sijing Chen, Yuan Feng, Laipeng He, Tianwei He, Wendi He, Yanni Hu, Bin Lin, Yiting Lin, Yu Pan, Pengfei Tan, Chengwei Tian, Chen Wang, Zhicheng Wang, Ruoye Xie, Jixun Yao, Quanlei Yan, Yuguang Yang, Jianhao Ye, Jingjing Yin, Yanzhen Yu, Huimin Zhang, Xiang Zhang, Guangcheng Zhao, Hongbin Zhou, Pengpeng Zou

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments Technical Report; 18 pages; typos corrected, references added, demo url modified, author name modified;

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13992 2024-09-24 cs.CL 70%

SMART-RAG: Selection using Determinantal Matrices for Augmented Retrieval

Jiatao Li, Xinyu Hu, Xiaojun Wan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13331 2024-09-23 cs.CL cs.CR 70%

Applying Pre-trained Multilingual BERT in Embeddings for Improved Malicious Prompt Injection Attacks Detection

Md Abdur Rahman, Hossain Shahriar, Fan Wu, Alfredo Cuzzocrea

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13064 2024-09-23 cs.SI cs.AI 70%

Fear and Loathing on the Frontline: Decoding the Language of Othering by Russia-Ukraine War Bloggers

Patrick Gerard, William Theisen, Tim Weninger, Kristina Lerman

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12658 2024-09-20 cs.CL 70%

Exploring the topics, sentiments and hate speech in the Spanish information environment

ALEJANDRO BUITRAGO LOPEZ, Javier Pastor-Galindo, José Antonio Ruipérez-Valiente

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10741 2024-09-18 cs.SE cs.CL 70%

NaviQAte: Functionality-Guided Web Application Navigation

Mobina Shahbandeh, Parsa Alian, Noor Nashid, Ali Mesbah

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08323 2024-09-18 cs.CY cs.AI 70%

Mapping the Ethics of Generative AI: A Comprehensive Scoping Review

Thilo Hagendorff

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18134 2024-09-13 cs.CV cs.LG 70%

$\mathbb{X}$-Sample Contrastive Loss: Improving Contrastive Learning with Sample Similarity Graphs

Vlad Sobal, Mark Ibrahim, Randall Balestriero, Vivien Cabannes, Diane Bouchacourt, Pietro Astolfi, Kyunghyun Cho, Yann LeCun

专题命中 其他LLM :language model(abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06227 2024-09-13 eess.SY cs.AI cs.SY 70%

Communication and Control Co-Design in 6G: Sequential Decision-Making with LLMs

Xianfu Chen, Celimuge Wu, Yi Shen, Yusheng Ji, Tsutomu Yoshinaga, Qiang Ni, Charilaos C. Zarakovitis, Honggang Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏