arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32411 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32411 篇

2505.07857 2025-05-14 cs.CL cs.AI 87%

Enhanced Urdu Intent Detection with Large Language Models and Prototype-Informed Predictive Pipelines

Faiza Hassan, Summra Saleem, Kashif Javed, Muhammad Nabeel Asim, Abdur Rehman, Andreas Dengel

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 42 pages, 10 figures(including 6 graphs)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00694 2025-05-13 cs.LG cs.AI q-bio.QM 87%

Leveraging Large Language Models to Predict Antibody Biological Activity Against Influenza A Hemagglutinin

Ella Barkan, Ibrahim Siddiqui, Kevin J. Cheng, Alex Golts, Yoel Shoshan, Jeffrey K. Weber, Yailin Campos Mota, Michal Ozery-Flato, Giuseppe A. Sautto

专题命中 评测与基准 :large language model(title);language model(title);foundation model(abstract);分类 cs.AI、cs.LG

Journal ref https://www.csbj.org/article/S2001-0370(25)00105-9/fulltext

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11260 2025-04-21 cs.CL cs.AI 87%

Adversarial Style Augmentation via Large Language Model for Robust Fake News Detection

Sungwon Park, Sungwon Han, Xing Xie, Jae-Gil Lee, Meeyoung Cha

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments WWW'25 research track accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05180 2025-04-08 cs.LG cs.AI 87%

BRIDGES: Bridging Graph Modality and Large Language Models within EDA Tasks

Wei Li, Yang Zou, Christopher Ellis, Ruben Purdy, Shawn Blanton, José M. F. Moura

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20726 2025-03-31 cs.CL cs.LG 87%

Retrieval Backward Attention without Additional Training: Enhance Embeddings of Large Language Models via Repetition

Yifei Duan, Raphael Shang, Deng Liang, Yongqiang Cai

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14853 2025-03-04 cs.CL cs.AI 87%

DFlow: Diverse Dialogue Flow Simulation with Large Language Models

Wanyu Du, Song Feng, James Gung, Lijia Sun, Yi Zhang, Saab Mansour, Yanjun Qi

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11896 2025-02-18 cs.LG cs.AI 87%

CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning

Yanxiao Zhao, Yangge Qian, Jingyang Shan, Xiaolin Qin

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments Accepted at RLDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12405 2025-02-18 cs.CL cs.AI cs.HC 87%

Evaluating the Prompt Steerability of Large Language Models

Erik Miehling, Michael Desmond, Karthikeyan Natesan Ramamurthy, Elizabeth M. Daly, Pierre Dognin, Jesus Rios, Djallel Bouneffouf, Miao Liu

专题命中 评测与基准 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI

Comments Short version appeared at the Pluralistic Alignment workshop at NeurIPS 2024; extended version appeared at NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03738 2025-02-05 cs.CL cs.AI 87%

ERASMO: Leveraging Large Language Models for Enhanced Clustering Segmentation

Fillipe dos Santos Silva, Gabriel Kenzo Kakimoto, Julio Cesar dos Reis, Marcelo S. Reis

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 15 pages, 10 figures, published in BRACIS 2024 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18062 2025-01-31 cs.LG cs.CL 87%

FinanceQA: A Benchmark for Evaluating Financial Analysis Capabilities of Large Language Models

Spencer Mateega, Carlos Georgescu, Danny Tang

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05403 2024-11-11 cs.CL cs.AI 87%

Benchmarking Distributional Alignment of Large Language Models

Nicole Meister, Carlos Guestrin, Tatsunori Hashimoto

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18680 2024-11-07 cs.SD cs.AI cs.CL cs.MM eess.AS 87%

Beyond Single-Audio: Advancing Multi-Audio Processing in Audio Large Language Models

Yiming Chen, Xianghu Yue, Xiaoxue Gao, Chen Zhang, Luis Fernando D'Haro, Robby T. Tan, Haizhou Li

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments EMNLP24 Findings. Data available at https://github.com/MatthewCYM/MALLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00044 2024-11-04 cs.CL cs.LG 87%

MIMIC-IV-Ext-PE: Using a large language model to predict pulmonary embolism phenotype in the MIMIC-IV dataset

B. D. Lam, S. Ma, I. Kovalenko, P. Wang, O. Jafari, A. Li, S. Horng

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19937 2024-10-29 cs.CR cs.AI cs.CL 87%

RobustKV: Defending Large Language Models against Jailbreak Attacks via KV Eviction

Tanqiu Jiang, Zian Wang, Jiacheng Liang, Changjiang Li, Yuhui Wang, Ting Wang

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03871 2024-10-23 cs.CL cs.AI 87%

Large Language Models for Biomedical Text Simplification: Promising But Not There Yet

Zihao Li, Samuel Belkadi, Nicolo Micheletti, Lifeng Han, Matthew Shardlow, Goran Nenadic

专题命中 评测与基准 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI

Comments Extended system report for PLABA-2023. arXiv admin note: substantial text overlap with arXiv:2309.13202

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12902 2024-10-14 cs.LG cs.AI cs.PL cs.SE 87%

JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models

Jialun Cao, Zhiyong Chen, Jiarong Wu, Shing-chi Cheung, Chang Xu

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments Accepted by ASE 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10977 2024-07-17 cs.LG cs.AI cs.ET 87%

CIRCUITSYNTH: Leveraging Large Language Models for Circuit Topology Synthesis

Prashanth Vijayaraghavan, Luyao Shi, Ehsan Degan, Xin Zhang

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 1 figure, LAD'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07710 2024-06-26 cs.CR cs.CL cs.LG 87%

A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models

Yihan Wu, Zhengmian Hu, Junfeng Guo, Hongyang Zhang, Heng Huang

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15527 2024-06-25 cs.LG cs.CL 87%

Data Efficient Evaluation of Large Language Models and Text-to-Image Models via Adaptive Sampling

Cong Xu, Gayathri Saranathan, Mahammad Parwez Alam, Arpit Shah, James Lim, Soon Yee Wong, Foltin Martin, Suparna Bhattacharya

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14683 2024-06-18 cs.CV cs.AI cs.LG 87%

Visual Hallucinations of Multi-modal Large Language Models

Wen Huang, Hongbin Liu, Minxin Guo, Neil Zhenqiang Gong

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments To appear in ACL Findings, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10302 2024-06-04 cs.CL cs.AI 87%

One-Shot Learning as Instruction Data Prospector for Large Language Models

Yunshui Li, Binyuan Hui, Xiaobo Xia, Jiaxi Yang, Min Yang, Lei Zhang, Shuzheng Si, Ling-Hao Chen, Junhao Liu, Tongliang Liu, Fei Huang, Yongbin Li

专题命中 评测与基准 :large language model(title);language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI

Comments ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01518 2024-03-05 cs.CL cs.LG 87%

Revisiting Dynamic Evaluation: Online Adaptation for Large Language Models

Amal Rannen-Triki, Jorg Bornschein, Razvan Pascanu, Marcus Hutter, Andras György, Alexandre Galashov, Yee Whye Teh, Michalis K. Titsias

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03053 2024-02-06 cs.CL cs.LG 87%

Multi-Lingual Malaysian Embedding: Leveraging Large Language Models for Semantic Representations

Husein Zolkepli, Aisyah Razak, Kamarul Adha, Ariff Nazhan

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15966 2024-01-30 cs.CL cs.AI 87%

Response Generation for Cognitive Behavioral Therapy with Large Language Models: Comparative Study with Socratic Questioning

Kenta Izumi, Hiroki Tanaka, Kazuhiro Shidara, Hiroyoshi Adachi, Daisuke Kanayama, Takashi Kudo, Satoshi Nakamura

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by IWSDS2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00208 2023-09-04 cs.CL cs.AI 87%

Large Language Models for Semantic Monitoring of Corporate Disclosures: A Case Study on Korea's Top 50 KOSPI Companies

Junwon Sung, Woojin Heo, Yunkyung Byun, Youngsam Kim

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07518 2023-07-18 cs.AI cs.CL cs.CV eess.IV 87%

CephGPT-4: An Interactive Multimodal Cephalometric Measurement and Diagnostic System with Visual Large Language Model

Lei Ma, Jincong Han, Zhaoxin Wang, Dian Zhang

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04683 2023-07-11 cs.CL cs.AI 87%

CORE-GPT: Combining Open Access research and large language models for credible, trustworthy question answering

David Pride, Matteo Cancellieri, Petr Knoth

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 12 pages, accepted submission to TPDL2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13966 2023-04-17 cs.LG cs.AI 87%

The Debate Over Understanding in AI's Large Language Models

Melanie Mitchell, David C. Krakauer

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.AI、cs.LG

Comments Under submission as a Perspective article. Updated with additional discussion and citations

Journal ref Proceedings of the National Academy of Sciences 120 (13), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05853 2023-04-13 cs.CL cs.AI cs.CY 87%

Measuring Reliability of Large Language Models through Semantic Consistency

Harsh Raj, Domenic Rosati, Subhabrata Majumdar

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments NeurIPS 2022 ML Safety Workshop, https://neurips2022.mlsafety.org

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.00498 2022-04-04 cs.CL cs.DB cs.LG 87%

Evaluating the Text-to-SQL Capabilities of Large Language Models

Nitarshan Rajkumar, Raymond Li, Dzmitry Bahdanau

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏