arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2305.18365 2023-12-29 cs.CL cs.AI 88%

What can Large Language Models do in chemistry? A comprehensive benchmark on eight tasks

Taicheng Guo, Kehan Guo, Bozhao Nan, Zhenwen Liang, Zhichun Guo, Nitesh V. Chawla, Olaf Wiest, Xiangliang Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2023 Datasets and Benchmarks Track camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15713 2023-12-27 cs.CL cs.AI 88%

PersianLLaMA: Towards Building First Persian Large Language Model

Mohammad Amin Abbasi, Arash Ghafouri, Mahdi Firouzmandi, Hassan Naderi, Behrouz Minaei Bidgoli

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14211 2023-12-25 cs.CL astro-ph.IM cs.AI 88%

Experimenting with Large Language Models and vector embeddings in NASA SciX

Sergi Blanco-Cuaresma, Ioana Ciucă, Alberto Accomazzi, Michael J. Kurtz, Edwin A. Henneken, Kelly E. Lockhart, Felix Grezes, Thomas Allen, Golnaz Shapurian, Carolyn S. Grant, Donna M. Thompson, Timothy W. Hostetler, Matthew R. Templeton, Shinyi Chen, Jennifer Koch, Taylor Jacovich, Daniel Chivvis, Fernanda de Macedo Alves, Jean-Claude Paquin, Jennifer Bartlett, Mugdha Polimera, Stephanie Jarmak

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments To appear in the proceedings of the 33th annual international Astronomical Data Analysis Software & Systems (ADASS XXXIII)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14203 2023-12-25 q-fin.PM cs.CL cs.LG 88%

Shai: A large language model for asset management

Zhongyang Guo, Guanran Jiang, Zhongdan Zhang, Peng Li, Zhefeng Wang, Yinchun Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12420 2023-12-25 cs.AI cs.CL cs.CR 88%

How Far Have We Gone in Vulnerability Detection Using Large Language Models

Zeyu Gao, Hao Wang, Yuchen Zhou, Wenyu Zhu, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12852 2023-12-21 cs.CL cs.AI 88%

Language Resources for Dutch Large Language Modelling

Bram Vanroy

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12806 2023-12-21 cs.CL cs.AI 88%

MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models

Yan Cai, Linlin Wang, Ye Wang, Gerard de Melo, Ya Zhang, Yanfeng Wang, Liang He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments accepted by AAAI-24

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11970 2023-12-20 cs.AI cs.CL cs.CY cs.MA 88%

Large Language Models Empowered Agent-based Modeling and Simulation: A Survey and Perspectives

Chen Gao, Xiaochong Lan, Nian Li, Yuan Yuan, Jingtao Ding, Zhilun Zhou, Fengli Xu, Yong Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06315 2023-12-12 cs.CL cs.CY cs.LG 88%

GPTBIAS: A Comprehensive Framework for Evaluating Bias in Large Language Models

Jiaxu Zhao, Meng Fang, Shirui Pan, Wenpeng Yin, Mykola Pechenizkiy

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03718 2023-12-08 cs.CL cs.AI 88%

Large Language Models in Law: A Survey

Jinqi Lai, Wensheng Gan, Jiayang Wu, Zhenlian Qi, Philip S. Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01032 2023-12-05 cs.CL cs.AI 88%

Harnessing the Power of Prompt-based Techniques for Generating School-Level Questions using Large Language Models

Subhankar Maity, Aniket Deroy, Sudeshna Sarkar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02071 2023-11-29 cs.AI cs.CL cs.CV cs.RO 88%

Towards End-to-End Embodied Decision Making via Multi-modal Large Language Model: Explorations with GPT4-Vision and Beyond

Liang Chen, Yichi Zhang, Shuhuai Ren, Haozhe Zhao, Zefan Cai, Yuchi Wang, Peiyi Wang, Tianyu Liu, Baobao Chang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments FMDM@NeurIPS2023, Code and data: https://github.com/pkunlp-icler/PCA-EVAL/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10819 2023-11-28 cs.CL cs.AI 88%

Evaluating the Instruction-Following Robustness of Large Language Models to Prompt Injection

Zekun Li, Baolin Peng, Pengcheng He, Xifeng Yan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments The data and code can be found at https://github.com/Leezekun/instruction-following-robustness-eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12524 2023-11-22 cs.LG cs.AI 88%

ALPHA: AnomaLous Physiological Health Assessment Using Large Language Models

Jiankai Tang, Kegang Wang, Hongming Hu, Xiyuxing Zhang, Peiyu Wang, Xin Liu, Yuntao Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10785 2023-11-21 cs.CL cs.LG 88%

Text Sanitization Beyond Specific Domains: Zero-Shot Redaction & Substitution with Large Language Models

Federico Albanese, Daniel Ciolek, Nicolas D'Ippolito

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04274 2023-11-14 cs.CL cs.LG 88%

Assessing the efficacy of large language models in generating accurate teacher responses

Yann Hicke, Abhishek Masand, Wentao Guo, Tushaar Gangavarapu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Journal ref ACL, Innovative Use of NLP for Building Educational Applications Workshop, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12425 2023-11-08 cs.SE cs.AI cs.LG 88%

Automated Repair of Declarative Software Specifications in the Era of Large Language Models

Md Rashedul Hasan, Jiawei Li, Iftekhar Ahmed, Hamid Bagheri

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 13 Pages with reference, 4 Tables, 2 Figures, 2 Listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00739 2023-11-03 cs.CL cs.DB cs.LG 88%

Can Large Language Models Design Accurate Label Functions?

Naiqing Guan, Kaiwen Chen, Nick Koudas

专题命中 评测与基准 :language model(title,abstract);large language model(title);prompting(abstract);分类 cs.CL、cs.LG

Comments 9 pages, submitted to VLDB 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20081 2023-11-01 cs.CL cs.AI cs.IR 88%

Integrating Summarization and Retrieval for Enhanced Personalization via Large Language Models

Chris Richardson, Yao Zhang, Kellen Gillespie, Sudipta Kar, Arshdeep Singh, Zeynab Raeesy, Omar Zia Khan, Abhinav Sethy

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 4 pages, International Workshop on Personalized Generative AI (@CIKM 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19308 2023-10-31 cs.SE cs.AI cs.CL 88%

SheetCopilot: Bringing Software Productivity to the Next Level through Large Language Models

Hongxin Li, Jingran Su, Yuntao Chen, Qing Li, Zhaoxiang Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10397 2023-10-30 cs.CL cs.AI 88%

FairMonitor: A Four-Stage Automatic Framework for Detecting Stereotypes and Biases in Large Language Models

Yanhong Bai, Jiabao Zhao, Jinxin Shi, Tingjiang Wei, Xingjiao Wu, Liang He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17019 2023-10-27 cs.LG cs.CL cs.RO 88%

Conditionally Combining Robot Skills using Large Language Models

K. R. Zentner, Ryan Julian, Brian Ichter, Gaurav S. Sukhatme

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16755 2023-10-26 cs.CL cs.AI 88%

HI-TOM: A Benchmark for Evaluating Higher-Order Theory of Mind Reasoning in Large Language Models

Yinghui He, Yufan Wu, Yilin Jia, Rada Mihalcea, Yulong Chen, Naihao Deng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at Findings of EMNLP 2023

Journal ref Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16263 2023-10-26 cs.SE cs.AI cs.CL cs.CR 88%

Enhancing Large Language Models for Secure Code Generation: A Dataset-driven Study on Vulnerability Mitigation

Jiexin Wang, Liuwen Cao, Xitong Luo, Zhiping Zhou, Jiayuan Xie, Adam Jatowt, Yi Cai

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13671 2023-10-23 cs.CL cs.AI 88%

Let's Synthesize Step by Step: Iterative Dataset Synthesis with Large Language Models by Extrapolating Errors from Small Models

Ruida Wang, Wangchunshu Zhou, Mrinmaya Sachan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2023(Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13307 2023-10-23 cs.CL cs.LG 88%

Test-Time Self-Adaptive Small Language Models for Question Answering

Soyeong Jeong, Jinheon Baek, Sukmin Cho, Sung Ju Hwang, Jong C. Park

专题命中 评测与基准 :language model(title,abstract);small language model(title);large language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP Findings 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12505 2023-10-20 cs.CL cs.CR cs.LG 88%

Attack Prompt Generation for Red Teaming and Defending Large Language Models

Boyi Deng, Wenjie Wang, Fuli Feng, Yang Deng, Qifan Wang, Xiangnan He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2023 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09716 2023-10-19 cs.HC cs.AI cs.CL cs.IR 88%

Enhancing Conversational Search: Large Language Model-Aided Informative Query Rewriting

Fanghua Ye, Meng Fang, Shenghui Li, Emine Yilmaz

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 22 pages, accepted to EMNLP Findings 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10633 2023-10-17 cs.CL cs.AI 88%

RaLLe: A Framework for Developing and Evaluating Retrieval-Augmented Large Language Models

Yasuto Hoshi, Daisuke Miyashita, Youyang Ng, Kento Tatsuno, Yasuhiro Morioka, Osamu Torii, Jun Deguchi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 18 pages, 2 figures, see https://youtu.be/JYbm75qnfTg for the demonstration screencast, accepted by EMNLP 2023 System Demonstrations

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06254 2023-10-11 cs.CL cs.AI 88%

Get the gist? Using large language models for few-shot decontextualization

Benjamin Kane, Lenhart Schubert

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏