arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32271 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32271 篇

2407.16277 2024-07-29 cs.CV cs.HC 88%

When, Where, and What? A Novel Benchmark for Accident Anticipation and Localization with Large Language Models

Haicheng Liao, Yongkang Li, Chengyue Wang, Yanchen Guan, KaHou Tam, Chunlin Tian, Li Li, Chengzhong Xu, Zhenning Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14925 2024-07-23 cs.HC 88%

When Qualitative Research Meets Large Language Model: Exploring the Potential of QualiGPT as a Tool for Qualitative Coding

He Zhang, Chuhao Wu, Jingyi Xie, Fiona Rubino, Sydney Graver, ChanMin Kim, John M. Carroll, Jie Cai

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments arXiv admin note: substantial text overlap with arXiv:2310.07061

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06290 2024-07-09 cs.NE 88%

Exploring the True Potential: Evaluating the Black-box Optimization Capability of Large Language Models

Beichen Huang, Xingyu Wu, Yu Zhou, Jibin Wu, Liang Feng, Ran Cheng, Kay Chen Tan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06749 2024-07-01 cs.DB 88%

Evaluating Large Language Models in Process Mining: Capabilities, Benchmarks, and Evaluation Strategies

Alessandro Berti, Humam Kourani, Hannes Hafke, Chiao-Yun Li, Daniel Schuster

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16510 2024-06-25 econ.GN q-fin.EC 88%

Large Language Models in Student Assessment: Comparing ChatGPT and Human Graders

Magnus Lundgren

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16367 2024-06-25 cs.IR 88%

On the Role of Long-tail Knowledge in Retrieval Augmented Large Language Models

Dongyang Li, Junbing Yan, Taolin Zhang, Chengyu Wang, Xiaofeng He, Longtao Huang, Hui Xue, Jun Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00357 2024-06-21 cs.CV 88%

Safety of Multimodal Large Language Models on Images and Texts

Xin Liu, Yichen Zhu, Yunshi Lan, Chao Yang, Yu Qiao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted at IJCAI2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06090 2024-06-21 cs.SD eess.AS 88%

Can Large Language Models Aid in Annotating Speech Emotional Data? Uncovering New Frontiers

Siddique Latif, Muhammad Usama, Mohammad Ibrahim Malik, Björn W. Schuller

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted in IEEE Computational Intelligence Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12800 2024-06-19 cs.CR 88%

Supporting Human Raters with the Detection of Harmful Content using Large Language Models

Kurt Thomas, Patrick Gage Kelley, David Tao, Sarah Meiklejohn, Owen Vallis, Shunwen Tan, Blaž Bratanič, Felipe Tiengo Ferreira, Vijay Kumar Eranti, Elie Bursztein

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09781 2024-06-17 cs.CV 88%

GPT-4o: Visual perception performance of multimodal large language models in piglet activity understanding

Yiqi Wu, Xiaodan Hu, Ziming Fu, Siling Zhou, Jiangong Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14211 2024-06-17 cs.LG cs.AI cs.CL cs.CR cs.SE 88%

LUNA: A Model-Based Universal Analysis Framework for Large Language Models

Da Song, Xuan Xie, Jiayang Song, Derui Zhu, Yuheng Huang, Felix Juefei-Xu, Lei Ma

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 34 pages, 13 figures, To appear in Transactions on Software Engineering (Journal First)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19216 2024-06-11 cs.IR 88%

Are Large Language Models Good at Utility Judgments?

Hengran Zhang, Ruqing Zhang, Jiafeng Guo, Maarten de Rijke, Yixing Fan, Xueqi Cheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Acctepted by SIGIR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03660 2024-06-07 cs.SE 88%

Refactoring to Pythonic Idioms: A Hybrid Knowledge-Driven Approach Leveraging Large Language Models

Zejun Zhang, Zhenchang Xing, Xiaoxue Ren, Qinghua Lu, Xiwei Xu

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments Accepted by FSE 2024,22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03446 2024-06-04 cs.CR 88%

SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence

Hangyuan Ji, Jian Yang, Linzheng Chai, Chaoren Wei, Liqun Yang, Yunlong Duan, Yunli Wang, Tianzhen Sun, Hongcheng Guo, Tongliang Li, Changyu Ren, Zhoujun Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15131 2024-05-27 cond-mat.mtrl-sci cond-mat.str-el 88%

Computational toolkit for predicting thickness of 2D materials using machine learning and autogenerated dataset by large language model

Chinedu Ekuma

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14487 2024-05-24 cs.CR 88%

A Comprehensive Overview of Large Language Models (LLMs) for Cyber Defences: Opportunities and Directions

Mohammed Hassanin, Nour Moustafa

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11048 2024-05-21 cs.HC 88%

Exploring Subjectivity for more Human-Centric Assessment of Social Biases in Large Language Models

Paula Akemi Aoyagui, Sharon Ferguson, Anastasia Kuzminykh

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments HEAL Workshop at CHI Conference on Human Factors in Computing Systems, May 12, 2024, Honolulu, HI, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00593 2024-05-09 cs.SE 88%

Isolating Compiler Bugs by Generating Effective Witness Programs with Large Language Models

Haoxin Tu, Zhide Zhou, He Jiang, Imam Nur Bani Yusuf, Yuxian Li, Lingxiao Jiang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by IEEE Transactions on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03097 2024-05-07 cs.LG cs.AI cs.CL 88%

To Each (Textual Sequence) Its Own: Improving Memorized-Data Unlearning in Large Language Models

George-Octavian Barbulescu, Peter Triantafillou

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published as a conference paper at ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00435 2024-05-02 cs.HC 88%

CultiVerse: Towards Cross-Cultural Understanding for Paintings with Large Language Model

Wei Zhang, Wong Kam-Kwai, Biying Xu, Yiwen Ren, Yuhuai Li, Minfeng Zhu, Yingchaojie Feng, Wei Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16790 2024-04-26 cs.CV 88%

SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension

Bohao Li, Yuying Ge, Yi Chen, Yixiao Ge, Ruimao Zhang, Ying Shan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14801 2024-04-24 cs.CV 88%

DesignProbe: A Graphic Design Benchmark for Multimodal Large Language Models

Jieru Lin, Danqing Huang, Tiejun Zhao, Dechen Zhan, Chin-Yew Lin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13053 2024-04-23 cond-mat.mtrl-sci 88%

Harnessing Large Language Model to collect and analyze Metal-organic framework property dataset

Wonseok Lee, Yeonghun Kang, Taeun Bae, Jihan Kim

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17830 2024-03-27 cs.CV 88%

Assessment of Multimodal Large Language Models in Alignment with Human Values

Zhelun Shi, Zhipin Wang, Hongxing Fan, Zaibin Zhang, Lijun Li, Yongting Zhang, Zhenfei Yin, Lu Sheng, Yu Qiao, Jing Shao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments arXiv admin note: text overlap with arXiv:2311.02692

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10103 2024-03-22 cs.CV 88%

GSVA: Generalized Segmentation via Multimodal Large Language Models

Zhuofan Xia, Dongchen Han, Yizeng Han, Xuran Pan, Shiji Song, Gao Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by CVPR2024 (19 pages, 9 figures, 11 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13324 2024-03-21 cs.CV 88%

Out-of-Distribution Detection Using Peer-Class Generated by Large Language Model

K Huang, G Song, Hanwen Su, Jiyan Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13139 2024-03-21 cs.HC 88%

Generating Automatic Feedback on UI Mockups with Large Language Models

Peitong Duan, Jeremy Warner, Yang Li, Bjoern Hartmann

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments To appear at ACM CHI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12446 2024-03-20 cs.SE cs.CR 88%

On the effectiveness of Large Language Models for GitHub Workflows

Xinyu Zhang, Siddharth Muralee, Sourag Cherupattamoolayil, Aravind Machiry

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12357 2024-03-07 cs.SE cs.CR 88%

Large Language Models for Code Analysis: Do LLMs Really Do Their Job?

Chongzhou Fang, Ning Miao, Shaurya Srivastav, Jialin Liu, Ruoyu Zhang, Ruijie Fang, Asmita, Ryan Tsang, Najmeh Nazari, Han Wang, Houman Homayoun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by Usenix Security 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07221 2024-03-05 cs.SE 88%

Software Testing with Large Language Models: Survey, Landscape, and Vision

Junjie Wang, Yuchao Huang, Chunyang Chen, Zhe Liu, Song Wang, Qing Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments accepted by IEEE Transactions on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏