arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32096 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32096 篇

2405.04652 2024-05-09 cs.HC 89%

AffirmativeAI: Towards LGBTQ+ Friendly Audit Frameworks for Large Language Models

Yinru Long, Zilin Ma, Yiyang Mei, Zhaoyuan Su

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13236 2024-05-06 cs.DC cs.ET 89%

LLMChain: Blockchain-based Reputation System for Sharing and Evaluating Large Language Models

Mouhamed Amine Bouchiha, Quentin Telnoff, Souhail Bakkali, Ronan Champagnat, Mourad Rabah, Mickaël Coustaty, Yacine Ghamri-Doudane

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Paper accepted at IEEE 48th Annual Computers, Software, and Applications Conference (COMPSAC) IEEE, Osaka, Japan (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18824 2024-04-30 cs.CL cs.AI cs.LG 89%

Benchmarking Benchmark Leakage in Large Language Models

Ruijie Xu, Zengzhi Wang, Run-Ze Fan, Pengfei Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 30 pages; Homepage: https://gair-nlp.github.io/benbench

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18746 2024-04-30 cs.MM cs.CV 89%

Enhancing Interactive Image Retrieval With Query Rewriting Using Large Language Models and Vision Language Models

Hongyi Zhu, Jia-Hong Huang, Stevan Rudinac, Evangelos Kanoulas

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17607 2024-04-30 cs.IR cs.AI cs.CL cs.LG cs.SI 89%

Utilizing Large Language Models to Identify Reddit Users Considering Vaping Cessation for Digital Interventions

Sai Krishna Revanth Vuruma, Dezhi Wu, Saborny Sen Gupta, Lucas Aust, Valerie Lookingbill, Caleb Henry, Yang Ren, Erin Kasson, Li-Shiun Chen, Patricia Cavazos-Rehg, Dian Hu, Ming Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16651 2024-04-26 cs.CR 89%

Evolutionary Large Language Models for Hardware Security: A Comparative Survey

Mohammad Akyash, Hadi Mardani Kamali

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08475 2024-04-19 cs.CL cs.AI cs.CV cs.LG cs.MM 89%

Can We Edit Multimodal Large Language Models?

Siyuan Cheng, Bozhong Tian, Qingbin Liu, Xi Chen, Yongheng Wang, Huajun Chen, Ningyu Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023. Add the Exact Match/Accuracy results of Reliability and T-Generality

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05836 2024-04-18 cs.CL cs.AI cs.LG 89%

Can Large Language Models Infer Causation from Correlation?

Zhijing Jin, Jiarui Liu, Zhiheng Lyu, Spencer Poff, Mrinmaya Sachan, Rada Mihalcea, Mona Diab, Bernhard Schölkopf

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09717 2024-04-16 cs.CL cs.AI cs.LG 89%

Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model

Hyunsoo Cho

专题命中 评测与基准 :language model(title,abstract);large language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under review @ *ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09254 2024-04-16 cs.CV 89%

TEXT2TASTE: A Versatile Egocentric Vision System for Intelligent Reading Assistance Using Large Language Model

Wiktor Mucha, Florin Cuconasu, Naome A. Etori, Valia Kalokyri, Giovanni Trappolini

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ICCHP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09432 2024-04-05 cs.CL cs.AI cs.LG 89%

RoleCraft-GLM: Advancing Personalized Role-Playing in Large Language Models

Meiling Tao, Xuechen Liang, Tianyu Shi, Lei Yu, Yiting Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14801 2024-04-04 q-bio.QM 89%

Assessing the Utility of Large Language Models for Phenotype-Driven Gene Prioritization in Rare Genetic Disorder Diagnosis

Junyoung Kim, Jingye Yang, Kai Wang, Chunhua Weng, Cong Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 56 pages, 6 figures, 6 tables, 2 supplementary tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16417 2024-03-26 cs.NE 89%

Leveraging Large Language Model to Generate a Novel Metaheuristic Algorithm with CRISPE Framework

Rui Zhong, Yuefeng Xu, Chao Zhang, Jun Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15281 2024-03-25 econ.GN q-fin.EC 89%

Measuring Gender and Racial Biases in Large Language Models

Jiafu An, Difang Huang, Chen Lin, Mingzhu Tai

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13925 2024-03-22 cs.CL cs.AI cs.LG 89%

Reducing Large Language Model Bias with Emphasis on 'Restricted Industries': Automated Dataset Augmentation and Prejudice Quantification

Devam Mondal, Carlo Lipizzi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09906 2024-03-18 cs.SE 89%

Reality Bites: Assessing the Realism of Driving Scenarios with Large Language Models

Jiahui Wu, Chengjie Lu, Aitor Arrieta, Tao Yue, Shaukat Ali

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05156 2024-03-15 cs.CR 89%

On Protecting the Data Privacy of Large Language Models (LLMs): A Survey

Biwei Yan, Kun Li, Minghui Xu, Yueyan Dong, Yue Zhang, Zhaochun Ren, Xiuzhen Cheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12366 2024-02-20 cs.LG cs.AI cs.CL 89%

A Critical Evaluation of AI Feedback for Aligning Large Language Models

Archit Sharma, Sedrick Keh, Eric Mitchell, Chelsea Finn, Kushal Arora, Thomas Kollar

专题命中 评测与基准 :language model(title,abstract);large language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07910 2024-02-14 cs.HC 89%

Experimental Interface for Multimodal and Large Language Model Based Explanations of Educational Recommender Systems

Hasan Abu-Rasheed, Christian Weber, Madjid Fathi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14890 2024-02-13 cs.AI cs.CC cs.CL cs.LG 89%

NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes

Lizhou Fan, Wenyue Hua, Lingyao Li, Haoyang Ling, Yongfeng Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 23 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05952 2024-02-12 cs.LG cs.AI cs.CL 89%

Advancing Graph Representation Learning with Large Language Models: A Comprehensive Survey of Techniques

Qiheng Mao, Zemin Liu, Chenghao Liu, Zhuo Li, Jianling Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04088 2024-02-07 cs.CL cs.AI cs.LG stat.AP 89%

The Use of a Large Language Model for Cyberbullying Detection

Bayode Ogunleye, Babitha Dharmaraj

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, Journal of Analytics

Journal ref Analytics 2 (2023), no. 3: 694-707

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03396 2024-02-07 cs.SE cs.AI cs.CL cs.CR cs.LG 89%

UniTSyn: A Large-Scale Dataset Capable of Enhancing the Prowess of Large Language Models for Program Testing

Yifeng He, Jiabo Huang, Yuyang Rong, Yiwen Guo, Ethan Wang, Hao Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15812 2024-02-07 cs.LG cs.AI cs.CL 89%

Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models

Hritik Bansal, John Dang, Aditya Grover

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 31 pages, Accepted to ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13802 2024-01-31 cs.SE cs.AI cs.CL cs.LG 89%

Investigating the Efficacy of Large Language Models for Code Clone Detection

Mohamad Khajezade, Jie JW Wu, Fatemeh Hendijani Fard, Gema Rodríguez-Pérez, Mohamed Sami Shehata

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09631 2024-01-29 cs.IR 89%

Context-Driven Interactive Query Simulations Based on Generative Large Language Models

Björn Engelmann, Timo Breuer, Jana Isabelle Friese, Philipp Schaer, Norbert Fuhr

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ECIR 2024 (Full Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10529 2024-01-26 cs.CV cs.AI cs.CL cs.LG 89%

Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences

Xiyao Wang, Yuhang Zhou, Xiaoyu Liu, Hongjin Lu, Yuancheng Xu, Feihong He, Jaehong Yoon, Taixi Lu, Gedas Bertasius, Mohit Bansal, Huaxiu Yao, Furong Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08329 2024-01-17 cs.HC 89%

Understanding User Experience in Large Language Model Interactions

Jiayin Wang, Weizhi Ma, Peijie Sun, Min Zhang, Jian-Yun Nie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 15 pages + 3 page references + 2 page Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03109 2024-01-17 cs.SE 89%

Lost in Translation: A Study of Bugs Introduced by Large Language Models while Translating Code

Rangeet Pan, Ali Reza Ibrahimzada, Rahul Krishna, Divya Sankar, Lambert Pouguem Wassi, Michele Merler, Boris Sobolev, Raju Pavuluri, Saurabh Sinha, Reyhaneh Jabbarvand

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Published in ICSE 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17147 2024-01-12 cs.CL cs.AI cs.HC cs.LG 89%

Heterogeneous Value Alignment Evaluation for Large Language Models

Zhaowei Zhang, Ceyao Zhang, Nian Liu, Siyuan Qi, Ziqi Rong, Song-Chun Zhu, Shuguang Cui, Yaodong Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments v3 is the camera-ready version for AAAI-24 Workshop on Public Sector LLMs: Algorithmic and Sociotechnical Design. 7 pages of main content, 1 page of references, 3 pages of appendices, and 7 figures. Our full prompts are released in the repo: https://github.com/zowiezhang/HVAE

详情

展开后加载摘要…

URL PDF HTML 收藏