arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32413 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32413 篇

2411.13738 2024-11-22 cs.CL cs.LG 86%

Assessing Gender Bias in LLMs: Comparing LLM Outputs with Human Perceptions and Official Statistics

Tetiana Bas

机构 * Minerva University(密涅瓦大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments under review for Coling conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09955 2024-11-22 cs.CV cs.AI cs.HC cs.LG cs.MM 86%

Instruction-Guided Editing Controls for Images and Multimedia: A Survey in LLM era

Thanh Tam Nguyen, Zhao Ren, Trinh Pham, Thanh Trung Huynh, Phi Le Nguyen, Hongzhi Yin, Quoc Viet Hung Nguyen

机构 * Griffith University(格里菲斯大学) University of Bremen(不来梅大学) Ho Chi Minh City University of Technology(胡志明市技术大学) École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) Hanoi University of Science and Technology(河内科技大学) The University of Queensland(昆士兰大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Fixed a serious error in author information

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16937 2024-11-19 cs.CL cs.AI 86%

A Complete Survey on LLM-based AI Chatbots

Sumit Kumar Dam, Choong Seon Hong, Yu Qiao, Chaoning Zhang

机构 * School of Computing, Kyung Hee University(庆熙大学计算机学院)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 23 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17632 2024-11-12 cs.CL cs.AI 86%

LMLPA: Language Model Linguistic Personality Assessment

Jingyao Zheng, Xian Wang, Simo Hosio, Xiaoxian Xu, Lik-Hang Lee

机构 * Hong Kong Polytechnic University(香港理工大学) University of Oulu(奥卢大学) University of Cambridge(剑桥大学)

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12649 2024-11-04 cs.LG cs.AI cs.CV stat.ML 86%

Probabilistic Conceptual Explainers: Trustworthy Conceptual Explanations for Vision Foundation Models

Hengyi Wang, Shiwei Tan, Hao Wang

机构 * Rutgers University(罗格斯大学)

专题命中 评测与基准 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Proceedings of the 41st International Conference on Machine Learning (ICML 2024)

Journal ref PMLR 235:51502-51522, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13185 2024-10-31 cs.AI cs.CL 86%

Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents

Long Li, Weiwen Xu, Jiayan Guo, Ruochen Zhao, Xingxuan Li, Yuqian Yuan, Boqiang Zhang, Yuming Jiang, Yifei Xin, Ronghao Dang, Deli Zhao, Yu Rong, Tian Feng, Lidong Bing

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages,5 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21330 2024-10-30 cs.CL cs.AI 86%

LLM Robustness Against Misinformation in Biomedical Question Answering

Alexander Bondarenko, Adrian Viehweger

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15440 2024-10-22 cs.CL cs.AI 86%

Evaluating Consistencies in LLM responses through a Semantic Clustering of Question Answering

Yanggyu Lee, Jihie Kim

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to the Trustworthy AI Workshop at IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04808 2024-10-21 cs.CR cs.CL cs.LG 86%

WaterMax: breaking the LLM watermark detectability-robustness-quality trade-off

Eva Giboulot, Teddy Furon

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11594 2024-10-16 cs.LG cs.AI 86%

Black-box Uncertainty Quantification Method for LLM-as-a-Judge

Nico Wagner, Michael Desmond, Rahul Nair, Zahra Ashktorab, Elizabeth M. Daly, Qian Pan, Martín Santillán Cooper, James M. Johnson, Werner Geyer

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10215 2024-10-15 cs.CL cs.LG 86%

SkillAggregation: Reference-free LLM-Dependent Aggregation

Guangzhi Sun, Anmol Kagrecha, Potsawee Manakul, Phil Woodland, Mark Gales

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05975 2024-10-15 cs.CL cs.AI 86%

LLaMAX: Scaling Linguistic Horizons of LLM by Enhancing Translation Capabilities Beyond 100 Languages

Yinquan Lu, Wenhao Zhu, Lei Li, Yu Qiao, Fei Yuan

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

Comments EMNLP 2024 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00273 2024-10-15 cs.CR cs.AI cs.CL 86%

Mark My Words: Analyzing and Evaluating Language Model Watermarks

Julien Piet, Chawin Sitawarin, Vivian Fang, Norman Mu, David Wagner

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 22 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04587 2024-10-11 cs.LG cs.AI cs.SE 86%

Hammer: Robust Function-Calling for On-Device Language Models via Function Masking

Qiqiang Lin, Muning Wen, Qiuying Peng, Guanyu Nie, Junwei Liao, Jun Wang, Xiaoyun Mo, Jiamu Zhou, Cheng Cheng, Yin Zhao, Jun Wang, Weinan Zhang

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16022 2024-10-10 cs.CL cs.AI 86%

AI Can Be Cognitively Biased: An Exploratory Study on Threshold Priming in LLM-Based Batch Relevance Assessment

Nuo Chen, Jiqun Liu, Xiaoyu Dong, Qijiong Liu, Tetsuya Sakai, Xiao-Ming Wu

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05224 2024-10-08 cs.CL cs.LG 86%

Cookbook: A framework for improving LLM generative abilities via programmatic data generating templates

Avanika Narayan, Mayee F. Chen, Kush Bhatia, Christopher Ré

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01579 2024-10-03 cs.CL cs.AI 86%

Spoken Grammar Assessment Using LLM

Sunil Kumar Kopparapu, Chitralekha Bhat, Ashish Panda

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01458 2024-10-03 cs.AI cs.LG 86%

From Reward Shaping to Q-Shaping: Achieving Unbiased Learning with LLM-Guided Knowledge

Xiefeng Wu

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments q-shaping, reinforcement learning, reward shaping

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11634 2024-10-01 cs.CL cs.AI 86%

The Base-Rate Effect on LLM Benchmark Performance: Disambiguating Test-Taking Strategies from Benchmark Performance

Kyle Moore, Jesse Roberts, Thao Pham, Oseremhen Ewaleifoh, Doug Fisher

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02872 2024-09-26 cs.CL cs.LG 86%

How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning

Zeping Yu, Sophia Ananiadou

专题命中 评测与基准 :large language model(title,comments);language model(title,comments);分类 cs.CL、cs.LG

Comments Accepted by EMNLP 2024 main. Mechanistic interpretability for in-contexting in large language models

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12623 2024-09-25 cs.CL cs.AI 86%

CamelEval: Advancing Culturally Aligned Arabic Language Models and Benchmarks

Zhaozhi Qian, Faroq Altam, Muhammad Alqurishi, Riad Souissi

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18088 2024-09-25 cs.CL cs.AI cs.SD eess.AS 86%

LLM-Driven Multimodal Opinion Expression Identification

Bonian Jia, Huiyao Chen, Yueheng Sun, Meishan Zhang, Min Zhang

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 3 Figures, Accept by Interspeech 2024

Journal ref Proceedings of Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09682 2024-09-25 cs.CL cs.AI 86%

Multi-News+: Cost-efficient Dataset Cleansing via LLM-based Data Annotation

Juhwan Choi, Jungmin Yun, Kyohoon Jin, YoungBin Kim

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024: Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15027 2024-09-24 cs.CL cs.AI 86%

Generative LLM Powered Conversational AI Application for Personalized Risk Assessment: A Case Study in COVID-19

Mohammad Amin Roshani, Xiangyu Zhou, Yao Qiang, Srinivasan Suresh, Steve Hicks, Usha Sethuraman, Dongxiao Zhu

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08105 2024-09-24 cs.LG cs.CL 86%

DiLoCo: Distributed Low-Communication Training of Language Models

Arthur Douillard, Qixuan Feng, Andrei A. Rusu, Rachita Chhaparia, Yani Donchev, Adhiguna Kuncoro, Marc'Aurelio Ranzato, Arthur Szlam, Jiajun Shen

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10576 2024-09-19 cs.CL cs.IR cs.LG 86%

Language Models and Retrieval Augmented Generation for Automated Structured Data Extraction from Diagnostic Reports

Mohamed Sobhi Jabal, Pranav Warman, Jikai Zhang, Kartikeye Gupta, Ayush Jain, Maciej Mazurowski, Walter Wiggins, Kirti Magudia, Evan Calabrese

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11449 2024-09-19 cs.LG cs.AI cs.IR cs.SD eess.AS 86%

Evaluation of pretrained language models on music understanding

Yannis Vasilakis, Rachel Bittner, Johan Pauwels

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09989 2024-09-17 cs.CL cs.AI cs.CY cs.HC 86%

Comprehensive Study on Sentiment Analysis: From Rule-based to modern LLM based system

Shailja Gupta, Rajesh Ranjan, Surya Narayan Singh

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 2 Images

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09615 2024-09-17 cs.CL cs.AI 86%

Enhancing Text Annotation through Rationale-Driven Collaborative Few-Shot Prompting

Jianfei Wu, Xubin Wang, Weijia Jia

专题命中 评测与基准 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11322 2024-09-17 cs.CL cs.AI 86%

StateFlow: Enhancing LLM Task-Solving through State-Driven Workflows

Yiran Wu, Tianwei Yue, Shaokun Zhang, Chi Wang, Qingyun Wu

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏