arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32271 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32271 篇

2402.16445 2025-09-16 cs.CE q-bio.BM 88%

ProLLaMA: A Protein Large Language Model for Multi-Task Protein Language Processing

Liuzhenghao Lv, Zongying Lin, Hao Li, Yuyang Liu, Jiaxi Cui, Calvin Yu-Chian Chen, Li Yuan, Yonghong Tian

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract)

Comments IEEE Transactions on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19662 2025-09-12 physics.ed-ph 88%

Multimodal large language models and physics visual tasks: comparative analysis of performance and costs

Giulia Polverini, Bor Gregorcic

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08024 2025-09-11 cs.CV cs.CY 88%

Two Stage Context Learning with Large Language Models for Multimodal Stance Detection on Climate Change

Lata Pangtey, Omkar Kabde, Shahid Shafi Dar, Nagendra Kumar

机构 * Department of Computer Science and Engineering, Indian Institute of Technology (IIT) Indore(计算机科学与工程系,印度理工学院(IIT)印多尔) Chaitanya Bharathi Institute of Technology, Gandipet, Hyderabad, 500075(恰伊坦尼亚·巴哈提技术学院,加迪皮特,海得拉巴,500075)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04644 2025-09-08 cs.SE 88%

Comparative Evaluation of Large Language Models for Test-Skeleton Generation

Subhang Boorlagadda, Nitya Naga Sai Atluri, Muhammet Mustafa Olmez, Edward F. Gehringer

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Forthcoming in Frontiers in Education (FIE 2025), Nashville, Tennessee, USA, Nov 2-5, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03021 2025-09-04 eess.AS cs.SD 88%

A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models

Ryandhimas E. Zezario, Dyah A. M. G. Wisnu, Hsin-Min Wang, Yu Tsao

机构 * Academia Sinica(中国科学院) National Chengchi University(中正大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted to IEEE ICCE-TW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17571 2025-08-26 cs.IR 88%

A Universal Framework for Offline Serendipity Evaluation in Recommender Systems via Large Language Models

Yu Tokutake, Kazushi Okamoto, Kei Harada, Atsushi Shibata, Koki Karube

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Journal ref The 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16074 2025-08-25 cs.NI 88%

Congestion Control System Optimization with Large Language Models

Zhiyuan He, Aashish Gottipati, Lili Qiu, Yuqing Yang, Francis Y. Yan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10922 2025-08-18 cs.CV 88%

A Survey on Video Temporal Grounding with Multimodal Large Language Model

Jianlong Wu, Wei Liu, Ye Liu, Meng Liu, Liqiang Nie, Zhouchen Lin, Chang Wen Chen

机构 * School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Computer Science and Technology, Shandong Jianzhu University(山东建筑大学计算机科学与技术学院) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 20 pages,6 figures,survey

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07818 2025-08-12 cs.CV 88%

Segmenting and Understanding: Region-aware Semantic Attention for Fine-grained Image Quality Assessment with Large Language Models

Chenyue Song, Chen Hui, Haiqi Zhu, Feng Jiang, Yachun Mi, Wei Zhang, Shaohui Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16104 2025-08-12 cs.CY 88%

Beauty and the Bias: Exploring the Impact of Attractiveness on Multimodal Large Language Models

Aditya Gulati, Moreno D'Incà, Nicu Sebe, Bruno Lepri, Nuria Oliver

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 39 pages, 4 figures, 33 tables; Accepted for publication at the Eighth AAAI/ACM Conference on AI, Ethics and Society (AIES 2025) (https://www.aies-conference.com/2025/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05602 2025-08-08 cs.CV 88%

LLaVA-RE: Binary Image-Text Relevancy Evaluation with Multimodal Large Language Model

Tao Sun, Oliver Liu, JinJin Li, Lan Ma

机构 * Stony Brook University(斯通布罗克大学) Amazon(亚马逊)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Published in the First Workshop of Evaluation of Multi-Modal Generation 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04448 2025-08-07 cs.SE 88%

Large Language Models Versus Static Code Analysis Tools: A Systematic Benchmark for Vulnerability Detection

Damian Gnieciak, Tomasz Szandala

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04059 2025-08-07 cs.CV 88%

Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models

Zhaochen Liu, Kaiwen Gao, Shuyi Liang, Bin Xiao, Limeng Qiao, Lin Ma, Tingting Jiang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00726 2025-08-04 cs.CV 88%

MIHBench: Benchmarking and Mitigating Multi-Image Hallucinations in Multimodal Large Language Models

Jiale Li, Mingrui Wu, Zixiang Jin, Hao Chen, Jiayi Ji, Xiaoshuai Sun, Liujuan Cao, Rongrong Ji

机构 * Xiamen University(厦门大学) Zhongguancun Academy(中关村学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments ACM MM25 has accepted this paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20995 2025-07-29 cs.CY cs.SY eess.SY 88%

VArsity: Can Large Language Models Keep Power Engineering Students in Phase?

Samuel Talkington, Daniel K. Molzahn

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08088 2025-07-28 cs.CR cs.IR 88%

KGV: Integrating Large Language Models with Knowledge Graphs for Cyber Threat Intelligence Credibility Assessment

Zongzong Wu, Fengxiao Tang, Ming Zhao, Yufeng Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12545 2025-07-23 cs.CV 88%

PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models

Zhaopan Xu, Pengfei Zhou, Weidong Tang, Jiaxin Ai, Wangbo Zhao, Kai Wang, Xiaojiang Peng, Wenqi Shao, Hongxun Yao, Kaipeng Zhang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) School of Computer, Harbin Institute of Technology(计算机学院,哈尔滨工业大学) School of Computer, National University of Singapore(计算机学院,国立新加坡大学) School of Computer, Xidian University(计算机学院,西安电子科技大学) College of Big Data and Internet, Shenzhen Technology University(大数据与互联网学院,深圳科技大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07942 2025-07-21 cs.SE 88%

Adversarial Attack Classification and Robustness Testing for Large Language Models for Code

Yang Liu, Armstrong Foundjem, Foutse Khomh, Heng Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23481 2025-07-01 cs.CV eess.IV 88%

Evaluation of Geolocation Capabilities of Multimodal Large Language Models and Analysis of Associated Privacy Risks

Xian Zhang, Xiang Cheng

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing(信息工程测绘遥感国家重点实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20918 2025-06-27 cs.DL cs.ET cs.IR 88%

Metadata Enrichment of Long Text Documents using Large Language Models

Manika Lamba, You Peng, Sophie Nikolov, Glen Layne-Worthey, J. Stephen Downie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15668 2025-06-27 cs.CV 88%

What Do You See? Enhancing Zero-Shot Image Classification with Multimodal Large Language Models

Abdelrahman Abdelhamed, Mahmoud Afifi, Alec Go

机构 * Google Research(谷歌研究)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19624 2025-06-25 cs.CR 88%

Decompiling Smart Contracts with a Large Language Model

Isaac David, Liyi Zhou, Dawn Song, Arthur Gervais, Kaihua Qin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17282 2025-06-24 cs.IR 88%

Automating Financial Statement Audits with Large Language Models

Rushi Wang, Jiateng Liu, Weijie Zhao, Shenglan Li, Denghui Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14297 2025-06-18 cs.SE 88%

Quality Assessment of Python Tests Generated by Large Language Models

Victor Alves, Carla Bezerra, Ivan Machado, Larissa Rocha, Tássio Virgínio, Publio Silva

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments International Conference on Evaluation and Assessment in Software Engineering (EASE), 2025 edition

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13663 2025-06-17 cs.SE 88%

DesignCoder: Hierarchy-Aware and Self-Correcting UI Code Generation with Large Language Models

Yunnong Chen, Shixian Ding, YingYing Zhang, Wenkai Chen, Jinzhou Du, Lingyun Sun, Liuqing Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 11 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11155 2025-06-16 cs.CV 88%

Evaluating Multimodal Large Language Models on Video Captioning via Monte Carlo Tree Search

Linhao Yu, Xinguang Ji, Yahui Liu, Fanheng Kong, Chenxi Sun, Jingyuan Zhang, Hongzhi Zhang, V. W., Fuzheng Zhang, Deyi Xiong

机构 * TJUNLP Lab, College of Intelligence and Computing, Tianjin University(天津大学智能计算学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 28 pages; ACL 2025(main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08282 2025-06-03 cs.CV 88%

LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding

Hongyu Li, Jinyu Chen, Ziyu Wei, Shaofei Huang, Tianrui Hui, Jialin Gao, Xiaoming Wei, Si Liu

机构 * School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Meituan(美团)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19305 2025-06-02 cs.NI 88%

Leveraging Large Language Models to Contextualize Network Measurements

Roman Beltiukov, Karthik Bhattaram, Evania Cheng, Vinod Kanigicherla, Akul Singh, Ken Thampiratwong, Arpit Gupta

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Comments 3 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23987 2025-06-02 cs.LG cs.AI cs.CL q-bio.BM 88%

Large Language Models for Controllable Multi-property Multi-objective Molecule Optimization

Vishal Dey, Xiao Hu, Xia Ning

机构 * Department of Computer Science and Engineering, The Ohio State University, USA(计算机科学与工程系,俄亥俄州立大学) Translational Data Analytics Institute, The Ohio State University, USA(转化数据分析研究所,俄亥俄州立大学) Department of Biomedical Informatics, The Ohio State University, USA(生物医学信息学系,俄亥俄州立大学) College of Pharmacy, The Ohio State University, USA(药学院,俄亥俄州立大学)

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21741 2025-05-29 cs.MA cs.CY cs.IR 88%

AI-Supported Platform for System Monitoring and Decision-Making in Nuclear Waste Management with Large Language Models

Dongjune Chang, Sola Kim, Young Soo Park

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Journal ref Proceedings of the WM2025 Conference, March 9-13, 2025, Phoenix, Arizona, USA

详情

展开后加载摘要…

URL PDF HTML 收藏