arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-05 至 2025-08-05 共收录 84 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 84 篇

2508.02429 2025-08-05 cs.AI cs.LG 92%

Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting

Miaosen Luo, Jiesen Long, Zequn Li, Yunying Yang, Yuncheng Jiang, Sijie Mai

机构 * School of Computer Science, South China Normal University(华南师范大学计算机科学学院) School of Information Technology in Education, South China Normal University(华南师范大学教育信息技术学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02312 2025-08-05 cs.CR cs.AI 90%

A Survey on Data Security in Large Language Models

Kang Chen, Xiuze Zhou, Yuanguo Lin, Jinhe Su, Yuanhui Yu, Li Shen, Fan Lin

机构 * School of Computer Engineering, Jimei University, Xiamen, 361021, China(厦门大学计算机工程学院) College of Science, Mathematics and Technology, Wenzhou-Kean University, Wenzhou, 325060, China(温州-凯恩大学科学、数学与技术学院) The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, 511453, China(香港科学与技术大学(广州)) School of Professional Studies, New York University, New York, 10003, United States(纽约大学专业研究学院) School of Informatics, Xiamen University, Xiamen, 361102, China(厦门大学信息学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01708 2025-08-05 cs.CL 90%

Am I Blue or Is My Hobby Counting Teardrops? Expression Leakage in Large Language Models as a Symptom of Irrelevancy Disruption

Berkay Köprü, Mehrzad Mashal, Yigit Gurses, Akos Kadar, Maximilian Schmitt, Ditty Mathew, Felix Burkhardt, Florian Eyben, Björn W. Schuller

机构 * audEERING GmbH(audEERING公司) Agile Robots SE(Agile Robots公司) Chair of Health Informatics, Technical University of Munich(技术大学慕尼黑健康信息学系) Group on Language, Audio & Music, Imperial College London(伦敦帝国学院语言、音频与音乐组)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18182 2025-08-05 cs.CL cs.AI 90%

SCOPE: Stochastic and Counterbiased Option Placement for Evaluating Large Language Models

Wonjun Jeong, Dongseok Kim, Taegkeun Whangbo

机构 * Department of Computer Engineering(计算机工程系) Gachon University(高城大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Comments: 34 pages, 1 figure. v2: All "Consequence." statements in the Theoretical Analysis section relabeled as "Corollary."; duplicated values in Table 20 (previously identical to Table 15) corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02430 2025-08-05 cs.CL 89%

AI-Based Measurement of Innovation: Mapping Expert Insight into Large Language Model Applications

Robin Nowak, Patrick Figge, Carolin Haeussler

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01514 2025-08-05 cs.IR cs.LG 89%

End-to-End Personalization: Unifying Recommender Systems with Large Language Models

Danial Ebrat, Tina Aminian, Sepideh Ahmadian, Luis Rueda

机构 * University of Windsor(温莎大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments Second Workshop on Generative AI for Recommender Systems and Personalization at the ACM Conference on Knowledge Discovery and Data Mining (GenAIRecP@KDD 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22952 2025-08-05 cs.HC cs.CV cs.LG 89%

Automated Label Placement on Maps via Large Language Models

Harry Shomer, Jiejun Xu

机构 * University of Texas at Arlington(德克萨斯理工大学) HRL Laboratories(HRL实验室)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.LG

Comments Workshop on AI for Data Editing (AI4DE) at KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10852 2025-08-05 cs.CL 89%

LLMs on Trial: Evaluating Judicial Fairness for Large Language Models

Yiran Hu, Zongyue Xue, Haitao Li, Siyuan Zheng, Qingjing Chen, Shaochun Wang, Xihan Zhang, Ning Zheng, Yun Liu, Qingyao Ai, Yiqun Liu, Charles L. A. Clarke, Weixing Shen

机构 * Tsinghua University, China(清华大学) University of Waterloo, Canada(滑铁卢大学) Yale Law School, USA(耶鲁法学院) Shanghai Jiao Tong University, China(上海交通大学) University of Bologna, Italy(博洛尼亚大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12934 2025-08-05 cs.SE cs.LG 89%

Correctness Assessment of Code Generated by Large Language Models Using Internal Representations

Tuan-Dung Bui, Thanh Trong Vu, Thu-Trang Nguyen, Son Nguyen, Hieu Dinh Vo

机构 * Faculty of Information Technology, VNU University of Engineering and Technology(信息科技学院,越南工程大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12307 2025-08-05 cs.CL 89%

Can Tool-augmented Large Language Models be Aware of Incomplete Conditions?

Seungbin Yang, ChaeHun Park, Taehee Kim, Jaegul Choo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01451 2025-08-05 cs.CR cs.SE 89%

Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models

Mohammed Sayagh, Mohammad Ghafari

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01402 2025-08-05 cs.CV 89%

ForenX: Towards Explainable AI-Generated Image Detection with Multimodal Large Language Models

Chuangchuang Tan, Jinglu Wang, Xiang Ming, Renshuai Tao, Yunchao Wei, Yao Zhao, Yan Lu

机构 * Beijing Jiaotong University(北京交通大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01554 2025-08-05 cs.CL cs.AI cs.CR 88%

Are All Prompt Components Value-Neutral? Understanding the Heterogeneous Adversarial Robustness of Dissected Prompt in Large Language Models

Yujia Zheng, Tianhao Li, Haotian Huang, Tianyu Zeng, Jingyu Lu, Chuangxin Chu, Yuekai Huang, Ziyou Jiang, Qian Xiong, Yuyao Ge, Mingyang Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01006 2025-08-05 cs.CL 88%

UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu

Farah Adeeba, Brian Dillon, Hassan Sajjad, Rajesh Bhatt

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16326 2025-08-05 cs.LG 88%

ChemMLLM: Chemical Multimodal Large Language Model

Qian Tan, Dongzhan Zhou, Peng Xia, Wanhao Liu, Wanli Ouyang, Lei Bai, Yuqiang Li, Tianfan Fu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19166 2025-08-05 cs.SE cs.LG 88%

CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation

Kaiwen Yan, Hongcheng Guo, Xuanqing Shi, Shaosheng Cao, Donglin Di, Zhoujun Li

机构 * Beihang University(北航大学) Tsinghua University(清华大学) Xiaohongshu(小红书)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted as an ACL 2025 Industry Track paper (15 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01685 2025-08-05 cs.LG cs.CR 87%

Innovative tokenisation of structured data for LLM training

Kayvan Karim, Hani Ragab Hassen. Hadj Batatia

机构 * School of Mathematics and Computer Science(数学与计算机科学学院)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10342 2025-08-05 cs.CV cs.AI 86%

UrbanSense:A Framework for Quantitative Analysis of Urban Streetscapes leveraging Vision Large Language Models

Jun Yin, Jing Zhong, Peilin Li, Ruolin Pan, Pengyu Zeng, Miao Zhang, Shuai Lu

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07739 2025-08-05 cs.CV cs.AI 86%

ArchiLense: A Framework for Quantitative Analysis of Architectural Styles Based on Vision Large Language Models

Jing Zhong, Jun Yin, Peilin Li, Pengyu Zeng, Miao Zang, Ran Luo, Shuai Lu

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01178 2025-08-05 cs.SD cs.AI cs.IR eess.AS 85%

Advancing the Foundation Model for Music Understanding

Yi Jiang, Wei Wang, Xianwen Guo, Huiyun Liu, Hanrui Wang, Youri Xu, Haoqi Gu, Zhongqian Xie, Chuanjiang Luo

专题命中 评测与基准 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01370 2025-08-05 cs.CL cs.IR 85%

MaRGen: Multi-Agent LLM Approach for Self-Directed Market Research and Analysis

Roman Koshkin, Pengyu Dai, Nozomi Fujikawa, Masahito Togami, Marco Visentini-Scarzanella

机构 * Okinawa Institute of Science and Technology(冲绳科学技术研究所) Institute of Science Tokyo(东京科学研究所) Amazon(亚马逊)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01203 2025-08-05 cs.AI 85%

Importance Sampling is All You Need: Predict LLM's performance on new benchmark by reusing existing benchmark

Junjie Shi, Wei Ma, Shi Ying, Lingxiao Jiang, Yang liu, Bo Du

机构 * Nanyang Technological University(南洋理工大学) Singapore Management University(新加坡管理学院) Wuhan University(武汉大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08113 2025-08-05 cs.SE 85%

Test Amplification for REST APIs via Single and Multi-Agent LLM Systems

Robbe Nooyens, Tolgahan Bardakci, Mutlu Beyazit, Serge Demeyer

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02035 2025-08-05 cs.CR 85%

PhishParrot: LLM-Driven Adaptive Crawling to Unveil Cloaked Phishing Sites

Hiroki Nakano, Takashi Koide, Daiki Chiba

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted for publication at IEEE GLOBECOM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01699 2025-08-05 cs.CV 85%

TimeExpert: An Expert-Guided Video LLM for Video Temporal Grounding

Zuhao Yang, Yingchen Yu, Yunqing Zhao, Shijian Lu, Song Bai

机构 * Nanyang Technological University(南洋理工大学) ByteDance Inc.(字节跳动公司)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01357 2025-08-05 cs.SE 85%

HyClone: Bridging LLM Understanding and Dynamic Execution for Semantic Code Clone Detection

Yunhao Liang, Ruixuan Ying, Takuya Taniguchi, Guwen Lyu, Zhe Cui

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01008 2025-08-05 cs.CV 85%

ROVI: A VLM-LLM Re-Captioned Dataset for Open-Vocabulary Instance-Grounded Text-to-Image Generation

Cihang Peng, Qiming Hou, Zhong Ren, Kun Zhou

机构 * State Key Lab of CAD&CG(计算机辅助设计与图形学国家重点实验室)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01556 2025-08-05 cs.AI 83%

Empowering Tabular Data Preparation with Language Models: Why and How?

Mengshi Chen, Yuxiang Sun, Tengchao Li, Jianwei Wang, Kai Wang, Xuemin Lin, Ying Zhang, Wenjie Zhang

机构 * Antai College of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) The University of New South Wales(新南威尔士大学) Zhejiang Gongshang University(浙江工商大学)

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments Preprint under submission, 16 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11715 2025-08-05 cs.HC 82%

ConflictLens: LLM-Based Conflict Resolution Training in Romantic Relationship

Jiwon Chun, Gefei Zhang, Meng Xia

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract)

Comments 2 figures. To appear in a poster at ACM UIST 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04133 2025-08-05 cs.LG cs.AI eess.SP 81%

An Electrocardiogram Foundation Model Built on over 10 Million Recordings with External Evaluation across Multiple Domains

Jun Li, Aaron Aguirre, Junior Moura, Che Liu, Lanhai Zhong, Chenxi Sun, Gari Clifford, Brandon Westover, Shenda Hong

机构 * National Institute of Health Data Science, Peking University(北京大学国家健康数据科学研究院) Department of Cardiology, Massachusetts General Hospital(麻省总医院心内科) Department of Biomedical Informatics, School of Medicine, Emory University(埃默里大学医学院生物医学信息学系) Department of Biomedical Engineering, Georgia Institute of Technology(佐治亚理工学院生物医学工程系) Harvard Medical School(哈佛医学院) Department of Neurology, Beth Israel Deaconess Medical Center(贝斯以色列医疗中心神经科) Department of Computing, Data Science Institute, Imperial College London(伦敦帝国学院计算系、数据科学研究所) Zhongshan School of Medicine, Sun Yat-sen University(中山医学院,孙逸仙大学) Institute of Medical Technology, Peking University Health Science Center(北京大学医学技术研究所,北京大学医学部) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments Code: https://github.com/PKUDigitalHealth/ECGFounder

详情

展开后加载摘要…

URL PDF HTML 收藏