arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-09 至 2025-09-09 共收录 262 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 62 篇

2509.05315 2025-09-09 cs.RO cs.AI cs.CV 88%

Evaluation of Large Language Models for Anomaly Detection in Autonomous Vehicles

Petros Loukas, David Bassir, Savvas Chatzichristofis, Angelos Amanatiadis

机构 * Democritus University of Thrace(德米特里乌斯大学) Dongguan University of Technology(东莞理工大学) ENS-Paris-Saclay University(巴黎-萨克雷大学) Neapolis University Pafos(纳皮奥斯大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15865 2025-09-09 cs.RO cs.AI cs.CL 87%

BeSimulator: A Large Language Model Powered Text-based Behavior Simulator

Jianan Wang, Bin Li, Jingtao Qi, Xueying Wang, Fu Li, Hanxun Li

机构 * College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室)

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 19 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12226 2025-09-09 cs.CL cs.AI cs.CV cs.LG 87%

AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling

Jun Zhan, Junqi Dai, Jiasheng Ye, Yunhua Zhou, Dong Zhang, Zhigeng Liu, Xin Zhang, Ruibin Yuan, Ge Zhang, Linyang Li, Hang Yan, Jie Fu, Tao Gui, Tianxiang Sun, Yu-Gang Jiang, Xipeng Qiu

机构 * Fudan University(复旦大学) Multimodal Art Projection Research Community(多模态艺术投影研究社区) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 28 pages, 16 figures, under review, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05541 2025-09-09 cs.AI 85%

SenseCF: LLM-Prompted Counterfactuals for Intervention and Sensor Data Augmentation

Shovito Barua Soumma, Asiful Arefeen, Stephanie M. Carpenter, Melanie Hingle, Hassan Ghasemzadeh

机构 * College of Health Solutions, Arizona State University(亚利桑那州立大学健康解决方案学院) School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院) School of Nutritional Sciences and Wellness, University of Arizona(亚利桑那大学营养科学与健康学院)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at the IEEE-EMBS International Conference on Body Sensor Networks (IEEE-EMBS BSN) 2025, LA, CA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13384 2025-09-09 cs.AI cs.CY stat.ME stat.OT 85%

Delving Into the Psychology of Machines: Exploring the Structure of Self-Regulated Learning via LLM-Generated Survey Responses

Leonie V. D. E. Vogelsmeier, Eduardo Oliveira, Kamila Misiejuk, Sonsoles López-Pernas, Mohammed Saqr

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05759 2025-09-09 cs.CL 85%

Reinforced Lifelong Editing for Language Models

Zherui Li, Houcheng Jiang, Hao Chen, Baolong Bi, Zhenhong Zhou, Fei Sun, Junfeng Fang, Xiang Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) University of Science and Technology of China(中国科学技术大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) National University of Singapore(新加坡国立大学)

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted by ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06422 2025-09-09 cs.CV 85%

Phantom-Insight: Adaptive Multi-cue Fusion for Video Camouflaged Object Detection with Multimodal LLM

Hua Zhang, Changjiang Luo, Ruoyu Chen

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06382 2025-09-09 cs.HC 85%

Context-Adaptive Hearing Aid Fitting Advisor through Multi-turn Multimodal LLM Conversation

Yingke Ding, Zeyu Wang, Xiyuxing Zhang, Hongbin Chen, Zhenan Xu

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Ubicomp Companion 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05540 2025-09-09 cs.SE cs.AI 84%

Combining TSL and LLM to Automate REST API Testing: A Comparative Study

Thiago Barradas, Aline Paes, Vânia de Oliveira Neves

专题命中 评测与基准 :LLM(title,comments);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, article computer science, software engineering, software testing, ia, llm

Journal ref SBES 2025 39th Brazilian Symposium on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05921 2025-09-09 cs.CR 83%

Dataset Ownership in the Era of Large Language Models

Kun Li, Cheng Wang, Minghui Xu, Yue Zhang, Xiuzhen Cheng

专题命中 评测与基准 :large language model(title);language model(title)

Comments 15 pages, 1 table, accepted by the 2025 International Conference on Blockchain and Web3.0 Technology Innovation and Application Exchange (BWTAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06341 2025-09-09 cs.AI 83%

Evaluating Multi-Turn Bargain Skills in LLM-Based Seller Agent

Issue Yishu Wang, Kakam Chong, Xiaofeng Wang, Xu Yan, DeXin Kong, Chen Ju, Ming Chen, Shuai Xiao, Shuguang Han, jufeng chen

机构 * Johns Hopkins University(约翰霍普金斯大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06609 2025-09-09 cs.LG 79%

A Survey of Generalization of Graph Anomaly Detection: From Transfer Learning to Foundation Models

Junjun Pan, Yu Zheng, Yue Tan, Yixin Liu

机构 * School of ICT Griffith University(信息与通信技术学院 格里菲斯大学) School of CSE University of New South Wales(计算机科学与工程学院 新南威尔士大学)

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.LG

Comments Accepted by ICKG 2025. 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05617 2025-09-09 cs.CL cs.AI 79%

From Joy to Fear: A Benchmark of Emotion Estimation in Pop Song Lyrics

Shay Dahary, Avi Edana, Alexander Apartsin, Yehudit Aperstein

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05792 2025-09-09 physics.data-an 78%

TPCpp-10M: Simulated proton-proton collisions in a Time Projection Chamber for AI Foundation Models

Shuhang Li, Yi Huang, David Park, Xihaier Luo, Haiwang Yu, Yeonju Go, Christopher Pinkenburg, Yuewei Lin, Shinjae Yoo, Joseph Osborn, Christof Roland, Jin Huang, Yihui Ren

专题命中 评测与基准 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06401 2025-09-09 cs.CL 77%

Do LLMs exhibit the same commonsense capabilities across languages?

Ivan Martínez-Murillo, Elena Lloret, Paloma Moreda, Albert Gatt

机构 * University of Alicante(阿利坎特大学) University of Utrecht(乌得勒支大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18791 2025-09-09 cs.CL 77%

CodeMixBench: Evaluating Code-Mixing Capabilities of LLMs Across 18 Languages

Yilun Yang, Yekun Chai

机构 * NUC(南京大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05303 2025-09-09 cs.DC cs.AI 77%

Multi-IaC-Eval: Benchmarking Cloud Infrastructure as Code Across Multiple Formats

Sam Davidson, Li Sun, Bhavana Bhasker, Laurent Callot, Anoop Deoras

机构 * Amazon Web Services(亚马逊网络服务)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06734 2025-09-09 stat.AP 75%

Intelligent Manufacturing Support: Specialized LLMs for Composite Material Processing and Equipment Operation

Gunnika Kapoor, Komal Chawla, Tirthankar Ghosal, Kris Villez, Dan Coughlin, Tyden Rucker, Vincent Paquit, Soydan Ozcan, Seokpum Kim

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14484 2025-09-09 cs.CV 75%

Llama Learns to Direct: DirectorLLM for Human-Centric Video Generation

Kunpeng Song, Tingbo Hou, Zecheng He, Haoyu Ma, Jialiang Wang, Animesh Sinha, Sam Tsai, Yaqiao Luo, Xiaoliang Dai, Li Chen, Xide Xia, Peizhao Zhang, Peter Vajda, Ahmed Elgammal, Felix Juefei-Xu

机构 * GenAI at Meta(Meta 人工智能) Rutgers University(罗格斯大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05719 2025-09-09 cs.CL 74%

Exploring Subjective Tasks in Farsi: A Survey Analysis and Evaluation of Language Models

Donya Rooein, Flor Miriam Plaza-del-Arco, Debora Nozza, Dirk Hovy

机构 * Bocconi University(博科尼大学) Leiden University(莱顿大学)

专题命中 评测与基准 :language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13111 2025-09-09 cs.CV cs.CL cs.LG 73%

MM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs

Erik Daxberger, Nina Wenzel, David Griffiths, Haiming Gang, Justin Lazarow, Gefen Kohavi, Kai Kang, Marcin Eichner, Yinfei Yang, Afshin Dehghan, Peter Grasch

机构 * Apple(苹果公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00102 2025-09-09 cs.CV cs.CL cs.LG 73%

ElectroVizQA: How well do Multi-modal LLMs perform in Electronics Visual Question Answering?

Pragati Shuddhodhan Meshram, Swetha Karthikeyan, Bhavya Bhavya, Suma Bhat

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05716 2025-09-09 cs.CL cs.AI 73%

A Survey of the State-of-the-Art in Conversational Question Answering Systems

Manoj Madushanka Perera, Adnan Mahmood, Kasun Eranda Wijethilake, Fahmida Islam, Maryam Tahermazandarani, Quan Z. Sheng

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 42 pages, 12 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06298 2025-09-09 cs.DB 71%

MCTuner: Spatial Decomposition-Enhanced Database Tuning via LLM-Guided Exploration

Zihan Yan, Rui Xi, Mengshu Hou

专题命中 评测与基准 :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19429 2025-09-09 cs.CL 70%

Rhapsody: A Dataset for Highlight Detection in Podcasts

Younghan Park, Anuj Diwan, David Harwath, Eunsol Choi

机构 * Yonsei University(延世大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) New York University(纽约大学)

专题命中 评测与基准 :language model(abstract);prompting(abstract);分类 cs.CL

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11041 2025-09-09 cs.CL cs.RO 70%

Towards No-Code Programming of Cobots: Experiments with Code Synthesis by Large Code Models for Conversational Programming

Chalamalasetti Kranti, Sherzod Hakimov, David Schlangen

机构 * Computational Linguistics, Department of Linguistics, University of Potsdam, Germany(波恩大学语言学系计算语言学部门) German Research Center for Artificial Intelligence (DFKI), Berlin, Germany(德国人工智能研究中心(DFKI))

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ITL4HRI workshop at RO-MAN 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16482 2025-09-09 cs.CL 70%

Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning

Rochelle Choenni, Ekaterina Shutova

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06806 2025-09-09 cs.CR cs.DB cs.LG 70%

Systematic Assessment of Tabular Data Synthesis

Yuntao Du, Ninghui Li

机构 * Purdue University(普渡大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by the ACM Conference on Computer and Communications Security (CCS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07350 2025-09-09 cs.AI 70%

KABB: Knowledge-Aware Bayesian Bandits for Dynamic Expert Coordination in Multi-Agent Systems

Jusheng Zhang, Zimeng Huang, Yijia Fan, Ningyuan Liu, Mingyan Li, Zhuojie Yang, Jiawei Yao, Jian Wang, Keze Wang

机构 * Department of XXX, University of YYY, Location, Country(YYY大学XXX系) School of ZZZ, Institute of WWW, Location, Country(WWW研究所ZZZ学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by the Main Conference of ICML 2025. Code: https://github.com/HCP-AI-Research-Lab/KABB

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06452 2025-09-09 cs.IR cs.SD 67%

AudioBoost: Increasing Audiobook Retrievability in Spotify Search with Synthetic Query Generation

Enrico Palumbo, Gustavo Penha, Alva Liu, Marcus Eltscheminov, Jefferson Carvalho dos Santos, Alice Wang, Hugues Bouchard, Humberto Jesús Corona Pampin, Michelle Tran Luu

机构 * Spotify

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments EARL Workshop @ RecSys25

详情

展开后加载摘要…

URL PDF HTML 收藏