arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-26 至 2025-08-26 共收录 302 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 57 篇

2508.14527 2025-08-26 cs.CV 67%

Adversarial Generation and Collaborative Evolution of Safety-Critical Scenarios for Autonomous Vehicles

Jiangfan Liu, Yongkang Guo, Fangzhi Zhong, Tianyuan Zhang, Zonglei Jing, Siyuan Liang, Jiakai Wang, Mingchuan Zhang, Aishan Liu, Xianglong Liu

机构 * Beihang University(北京航空航天大学) Nanyang Technological University(南洋理工大学) Zhongguancun Laboratory(中关村实验室) Henan University of Science and Technology(河南科技大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17205 2025-08-26 cs.CV cs.AI cs.CL eess.IV 62%

Multi-Agent Visual-Language Reasoning for Comprehensive Highway Scene Understanding

Yunxiang Yang, Ningning Xu, Jidong J. Yang

机构 * Smart Mobility and Infrastructure Lab(智能移动与基础设施实验室) College of Engineering, University of Georgia(佐治亚大学工程学院)

专题命中 推理与问题求解 :language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 16 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01881 2025-08-26 cs.AI cs.CL 62%

WHEN TO ACT, WHEN TO WAIT: Modeling the Intent-Action Alignment Problem in Dialogue

Yaoyao Qian, Jindan Huang, Yuanli Wang, Simon Yu, Kyrie Zhixuan Zhou, Jiayuan Mao, Mingfu Liang, Hanhan Zhou

专题命中 推理与问题求解 :language model(abstract);分类 cs.CL、cs.AI

Comments Project website: https://nanostorm.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16987 2025-08-26 cs.AI cs.CV 57%

WebSight: A Vision-First Architecture for Robust Web Agents

Tanvir Bhathal, Asanshay Gupta

机构 * Stanford University(斯坦福大学)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18050 2025-08-26 cs.CV 50%

ArgusCogito: Chain-of-Thought for Cross-Modal Synergy and Omnidirectional Reasoning in Camouflaged Object Segmentation

Jianwen Tan, Huiyao Zhang, Rui Xiong, Han Zhou, Hongfei Wang, Ye Li

机构 * University of Chinese Academy of Sciences(中国科学院大学) Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)

专题命中 推理与问题求解 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17595 2025-08-26 cs.CV 50%

TinyGiantVLM: A Lightweight Vision-Language Architecture for Spatial Reasoning under Resource Constraints

Vinh-Thuan Ly, Hoang M. Truong, Xuan-Huong Nguyen

机构 * University of Science, VNU-HCM(越南胡志明市国家大学) Vietnam National University(越南国家大学)

专题命中 推理与问题求解 :language model(abstract)

Comments Accepted for presentation at the IEEE/CVF International Conference on Computer Vision (ICCV) Workshops, 2025

Journal ref IEEE/CVF International Conference on Computer Vision (ICCV) Workshops, Hawaii, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 评测与基准 63 篇

2508.11280 2025-08-26 cs.CL cs.AI 90%

LETToT: Label-Free Evaluation of Large Language Models On Tourism Using Expert Tree-of-Thought

Ruiyan Qi, Congding Wen, Weibo Zhou, Jiwei Li, Shangsong Liang, Lingbo Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16673 2025-08-26 cs.CY cs.AI cs.CL 90%

Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models

Pooja S. B. Rao, Laxminarayen Nagarajan Venkatesan, Mauro Cherubini, Dinesh Babu Jayagopi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to AIES 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18889 2025-08-26 cs.CR cs.AI 89%

Security Concerns for Large Language Models: A Survey

Miles Q. Li, Benjamin C. M. Fung

机构 * Infinite Optimization AI Lab, Montreal, Canada(无限优化人工智能实验室,加拿大蒙特利尔) School of Information Studies, McGill University, Montreal, Canada(信息研究学院,麦吉尔大学,加拿大蒙特利尔)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13491 2025-08-26 cs.CE 89%

From Scores to Skills: A Cognitive Diagnosis Framework for Evaluating Financial Large Language Models

Ziyan Kuang, Feiyu Zhu, Maowei Jiang, Yanzhao Lai, Zelin Wang, Zhitong Wang, Meikang Qiu, Jiajia Huang, Min Peng, Qianqian Xie, Sophia Ananiadou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06602 2025-08-26 cs.CL cs.AI cs.LG cs.MM cs.SD eess.AS 89%

Towards Controllable Speech Synthesis in the Era of Large Language Models: A Systematic Survey

Tianxin Xie, Yan Rong, Pengfei Zhang, Wenwu Wang, Li Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Surrey(萨里大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments The first comprehensive survey on controllable TTS. Accepted to the EMNLP 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05914 2025-08-26 eess.AS cs.SD eess.SP 89%

Soundscape Captioning using Sound Affective Quality Network and Large Language Model

Yuanbo Hou, Qiaoqiao Ren, Andrew Mitchell, Wenwu Wang, Jian Kang, Tony Belpaeme, Dick Botteldooren

机构 * Machine Learning Group, University of Oxford(牛津大学机器学习组) AIRO-IDLab, Ghent University-Imec(根特大学-imec AIRO-IDLab) CVSSP, University of Surrey(萨里大学计算机视觉与模式识别中心) University College London(伦敦大学学院) WAVES Group, Ghent University(根特大学WAVES组)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments IEEE Transactions on Multimedia, Code: https://github.com/Yuanbo2020/SoundSCaper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16982 2025-08-26 cs.CL 89%

Decoding Alignment: A Critical Survey of LLM Development Initiatives through Value-setting and Data-centric Lens

Ilias Chalkidis

机构 * Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments This is a working paper and will be updated with new information or corrections based on community feedback

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00026 2025-08-26 cs.CL cs.AI 88%

Theory of Mind in Large Language Models: Assessment and Enhancement

Ruirui Chen, Weifeng Jiang, Chengwei Qin, Cheston Tan

机构 * Agency for Science Technology and Research (A*STAR)(科技研究局) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology (Guangzhou) China(香港科学与技术大学(广州)中国)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12819 2025-08-26 cs.CL cs.AI 88%

Large Language Models Meet NLP: A Survey

Libo Qin, Qiguang Chen, Xiachong Feng, Yang Wu, Yongheng Zhang, Yinghui Li, Min Li, Wanxiang Che, Philip S. Yu

机构 * School of Computer Science(计算机科学学院) Engineering, Central South University(工程学院,中南大学) Research Center for Social Computing(社会计算研究中心) Interactive Robotics, Harbin Institute of Technology(交互机器人研究,哈尔滨工业大学) Department of Computer Science, University of Hong Kong(计算机科学系,香港大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Department of Computer Science, University of Illinons at Chicago(计算机科学系,伊利诺伊大学香槟分校)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-025-50472-3}

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06932 2025-08-26 cs.CL cs.CY cs.LG 88%

Harnessing Large Language Models for Disaster Management: A Survey

Zhenyu Lei, Yushun Dong, Weiyu Li, Rong Ding, Qi Wang, Jundong Li

机构 * University of Virginia(弗吉尼亚大学) Florida State University(佛罗里达州立大学) Northeastern University(东北大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18245 2025-08-26 cs.CL 88%

Demographic Biases and Gaps in the Perception of Sexism in Large Language Models

Judith Tavarez-Rodríguez, Fernando Sánchez-Vega, A. Pastor López-Monroy

机构 * Computer Science Department, Mathematics Research Center (CIMAT)(计算机科学系,数学研究中心(CIMAT))

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments This work was presented as a poster at the Latin American Meeting in Artificial Intelligence KHIPU 2025, Santiago, Chile, March 10th - 14th 2025, https://khipu.ai/khipu2025/poster-sessions-2025/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17647 2025-08-26 cs.CL cs.DL cs.IR 88%

SurveyGen: Quality-Aware Scientific Survey Generation with Large Language Models

Tong Bao, Mir Tafseer Nayeem, Davood Rafiei, Chengzhi Zhang

机构 * Nanjing University of Science and Technology(南京理工大学) University of Alberta(阿尔伯塔大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Journal ref EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17571 2025-08-26 cs.IR 88%

A Universal Framework for Offline Serendipity Evaluation in Recommender Systems via Large Language Models

Yu Tokutake, Kazushi Okamoto, Kei Harada, Atsushi Shibata, Koki Karube

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

Journal ref The 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17435 2025-08-26 cs.CV 87%

An LLM-LVLM Driven Agent for Iterative and Fine-Grained Image Editing

Zihan Liang, Jiahao Sun, Haoran Ma

机构 * Kunming University of Science and Technology(昆明理工大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18048 2025-08-26 cs.IR cs.AI 86%

HyST: LLM-Powered Hybrid Retrieval over Semi-Structured Tabular Data

Jiyoon Myung, Jihyeon Park, Joohyung Han

机构 * PrompTart LAB, MODULABS(PrompTart实验室,MODULABS)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI

Comments Accepted at the 2nd EARL Workshop on Evaluating and Applying Recommender Systems with Large Language Models (RecSys 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21500 2025-08-26 cs.CL 86%

OpenHuEval: Evaluating Large Language Model on Hungarian Specifics

Haote Yang, Xingjian Wei, Jiang Wu, Noémi Ligeti-Nagy, Jiaxing Sun, Yinfan Wang, Zijian Győző Yang, Junyuan Gao, Jingchao Wang, Bowen Jiang, Shasha Wang, Nanjun Yu, Zihao Zhang, Shixin Hong, Hongwei Liu, Wei Li, Songyang Zhang, Dahua Lin, Lijun Wu, Gábor Prószéky, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) HUN-REN Hungarian Research Centre for Linguistics(匈牙利语言研究与研究中心) Wuhan University(武汉大学) Shanghai University(上海大学) University of Chinese Academy of Sciences(中国科学院大学) East China Normal University(华东师范大学) Peking University(北京大学) Harbin Institute of Technology(哈尔滨工业大学) Tsinghua University(清华大学) Chinese University of Hong Kong(香港大学)

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17692 2025-08-26 cs.AI cs.CL 86%

LLM-based Agentic Reasoning Frameworks: A Survey from Methods to Scenarios

Bingxi Zhao, Lin Geng Foo, Ping Hu, Christian Theobalt, Hossein Rahmani, Jun Liu

机构 * Beijing Jiaotong University(北京交通大学) Lancaster University(兰卡斯特大学) Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克研究所(信息学)萨尔兰州信息学校区) University of Electronic Science and Technology of China(电子科技大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 51 pages,10 figures,8 tables. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17378 2025-08-26 cs.CL 85%

UI-Level Evaluation of ALLaM 34B: Measuring an Arabic-Centric LLM via HUMAIN Chat

Omer Nacar

机构 * NAMAA Community(NAMAA社区) Riyadh - KSA(利雅得-科威特)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17155 2025-08-26 cs.CR cs.AI 85%

Mind the Gap: Time-of-Check to Time-of-Use Vulnerabilities in LLM-Enabled Agents

Derek Lilienthal, Sanghyun Hong

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17710 2025-08-26 cs.CR cs.AI 85%

Optimization-based Prompt Injection Attack to LLM-as-a-Judge

Jiawen Shi, Zenghui Yuan, Yinuo Liu, Yue Huang, Pan Zhou, Lichao Sun, Neil Zhenqiang Gong

机构 * Huazhong University of Science and Technology(华中科技大学) University of Notre Dame(圣母大学) Lehigh University(莱文森大学) Duke University(杜克大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments To appear in the Proceedings of The ACM Conference on Computer and Communications Security (CCS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16757 2025-08-26 cs.CL cs.IR 85%

How Good are LLM-based Rerankers? An Empirical Analysis of State-of-the-Art Reranking Models

Abdelrahman Abdallah, Bhawna Piryani, Jamshid Mozafari, Mohammed Ali, Adam Jatowt

机构 * University of Innsbruck(因斯布鲁克大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17644 2025-08-26 cs.IR 85%

Demographically-Inspired Query Variants Using an LLM

Marwah Alaofi, Nicola Ferro, Paul Thomas, Falk Scholer, Mark Sanderson

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Published in the proceedings of ICTIR'25, Padua, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06004 2025-08-26 cs.CL cs.AI cs.LG 85%

Analysis of LLM as a grammatical feature tagger for African American English

Rahul Porwal, Alice Rozet, Pryce Houck, Jotsna Gowda, Sarah Moeller, Kevin Tang

机构 * University of Florida(佛罗里达大学) Heinrich Heine University Düsseldorf(杜塞尔多夫海因里希-海涅大学)

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, Accepted to "Findings of the Association for Computational Linguistics: NAACL 2025"

Journal ref Findings of the Association for Computational Linguistics: NAACL 2025 (2025) 7744-7756

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17580 2025-08-26 cs.CL cs.AI cs.LG 82%

UQ: Assessing Language Models on Unsolved Questions

Fan Nie, Ken Ziyu Liu, Zihao Wang, Rui Sun, Wei Liu, Weijia Shi, Huaxiu Yao, Linjun Zhang, Andrew Y. Ng, James Zou, Sanmi Koyejo, Yejin Choi, Percy Liang, Niklas Muennighoff

专题命中 评测与基准 :language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments FN, KZL, and NM are project co-leads and contributed equally. Project website: https://uq.stanford.edu

详情

展开后加载摘要…

URL PDF HTML 收藏