arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-31 至 2025-10-31 共收录 190 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 48 篇

2510.25054 2025-10-31 cs.CL eess.AS 79%

Evaluating Emotion Recognition in Spoken Language Models on Emotionally Incongruent Speech

Pedro Corrêa, João Lima, Victor Moreno, Lucas Ueda, Paula Dornhofer Paro Costa

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

Comments Submitted to IEEE ICASSP 2026. Copyright 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26124 2025-10-31 cs.CL 77%

On the Influence of Discourse Relations in Persuasive Texts

Nawar Turk, Sevag Kaspar, Leila Kosseim

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Published in Proceedings of the 38th Canadian Conference on Artificial Intelligence CanAI 2025 Calgary Alberta May 26-27 2025. 5 figures 7 tables

Journal ref Proceedings of the 38th Canadian Conference on Artificial Intelligence CanAI 2025 Canadian Artificial Intelligence Association Article ID 2025L162 Calgary Canada May 26-27 2025 Published online at https://caiac.pubpub.org/pub/p99aab5q/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26086 2025-10-31 cs.LG 77%

LLMBisect: Breaking Barriers in Bug Bisection with A Comparative Analysis Pipeline

Zheng Zhang, Haonan Li, Xingyu Li, Hang Zhang, Zhiyun Qian

机构 * University of California, Riverside(加州大学河滨分校) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25820 2025-10-31 cs.AI cs.HC 77%

Symbolically Scaffolded Play: Designing Role-Sensitive Prompts for Generative NPC Dialogue

Vanessa Figueiredo, David Elumeze

机构 * ExplorAI, Department of Computer Science, University of Regina(ExplorAI,计算机科学系,里嘉大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26228 2025-10-31 q-fin.PM q-fin.PR 75%

ChatGPT in Systematic Investing -- Enhancing Risk-Adjusted Returns with LLMs

Nikolas Anic, Andrea Barbon, Ralf Seiz, Carlo Zarattini

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26480 2025-10-31 cs.SE 75%

Automated Extract Method Refactoring with Open-Source LLMs: A Comparative Study

Sivajeet Chand, Melih Kilic, Roland Würsching, Sushant Kumar Pandey, Alexander Pretschner

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at AIware'25 - Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21257 2025-10-31 cs.AI cs.CL 73%

CompoST: A Benchmark for Analyzing the Ability of LLMs To Compositionally Interpret Questions in a QALD Setting

David Maria Schmidt, Raoul Schubert, Philipp Cimiano

机构 * Bielefeld University(比勒菲尔德大学) CITEC(CITEC研究中心) Technical Faculty(技术学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Research Track, 24th International Semantic Web Conference (ISWC 2025), November 2-6, 2025, Nara, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26024 2025-10-31 cs.CL cs.AI 73%

Rethinking Cross-lingual Alignment: Balancing Transfer and Cultural Erasure in Multilingual LLMs

HyoJung Han, Sweta Agrawal, Eleftheria Briakou

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25409 2025-10-31 cs.CL cs.AI 73%

BhashaBench V1: A Comprehensive Benchmark for the Quadrant of Indic Domains

Vijay Devane, Mohd Nauman, Bhargav Patel, Aniket Mahendra Wakchoure, Yogeshkumar Sant, Shyam Pawar, Viraj Thakur, Ananya Godse, Sunil Patra, Neha Maurya, Suraj Racha, Nitish Kamal Singh, Ajay Nagpal, Piyush Sawarkar, Kundeshwar Vijayrao Pundalik, Rohit Saluja, Ganesh Ramakrishnan

机构 * BharatGen Team(BharatGen团队)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20535 2025-10-31 cs.DC cs.AI cs.LG 73%

AIMeter: Measuring, Analyzing, and Visualizing Energy and Carbon Footprint of AI Workloads

Hongzhen Huang, Kunming Zhang, Hanlong Liao, Kui Wu, Guoming Tang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) National University of Defense Technology(国防科技大学) University of Victoria(维多利亚大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 7 figures and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25402 2025-10-31 cs.IR cs.CE 71%

Towards Automated Quality Assurance of Patent Specifications: A Multi-Dimensional LLM Framework

Yuqian Chai, Chaochao Wang, Weilei Wang

专题命中 评测与基准 :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26702 2025-10-31 cs.AI 70%

Delegated Authorization for Agents Constrained to Semantic Task-to-Scope Matching

Majed El Helou, Chiara Troiani, Benjamin Ryder, Jean Diaconu, Hervé Muyal, Marcelo Yannuzzi

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Paper page at https://outshift-open.github.io/ASTRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16271 2025-10-31 cs.CL 70%

Beyond Isolated Dots: Benchmarking Structured Table Construction as Deep Knowledge Extraction

Tianyun Zhong, Guozhao Mo, Yanjiang Liu, Yihan Chen, Lingdi Kong, Xuanang Chen, Yaojie Lu, Hongyu Lin, Shiwei Ye, Xianpei Han, Ben He, Le Sun

机构 * University of Chinese Academy of Sciences(中国科学院大学) Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16556 2025-10-31 cs.CV 67%

Fit for Purpose? Deepfake Detection in the Real World

Guangyu Lin, Li Lin, Christina P. Walker, Daniel S. Schiff, Shu Hu

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00066 2025-10-31 cs.CL cs.AI cs.LG 67%

Interpretable Next-token Prediction via the Generalized Induction Head

Eunji Kim, Sriya Mantena, Weiwei Yang, Chandan Singh, Sungroh Yoon, Jianfeng Gao

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26790 2025-10-31 cs.CL cs.AI 62%

Gistify! Codebase-Level Understanding via Runtime Execution

Hyunji Lee, Minseon Kim, Chinmay Singh, Matheus Pereira, Atharv Sonwane, Isadora White, Elias Stengel-Eskin, Mohit Bansal, Zhengyan Shi, Alessandro Sordoni, Marc-Alexandre Côté, Xingdi Yuan, Lucas Caccia

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft Research(微软研究院) Cornell University(康奈尔大学) University of California San Diego(加州大学圣地亚哥分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26095 2025-10-31 cs.IR cs.CL 57%

ORBIT -- Open Recommendation Benchmark for Reproducible Research with Hidden Tests

Jingyuan He, Jiongnan Liu, Vishan Vishesh Oberoi, Bolin Wu, Mahima Jagadeesh Patel, Kangrui Mao, Chuning Shi, I-Ta Lee, Arnold Overwijk, Chenyan Xiong

机构 * Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments Accepted to NeurIPS 2025 Datasets & Benchmarks track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26186 2025-10-31 cs.CV cs.AI 57%

ConceptScope: Characterizing Dataset Bias via Disentangled Visual Concepts

Jinho Choi, Hyesu Lim, Steffen Schneider, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) Helmholtz Munich(慕尼黑海德堡研究所) Institute of Computational Biology(计算生物学研究所) Computational Health Center(计算健康中心) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI

Comments Published in the Thirty-Ninth Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06220 2025-10-31 cs.CV cs.AI 57%

GenIR: Generative Visual Feedback for Mental Image Retrieval

Diji Yang, Minghao Liu, Chung-Hsiang Lo, Yi Zhang, James Davis

机构 * University of California Santa Cruz(加州大学圣克ruz分校) Northeastern University(东北大学) Accenture(Accenture公司)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04852 2025-10-31 cs.CV cs.LG 57%

CAUSAL3D: A Comprehensive Benchmark for Causal Learning from Visual Data

Disheng Liu, Yiran Qiao, Wuche Liu, Yiren Lu, Yunlai Zhou, Tuo Liang, Yu Yin, Jing Ma

机构 * Case Western Reserve University(凯斯西储大学)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

Comments Datasets link: https://huggingface.co/datasets/LLDDSS/Causal3D_Dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06771 2025-10-31 cs.CV 50%

D-HUMOR: Dark Humor Understanding via Multimodal Open-ended Reasoning -- A Benchmark Dataset and Method

Sai Kartheek Reddy Kasu, Mohammad Zia Ur Rehman, Shahid Shafi Dar, Rishi Bharat Junghare, Dhanvin Sanjay Namboodiri, Nagendra Kumar

机构 * Indian Institute of Information Technology Dharwad, India(印度达拉瓦德信息科技学院) Indian Institute of Technology Indore, India(印度印度理工学院) Malaviya National Institute of Technology Jaipur, India(马拉维亚国家理工学院)

专题命中 评测与基准 :language model(abstract)

Comments Accepted at IEEE International Conference on Data Mining (ICDM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24594 2025-10-31 cs.HC 50%

Detecting the Use of Generative AI in Crowdsourced Surveys: Implications for Data Integrity

Dapeng Zhang, Marina Katoh, Weiping Pei

专题命中 评测与基准 :LLM(abstract)

Comments Accepted by CSCW 2025 workshop Beyond Information: Online Participatory Culture and Information Disorder

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08772 2025-10-31 cs.CV 50%

From One to More: Contextual Part Latents for 3D Generation

Shaocong Dong, Lihe Ding, Xiao Chen, Yaokun Li, Yuxin Wang, Yucheng Wang, Qi Wang, Jaehyeok Kim, Chenjian Gao, Zhanpeng Huang, Zibin Wang, Tianfan Xue, Dan Xu

机构 * HKUST(香港科技大学) CUHK(香港中文大学) SenseTime Research(商汤科技研究院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 评测与基准 :foundation model(abstract)

Comments Project page: https://copart3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05696 2025-10-31 cs.CV 50%

MoralCLIP: Contrastive Alignment of Vision-and-Language Representations with Moral Foundations Theory

Ana Carolina Condez, Diogo Tavares, João Magalhães

机构 * NOVA LINCS, NOVA School of Science and Technology(NOVA LINCS,NOVA科学与技术学院)

专题命中 评测与基准 :language model(abstract)

Comments Updated version: corresponds to the ACM MM '25 published paper and includes full appendix material

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 41 篇

2510.26622 2025-10-31 cs.CL 91%

Encoder-Decoder or Decoder-Only? Revisiting Encoder-Decoder Large Language Model

Biao Zhang, Yong Cheng, Siamak Shakeri, Xinyi Wang, Min Ma, Orhan Firat

机构 * Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments The scaling study inspiring T5Gemma

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25817 2025-10-31 cs.CL 90%

A Survey on Efficient Large Language Model Training: From Data-centric Perspectives

Junyu Luo, Bohan Wu, Xiao Luo, Zhiping Xiao, Yiqiao Jin, Rong-Cheng Tu, Nan Yin, Yifan Wang, Jingyang Yuan, Wei Ju, Ming Zhang

机构 * State Key Laboratory for Multimedia Information Processing, School of Computer Science, PKU-Anker LLM Lab, Peking University(信息处理国家重点实验室,计算机学院,PKU-Anker LLM实验室,北京大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Washington(华盛顿大学) Georgia Institute of Technology(佐治亚理工学院) Nanyang Technological University(南洋理工大学) HKUST(香港科技大学) University of International Business and Economics(国际商务经济大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26446 2025-10-31 cs.CL 89%

1+1>2: A Synergistic Sparse and Low-Rank Compression Method for Large Language Models

Zeliang Zong, Kai Zhang, Zheyang Li, Wenming Tan, Ye Ren, Yiyan Zhai, Jilin Hu

机构 * Hikvision Research Institute(海康威视研究院) School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 15 pages, 6 figures, EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26096 2025-10-31 cs.SD cs.CR cs.LG 85%

ALMGuard: Safety Shortcuts and Where to Find Them as Guardrails for Audio-Language Models

Weifei Jin, Yuxin Cao, Junjie Su, Minhui Xue, Jie Hao, Ke Xu, Jin Song Dong, Derui Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) CSIRO’s Data61(CSIRO数据61) Responsible AI Research (RAIR) Centre, The University of Adelaide(负责任人工智能研究(RAIR)中心,阿德莱德大学) Tsinghua University(清华大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14808 2025-10-31 cs.DC cs.LG 85%

HyGen: Efficient LLM Serving via Elastic Online-Offline Request Co-location

Ting Sun, Penghan Wang, Fan Lai

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院) Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS 2025. 21 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08271 2025-10-31 cs.IR 85%

RecCocktail: A Generalizable and Efficient Framework for LLM-Based Recommendation

Min Hou, Chenxi Bai, Le Wu, Hao Liu, Kai Zhang, Weiwen Liu, Richang Hong, Ruiming Tang, Meng Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏