arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-29 至 2025-09-29 共收录 243 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 47 篇

2507.10859 2025-09-29 cs.MM cs.CL cs.HC 70%

MultiVox: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions

Ramaneswaran Selvakumar, Ashish Seth, Nishit Anand, Utkarsh Tyagi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21556 2025-09-29 cs.CL 70%

VAT-KG: Knowledge-Intensive Multimodal Knowledge Graph Dataset for Retrieval-Augmented Generation

Hyeongcheol Park, Jiyoung Seo, MinHyuk Jang, Hogun Park, Ha Dam Baek, Gyusam Chang, Hyeonsoo Im, Sangpil Kim

机构 * Korea University(韩国大学) Sungkyunkwan University(全北大学) Hanwha Systems(韩华系统)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Project Page: https://vatkg.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23297 2025-09-29 cs.CL 70%

EmoBench-UA: A Benchmark Dataset for Emotion Detection in Ukrainian

Daryna Dementieva, Nikolay Babakov, Alexander Fraser

机构 * Technical University of Munich (TUM)(慕尼黑技术大学) Universidade de Santiago de Compostela(圣塞巴斯蒂安大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Munich Data Science Institute(慕尼黑数据科学研究所)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP2025, Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01668 2025-09-29 cs.MM cs.IR 67%

Small Stickers, Big Meanings: A Multilingual Sticker Semantic Understanding Dataset with a Gamified Approach

Heng Er Metilda Chee, Jiayin Wang, Zhiqiang Guo, Weizhi Ma, Min Zhang

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted at MM '25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22437 2025-09-29 cs.CL cs.AI 62%

Chimera: Diagnosing Shortcut Learning in Visual-Language Understanding

Ziheng Chi, Yifan Hou, Chenxi Pang, Shaobo Cui, Mubashara Akhtar, Mrinmaya Sachan

机构 * ETH Zürich(苏黎世联邦理工学院) Google DeepMind(谷歌DeepMind) EPFL(瑞士联邦理工学院)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI

Comments Our code (https://github.com/CHIzhP/Chimera) and data (https://huggingface.co/datasets/CHIzhP/Chimera) are publicly available

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17388 2025-09-29 cs.CL cs.AI 62%

Can LLMs be Good Graph Judge for Knowledge Graph Construction?

Haoyu Huang, Chong Chen, Zeang Sheng, Yang Li, Wentao Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Huawei Cloud BU(华为云业务部) Peking University(北京大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05667 2025-09-29 cs.CV cs.AI 57%

DriveAction: A Benchmark for Exploring Human-like Driving Decisions in VLA Models

Yuhan Hao, Zhengning Li, Lei Sun, Weilong Wang, Naixin Yi, Sheng Song, Caihong Qin, Mofan Zhou, Yifei Zhan, Xianpeng Lang

机构 * Li Auto Inc.

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments Benchmark: https://huggingface.co/datasets/LiAuto-DriveAction/drive-action

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15197 2025-09-29 cs.CV cs.AI cs.GR 57%

Intentional Gesture: Deliver Your Intentions with Gestures for Speech

Pinxin Liu, Haiyang Liu, Luchuan Song, Jason J. Corso, Chenliang Xu

机构 * University of Rochester(罗切斯特大学) University of Tokyo(东京大学) University of Michigan(密歇根大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21989 2025-09-29 cs.CV 50%

Mind-the-Glitch: Visual Correspondence for Detecting Inconsistencies in Subject-Driven Generation

Abdelrahman Eldesokey, Aleksandar Cvejic, Bernard Ghanem, Peter Wonka

机构 * KAUST, Saudi Arabia(卡士大学)

专题命中 评测与基准 :language model(abstract)

Comments NeurIPS 2025 (Spotlight). Project Page: https://abdo-eldesokey.github.io/mind-the-glitch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03334 2025-09-29 cs.CV cs.DB 50%

OS-W2S: An Automatic Labeling Engine for Language-Guided Open-Set Aerial Object Detection

Guoting Wei, Yu Liu, Xia Yuan, Xizhe Xue, Linlin Guo, Yifan Yang, Chunxia Zhao, Zongwen Bai, Haokui Zhang, Rong Xiao

机构 * Nanjing University of Science and Technology(南京理工大学) Intellifusion Inc.(Intellifusion公司) Northwestern Polytechnical University(西北工业大学) Zhejiang Lab(浙江实验室) Yan’an University(延安大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 32 篇

2509.21613 2025-09-29 cs.CL cs.AI cs.LG cs.MA 90%

Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective

Lingxiao Kong, Cong Yang, Oya Deniz Beyan, Zeyd Boukhers

机构 * Fraunhofer Institute for Applied Information Technology FIT, Germany(弗劳恩霍夫应用信息科技研究所) Soochow University, China(苏州大学) University Hospital of Cologne, Germany(科隆大学医院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 3 pages, 1 figure, accepted by ECAI MODeM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22449 2025-09-29 cs.CL 88%

Detecting (Un)answerability in Large Language Models with Linear Directions

Maor Juliet Lavi, Tova Milo, Mor Geva

机构 * Blavatnik School of Computer Science and AI, Tel Aviv University(巴尔-艾赫大学计算机科学与人工智能学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14364 2025-09-29 cs.CL 88%

Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models

Runsong Zhao, Xin Liu, Xinyu Liu, Pengcheng Huang, Chunyang Xiao, Tong Xiao, Jingbo Zhu

机构 * NLP Lab, School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院自然语言处理实验室) NiuTrans Research, Shenyang, China(NiuTrans研究院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22512 2025-09-29 cs.AR 88%

AxLLM: accelerator architecture for large language models with computation reuse capability

Soroush Ahadi, Mehdi Modarressi, Masoud Daneshtalab

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

Comments 7 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22008 2025-09-29 cs.LG 86%

Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning

Yajie Qi, Wei Wei, Lin Li, Lijun Zhang, Zhidong Gao, Da Wang, Huizhong Song

机构 * School of Computer and Information Technology, Shanxi University(计算机与信息技术学院,山西大学)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13681 2025-09-29 cs.CL cs.AI 86%

LoopServe: An Adaptive Dual-phase LLM Inference Acceleration System for Multi-Turn Dialogues

Haoyang Li, Zhanchao Xu, Yiming Li, Xuejia Chen, Darian Li, Anxin Tian, Qingfa Xiao, Cheng Deng, Jun Wang, Qing Li, Lei Chen, Mingxuan Yuan

机构 * PolyU HKUST(香港科技大学) HUST(华中科技大学) Huawei Noah’s Ark Lab(华为诺亚实验室) HKUST(GZ)(香港科技大学(广州)) Edin UCL(伦敦大学学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22062 2025-09-29 cs.SD eess.AS 85%

Comprehend and Talk: Text to Speech Synthesis via Dual Language Modeling

Junjie Cao, Yichen Han, Ruonan Zhang, Xiaoyang Hao, Hongxiang Li, Shuaijiang Zhao, Yue Liu, Xiao-Ping Zhng

机构 * Tsinghua University(清华大学) Peking University(北京大学) AMAP Speech(AMAP语音)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments conference paper about TTS

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00719 2025-09-29 cs.CL cs.AI 84%

DAMR: Efficient and Adaptive Context-Aware Knowledge Graph Question Answering with LLM-Guided MCTS

Yingxu Wang, Shiqi Fan, Mengzhu Wang, Siyang Gao, Chao Wang, Nan Yin

机构 * MBZUAI PolyU Hebei University of Technology(河北工业大学) CityU(城市大学) HKUST(香港科技大学)

专题命中 效率与部署 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18053 2025-09-29 cs.CR cs.CL 83%

Resource Consumption Red-Teaming for Large Vision-Language Models

Haoran Gao, Yuanhe Zhang, Zhenhong Zhou, Lei Jiang, Fanyu Meng, Yujia Xiao, Li Sun, Kun Wang, Yang Liu, Junlan Feng

机构 * China Mobile Research Institute(中国移动研究院) Beijing University of Posts and Telecommunications(北京邮电大学) Nanyang Technological University(南洋理工大学) University of Science and Technology of China(中国科学技术大学) North China Electric Power University(华北电力大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19375 2025-09-29 cs.LG cs.AI cs.CL cs.CV cs.HC 82%

DOTA: Distributional Test-Time Adaptation of Vision-Language Models

Zongbo Han, Jialong Yang, Guangyu Wang, Junfan Li, Qianli Xu, Mike Zheng Shou, Changqing Zhang

机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学) College of Intelligence and Computing(智能与计算学院) Tianjin University(天津大学) School of Computer Science and Technology(计算机科学与技术学院) Harbin Institute of Technology Shenzhen(哈尔滨工业大学深圳学院) Institute for Infocomm Research, A*STAR(信息通信研究机构,A*STAR) Show Lab, National University of Singapore(新加坡国立大学Show实验室) National University of Singapore(新加坡国立大学)

专题命中 效率与部署 :language model(title);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21801 2025-09-29 cs.CL 81%

Redefining Machine Simultaneous Interpretation: From Incremental Translation to Human-Like Strategies

Qianen Zhang, Satoshi Nakamura

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nara Institute of Science and Technology, Japan(日本奈良科学技术大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23621 2025-09-29 cs.CL 81%

Table-R1: Inference-Time Scaling for Table Reasoning

Zheyuan Yang, Lyuhao Chen, Arman Cohan, Yilun Zhao

机构 * Yale NLP Lab(耶鲁大学自然语言处理实验室) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(abstract);instruction tuning(abstract);post-training(abstract);SFT(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22633 2025-09-29 stat.ML cs.AI cs.CL cs.LG math.ST stat.TH 80%

Towards Efficient Online Exploration for Reinforcement Learning with Human Feedback

Gen Li, Yuling Yan

机构 * Department of Statistics and Data Science, The Chinese University of Hong Kong(统计与数据科学系,香港中文大学) Department of Statistics, University of Wisconsin-Madison(统计系,威斯康星大学麦迪逊分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21737 2025-09-29 cs.LG cs.AI 79%

POLO: Preference-Guided Multi-Turn Reinforcement Learning for Lead Optimization

Ziqing Wang, Yibo Wen, William Pattie, Xiao Luo, Weimin Wu, Jerry Yao-Chieh Hu, Abhishek Pandey, Han Liu, Kaize Ding

机构 * Northwestern University(西北大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) AbbVie(阿比唯)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21731 2025-09-29 cs.HC 78%

When Teams Embrace AI: Human Collaboration Strategies in Generative Prompting in a Creative Design Task

Yuanning Han, Ziyi Qiu, Jiale Cheng, RAY LC

专题命中 效率与部署 :prompting(title,abstract)

Journal ref CHI '24: Proceedings of the 2024 CHI Conference on Human Factors in Computing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21400 2025-09-29 cs.CR 78%

SafeSteer: Adaptive Subspace Steering for Efficient Jailbreak Defense in Vision-Language Models

Xiyu Zeng, Siyuan Liang, Liming Lu, Haotian Zhu, Enguang Liu, Jisheng Dang, Yongbin Zhou, Shuchao Pang

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19516 2025-09-29 cs.DC 78%

Boosting LLM Serving through Spatial-Temporal GPU Resource Sharing

Zejia Lin, Hongxin Xu, Guanyi Chen, Zhiguang Chen, Yutong Lu, Xianwei Zhang

专题命中 效率与部署 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12313 2025-09-29 cs.CL 77%

ExpertSteer: Intervening in LLMs through Expert Knowledge

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Monash University(墨尔本大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05563 2025-09-29 cs.GT cs.LG 77%

Do Data Valuations Make Good Data Prices?

Dongyang Fan, Tyler J. Rotello, Sai Praneeth Karimireddy

机构 * EPFL(瑞士联邦理工学院) USC(美国南加州大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22068 2025-09-29 cs.DC 75%

Code once, Run Green: Automated Green Code Translation in Serverless Computing

Sebastian Werner, Mathis Kähler, Alireza Hakamian

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at IC2E 2025

详情

展开后加载摘要…

URL PDF HTML 收藏