arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-16 至 2025-10-16 共收录 175 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 45 篇

2510.13598 2025-10-16 cs.CL 77%

FreshTab: Sourcing Fresh Data for Table-to-Text Generation Evaluation

Kristýna Onderková, Ondřej Plátek, Zdeněk Kasner, Ondřej Dušek

机构 * Charles University(查理大学) Faculty of Mathematics and Physics(数学与物理学院) Institute of Formal and Applied Linguistics(形式与应用语言学研究所)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments To be published in INLG 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04329 2025-10-16 cs.CL 77%

No Language Data Left Behind: A Comparative Study of CJK Language Datasets in the Hugging Face Ecosystem

Dasol Choi, Woomyoung Park, Youngsook Song

机构 * Yonsei University(延世大学) AIM Intelligence(AIM智能) MODULABS Sionic AI Lablup

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 MRL Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07037 2025-10-16 cs.CL 77%

KG2QA: Knowledge Graph-enhanced Retrieval-augmented Generation for Communication Standards Question Answering

Zhongze Luo, Weixuan Wan, Tianya Zhang, Dan Wang, Xiaoying Tang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)科学与工程学院) School of Microelectronics, Xi'an Jiaotong University, China(西安交通大学微电子学院)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13079 2025-10-16 cs.CL cs.LG 73%

GatePro: Parameter-Free Expert Selection Optimization for Mixture-of-Experts Models

Chen Zheng, Yuhang Cai, Deyi Liu, Jin Ma, Yiyuan Ma, Yuan Yang, Jing Liu, Yutao Zeng, Xun Zhou, Siyuan Qiao

机构 * ByteDance Seed(字节跳动种子) UC Berkeley(伯克利大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12845 2025-10-16 cs.CL cs.AI cs.CV cs.RO 73%

VLURes: Benchmarking VLM Visual and Linguistic Understanding in Low-Resource Languages

Jesse Atuhurra, Iqra Ali, Tomoya Iwakura, Hidetaka Kamigaito, Tatsuya Hiraoka

专题命中 评测与基准 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03173 2025-10-16 cs.CL cs.AI cs.CV 73%

MULTI: Multimodal Understanding Leaderboard with Text and Images

Zichen Zhu, Yang Xu, Lu Chen, Jingkai Yang, Yichuan Ma, Yiming Sun, Hailin Wen, Jiaqi Liu, Jinyu Cai, Yingzi Ma, Situo Zhang, Zihan Zhao, Liangtai Sun, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Key Laboratory of Artificial Intelligence\ of Education, Shanghai Jiao Tong University, Shanghai 200240 , China Jiangsu Key Lab of Language Computing, Suzhou 215123 , China College of Computing Data Science, Nanyang Technological University, Singapore 639798 , Singapore Suzhou Laboratory, Suzhou 215123 , China

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 19 figures, 10 tables. Details and access are available at: https://OpenDFM.github.io/MULTI-Benchmark/

Journal ref Sci. China Inf. Sci. 68, 200107 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13681 2025-10-16 cs.CL 70%

How Sampling Affects the Detectability of Machine-written texts: A Comprehensive Study

Matthieu Dubois, François Yvon, Pablo Piantanida

机构 * Sorbonne Université, CNRS, ISIR, Paris France(索邦大学、国家科学研究中心、ISIR、巴黎法国) CNRS, International Laboratory on Learning Systems, Montréal, Canada(国家科学研究中心、学习系统国际实验室、蒙特利尔加拿大) Mila - Québec AI Institute, Montréal, Canada(魁北克AI研究所、蒙特利尔加拿大) CentraleSupélec, Université Paris-Saclay, Gif-sur-Yvette, France(CentraleSupélec、巴黎萨克雷大学、吉夫-sur-伊夫特法国)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12621 2025-10-16 cs.CL 70%

ACADATA: Parallel Dataset of Academic Data for Machine Translation

Iñaki Lacunza, Javier Garcia Gilabert, Francesca De Luca Fornaciari, Javier Aula-Blasco, Aitor Gonzalez-Agirre, Maite Melero, Marta Villegas

机构 * Barcelona Supercomputing Center (BSC)(巴塞罗那超级计算中心)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00893 2025-10-16 cs.CL 70%

SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset

Răzvan-Alexandru Smădu, Andreea Iuga, Dumitru-Clementin Cercel, Florin Pop

机构 * National University of Science and Technology POLITEHNICA Bucharest(波兰技术大学科学与技术国家大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 9 pages, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13787 2025-10-16 cs.CV 67%

Adaptive Visual Conditioning for Semantic Consistency in Diffusion-Based Story Continuation

Seyed Mohammad Mousavi, Morteza Analoui

机构 * School of Computer Engineering, Iran University of Science and Technology(伊朗科学技术大学计算机工程学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13494 2025-10-16 cs.CL cs.AI 62%

LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA

Tommaso Bonomo, Luca Gioffré, Roberto Navigli

机构 * Sapienza NLP Group, Sapienza University of Rome(Sapienza 大学自然语言处理组,Sapienza 罗马大学) Babelscape, Italy(Babelscape 公司,意大利)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Main Conference. 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13194 2025-10-16 cs.CL cs.AI 62%

StressTransfer: Stress-Aware Speech-to-Speech Translation with Emphasis Preservation

Xi Chen, Yuchen Song, Satoshi Nakamura

机构 * The Chinese University of Hong Kong, China(香港中文大学) Nara Institute of Science and Technology(奈良科学技術大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19972 2025-10-16 cs.CV cs.AI cs.CL 62%

GLSim: Detecting Object Hallucinations in LVLMs via Global-Local Similarity

Seongheon Park, Sharon Li

机构 * Department of Computer Sciences University of Wisconsin-Madison(计算机科学系威斯康星大学麦迪逊分校)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01540 2025-10-16 cs.LG cs.AI 62%

BoxingGym: Benchmarking Progress in Automated Experimental Design and Model Discovery

Kanishk Gandhi, Michael Y. Li, Lyle Goodyear, Agam Bhatia, Louise Li, Aditi Bhaskar, Mohammed Zaman, Noah D. Goodman

机构 * Stanford University(斯坦福大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI、cs.LG

Comments KG and MYL contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13364 2025-10-16 cs.CV cs.AI 57%

Language as a Label: Zero-Shot Multimodal Classification of Everyday Postures under Data Scarcity

MingZe Tang, Jubal Chandy Jacob

机构 * Department of Computing Science University of Aberdeen(计算科学系阿伯丁大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13054 2025-10-16 cs.RO cs.AI 57%

VLA-0: Building State-of-the-Art VLAs with Zero Modification

Ankit Goyal, Hugo Hadfield, Xuning Yang, Valts Blukis, Fabio Ramos

机构 * NVIDIA

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12981 2025-10-16 cs.LG 57%

Reference-Specific Unlearning Metrics Can Hide the Truth: A Reality Check

Sungjun Cho, Dasol Hwang, Frederic Sala, Sangheum Hwang, Kyunghyun Cho, Sungmin Cha

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) LG AI Research(LG人工智能研究) Seoul National University of Science and Technology(首尔科学技术大学) New York University(纽约大学) Genentech(基因泰克)

专题命中 评测与基准 :LLM(abstract);分类 cs.LG

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12948 2025-10-16 cs.SE cs.AI 57%

SpareCodeSearch: Searching for Code Context When You Have No Spare GPU

Minh Nguyen

专题命中 评测与基准 :language model(abstract);分类 cs.AI

Comments 4 pages, 3 figures, 4 tables. Accepted to Context Collection Workshop co-located with ASE'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12827 2025-10-16 eess.AS cs.AI cs.SD 57%

Automatic Speech Recognition in the Modern Era: Architectures, Training, and Evaluation

Md. Nayeem, Md Shamse Tabrej, Kabbojit Jit Deb, Shaonti Goswami, Md. Azizul Hakim

机构 * Department of Computer Science, Delhi Technological University (DTU), India(德里技术大学计算机科学系,印度) National University of Bangladesh(孟加拉国国立大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09558 2025-10-16 cs.CL 57%

AutoPR: Let's Automate Your Academic Promotion!

Qiguang Chen, Zheng Yan, Mingda Yang, Libo Qin, Yixin Yuan, Hanjing Li, Jinhao Liu, Yiyan Ji, Dengyun Peng, Jiannan Guan, Mengkang Hu, Yantao Du, Wanxiang Che

机构 * LARG Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究室) Harbin Institute of Technology(哈尔滨工业大学) School of Computer Science and Engineering(计算机科学与工程学院) Central South University(中南大学) The University of Hong Kong(香港大学) ByteDance China (Seed)(字节跳动中国(种子))

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments Preprint. Code: https://github.com/LightChen233/AutoPR . Benchmark: https://huggingface.co/datasets/yzweak/PRBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12311 2025-10-16 cs.CL 57%

Learning Optimal Prompt Ensemble for Multi-source Visual Prompt Transfer

Enming Zhang, Liwen Cao, Yanru Wu, Zijie Zhao, Yang Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Southeast University(东南大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16152 2025-10-16 cs.CL 57%

Towards Region-aware Bias Evaluation Metrics

Angana Borah, Aparna Garimella, Rada Mihalcea

机构 * University of Michigan(密歇根大学) Adobe Research(Adobe研究)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments Accepted to Cross-Cultural Considerations in NLP (C3NLP Workshop at NAACL 2025) -- Outstanding Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13652 2025-10-16 cs.CV 50%

EditCast3D: Single-Frame-Guided 3D Editing with Video Propagation and View Selection

Huaizhi Qu, Ruichen Zhang, Shuqing Luo, Luchao Qi, Zhihao Zhang, Xiaoming Liu, Roni Sengupta, Tianlong Chen

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Michigan State University(密歇根州立大学)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12995 2025-10-16 cs.CV 50%

Brought a Gun to a Knife Fight: Modern VFM Baselines Outgun Specialized Detectors on In-the-Wild AI Image Detection

Yue Zhou, Xinan He, Kaiqing Lin, Bing Fan, Feng Ding, Jinhua Zeng, Bin Li

机构 * Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室) Shenzhen Key Laboratory of Media Security(深圳媒体安全重点实验室) SZU AFS Joint Innovation Center for AI Technology, Shenzhen University(深圳大学AFS人工智能技术联合创新中心) University of North Texas(北卡罗来纳州立大学) Academy of Forensic Science(法医科学研究院) Nanchang University(南昌大学)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10414 2025-10-16 cs.CV 50%

HUMOTO: A 4D Dataset of Mocap Human Object Interactions

Jiaxin Lu, Chun-Hao Paul Huang, Uttaran Bhattacharya, Qixing Huang, Yi Zhou

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Adobe Research(Adobe研究院)

专题命中 评测与基准 :LLM(abstract)

Comments ICCV 2025, 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 21 篇

2510.00133 2025-10-16 cs.LG 86%

Large Language Models Inference Engines based on Spiking Neural Networks

Adarsha Balaji, Sandeep Madireddy, Prasanna Balaprakash

机构 * Mathematics and Computer Science Division Argonne National Laboratory(阿贡国家实验室数学与计算机科学部) Computer Science and Mathematics Division Oak Ridge National Laboratory(橡树岭国家实验室计算机科学与数学部)

专题命中 效率与部署 :language model(title,abstract);large language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19234 2025-10-16 cs.AI cs.CL cs.MA 86%

GUARDIAN: Safeguarding LLM Multi-Agent Collaborations with Temporal Graph Modeling

Jialong Zhou, Lichao Wang, Xiao Yang

机构 * King’s College London(伦敦国王学院) Beijing Institute of Technology(北京理工大学) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13668 2025-10-16 cs.DC cs.LG 85%

Adaptive Rescheduling in Prefill-Decode Disaggregated LLM Inference

Zhibin Wang, Zetao Hong, Xue Li, Zibo Wang, Shipeng Li, Qingkai Meng, Qing Wang, Chengying Huan, Rong Gu, Sheng Zhong, Chen Tian

机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) Nanjing University(南京大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13285 2025-10-16 cs.CL 85%

In-Distribution Steering: Balancing Control and Coherence in Language Model Generation

Arthur Vogels, Benjamin Wong, Yann Choho, Annabelle Blangero, Milan Bhan

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13248 2025-10-16 cs.NI cs.LG 85%

Automated Network Protocol Testing with LLM Agents

Yunze Wei, Kaiwen Wei, Shibo Du, Jianyu Wang, Zhangzhong Liu, Yawen Wang, Zhanyou Li, Congcong Miao, Xiaohui Xie, Yong Cui

机构 * Tsinghua University(清华大学) Beijing Xinertel Technology Co., Ltd.(北京新ertel技术有限公司) Tencent(腾讯)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏