arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-18 至 2025-11-18 共收录 428 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 94 篇

2412.12478 2025-11-18 cs.CL cs.CR cs.HC 57%

Human-in-the-Loop Generation of Adversarial Texts: A Case Study on Tibetan Script

Xi Cao, Yuan Sun, Jiajun Li, Quzong Gesang, Nuo Qun, Tashi Nyima

机构 * Institute of National Security, Minzu University of China(中国民族大学国家安全学院) School of Information Science and Technology, Xizang University(西藏大学信息科学与技术学院) National Language Resource Monitoring & Research Center | Minority Languages Branch(国家语言资源监测与研究中心 | 少数民族语言分支) The State Key Laboratory of Tibetan Intelligence(藏语智能 state key laboratory)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments Camera-Ready Version; Accepted at IJCNLP-AACL 2025 Demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13369 2025-11-18 cs.SI physics.soc-ph 50%

Unifying points of interest taxonomies: mapping OpenStreetMap tags to the Foursquare category system

Lilou Soulas, Lorenzo Lucchini, Maurizio Napolitano, Sebastiano Bontorin, Simone Centellegher, Bruno Lepri, Riccardo Gallotti, Eleonora Andreotti

专题命中 评测与基准 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13269 2025-11-18 cs.CV 50%

Is your VLM Sky-Ready? A Comprehensive Spatial Intelligence Benchmark for UAV Navigation

Lingfeng Zhang, Yuchen Zhang, Hongsheng Li, Haoxiang Fu, Yingbo Tang, Hangjun Ye, Long Chen, Xiaojun Liang, Xiaoshuai Hao, Wenbo Ding

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12675 2025-11-18 cs.CV 50%

Appreciate the View: A Task-Aware Evaluation Framework for Novel View Synthesis

Saar Stern, Ido Sobol, Or Litany

机构 * Technion(技术学院) NVIDIA(英伟达)

专题命中 评测与基准 :foundation model(abstract)

Comments 3DV 2026. Project page: https://saarst.github.io/appreciate-the-view-website

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12633 2025-11-18 cs.CV 50%

Denoising Vision Transformer Autoencoder with Spectral Self-Regularization

Xunzhi Xiang, Xingye Tian, Guiyu Zhang, Yabo Chen, Shaofeng Zhang, Xuebo Wang, Xin Tao, Qi Fan

机构 * Nanjing University(南京大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12436 2025-11-18 cs.RO 50%

RoboAfford++: A Generative AI-Enhanced Dataset for Multimodal Affordance Learning in Robotic Manipulation and Navigation

Xiaoshuai Hao, Yingbo Tang, Lingfeng Zhang, Yanbiao Ma, Yunfeng Diao, Ziyu Jia, Wenbo Ding, Hangjun Ye, Long Chen

机构 * Xiaomi EV(小米电动车) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 Gallagher人工智能学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05982 2025-11-18 cs.CV 50%

MCA-Bench: A Multimodal Benchmark for Evaluating CAPTCHA Robustness Against VLM-based Attacks

Zonglin Wu, Yule Xue, Yaoyao Feng, Xiaolong Wang, Yiren Song

专题命中 评测与基准 :language model(abstract)

Comments we update the paper supplement

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14290 2025-11-18 cs.CV 50%

The Path to Reconciling Quality and Safety in Text-to-Image Generation: Dataset, Method, and Evaluation

Shouwei Ruan, Zhenyu Wu, Yao Huang, Ruochen Zhang, Yitong Sun, Caixin Kang, Shiji Zhao, Xingxing Wei

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室)

专题命中 评测与基准 :preference optimization(abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10810 2025-11-18 cs.CV 50%

SVBench: A Benchmark with Temporal Multi-Turn Dialogues for Streaming Video Understanding

Zhenyu Yang, Yuhang Hu, Zemin Du, Dizhan Xue, Shengsheng Qian, Jiahong Wu, Fan Yang, Weiming Dong, Changsheng Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Kuaishou Technology(快手科技) Zhengzhou University(郑州大学) ShanghaiTech University(上海科技大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 评测与基准 :language model(abstract)

Comments ICLR 2025 Accepted (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06251 2025-11-18 cs.CV 50%

Physics Knowledge in Frontier Models: A Diagnostic Study of Failure Modes

Ieva Bagdonaviciute, Vibhav Vineet

专题命中 评测与基准 :language model(abstract)

Comments 8 pages, 7 figures. Preprint. v2: Updated experiments and diagnostics; formatting fixes

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05456 2025-11-18 cs.CV 50%

SITE: towards Spatial Intelligence Thorough Evaluation

Wenqi Wang, Reuben Tan, Pengyue Zhu, Jianwei Yang, Zhengyuan Yang, Lijuan Wang, Andrey Kolobov, Jianfeng Gao, Boqing Gong

机构 * Boston University(波士顿大学) Microsoft Research(微软研究院)

专题命中 评测与基准 :language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 88 篇

2511.13023 2025-11-18 cs.LG cs.AI 91%

SLMQuant:Benchmarking Small Language Model Quantization for Practical Deployment

Jiacheng Wang, Yejun Zeng, Jinyang Guo, Yuqing Ma, Aishan Liu, Xianglong Liu

机构 * SKLCCSE School of Artificial Intelligence(人工智能学院) Beihang University(北航) School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13717 2025-11-18 cs.CR 91%

TZ-LLM: Protecting On-Device Large Language Models with Arm TrustZone

Xunjie Wang, Jiacheng Shi, Zihan Zhao, Yang Yu, Zhichao Hua, Jinyu Gu

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13476 2025-11-18 cs.AI 90%

Multi-Agent Multimodal Large Language Model Framework for Automated Interpretation of Fuel Efficiency Analytics in Public Transportation

Zhipeng Ma, Ali Rida Bahja, Andreas Burgdorf, André Pomp, Tobias Meisen, Bo Nørregaard Jørgensen, Zheng Grace Ma

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref Applied Sciences, 2025, 15(21), 11619

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11624 2025-11-18 cs.DC cs.AI cs.CL cs.LG 90%

Characterizing and Understanding Energy Footprint and Efficiency of Small Language Model on Edges

Md Romyull Islam, Bobin Deng, Nobel Dhar, Tu N. Nguyen, Selena He, Yong Shi, Kun Suo

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Submitted version; 9 pages, 5 figures; presented at IEEE MASS 2025 (online publication pending)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06706 2025-11-18 cs.CL 89%

Simultaneous Machine Translation with Large Language Models

Minghan Wang, Jinming Zhao, Thuy-Trang Vu, Fatemeh Shiri, Ehsan Shareghi, Gholamreza Haffari

机构 * Department of Data Science & AI, Monash University(数据科学与人工智能系,墨尔本大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to ALTA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15278 2025-11-18 cs.LG cs.CL 88%

PIP: Perturbation-based Iterative Pruning for Large Language Models

Yi Cao, Wei-Jie Xu, Yucheng Shen, Weijie Shi, Chi-Min Chan, Jianfeng Qu, Jiajie Xu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025 Findings, 17 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13746 2025-11-18 cs.LG cs.AI cs.DC 88%

CG-FedLLM: How to Compress Gradients in Federated Fune-tuning for Large Language Models

Huiwen Wu, Xiaogang Xu, Deyi Zhang, Xiaohan Li, Jiafei Wu, Zhe Liu

机构 * Zhejiang Laboratory(浙江实验室)

专题命中 效率与部署 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11821 2025-11-18 cs.CL cs.AI 88%

Scaling Open-Weight Large Language Models for Hydropower Regulatory Information Extraction: A Systematic Analysis

Hong-Jun Yoon, Faisal Ashraf, Thomas A. Ruggles, Debjani Singh

机构 * Oak Ridge National Laboratory(奥克伍德国家实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 18 pages, zero figures, Preprint submitted to Environmental Modeling and Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14398 2025-11-18 cs.CL cs.AI cs.LG 88%

On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning

Simon Kurz, Jian-Jia Chen, Lucie Flek, Zhixue Zhao

机构 * Department of Computer Science, TU Dortmund University(图恩-多特蒙德大学计算机科学系) Bonn-Aachen International Center for Information Technology, University of Bonn(波恩-亚琛国际信息科技中心,波恩大学) Computer Science School, University of Sheffield(谢菲尔德大学计算机科学学院) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能与机器学习研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted for publication in TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09920 2025-11-18 cs.CY 88%

Uncovering Strategic Egoism Behaviors in Large Language Models

Yaoyuan Zhang, Aishan Liu, Zonghao Ying, Xianglong Liu, Jiangfan Liu, Yisong Xiao, Qihang Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

Comments PersonaNLP@NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12236 2025-11-18 cs.CL cs.AI cs.LG 87%

Consistency Is the Key: Detecting Hallucinations in LLM Generated Text By Checking Inconsistencies About Key Facts

Raavi Gupta, Pranav Hari Panicker, Sumit Bhatia, Ganesh Ramakrishnan

机构 * Columbia University(哥伦比亚大学) IIT Bombay(印度理工学院Bombay) Media and Data Science Research (MDSR) Lab, Adobe(Adobe媒体与数据科学研究实验室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear at International Joint Conference on Natural Language Processing & Asia-Pacific Chapter of the Association for Computational Linguistics (IJCNLP-AACL), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10552 2025-11-18 cs.CL 86%

Conversational SimulMT: Efficient Simultaneous Translation with Large Language Models

Minghan Wang, Thuy-Trang Vu, Yuxia Wang, Ehsan Shareghi, Gholamreza Haffari

机构 * Department of Data Science & AI, Monash University(数据科学与人工智能系,莫纳什大学) MBZUAI(马克斯·普朗克智能系统研究所)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments Accepted to IWSLT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06261 2025-11-18 cs.LG cs.CL 86%

Hogwild! Inference: Parallel LLM Generation via Concurrent Attention

Gleb Rodionov, Roman Garipov, Alina Shutova, George Yakushev, Erik Schultheis, Vage Egiazarian, Anton Sinitsin, Denis Kuznedelev, Dan Alistarh

机构 * Yandex HSE University(俄罗斯高等经济大学) IST Austria(国际研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12751 2025-11-18 cs.LG cs.AI cs.RO 86%

Are LLMs The Way Forward? A Case Study on LLM-Guided Reinforcement Learning for Decentralized Autonomous Driving

Timur Anvar, Jeffrey Chen, Yuyan Wang, Rohan Chandra

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19662 2025-11-18 cs.AR cs.AI 85%

HALO: Hardware-aware quantization with low critical-path-delay weights for LLM acceleration

Rohan Juneja, Shivam Aggarwal, Safeen Huda, Tulika Mitra, Li-Shiuan Peh

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12217 2025-11-18 cs.LG 85%

AlignTree: Efficient Defense Against LLM Jailbreak Attacks

Gil Goren, Shahar Katz, Lior Wolf

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted as an Oral Presentation at the 40th AAAI Conference on Artificial Intelligence (AAAI-26), January 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12031 2025-11-18 cs.DC cs.AI 85%

Striking the Right Balance between Compute and Copy: Improving LLM Inferencing Under Speculative Decoding

Arun Ramachandran, Ramaswamy Govindarajan, Murali Annavaram, Prakash Raghavendra, Hossein Entezari Zarch, Lei Gao, Chaoyi Jiang

机构 * Indian Institute of Science (IISc)(印度科学研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11788 2025-11-18 cs.MA cs.AI 85%

MALBO: Optimizing LLM-Based Multi-Agent Teams via Multi-Objective Bayesian Optimization

Antonio Sabbatella

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Master's Thesis, University of Milano-Bicocca, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11733 2025-11-18 cs.DC cs.AI 85%

Speculative Decoding in Decentralized LLM Inference: Turning Communication Latency into Computation Throughput

Jingwei Song, Wanyi Chen, Xinyuan Song, Max, Chris Tong, Gufeng Chen, Tianyi Zhao, Eric Yang, Bill Shi, Lynn Ai

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages, 2 figures, 2 tables. Uses ICML 2025 style

详情

展开后加载摘要…

URL PDF HTML 收藏