arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-05 至 2025-09-05 共收录 137 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 41 篇

2509.03891 2025-09-05 cs.CL cs.CV 77%

MobileRAG: Enhancing Mobile Agent with Retrieval-Augmented Generation

Gowen Loo, Chang Liu, Qinghong Yin, Xiang Chen, Jiawei Chen, Jingyuan Zhang, Yu Tian

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03857 2025-09-05 cs.AI 77%

Continuous Monitoring of Large-Scale Generative AI via Deterministic Knowledge Graph Structures

Kishor Datta Gupta, Mohd Ariful Haque, Hasmot Ali, Marufa Kamal, Syed Bahauddin Alam, Mohammad Ashiqur Rahman

机构 * Clark Atlanta University(克拉克阿特兰大学) Daffodil International University(达福迪国际大学) BRAC University(BRAC大学) The Grainger College of Engineering Nuclear Plasma & Radiological Engineering University of Illinois Urbana-Champaign(格拉inger工程学院核物理与放射性工程大学伊利诺伊大学厄巴纳-香槟分校) Department of Electrical and Computer Engineering Florida International University(电气与计算机工程系佛罗里达国际大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03741 2025-09-05 cs.HC cs.AI 77%

Designing Gaze Analytics for ELA Instruction: A User-Centered Dashboard with Conversational AI Support

Eduardo Davalos, Yike Zhang, Shruti Jain, Namrata Srivastava, Trieu Truong, Nafees-ul Haque, Tristan Van, Jorge Salas, Sara McFadden, Sun-Joo Cho, Gautam Biswas, Amanda Goodwin

机构 * Trinity University(特里尼蒂大学) St. Mary's University(圣玛丽大学) Vanderbilt University(范德比大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 22 pages, 9 figures, 3 tables, submitted to IUI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04316 2025-09-05 cs.CL 77%

Small Changes, Large Consequences: Analyzing the Allocational Fairness of LLMs in Hiring Contexts

Preethi Seshadri, Hongyu Chen, Sameer Singh, Seraphina Goldfarb-Tarrant

机构 * UC Irvine(uci)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03696 2025-09-05 cs.IR 75%

LLMs for estimating positional bias in logged interaction data

Aleksandr V. Petrov, Michael Murtagh, Karthik Nagesh

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at the CONSEQUENCES Workshop @ RecSys'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03528 2025-09-05 cs.CL cs.CY cs.LG 73%

The ProLiFIC dataset: Leveraging LLMs to Unveil the Italian Lawmaking Process

Matilde Contestabile, Chiara Ferrara, Alberto Giovannetti, Giovanni Parrillo, Andrea Vandin

机构 * Sant'Anna School of Advanced Studies Pisa(圣安娜高级研究学院皮萨) DTU Technical University of Denmark(丹麦技术大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02349 2025-09-05 cs.SD cs.AI cs.LG 73%

AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation

Lu Wang, Hao Chen, Siyu Wu, Zhiyue Wu, Hao Zhou, Chengfeng Zhang, Ting Wang, Haodi Zhang

机构 * Lu Wang(卢王) Hao Chen(何晨) Siyu Wu(武士) Zhiyue Wu(吴致岳) Hao Zhou(周浩) Chengfeng Zhang(张成峰) Ting Wang(王婷) Haodi Zhang(张浩迪)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23746 2025-09-05 cs.CV cs.CL cs.LG cs.MM cs.SI 73%

Short-video Propagation Influence Rating: A New Real-world Dataset and A New Large Graph Model

Dizhan Xue, Shengsheng Qian, Chuanrui Hu, Changsheng Xu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Qihoo 360 AI lab(奇虎360 AI实验室)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04202 2025-09-05 cs.CL cs.SI 70%

Explicit and Implicit Data Augmentation for Social Event Detection

Congbo Ma, Yuxia Wang, Jia Wu, Jian Yang, Jing Du, Zitai Qiu, Qing Li, Hu Wang, Preslav Nakov

机构 * Macquarie University(麦考瑞大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) New York University Abu Dhabi(纽约大学阿布扎比分校)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03793 2025-09-05 cs.MA cs.AI 70%

SAMVAD: A Multi-Agent System for Simulating Judicial Deliberation Dynamics in India

Prathamesh Devadiga, Omkaar Jayadev Shetty, Pooja Agarwal

机构 * PES University(PES大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03610 2025-09-05 cs.CL 70%

NoteBar: An AI-Assisted Note-Taking System for Personal Knowledge Management

Josh Wisoff, Yao Tang, Zhengyu Fang, Jordan Guzman, YuTang Wang, Alex Yu

机构 * NoteBar Research(NoteBar研究) University of Rochester(罗切斯特大学) Case Western Reserve University(凯斯西储大学) Skidmore College(斯克里文学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10438 2025-09-05 cs.LG math.OC stat.ML 70%

MARS: Unleashing the Power of Variance Reduction for Training Large Models

Huizhuo Yuan, Yifeng Liu, Shuang Wu, Xun Zhou, Quanquan Gu

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 35 pages, 19 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13287 2025-09-05 cs.LG 70%

PAK-UCB Contextual Bandit: An Online Learning Approach to Prompt-Aware Selection of Generative Models and LLMs

Xiaoyan Hu, Ho-fung Leung, Farzan Farnia

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Independent Researcher(独立研究者)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

Comments accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03986 2025-09-05 cs.CV cs.AI cs.CL cs.LG 67%

Promptception: How Sensitive Are Large Multimodal Models to Prompts?

Mohamed Insaf Ismithdeen, Muhammad Uzair Khattak, Salman Khan

机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫罕默德·本·扎耶德人工智能大学) Swiss Federal Institute of Technology Lausanne (EPFL)(洛桑联邦理工学院) Australian National University(澳大利亚国立大学)

专题命中 评测与基准 :prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03972 2025-09-05 cs.CL cs.AI cs.LG 67%

Expanding Foundational Language Capabilities in Open-Source LLMs through a Korean Case Study

Junghwan Lim, Gangwon Jo, Sungmin Lee, Jiyoung Park, Dongseok Kim, Jihwan Kim, Junhyeok Lee, Wai Ting Cheung, Dahye Choi, Kibong Choi, Jaeyeon Huh, Beomgyu Kim, Jangwoong Kim, Taehyun Kim, Haesol Lee, Jeesoo Lee, Dongpin Oh, Changseok Song, Daewon Suh

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03883 2025-09-05 cs.CV cs.MM 67%

Human Motion Video Generation: A Survey

Haiwei Xue, Xiangyang Luo, Zhanghao Hu, Xin Zhang, Xunzhi Xiang, Yuqin Dai, Jianzhuang Liu, Zhensong Zhang, Minglei Li, Jian Yang, Fei Ma, Zhiyong Wu, Changpeng Yang, Zonghong Dai, Fei Richard Yu

机构 * Tsinghua University(清华大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Huawei Noah’s Ark Lab(华为诺亚实验室) School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学学院) Artificial Intelligence Innovation and Incubation (Al’) Institute of Fudan University(复旦大学人工智能创新与孵化院) University of Chinese Academy of Sciences(中国科学院大学) PCA Lab, Nanjing University of Science and Technology(南京理工大学PCA实验室) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) Shenzhen University and Carleton University(深圳大学和卡尔顿大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted by TPAMI. Github Repo: https://github.com/Winn1y/Awesome-Human-Motion-Video-Generation IEEE Access: https://ieeexplore.ieee.org/document/11106267

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16695 2025-09-05 cs.DL 67%

In which fields can ChatGPT detect journal article quality? An evaluation of REF2021 results

Mike Thelwall, Abdallah Yaghi

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Journal ref Trends in Information Management, 13(1), 1-29 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12552 2025-09-05 cs.CV cs.AI cs.LG 62%

Privacy-Preserving Operating Room Workflow Analysis using Digital Twins

Alejandra Perez, Han Zhang, Yu-Chun Ku, Lalithkumar Seenivasan, Roger Soberanis, Jose L. Porras, Richard Day, Jeff Jopling, Peter Najjar, Mathias Unberath

机构 * Johns Hopkins University(约翰霍普金斯大学) Johns Hopkins Medical Institutions(约翰霍普金斯医学机构)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI、cs.LG

Journal ref Medical Imaging with Deep Learning - Short Papers 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04260 2025-09-05 cs.SE cs.AI cs.CR 57%

An Empirical Study of Vulnerabilities in Python Packages and Their Detection

Haowei Quan, Junjie Wang, Xinzhe Li, Terry Yue Zhuo, Xiao Chen, Xiaoning Du

机构 * Monash University(墨尔本大学) College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学) University of Newcastle(新castle大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04214 2025-09-05 cs.CR 50%

An Automated, Scalable Machine Learning Model Inversion Assessment Pipeline

Tyler Shumaker, Jessica Carpenter, David Saranchak, Nathaniel D. Bastian

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03893 2025-09-05 cs.CV 50%

Weakly-Supervised Learning of Dense Functional Correspondences

Stefan Stojanov, Linan Zhao, Yunzhi Zhang, Daniel L. K. Yamins, Jiajun Wu

机构 * Stanford University(斯坦福大学)

专题命中 评测与基准 :language model(abstract)

Comments Accepted at ICCV 2025. Project website: https://dense-functional-correspondence.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03155 2025-09-05 cs.PL 50%

Synthesizing Optimal Object Selection Predicates for Image Editing using Lattices

Yang He, Xiaoyu Liu, Yuepeng Wang

专题命中 评测与基准 :LLM(abstract)

Comments We identified issues in the experimental results and want to withdraw the paper. We plan to submit an updated version once these issues have been resolved

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08046 2025-09-05 cs.IR 50%

MultiConIR: Towards multi-condition Information Retrieval

Xuan Lu, Sifan Liu, Bochao Yin, Yongqi Li, Xinghao Chen, Hui Su, Yaohui Jin, Wenjun Zeng, Xiaoyu Shen

专题命中 评测与基准 :LLM(abstract)

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 19 篇

2509.04377 2025-09-05 cs.LG 89%

PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference

Krishna Teja Chitty-Venkata, Jie Ye, Xian-He Sun, Anthony Kougkas, Murali Emani, Venkatram Vishwanath, Bogdan Nicolae

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12689 2025-09-05 cs.LG 89%

IC-Cache: Efficient Large Language Model Serving via In-context Caching

Yifan Yu, Yu Gan, Nikhil Sarda, Lillian Tsai, Jiaming Shen, Yanqi Zhou, Arvind Krishnamurthy, Fan Lai, Henry M. Levy, David Culler

机构 * University of Illinois Urbana-Champaign Google Google \& University of Washington

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03837 2025-09-05 cs.LG cs.IT math.IT 88%

Vehicle-to-Infrastructure Collaborative Spatial Perception via Multimodal Large Language Models

Kimia Ehsani, Walid Saad

机构 * Bradley Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted at IEEE GLOBECOM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03533 2025-09-05 cs.CL cs.LG q-fin.GN 86%

Topic Identification in LLM Input-Output Pairs through the Lens of Information Bottleneck

Igor Halperin

机构 * Fidelity Investments(fidelity投资公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 26 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03890 2025-09-05 cs.AI 85%

FaMA: LLM-Empowered Agentic Assistant for Consumer-to-Consumer Marketplace

Yineng Yan, Xidong Wang, Jin Seng Cheng, Ran Hu, Wentao Guan, Nahid Farahmand, Hengte Lin, Yue Li

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Meta Platforms, Inc(Meta平台公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01228 2025-09-05 cs.DC cs.LG 85%

ConServe: Fine-Grained GPU Harvesting for LLM Online and Offline Co-Serving

Yifan Qiao, Shu Anzai, Shan Yu, Haoran Ma, Shuo Yang, Yang Wang, Miryung Kim, Yongji Wu, Yang Zhou, Jiarong Xing, Joseph E. Gonzalez, Ion Stoica, Harry Xu

机构 * UC Berkeley(伯克利大学) UCLA(洛杉矶大学) Rice University(里奇大学) UC Davis(戴维斯大学) Intel(英特尔公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07900 2025-09-05 cs.CL cs.AI 82%

MiniCPM4: Ultra-Efficient LLMs on End Devices

MiniCPM Team, Chaojun Xiao, Yuxuan Li, Xu Han, Yuzhuo Bai, Jie Cai, Haotian Chen, Wentong Chen, Xin Cong, Ganqu Cui, Ning Ding, Shengda Fan, Yewei Fang, Zixuan Fu, Wenyu Guan, Yitong Guan, Junshao Guo, Yufeng Han, Bingxiang He, Yuxiang Huang, Baoxi Ji, Cunliang Kong, Qiuzuo Li, Siyuan Li, Wenhao Li, Xin Li, Yanghao Li, Yishan Li, Zhen Li, Dan Liu, Biyuan Lin, Yankai Lin, Xiang Long, Quanyu Lu, Yaxi Lu, Peiyan Luo, Hongya Lyu, Litu Ou, Yinxu Pan, Lushi Pu, Zekai Qu, Qundong Shi, Zijun Song, Jiayuan Su, Zhou Su, Ao Sun, Xianghui Sun, Peijun Tang, Fangzheng Wang, Feng Wang, Shuo Wang, Yudong Wang, Zheng Wang, Yesai Wu, Zhenyu Xiao, Jie Xie, Zihao Xie, Xiaoyue Xu, Yukun Yan, Jiarui Yuan, Jinqian Zhang, Kaihuo Zhang, Lei Zhang, Linyue Zhang, Xueren Zhang, Yudi Zhang, Hengyu Zhao, Weilin Zhao, Weilun Zhao, Yuanqian Zhao, Zhi Zheng, Chuyue Zhou, Ge Zhou, Jie Zhou, Wei Zhou, Yanghao Zhou, Zihan Zhou, Zixuan Zhou, Zhiyuan Liu, Guoyang Zeng, Chao Jia, Dahai Li, Maosong Sun

机构 * MiniCPM Team(MiniCPM团队)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments MiniCPM4 Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏