arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-14 至 2025-08-14 共收录 134 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 41 篇

2507.00938 2025-08-14 cs.IR cs.AI cs.DB 70%

WebArXiv: Evaluating Multimodal Agents on Time-Invariant arXiv Tasks

Zihao Sun, Ling Chen

机构 * University of Technology Sydney(悉尼技术大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22557 2025-08-14 cs.CR cs.LG 70%

MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMs

Boyuan Chen, Minghao Shao, Abdul Basit, Siddharth Garg, Muhammad Shafique

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09517 2025-08-14 cs.CL 70%

UWBa at SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval

Ladislav Lenc, Daniel Cífka, Jiří Martínek, Jakub Šmíd, Pavel Král

机构 * Department of Computer Science and Engineering, University of West Bohemia in Pilsen(西波希米亚大学信息科学与工程系) New Technologies for the Information Society, University of West Bohemia in Pilsen(西波希米亚大学信息社会新技术研究所)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Published in Proceedings of the 19th International Workshop on Semantic Evaluation (SemEval-2025). Official version: https://aclanthology.org/2025.semeval-1.31/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09203 2025-08-14 cs.LG 70%

Building Safer Sites: A Large-Scale Multi-Level Dataset for Construction Safety Research

Zhenhui Ou, Dawei Li, Zhen Tan, Wenlin Li, Huan Liu, Siyuan Song

机构 * Arizona State University(亚利桑那州立大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

Comments The paper was accepted on the CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09641 2025-08-14 cs.CE 67%

VisFinEval: A Scenario-Driven Chinese Multimodal Benchmark for Holistic Financial Understanding

Zhaowei Liu, Xin Guo, Haotian Xia, Lingfeng Zeng, Fangqi Lou, Jinyi Niu, Mengping Li, Qi Qi, Jiahuan Li, Wei Zhang, Yinglong Wang, Weige Cai, Weining Shen, Liwen Zhang

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09566 2025-08-14 cs.CV 67%

A Chain of Diagnosis Framework for Accurate and Explainable Radiology Report Generation

Haibo Jin, Haoxuan Che, Sunan He, Hao Chen

机构 * Department of Computer Science and Engineering, Hong Kong University of Science and Technology(计算机科学与工程系,香港科学理工大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted to IEEE TMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09987 2025-08-14 cs.CV cs.AI cs.CL 62%

Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation

Junyan Ye, Dongzhi Jiang, Zihao Wang, Leqi Zhu, Zhenghao Hu, Zilong Huang, Jun He, Zhiyuan Yan, Jinghua Yu, Hongsheng Li, Conghui He, Weijia Li

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Sun Yat-sen University(中山大学) CUHK MMLab(香港中文大学多模态实验室) Peking University(北京大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.CL、cs.AI

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09155 2025-08-14 cs.LG cs.AI 62%

A Rolling Stone Gathers No Moss: Adaptive Policy Optimization for Stable Self-Evaluation in Large Multimodal Models

Wenkai Wang, Hongcan Guo, Zheqi Lv, Shengyu Zhang

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09983 2025-08-14 cs.CV cs.GR cs.LG 57%

Story2Board: A Training-Free Approach for Expressive Storyboard Generation

David Dinkevich, Matan Levy, Omri Avrahami, Dvir Samuel, Dani Lischinski

机构 * Hebrew University of Jerusalem(耶路撒冷希伯来大学) OriginAI Bar-Ilan University(巴伊兰大学)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

Comments Project page is available at https://daviddinkevich.github.io/Story2Board/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09966 2025-08-14 cs.CV cs.AI 57%

January Food Benchmark (JFB): A Public Benchmark Dataset and Evaluation Suite for Multimodal Food Analysis

Amir Hosseinian, Ashkan Dehghani Zahedani, Umer Mansoor, Noosheen Hashemi, Mark Woodward

机构 * January AI

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09715 2025-08-14 cs.CV cs.LG 57%

NEURAL: Attention-Guided Pruning for Unified Multimodal Resource-Constrained Clinical Evaluation

Devvrat Joshi, Islem Rekik

机构 * BASIRA Lab, Imperial-X (I-X) and Department of Computing, Imperial College London(BASIRA实验室、Imperial-X(I-X)及帝国理工学院计算机系)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17857 2025-08-14 q-bio.BM cs.LG 57%

AbRank: A Benchmark Dataset and Metric-Learning Framework for Antibody-Antigen Affinity Ranking

Chunan Liu, Aurelien Pelissier, Yanjun Shao, Lilian Denzler, Andrew C. R. Martin, Brooks Paige, María Rodríguez Martínez

机构 * Structural Molecular Biology, Division of Biosciences, University College London(伦敦大学学院生物结构分子生物学系) Institute of Computational Life Sciences, Zürich University of Applied Sciences (ZHAW)(苏黎世应用科学大学计算生命科学研究所) Biomedical Informatics and Data Science, Yale School of Medicine(耶鲁医学院生物医学信息学与数据科学) Centre for Artificial Intelligence, University College London(伦敦大学学院人工智能中心)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01330 2025-08-14 cs.CV cs.AI 57%

Pediatric brain tumor classification using digital histopathology and deep learning: evaluation of SOTA methods on a multi-center Swedish cohort

Iulian Emil Tampu, Per Nyman, Christoforos Spyretos, Ida Blystad, Alia Shamikh, Gabriela Prochazka, Teresita Díaz de Ståhl, Johanna Sandgren, Peter Lundberg, Neda Haj-Hosseini

机构 * Department of Biomedical Engineering, Linköping University, Sweden(生物医学工程系,利厄普大学) Center for Medical Image Science and Visualization, Linköping University, Sweden(医学影像科学与可视化中心,利厄普大学) Crown Princess Victoria Children’s Hospital and Department of Health, Medicine and Caring Sciences, Linköping University, Sweden(维多利亚公主儿童医院和健康、医学与关怀科学系,利厄普大学) Department of Radiology and Department of Health, Medicine and Caring Sciences, Linköping University, Sweden(放射科和健康、医学与关怀科学系,利厄普大学) Department of Oncology-Pathology, Karolinska Institutet, Solna, Sweden(肿瘤病理学系,卡罗林斯卡研究所,索纳) Department of Clinical Pathology and Cancer Diagnostics, Karolinska University Hospital, Sweden(临床病理学和癌症诊断系,卡罗林斯卡大学医院) Department of Radiation Physics and Department of Medical and Health Sciences, Linköping University, Sweden(放射物理系和医学与健康科学系,利厄普大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI

Journal ref Tampu IE et al. Pediatric brain tumor classification using digital pathology and deep learning: Evaluation of SOTA methods on a multi-center Swedish cohort. Brain Pathology. 2025. e70029

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09450 2025-08-14 cs.CL 57%

From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text

Ridwan Mahbub, Mohammed Saidul Islam, Mir Tafseer Nayeem, Md Tahmid Rahman Laskar, Mizanur Rahman, Shafiq Joty, Enamul Hoque

机构 * York University, Canada(约克大学,加拿大) University of Alberta, Canada(阿尔伯塔大学,加拿大) Dialpad Inc., Canada(Dialpad公司,加拿大) RBC, Canada(RBC,加拿大) Nanyang Technological University, Singapore(南洋理工大学,新加坡) Salesforce AI, USA(Salesforce AI,美国)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09967 2025-08-14 cs.CV 50%

MOC: Meta-Optimized Classifier for Few-Shot Whole Slide Image Classification

Tianqi Xiang, Yi Li, Qixiang Zhang, Xiaomeng Li

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学)

专题命中 评测与基准 :foundation model(abstract)

Comments Accepted in MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09667 2025-08-14 cs.CV 50%

GSFixer: Improving 3D Gaussian Splatting with Reference-Guided Video Diffusion Priors

Xingyilang Yin, Qi Zhang, Jiahao Chang, Ying Feng, Qingnan Fan, Xi Yang, Chi-Man Pun, Huaqi Zhang, Xiaodong Cun

机构 * University of Macau(澳门大学) VIVO CUHKSZ(香港中文大学) Xidian University(西安电子科技大学) GVC Lab, Great Bay University(大澳大学GVC实验室)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09245 2025-08-14 cs.CV 50%

Beyond Blanket Masking: Examining Granularity for Privacy Protection in Images Captured by Blind and Low Vision Users

Jeffri Murrugarra-LLerena, Haoran Niu, K. Suzanne Barber, Hal Daumé, Yang Trista Cao, Paola Cascante-Bonilla

机构 * Stony Brook University(石溪大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Maryland(马里兰大学)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 25 篇

2508.09471 2025-08-14 cs.LG 92%

EGGS-PTP: An Expander-Graph Guided Structured Post-training Pruning Method for Large Language Models

Omar Bazarbachi, Zijun Sun, Yanning Shen

机构 * Department of Electrical Engineering and Computer Science University of California, Irvine(电气工程与计算机科学系加州大学伊文斯顿分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09834 2025-08-14 cs.CL cs.AI cs.CV 91%

Speed Always Wins: A Survey on Efficient Architectures for Large Language Models

Weigao Sun, Jiaxi Hu, Yucheng Zhou, Jusen Du, Disen Lan, Kexin Wang, Tong Zhu, Xiaoye Qu, Yu Zhang, Xiaoyu Mo, Daizong Liu, Yuxuan Liang, Wenliang Chen, Guoqi Li, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) HKUST (GZ)(香港科技大学) University of Macau(澳门大学) Institute of Automation Chinese Academy of Sciences(中国科学院自动化研究所) Soochow University(苏州大学) KTH Royal Institute of Technology(皇家理工学院) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

Comments Survey, 82 pages, GitHub: https://github.com/weigao266/Awesome-Efficient-Arch

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19090 2025-08-14 cs.LG 88%

Pivoting Factorization: A Compact Meta Low-Rank Representation of Sparsity for Efficient Inference in Large Language Models

Jialin Zhao, Yingtao Zhang, Carlo Vittorio Cannistraci

机构 * Center for Complex Network Intelligence (CCNI), Tsinghua Laboratory of Brain and Intelligence (THBI), Department of Psychological and Cognitive Sciences(复杂网络智能中心(CCNI)、清华脑智能实验室(THBI)、心理与认知科学系) Department of Computer Science(计算机科学系) Department of Biomedical Engineering, Tsinghua University, China(生物医学工程系,清华大学,中国)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14910 2025-08-14 cs.CL cs.AI 86%

EvoP: Robust LLM Inference via Evolutionary Pruning

Shangyu Wu, Hongchao Du, Ying Xiong, Shuai Chen, Tei-Wei Kuo, Nan Guan, Chun Jason Xue

机构 * City University of Hong Kong(香港城市大学) Mohamed bin Zayed University of Artificial Intelligence(马尔代夫穆罕默德·本·扎耶德人工智能大学) Baidu(百度) National Taiwan University(国立台湾大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09173 2025-08-14 cs.NI 85%

Camel: Energy-Aware LLM Inference on Resource-Constrained Devices

Hao Xu, Long Peng, Shezheng Song, Xiaodong Liu, Ma Jun, Shasha Li, Jie Yu, Xiaoguang Mao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09149 2025-08-14 cs.NI cs.DC 85%

Semantic-Aware LLM Orchestration for Proactive Resource Management in Predictive Digital Twin Vehicular Networks

Seyed Hossein Ahmadpanah

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09148 2025-08-14 cs.LG cs.AI 82%

Motif 2.6B Technical Report

Junghwan Lim, Sungmin Lee, Dongseok Kim, Eunhwan Park, Hyunbyung Park, Junhyeok Lee, Wai Ting Cheung, Dahye Choi, Jaeheui Her, Jaeyeon Huh, Hanbin Jung, Changjin Kang, Beomgyu Kim, Jihwan Kim, Minjae Kim, Taehwan Kim, Youngrok Kim, Haesol Lee, Jeesoo Lee, Kungyu Lee, Dongpin Oh, Yeongjae Park, Bokki Ryu, Daewon Suh, Dongjoo Weon

机构 * Motif Technologies

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09240 2025-08-14 cs.NI cs.AI cs.CL 79%

NEFMind: Parameter-Efficient Fine-Tuning of Open-Source LLMs for Telecom APIs Automation

Zainab Khan, Ahmed Hussain, Mukesh Thakur, Arto Hellas, Panos Papadimitratos

机构 * Alto University, School of Science, Espoo, Finland(阿尔托大学科学学院,芬兰) Networked Systems Security (NSS) Group -- KTH Royal Institute of Technology, Stockholm, Sweden(网络系统安全(NSS)小组——皇家理工学院,瑞典) Ericsson, Finland(爱立信,芬兰)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09199 2025-08-14 cs.CV cs.AI cs.CL 79%

$Δ$-AttnMask: Attention-Guided Masked Hidden States for Efficient Data Selection and Augmentation

Jucheng Hu, Suorong Yang, Dongzhan Zhou

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06323 2025-08-14 cs.LG cs.AI 79%

Mosaic: Composite Projection Pruning for Resource-efficient LLMs

Bailey J. Eccles, Leon Wong, Blesson Varghese

机构 * organization= School of Computer Science, University of St Andrews , addressline= Jack Cole Building , city= St Andrews , postcode= KY16 9SX , state= Fife , country= Scotland, United Kingdom organization= Autonomous Networking Research \& Innovation Department, Rakuten Mobile, Inc. , addressline= Rakuten Crimson House, 1-14-1 Tamagawa, Setagaya-ku , city= Tokyo , postcode= 158-0094 , state= Tokyo , country= Japan

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09470 2025-08-14 cs.CV 78%

CitySeg: A 3D Open Vocabulary Semantic Segmentation Foundation Model in City-scale Scenarios

Jialei Xu, Zizhuang Wei, Weikang You, Linyun Li, Weijian Sun

机构 * Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09500 2025-08-14 cs.CV 78%

Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations

Yiwen Liang, Hui Chen, Yizhe Xiong, Zihan Zhou, Mengyao Lyu, Zijia Lin, Shuaicheng Niu, Sicheng Zhao, Jungong Han, Guiguang Ding

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :language model(title,abstract)

Comments Accepted at the 33rd ACM International Conference on Multimedia(ACM MM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09755 2025-08-14 cs.CL 77%

Transforming Questions and Documents for Semantically Aligned Retrieval-Augmented Generation

Seokgi Lee

机构 * Seokgi Lee

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏