arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-15 至 2025-10-15 共收录 213 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 36 篇

2510.12072 2025-10-15 cs.AI cs.RO 77%

EmboMatrix: A Scalable Training-Ground for Embodied Decision-Making

Zixing Lei, Sheng Yin, Yichen Xiong, Yuanzhuo Ding, Wenhao Huang, Yuxi Wei, Qingyao Xu, Yiming Li, Weixin Li, Yunhong Wang, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Zhongguancun Academy(中关村学院) New York University(纽约大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08067 2025-10-15 cs.SE cs.LG 77%

K-ASTRO: Structure-Aware Adaptation of LLMs for Code Vulnerability Detection

Yifan Zhang, Michael Sandborn, Stefan Larson, Yu Huang, Kevin Leach

机构 * Vanderbilt University(范德比大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17238 2025-10-15 cs.AI cs.CL cs.LG 75%

MoEs Are Stronger than You Think: Hyper-Parallel Inference Scaling with RoE

Soheil Zibakhsh, Mohammad Samragh, Kumari Nishu, Lauren Hannah, Arnav Kundu, Minsik Cho

机构 * Apple(苹果公司) University of California San Diego(加州大学圣地亚哥分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Corrected typo in arxiv abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12474 2025-10-15 cs.CL cs.LG 73%

SMEC: Rethinking Matryoshka Representation Learning for Retrieval Embedding Compression

Biao Zhang, Lixin Chen, Tong Liu, Bo Zheng

机构 * Taobao & Tmall Group of Alibaba(淘宝与天猫集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11958 2025-10-15 cs.CL cs.AI 73%

Direct Multi-Token Decoding

Xuan Luo, Weizhi Wang, Xifeng Yan

机构 * Department of Computer Science, UC Santa Barbara(计算机科学系,加州大学圣芭芭拉分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16548 2025-10-15 cs.LG cs.CL 73%

SCAN: Self-Denoising Monte Carlo Annotation for Robust Process Reward Learning

Yuyang Ding, Xinyu Shi, Juntao Li, Xiaobo Liang, Zhaopeng Tu, Min Zhang

机构 * Soochow University(苏州大学) Tencent(腾讯)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025. Project page: https://scan-prm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15877 2025-10-15 cs.CV cs.CL cs.LG 73%

Highlighting What Matters: Promptable Embeddings for Attribute-Focused Image Retrieval

Siting Li, Xiang Gao, Simon Shaolei Du

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025; 27 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12719 2025-10-15 cs.LG q-bio.QM 70%

Multitask finetuning and acceleration of chemical pretrained models for small molecule drug property prediction

Matthew Adrian, Yunsie Chung, Kevin Boyd, Saee Paliwal, Srimukh Prasad Veccham, Alan C. Cheng

机构 * Modeling & Informatics(建模与信息学) Merck & Co., Inc.(默克公司) BioNeMo

专题命中 效率与部署 :foundation model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11832 2025-10-15 cs.LG 70%

Z0-Inf: Zeroth Order Approximation for Data Influence

Narine Kokhlikyan, Kamalika Chaudhuri, Saeed Mahloujifar

机构 * FAIR at Meta(Meta 的 FAIR)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12299 2025-10-15 cs.IR 67%

An Empirical Study for Representations of Videos in Video Question Answering via MLLMs

Zhi Li, Yanan Wang, Hao Niu, Julio Vizcarra, Masato Taya

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02659 2025-10-15 cs.LG cs.CL 62%

OmniDraft: A Cross-vocabulary, Online Adaptive Drafter for On-device Speculative Decoding

Ramchalam Kinattinkara Ramakrishnan, Zhaocong Yuan, Shaojie Zhuo, Chen Feng, Yicheng Lin, Chenzheng Su, Xiaopeng Zhang

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16845 2025-10-15 cs.CV cs.AI cs.LG 62%

NinA: Normalizing Flows in Action. Training VLA Models with Normalizing Flows

Denis Tarasov, Alexander Nikulin, Ilya Zisman, Albina Klepach, Nikita Lyubaykin, Andrei Polubarov, Alexander Derevyagin, Vladislav Kurenkov

机构 * ETH Zürich(苏黎世联邦理工学院) MIPT(莫斯科国立信息安全大学) Skoltech(斯克里普斯基技术大学) Innopolis University(因诺波利斯大学) HSE(俄罗斯高等经济学院)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

Comments https://github.com/dunnolab/NinA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12014 2025-10-15 cs.IR cs.LG 57%

Embedding the Teacher: Distilling vLLM Preferences for Scalable Image Retrieval

Eric He, Akash Gupta, Adian Liusie, Vatsal Raina, Piotr Molenda, Shirom Chabra, Vyas Raina

机构 * University of Cambridge(剑桥大学) Apta

专题命中 效率与部署 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11738 2025-10-15 cs.SD cs.AI cs.CV cs.MM 57%

SeeingSounds: Learning Audio-to-Visual Alignment via Text

Simone Carnemolla, Matteo Pennisi, Chiara Russo, Simone Palazzo, Daniela Giordano, Concetto Spampinato

机构 * University of Catania(卡塔尼亚大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments accepted to ACM Multimedia Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10349 2025-10-15 cs.CR cs.AI 57%

Optimized Layerwise Approximation for Efficient Private Inference on Fully Homomorphic Encryption

Junghyun Lee, Eunsang Lee, Young-Sik Kim, Yongwoo Lee, Joon-Woo Lee, Yongjune Kim, Jong-Seon No

机构 * Department of Electrical and Computer Engineering, INMC, Seoul National University(电子与计算机工程系,首尔国立大学) School of Computer Science and Engineering, Chung-Ang University(计算机科学与工程学院, Chung-Ang 大学) Department of Software, Sejong University(软件系,世宗大学) Department of Electrical Engineering and Computer Science, DGIST(电子与计算机科学系,DGIST) Department of Electrical and Electronic Engineering, Inha University(电子与电气工程系,Inha 大学) Department of Electrical Engineering, POSTECH(电子工程系,POSTECH)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12724 2025-10-15 cs.RO 50%

T(R,O) Grasp: Efficient Graph Diffusion of Robot-Object Spatial Transformation for Cross-Embodiment Dexterous Grasping

Xin Fei, Zhixuan Xu, Huaicong Fang, Tianrui Zhang, Lin Shao

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) RoboScience College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 效率与部署 :foundation model(abstract)

Comments 12 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12556 2025-10-15 quant-ph 50%

Optimization of the time-multiplexed SPDC source at 900-950 nm range

V. O. Gotovtsev, I. V. Dyakonov, O. V. Borzenkova, K. A. Taratorin, T. B. Dugarnimaev, A. A. Korneev, S. P. Kulik, S. S. Straupe

专题命中 效率与部署 :prompting(abstract)

Comments 9 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05864 2025-10-15 cs.CV 50%

CryoFastAR: Fast Cryo-EM Ab Initio Reconstruction Made Easy

Jiakai Zhang, Shouchen Zhou, Haizhao Dai, Xinhang Liu, Peihao Wang, Zhiwen Fan, Yuan Pei, Jingyi Yu

机构 * ShanghaiTech University(上海科技大學) Cellverse, Co., Ltd(Cellverse公司) HKUST(香港科技大学) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 19 篇

2408.02377 2025-10-15 cs.CL cs.AI 89%

A Few-Shot Approach for Relation Extraction Domain Adaptation using Large Language Models

Vanni Zavarella, Juan Carlos Gamero-Salinas, Sergio Consoli

机构 * Department of Mathematics and Computer Science, University of Cagliari, Cagliari, Italy(数学与计算机科学系,卡利亚里大学,卡利亚里,意大利) Institute of Data Science and Artificial Intelligence (DATAI), Universidad de Navarra, Pamplona, Spain(数据科学与人工智能研究所(DATAI),纳瓦拉大学,潘普隆,西班牙) European Commission, Joint Research Centre (DG JRC), Ispra (VA), Italy(欧洲委员会,联合研究中心(DG JRC),伊斯普拉(瓦拉),意大利)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref CEUR Workshop Proceedings, Vol. 3894 (2024), Workshop at KDD 2024 on Deep Learning and Large Language Models for Knowledge Graphs

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12189 2025-10-15 cs.CE 89%

Agent-Based Simulation of a Financial Market with Large Language Models

Ryuji Hashimoto, Takehiro Takayanagi, Masahiro Suzuki, Kiyoshi Izumi

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18180 2025-10-15 cs.AI 88%

Large Language Models in Operations Research: Methods, Applications, and Challenges

Yang Wang, Kai Li

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00739 2025-10-15 cs.CL 87%

DefenderBench: A Toolkit for Evaluating Language Agents in Cybersecurity Environments

Chiyu Zhang, Marc-Alexandre Cote, Michael Albada, Anush Sankaran, Jack W. Stokes, Tong Wang, Amir Abdi, William Blum, Muhammad Abdul-Mageed

机构 * Microsoft(微软公司) The University of British Columbia(不列颠哥伦比亚大学)

专题命中 领域大模型 :language agent(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025 Workshop Scaling Environments for Agents (SEA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12116 2025-10-15 cs.CL cs.AI 81%

Understanding the Modality Gap: An Empirical Study on the Speech-Text Alignment Mechanism of Large Speech Language Models

Bajian Xiang, Shuaijiang Zhao, Tingwei Guo, Wei Zou

机构 * Beike Inc.(贝克公司) Bairong Inc.(柏睿公司)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07330 2025-10-15 cs.LG cs.AI 81%

General Demographic Foundation Models for Enhancing Predictive Performance Across Diseases and Populations

Li-Chin Chen, Ji-Tian Sheu, Yuh-Jue Chuang

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04295 2025-10-15 cs.CY cs.AI cs.CL cs.HC 81%

LearnLens: LLM-Enabled Personalised, Curriculum-Grounded Feedback with Educators in the Loop

Runcong Zhao, Artem Bobrov, Jiazheng Li, Cesare Aloisi, Yulan He

机构 * King’s College London(伦敦国王学院) AQA

专题命中 领域大模型 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14214 2025-10-15 cs.AI cs.ET 79%

Physics-Informed Autonomous LLM Agents for Explainable Power Electronics Modulation Design

Junhua Liu, Fanfan Lin, Xinze Li, Kwan Hui Lim, Shuai Zhao

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

Comments Accepted to AAAI 2026 Innovative Applications of AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11985 2025-10-15 cs.AI 79%

CGBench: Benchmarking Language Model Scientific Reasoning for Clinical Genetics Research

Owen Queen, Harrison G. Zhang, James Zou

机构 * Stanford University(斯坦福大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13423 2025-10-15 cs.IR cs.AI 79%

AdaptJobRec: Enhancing Conversational Career Recommendation through an LLM-Powered Agentic System

Qixin Wang, Dawei Wang, Kun Chen, Yaowei Hu, Puneet Girdhar, Ruoteng Wang, Aadesh Gupta, Chaitanya Devella, Wenlai Guo, Shangwen Huang, Bachir Aoun, Greg Hayworth, Han Li, Xintao Wu

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08621 2025-10-15 cs.LG cs.SE 79%

MooseAgent: A LLM Based Multi-agent Framework for Automating Moose Simulation

Tao Zhang, Zhenhai Liu, Yong Xin, Yongjun Jiao

机构 * State Key Laboratory of Advanced Nuclear Energy Technology(先进核能技术国家重点实验室) Nuclear Power Institute of China(中国核能研究院)

专题命中 领域大模型 :LLM(title);language model(abstract);分类 cs.LG

Comments 11 pages, 3 Figs

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12115 2025-10-15 cs.CL 77%

Tracing Multilingual Knowledge Acquisition Dynamics in Domain Adaptation: A Case Study of English-Japanese Biomedical Adaptation

Xin Zhao, Naoki Yoshinaga, Yuma Tsuta, Akiko Aizawa

机构 * The University of Tokyo(东京大学) National Institute of Informatics(日本信息机构) Institute of Industrial Science, The University of Tokyo(东京大学工业科学研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 22 Pages, Submitted to ARR 2025 Oct

详情

展开后加载摘要…

URL PDF HTML 收藏