arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-12 至 2025-09-12 共收录 116 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 13 篇

2509.09066 2025-09-12 cs.AI 85%

Instructional Prompt Optimization for Few-Shot LLM-Based Recommendations on Cold-Start Users

Haowei Yang, Yushang Zhao, Sitao Min, Bo Su, Chao Yao, Wei Xu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07571 2025-09-12 cs.MA cs.AI 77%

Towards Generalized Routing: Model and Agent Orchestration for Adaptive and Efficient Inference

Xiyu Guo, Shan Wang, Chunfang Ji, Xuefeng Zhao, Wenhao Xi, Yaoyao Liu, Qinglan Li, Chao Deng, Junlan Feng

机构 * JIUTIAN Team, China Mobile Research Institute(钧天团队,中国移动研究院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09292 2025-09-12 cs.AI 70%

LightAgent: Production-level Open-source Agentic AI Framework

Weige Cai, Tong Zhu, Jinyi Niu, Ruiqi Hu, Lingyao Li, Tenglong Wang, Xiaowu Dai, Weining Shen, Liwen Zhang

机构 * Shanghai University of Finance and Economics(上海财经大学) University of California Los Angeles(加州大学洛杉矶分校) Fudan University(复旦大学) Shanghai University(上海大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09146 2025-09-12 cs.LG cs.AI cs.NI 62%

To Theoretically Understand Transformer-Based In-Context Learning for Optimizing CSMA

Shugang Hao, Hongbo Li, Lingjie Duan

机构 * Singapore University of Technology and Design(新加坡科技设计大学) The Ohio State University(俄亥俄州立大学) Hong Kong University of Science and Technology(香港科学科技大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14755 2025-09-12 cs.AI cs.CL 62%

Optimizing Length Compression in Large Reasoning Models

Zhengxiang Cheng, Dongping Chen, Mingyang Fu, Tianyi Zhou

机构 * umd(马里兰大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09226 2025-09-12 cs.LG cs.IR 57%

Constructing a Question-Answering Simulator through the Distillation of LLMs

Haipeng Liu, Ting Long, Jing Fu

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21831 2025-09-12 cs.CV cs.AI 57%

Early Exit and Multi Stage Knowledge Distillation in VLMs for Video Summarization

Anas Anwarul Haq Khan, Utkarsh Verma, Ganesh Ramakrishnan

机构 * Department of Computer Science and Engineering, IIT Bombay(印度理工学院班加罗尔计算机科学与工程系) Center of Machine Intelligence and Data Science (C-MInDS), IIT Bombay(印度理工学院班加罗尔人工智能与数据科学中心)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 8 篇

2507.10576 2025-09-12 cs.CY cs.AI cs.CL cs.ET 90%

Can Large Language Models Understand As Well As Apply Patent Regulations to Pass a Hands-On Patent Attorney Test?

Bhakti Khera, Rezvan Alamian, Pascal A. Scherz, Stephan M. Goetz

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 41 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08862 2025-09-12 cs.CY cs.AI cs.HC 89%

Investigating Student Interaction Patterns with Large Language Model-Powered Course Assistants in Computer Science Courses

Chang Liu, Loc Hoang, Andrew Stolman, Rene F. Kizilcec, Bo Wu

机构 * Colorado School of Mines(科罗拉多矿业学院) HiTA AI Inc.(HiTA人工智能公司) Cornell University(康奈尔大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09461 2025-09-12 cs.HC 85%

Changing the Paradigm from Dynamic Queries to LLM-generated SQL Queries with Human Intervention

Ambre Assor, Hyeon Jeon, Sungbok Shin, Jean-Daniel Fekete

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09121 2025-09-12 cs.CL 81%

Compass-v3: Scaling Domain-Specific LLMs for Multilingual E-Commerce in Southeast Asia

Sophia Maria

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15221 2025-09-12 cs.LG 79%

A Vector-Quantized Foundation Model for Patient Behavior Monitoring

Rodrigo Oliver, Josué Pérez-Sabater, Leire Paz-Arbaizar, Diego Herrero-Quevedo, Antonio Artés-Rodríguez, Alejandro Lancho, Pablo M. Olmos

机构 * Signal Theory and Communications Department University Carlos III of Madrid(信号理论与通讯系卡洛斯三世大学) Instituto de Investigación Sanitaria Gregorio Marañón(Gregorio Marañón卫生研究院) Center for Data Science New York University(数据科学中心纽约大学) Evidence-Based Behavior(基于证据的行为) CIBERSAM, ISCIII

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

Comments 10 pages (32 with references and supplementary material). Submitted to Elsevier's journal on Artificial Intelligence in Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08950 2025-09-12 eess.SP cs.LG 70%

Deploying AI for Signal Processing education: Selected challenges and intriguing opportunities

Jarvis Haupt, Qin Lu, Yanning Shen, Jia Chen, Yue Dong, Dan McCreary, Mehmet Akçakaya, Georgios B. Giannakis

机构 * Dept. of ECE, U. of Minnesota(电子工程系,明尼苏达大学) School of ECE, U. of Georgia(电子工程学院,佐治亚大学) Dept. of EECS, UC Irvine(电子工程与计算机科学系,伊沃雷大学) Depts. of ECE and CSE, UC Riverside(电子工程与计算机科学系,罗切斯特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to the IEEE Signal Processing Magazine Special Issue on Artificial Intelligence for Education: A Signal Processing Perspective

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08839 2025-09-12 cs.CY 67%

Evaluating the Clinical Safety of LLMs in Response to High-Risk Mental Health Disclosures

Siddharth Shah, Amit Gupta, Aarav Mann, Alexandre Vaz, Benjamin E. Caldwell, Robert Scholz, Peter Awad, Rocky Allemandi, Doug Faust, Harshita Banka, Tony Rousmaniere

专题命中 领域大模型 :large language model(abstract);language model(abstract)

Comments Previously posted as a preprint on Research Square (DOI: 10.21203/rs.3.rs-7364128/v1), under a CC BY 4.0 License

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09397 2025-09-12 cs.CV 50%

Decoupling Clinical and Class-Agnostic Features for Reliable Few-Shot Adaptation under Shift

Umaima Rahman, Raza Imam, Mohammad Yaqub, Dwarikanath Mahapatra

机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫扎德人工智能大学) Khalifa University(卡利法大学)

专题命中 领域大模型 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 4 篇

2509.09265 2025-09-12 cs.LG cs.CL 84%

Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents

Jiawei Wang, Jiacai Liu, Yuqian Fu, Yingru Li, Xintao Wang, Yuan Lin, Yu Yue, Lin Zhang, Yang Wang, Ke Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2026 Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08912 2025-09-12 cs.CY cs.HC 75%

Towards Trustworthy AI: Characterizing User-Reported Risks across LLMs "In the Wild"

Lingyao Li, Renkai Ma, Zhaoqian Xue, Junjie Xiong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09541 2025-09-12 cs.AI 57%

Compositional Concept Generalization with Variational Quantum Circuits

Hala Hawashin, Mina Abbaszadeh, Nicholas Joseph, Beth Pearson, Martha Lewis, Mehrnoosh sadrzadeh

机构 * School of Computer Science Engineering University of New South Wales Sydney, Australia Stanford University California, USA Computer Science University College London London, UK School of Eng. Maths. \& Tech University of Bristol Bristol, UK Inst. Logic Language \& Computation University of Amsterdam Amsterdam, NL

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments Accepted to: 2025 IEEE International Conference on Quantum Artificial Intelligence (QAI), Naples, Italy, Nov 2-5, 2025. This is the authors' accepted manuscript (AAM). An IEEE copyright notice appears on page 1. The final published version will appear in IEEE Xplore; DOI to be added when available

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11639 2025-09-12 eess.SP cs.LG stat.ML 57%

Recursive KalmanNet: Deep Learning-Augmented Kalman Filtering for State Estimation with Consistent Uncertainty Quantification

Hassan Mortada, Cyril Falcon, Yanis Kahil, Mathéo Clavaud, Jean-Philippe Michel

机构 * Exail

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.LG

Comments 5 pages, 3 figures. Accepted for publication in EUSIPCO 2025 proceedings

Journal ref 33rd European Signal Processing Conference, (2025), pp. 885-889

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他LLM 7 篇

2509.09194 2025-09-12 cs.SE cs.AI 89%

On Integrating Large Language Models and Scenario-Based Programming for Improving Software Reliability

Ayelet Berzack, Guy Katz

机构 * The Hebrew University Of Jerusalem(耶路撒冷希伯来大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08831 2025-09-12 q-bio.NC 89%

Path to Intelligence: Measuring Similarity between Human Brain and Large Language Model Beyond Language Task

Doai Ngo, Mingxuan Sun, Zhengji Zhang, Ashwin G Ramayya, Mark Schnitzer, Zhe Zhao

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09103 2025-09-12 cs.CR 85%

AgriSentinel: Privacy-Enhanced Embedded-LLM Crop Disease Alerting System

Chanti Raju Mylay, Bobin Deng, Zhipeng Cai, Honghui Xu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19860 2025-09-12 cs.CL cs.AI 79%

MIND: Towards Immersive Psychological Healing with Multi-agent Inner Dialogue

Yujia Chen, Changsong Li, Yiming Wang, Tianjie Ju, Qingqing Xiao, Nan Zhang, Zifan Kong, Peng Wang, Binyu Yan

机构 * Sichuan University(四川大学) Shanghai Jiao Tong University(上海交通大学) Mental Health Center, West China Hospital, Sichuan University(四川大学西昌医院心理健康中心) WestChina School of Nursing, Sichuan University(四川大学西昌护理学院) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06435 2025-09-12 cs.AI 77%

Simulating Human-like Daily Activities with Desire-driven Autonomy

Yiding Wang, Yuxuan Chen, Fangwei Zhong, Long Ma, Yizhou Wang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) The University of Hong Kong(香港大学) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Academy for Advanced Interdisciplinary Studies, Peking University(北京大学先进跨学科研究学院) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Center on Frontiers of Computing Studies, School of Computer Science, Nat’l Eng. Research Center of Visual Technology, Peking University(计算前沿研究中心,计算机科学学院,国家工程视觉技术研究中心,北京大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09291 2025-09-12 cs.CR cs.NI 75%

What You Code Is What We Prove: Translating BLE App Logic into Formal Models with LLMs for Vulnerability Detection

Biwei Yan, Yue Zhang, Minghui Xu, Runyu Pan, Jinku Li, Xiuzhen Cheng

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18492 2025-09-12 cs.HC cs.AI cs.CL 62%

VeriSafe Agent: Safeguarding Mobile GUI Agent via Logic-based Action Verification

Jungjae Lee, Dongjae Lee, Chihun Choi, Youngmin Im, Jaeyoung Wi, Kihong Heo, Sangeun Oh, Sunjae Lee, Insik Shin

机构 * School of Computing, KAIST(计算机学院,韩国科学技术院) Korea University(韩国大学) Sungkyunkwan University(成均馆大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏