arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-06 至 2025-10-06 共收录 167 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 27 篇

2510.02882 2025-10-06 cs.DC 50%

Energy Efficiency in Cloud-Based Big Data Processing for Earth Observation: Gap Analysis and Future Directions

Adhitya Bhawiyuga, Serkan Girgin, Rolf A. de By, Raul Zurita-Milla

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02732 2025-10-06 cs.CV 50%

From Tokens to Nodes: Semantic-Guided Motion Control for Dynamic 3D Gaussian Splatting

Jianing Chen, Zehao Li, Yujun Cai, Hao Jiang, Shuqin Gao, Honglong Zhao, Tianlu Mao, Yucheng Zhang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) The University of Queensland(昆士兰大学)

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02538 2025-10-06 cs.RO 50%

A Recipe for Efficient Sim-to-Real Transfer in Manipulation with Online Imitation-Pretrained World Models

Yilin Wang, Shangzhe Li, Haoyi Niu, Zhiao Huang, Weitong Zhang, Hao Su

机构 * Department of Computer Science and Engineering, University of California, San Diego(计算机科学与工程系,加州大学圣地亚哥分校) School of Data Science and Society, University of North Carolina at Chapel Hill(数据科学与社会学院,北卡罗来纳大学教堂山分校) Department of Mechanical Engineering, University of California, Berkeley(机械工程系,加州大学伯克利分校) Hillbot Inc.(Hillbot公司)

专题命中 效率与部署 :pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 20 篇

2508.01443 2025-10-06 cs.SE cs.AI 90%

Tuning LLM-based Code Optimization via Meta-Prompting: An Industrial Perspective

Jingzhi Gong, Rafail Giavrimis, Paul Brookes, Vardan Voskanyan, Fan Wu, Mari Ashiga, Matthew Truscott, Mike Basios, Leslie Kanthan, Jie Xu, Zheng Wang

机构 * University of Leeds(利兹大学) University of Surrey(萨里大学) University of West London(西伦敦大学)

专题命中 领域大模型 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by ASE'25 Industry Showcase

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01202 2025-10-06 cs.HC cs.AI cs.CL 88%

From Voices to Validity: Leveraging Large Language Models (LLMs) for Textual Analysis of Policy Stakeholder Interviews

Alex Liu, Min Sun

机构 * University of Washington(华盛顿大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref AERA OPEN Volume 11, January-December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07044 2025-10-06 cs.CL cs.AI 86%

DatawiseAgent: A Notebook-Centric LLM Agent Framework for Adaptive and Robust Data Science Automation

Ziming You, Yumiao Zhang, Dexuan Xu, Yiwei Lou, Yandong Yan, Wei Wang, Huaming Zhang, Yu Huang

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) School of Software & Microelectronics, Peking University(软件与微电子学院,北京大学) School of Computer Science, Peking University(计算机科学学院,北京大学) Xi’an Jiaotong University(西安交通大学) Institute of Basic Theory of Chinese Medicine, China Academy of Chinese Medical Sciences(中医基础理论研究所,中国中医科学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The camera-ready version for EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11191 2025-10-06 cs.CR cs.AI cs.CL 86%

Primus: A Pioneering Collection of Open-Source Datasets for Cybersecurity LLM Training

Yao-Ching Yu, Tsun-Han Chiang, Cheng-Wei Tsai, Chien-Ming Huang, Wen-Kwang Tsao

机构 * AI Lab, TrendMicro(TrendMicro人工智能实验室)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02694 2025-10-06 cs.CR 85%

MALF: A Multi-Agent LLM Framework for Intelligent Fuzzing of Industrial Control Protocols

Bowei Ning, Xuejun Zong, Kan He

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02359 2025-10-06 cs.CL cs.AI 84%

Emission-GPT: A domain-specific language model agent for knowledge retrieval, emission inventory and data analysis

Jiashu Ye, Tong Wu, Weiwen Chen, Hao Zhang, Zeteng Lin, Xingxing Li, Shujuan Weng, Manni Zhu, Xin Yuan, Xinlong Hong, Jingjie Li, Junyu Zheng, Zhijiong Huang, Jing Tang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02922 2025-10-06 cs.CV cs.AI 79%

Multimodal Carotid Risk Stratification with Large Vision-Language Models: Benchmarking, Fine-Tuning, and Clinical Insights

Daphne Tsolissou, Theofanis Ganitidis, Konstantinos Mitsis, Stergios CHristodoulidis, Maria Vakalopoulou, Konstantina Nikita

机构 * National Technical University of Athens(希腊国家技术大学) CentraleSupélec, Université Paris-Saclay(巴黎-萨克雷大学中央理工学院)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02328 2025-10-06 cs.CL cs.AI cs.MA 79%

AMANDA: Agentic Medical Knowledge Augmentation for Data-Efficient Medical Visual Question Answering

Ziqing Wang, Chengsheng Mao, Xiaole Wen, Yuan Luo, Kaize Ding

机构 * Northwestern University(西北大学) Microsoft(微软公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02679 2025-10-06 cs.AI 77%

Automated Constraint Specification for Job Scheduling by Regulating Generative Model with Domain-Specific Representation

Yu-Zhe Shi, Qiao Xu, Yanjia Li, Mingchen Liu, Huamin Qu, Lecheng Ruan, Qining Wang

机构 * School of Advanced Manufacturing and Robotics, Peking University(先进制造与机器人学院,北京大学) Department of Computer Science and Engineering, School of Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) School of Computer Science and Technology, Huazhong University of Science and Technology(计算机科学与技术学院,华中科技大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for publication in IEEE Transactions on Automation Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02338 2025-10-06 cs.CL cs.AI 73%

Optimizing Long-Form Clinical Text Generation with Claim-Based Rewards

Samyak Jhaveri, Praphul Singh, Jangwon Kim, Tara Taghavi, Krishnaram Kenthapadi

机构 * Oracle Health AI(Oracle健康AI)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02331 2025-10-06 cs.CL cs.AI 73%

Synthetic Dialogue Generation for Interactive Conversational Elicitation & Recommendation (ICER)

Moonkyung Ryu, Chih-Wei Hsu, Yinlam Chow, Mohammad Ghavamzadeh, Craig Boutilier

机构 * Google Research(谷歌研究) Amazon AGI(亚马逊人工智能)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02326 2025-10-06 cs.CL cs.AI 73%

Hallucination-Resistant, Domain-Specific Research Assistant with Self-Evaluation and Vector-Grounded Retrieval

Vivek Bhavsar, Joseph Ereifej, Aravanan Gurusami

机构 * CTO Office, Coherent Corporation(Coherent Corporation 技术总监办公室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02394 2025-10-06 cs.CL 70%

Retrieval and Augmentation of Domain Knowledge for Text-to-SQL Semantic Parsing

Manasi Patwardhan, Ayush Agarwal, Shabbirhussain Bhaisaheb, Aseem Arora, Lovekesh Vig, Sunita Sarawagi

机构 * TCS Research Pune, India(TCS研究部,印度浦那) TCS Research Delhi, India(TCS研究部,印度德里)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 10 pages, 2 figures, 11 tables. Accepted in the 1st Workshop on Grounding Documents with Reasoning, Agents, Retrieval, and Attribution (RARA) held in conjunction with IEEE International Conference on Data Mining (ICDM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02543 2025-10-06 cs.CV 67%

Exploring OCR-augmented Generation for Bilingual VQA

JoonHo Lee, Sunho Park

机构 * KL-Net, South Korea(韩国KL-Net)

专题命中 领域大模型 :language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00675 2025-10-06 physics.soc-ph cs.CY physics.hist-ph 67%

Can Machines Philosophize?

Michele Pizzochero, Giorgia Dellaferrera

专题命中 领域大模型 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10289 2025-10-06 cs.CV 67%

Fine-grained Abnormality Prompt Learning for Zero-shot Anomaly Detection

Jiawen Zhu, Yew-Soon Ong, Chunhua Shen, Guansong Pang

机构 * Singapore Management University(新加坡管理学院) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

专题命中 领域大模型 :language model(abstract);prompting(abstract)

Comments Accepted to ICCV 2025; 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02320 2025-10-06 eess.AS cs.CL cs.LG cs.SD 62%

WEE-Therapy: A Mixture of Weak Encoders Framework for Psychological Counseling Dialogue Analysis

Yongqi Kang, Yong Zhao

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.LG

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03216 2025-10-06 eess.IV cs.AI cs.CV 57%

Wave-GMS: Lightweight Multi-Scale Generative Model for Medical Image Segmentation

Talha Ahmed, Nehal Ahmed Shaikh, Hassan Mohy-ud-Din

机构 * School of Science and Engineering, Lahore University of Management Sciences, Lahore, Pakistan(科学与工程学院,拉合尔管理科学大学,巴基斯坦拉合尔)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI

Comments 5 pages, 1 figure, 4 tables; Submitted to IEEE Conference for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02815 2025-10-06 cs.CV 50%

Med-K2N: Flexible K-to-N Modality Translation for Medical Image Synthesis

Feng Yuan, Yifan Gao, Yuehua Ye, Haoyue Li, Xin Gao

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute of Biomedical Engineering and Technology(苏州生物医学工程与技术研究所) Chinese Academy of Sciences(中国科学院) The Third Affiliated Hospital of Sun Yat-sen University(中山大学第三附属医院)

专题命中 领域大模型 :language model(abstract)

Comments ICLR2026 under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14031 2025-10-06 cs.HC 50%

Reading.help: Supporting EFL Readers with Proactive and On-Demand Explanation of English Grammar and Semantics

Sunghyo Chung, Hyeon Jeon, Sungbok Shin, Md Naimul Hoque

专题命中 领域大模型 :LLM(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 7 篇

2510.02334 2025-10-06 cs.CL cs.AI cs.LG 87%

Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing

Zhe Li, Wei Zhao, Yige Li, Jun Sun

机构 * Singapore Management University(新加坡管理大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00476 2025-10-06 cs.SE cs.AI cs.LG 84%

Analyzing Latent Concepts in Code Language Models

Arushi Sharma, Vedant Pungliya, Christopher J. Quinn, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12113 2025-10-06 cs.CR cs.AI 83%

Semantic Preprocessing for LLM-based Malware Analysis

Benjamin Marais, Tony Quertier, Grégoire Barrue

机构 * Orange Innovation(Orange创新)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02917 2025-10-06 cs.SE cs.LG 81%

Mechanistic Interpretability of Code Correctness in LLMs via Sparse Autoencoders

Kriz Tahimic, Charibeth Cheng

机构 * College of Computer Studies(计算机科学学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02571 2025-10-06 cs.CV cs.AI cs.CL 73%

How Confident are Video Models? Empowering Video Models to Express their Uncertainty

Zhiting Mei, Ola Shorinwa, Anirudha Majumdar

机构 * Princeton University(普林斯顿大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01494 2025-10-06 cs.LG cs.AI 62%

Understanding Adversarial Transfer: Why Representation-Space Attacks Fail Where Data-Space Attacks Succeed

Isha Gupta, Rylan Schaeffer, Joshua Kazdan, Ken Ziyu Liu, Sanmi Koyejo

机构 * ETH Zürich(苏黎世联邦理工学院) Stanford CS(斯坦福大学计算机科学系)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19569 2025-10-06 cs.CL 57%

ExPe: Exact Positional Encodings for Generative Transformer Models with Extrapolating Capabilities

Aleksis Datseris, Sylvia Vassileva, Ivan Koychev, Svetla Boytcheva

机构 * Faculty of Mathematics and Informatics, Sofia University St. Kliment Ohridski(数学与信息学系,索菲亚大学) Graphwise

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏