arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-27 至 2025-08-27 共收录 164 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12 篇

2502.19402 2025-08-27 cs.LG 88%

General Intelligence Requires Reward-based Pretraining

Seungwook Han, Jyothish Pari, Samuel J. Gershman, Pulkit Agrawal

机构 * Improbable AI Lab, MIT(Improbable AI Lab,麻省理工学院) Department of Psychology(心理学系) Center for Brain Science, Harvard University(哈佛大学脑科学中心)

专题命中 预训练与数据 :pretraining(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments https://improbableai.notion.site/General-Intelligence-Requires-Reward-Based-Pretraining-2023b66e4cf580d3ab44c7860b75d25f?pvs=73

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18598 2025-08-27 cs.CL cs.AI 84%

What do language models model? Transformers, automata, and the format of thought

Colin Klein

机构 * School of Philosophy(哲学学院) The Australian National University(澳大利亚国立大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16076 2025-08-27 cs.HC cs.CV 82%

Prompting with Sign Parameters for Low-resource Sign Language Instruction Generation

Md Tariquzzaman, Md Farhan Ishmam, Saiyma Sittul Muna, Md Kamrul Hasan, Hasan Mahmud

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 预训练与数据 :prompting(title,abstract);language model(abstract)

Comments CV4A11y@ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11793 2025-08-27 cs.CV 82%

MM-Retinal: Knowledge-Enhanced Foundational Pretraining with Fundus Image-Text Expertise

Ruiqi Wu, Chenran Zhang, Jianle Zhang, Yi Zhou, Tao Zhou, Huazhu Fu

机构 * School of Computer Science and Engineering, Southeast University, China(东南大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Ministry of Education, China(教育部新一代人工智能技术及其交叉应用重点实验室) Nanjing University of Science and Technology, Nanjing, China(南京理工大学) Agency for Science, Technology and Research (A*STAR), Singapore(新加坡科技研究局)

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract)

Comments Early Accepted by The International Conference on Medical Image Computing and Computer Assisted Intervention(MICCAI)2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19069 2025-08-27 cs.AI 81%

Can Structured Templates Facilitate LLMs in Tackling Harder Tasks? : An Exploration of Scaling Laws by Difficulty

Zhichao Yang, Zhaoxin Fan, Gen Li, Yuanze Hu, Xinyu Wang, Ye Qiu, Xin Wang, Yifan Sun, Wenjun Wu

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18384 2025-08-27 cs.CL cs.AI 79%

Backprompting: Leveraging Synthetic Production Data for Health Advice Guardrails

Kellen Tan Cheng, Anna Lisa Gentile, Chad DeLuca, Guang-Jie Ren

机构 * IBM Research - Almaden(IBM研究院-阿玛登分部) Princeton University(普林斯顿大学) Adobe Research(Adobe研究院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09896 2025-08-27 cs.LG physics.chem-ph q-bio.BM 77%

Instruction-Based Molecular Graph Generation with Unified Text-Graph Diffusion Model

Yuran Xiang, Haiteng Zhao, Chang Ma, Zhi-Hong Deng

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) State Key Laboratory of General Artificial Intelligence, School of Intelligence Science(通用人工智能国家重点实验室,智能科学学院) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Comments ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13915 2025-08-27 cs.AI 70%

Structured Agentic Workflows for Financial Time-Series Modeling with LLMs and Reflective Feedback

Yihao Ang, Yifan Bao, Lei Jiang, Jiajie Tao, Anthony K. H. Tung, Lukasz Szpruch, Hao Ni

机构 * National University of Singapore(新加坡国立大学) University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24073 2025-08-27 cs.AI cs.CL cs.CV 62%

mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation

Chan-Wei Hu, Yueqi Wang, Shuo Xing, Chia-Ju Chen, Suofei Feng, Ryan Rossi, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学) University of California, Berkeley(加州大学伯克利分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Stanford University(斯坦福大学) Adobe Research(Adobe研究院)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17567 2025-08-27 cs.CV cs.LG 57%

Towards Optimal Convolutional Transfer Learning Architectures for Breast Lesion Classification and ACL Tear Detection

Daniel Frees, Moritz Bolling, Aditri Bhagirath

机构 * Stanford University Department of Statistics(斯坦福大学统计学系) Stanford University Department of Computer Science(斯坦福大学计算机科学系)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19180 2025-08-27 eess.AS cs.SD 50%

MDD: a Mask Diffusion Detector to Protect Speaker Verification Systems from Adversarial Perturbations

Yibo Bai, Sizhou Chen, Michele Panariello, Xiao-Lei Zhang, Massimiliano Todisco, Nicholas Evans

机构 * EURECOM The University of Sydney(悉尼大学) Northwestern Polytechnical University(西北工业大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究所) China Telecom Corp Ltd(中国电信有限公司)

专题命中 预训练与数据 :pretraining(abstract)

Comments Accepted by APSIPA ASC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15761 2025-08-27 cs.CV 50%

Waver: Wave Your Way to Lifelike Video Generation

Yifu Zhang, Hao Yang, Yuqi Zhang, Yifei Hu, Fengda Zhu, Chuang Lin, Xiaofeng Mei, Yi Jiang, Bingyue Peng, Zehuan Yuan

机构 * Bytedance Waver Team(字节跳动Waver团队)

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 13 篇

2508.18466 2025-08-27 cs.CL 91%

Integrating gender inclusivity into large language models via instruction tuning

Alina Wróblewska, Bartosz Żuk

机构 * Institute of Computer Science Polish Academy of Sciences(计算机科学研究所波兰科学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15495 2025-08-27 cs.CL cs.AI 91%

TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use

Junjie Ye, Yilong Wu, Sixian Li, Yuming Yang, Zhiheng Xi, Tao Gui, Qi Zhang, Xuanjing Huang, Peng Wang, Zhongchao Shi, Jianping Fan, Zhengyin Du

机构 * Fudan University(复旦大学) Lenovo Research(联想研究) ByteDance Seed(字节跳动种子) Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18793 2025-08-27 cs.SE 90%

SolEval: Benchmarking Large Language Models for Repository-level Solidity Code Generation

Zhiyuan Peng, Xin Yin, Rui Qian, Peiqin Lin, Yongkang Liu, Hao Zhang, Chenhao Ying, Yuan Luo

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments Accepted By EMNLP'25-Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18739 2025-08-27 cs.CL cs.LG 90%

Beyond Quality: Unlocking Diversity in Ad Headline Generation with Large Language Models

Chang Wang, Siyu Yan, Depeng Yuan, Yuqi Chen, Yanhua Huang, Yuanhang Zheng, Shuhao Li, Yinqi Zhang, Kedi Chen, Mingrui Zhu, Ruiwen Xu

机构 * Xiaohongshu Inc.(小红书公司) East China Normal University(东华大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07581 2025-08-27 cs.AI cs.CY 89%

YuLan-OneSim: Towards the Next Generation of Social Simulator with Large Language Models

Lei Wang, Heyang Gao, Xiaohe Bo, Xu Chen, Ji-Rong Wen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10717 2025-08-27 cs.CL cs.AI 89%

A Modular Approach for Clinical SLMs Driven by Synthetic Data with Pre-Instruction Tuning, Model Merging, and Clinical-Tasks Alignment

Jean-Philippe Corbeil, Amin Dada, Jean-Michel Attendu, Asma Ben Abacha, Alessandro Sordoni, Lucas Caccia, François Beaulieu, Thomas Lin, Jens Kleesiek, Paul Vozila

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Journal ref ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19074 2025-08-27 cs.RO cs.AI cs.PL 85%

An LLM-powered Natural-to-Robotic Language Translation Framework with Correctness Guarantees

ZhenDong Chen, ZhanShang Nie, ShiXing Wan, JunYi Li, YongTian Cheng, Shuai Zhao

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Sun Yat-Sen University(中山大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12584 2025-08-27 cs.CL 85%

Improving Multilingual Language Models by Aligning Representations through Steering

Omar Mahmoud, Buddhika Laknath Semage, Thommen George Karimpanal, Santu Rana

机构 * Applied Artificial Intelligence Initiative, Deakin University, Australia(应用人工智能计划,德肯大学,澳大利亚) School of Information Technology, Deakin University, Australia(信息技术学院,德肯大学,澳大利亚)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19089 2025-08-27 cs.CL 77%

It's All About In-Context Learning! Teaching Extremely Low-Resource Languages to LLMs

Yue Li, Zhixue Zhao, Carolina Scarton

机构 * Department of Computer Science, University of Sheffield, UK(计算机科学系,谢菲尔德大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18462 2025-08-27 cs.LG cs.AI 76%

VERIRL: Boosting the LLM-based Verilog Code Generation via Reinforcement Learning

Fu Teng, Miao Pan, Xuhong Zhang, Zhezhi He, Yiyao Yang, Xinyi Chai, Mengnan Qi, Liqiang Lu, Jianwei Yin

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 指令微调 :LLM(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18870 2025-08-27 cs.CL cs.AI cs.LG 75%

ReflectivePrompt: Reflective evolution in autoprompting algorithms

Viktor N. Zhuravlev, Artur R. Khairullin, Ernest A. Dyagin, Alena N. Sitkina, Nikita I. Kulin

机构 * Computer Technologies Laboratory(计算机技术实验室) ITMO University(ITMO大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16801 2025-08-27 cs.CV 67%

Decoupled Global-Local Alignment for Improving Compositional Understanding

Xiaoxing Hu, Kaicheng Yang, Jun Wang, Haoran Xu, Ziyong Feng, Yupei Wang

机构 * Beijing Institute of Technology(北京理工大学) Zhejiang University(浙江大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09487 2025-08-27 cs.CV 50%

Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness

Beier Zhu, Jiequan Cui, Hanwang Zhang, Chi Zhang

机构 * Nanyang Technological University(南洋理工大学) Westlake University(西湖大学)

专题命中 指令微调 :foundation model(abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 2 篇

2508.18391 2025-08-27 cs.AI 85%

PKG-DPO: Optimizing Domain-Specific AI systems with Physics Knowledge Graphs and Direct Preference Optimization

Nitin Nagesh Kulkarni, Bryson Wilcox, Max Sawa, Jason Thom

机构 * Advanced Engineering and Technology(先进工程与技术)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18884 2025-08-27 cs.LG cs.AI 73%

HAEPO: History-Aggregated Exploratory Policy Optimization

Gaurish Trivedi, Alakh Sharma, Kartikey Singh Bhandari, Dhruv Kumar, Pratik Narang, Jagat Sesh Challa

机构 * Birla Institute of Technology and Science, Pilani(比拉理工学院和科学学院,比兰)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 6 篇

2507.13152 2025-08-27 cs.CV cs.AI cs.RO 89%

SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models

Xiangyu Dong, Haoran Zhao, Jiang Gao, Haozhou Li, Xiaoguang Ma, Yaoming Zhou, Fuhai Chen, Juan Liu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18572 2025-08-27 cs.DC 85%

Strata: Hierarchical Context Caching for Long Context Language Model Serving

Zhiqiang Xie, Ziyi Xu, Mark Zhao, Yuwei An, Vikram Sharma Mailthody, Scott Mahlke, Michael Garland, Christos Kozyrakis

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments 13 pages, 14 figures, under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18749 2025-08-27 cs.AI 81%

Reflection-Enhanced Meta-Optimization Integrating TextGrad-style Prompt Optimization with Memory-Driven Self-Evolution

Chunlong Wu, Zhibo Qu

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏