arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-07 至 2025-08-07 共收录 173 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 11 篇

2508.04239 2025-08-07 cs.CL 88%

DP-GPT4MTS: Dual-Prompt Large Language Model for Textual-Numerical Time Series Forecasting

Chanjuan Liu, Shengzhi Wang, Enqiang Zhu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14194 2025-08-07 cs.CL 83%

Meta-rater: A Multi-dimensional Data Selection Method for Pre-training Language Models

Xinlin Zhuang, Jiahui Peng, Ren Ma, Yinfan Wang, Tianyi Bai, Xingjian Wei, Jiantao Qiu, Chi Zhang, Ying Qian, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments ACL 2025 Best Theme Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04645 2025-08-07 cs.LG cs.AI 81%

A Scalable Pretraining Framework for Link Prediction with Efficient Adaptation

Yu Song, Zhigang Hua, Harry Shomer, Yan Xie, Jingzhe Liu, Bo Long, Hui Liu

机构 * Computer Science and Engineering(计算机科学与工程) Michigan State University(密歇根州立大学) Meta

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by KDD 2025 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03729 2025-08-07 cs.LG cs.HC cs.MM 79%

Privileged Contrastive Pretraining for Multimodal Affect Modelling

Kosmas Pinitas, Konstantinos Makantasis, Georgios N. Yannakakis

机构 * Institute of Digital Games University of Malta(数字游戏研究所马耳他大学) Department of Artificial Intelligence University of Malta(人工智能系马耳他大学)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04401 2025-08-07 cs.CL cs.AI 79%

Why are LLMs' abilities emergent?

Vladimír Havlík

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03712 2025-08-07 cs.CL 77%

How Deep Is Representational Bias in LLMs? The Cases of Caste and Religion

Agrima Seth, Monojit Choudhary, Sunayana Sitaram, Kentaro Toyama, Aditya Vashistha, Kalika Bali

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to AIES 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04251 2025-08-07 cs.LG 70%

T3Time: Tri-Modal Time Series Forecasting via Adaptive Multi-Head Alignment and Residual Fusion

Abdul Monaf Chowdhury, Rabeya Akter, Safaeid Hossain Arib

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01317 2025-08-07 cs.CL 70%

LinkQA: Synthesizing Diverse QA from Multiple Seeds Strongly Linked by Knowledge Points

Xuemiao Zhang, Can Ren, Chengying Tu, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05189 2025-08-07 cs.LG cs.CR 57%

Understanding In-Context Learning of Linear Models in Transformers Through an Adversarial Lens

Usman Anwar, Johannes Von Oswald, Louis Kirsch, David Krueger, Spencer Frei

机构 * University of Cambridge(剑桥大学) Google, Paradigms of Intelligence Team(谷歌,Paradigms of Intelligence团队) Google DeepMind(谷歌DeepMind) Mila & Université de Montréal(Mila与蒙特利尔大学) UC Davis(加州大学戴维斯分校)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments Transactions on Machine Learning Research (TMLR) 2025, with Featured Certification

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04211 2025-08-07 cs.CV 56%

What Holds Back Open-Vocabulary Segmentation?

Josip Šarić, Ivan Martinović, Matej Kristan, Siniša Šegvić

机构 * Faculty of Computer and Information Science(计算机与信息科学学院) Faculty of Electrical Engineering and Computing(电子工程与计算学院)

专题命中 预训练与数据 :pretraining(abstract);foundation model(comments)

Comments Accepted for publication at ICCV 25 Workshop: What is Next in Multimodal Foundation Models?

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04208 2025-08-07 cs.CR 50%

DP-DocLDM: Differentially Private Document Image Generation using Latent Diffusion Models

Saifullah Saifullah, Stefan Agne, Andreas Dengel, Sheraz Ahmed

专题命中 预训练与数据 :pretraining(abstract)

Comments Accepted in ICDAR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 14 篇

2508.03709 2025-08-07 q-bio.BM cs.CL cs.LG physics.comp-ph 92%

MD-LLM-1: A Large Language Model for Molecular Dynamics

Mhd Hussein Murtada, Z. Faidon Brotzakis, Michele Vendruscolo

机构 * Centre for Misfolding Diseases(折叠疾病中心) Yusuf Hamied Department of Chemistry(尤素夫·哈米德化学系) University of Cambridge(剑桥大学)

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03935 2025-08-07 cs.CL 92%

CAP-LLM: Context-Augmented Personalized Large Language Models for News Headline Generation

Raymond Wilson, Cole Graham, Chase Carter, Zefeng Yang, Ruiqi Gu

机构 * National Energy University(国家能源大学)

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13415 2025-08-07 cs.IR 88%

Harnessing Large Language Models for Group POI Recommendations

Jing Long, Liang Qu, Junliang Yu, Tong Chen, Quoc Viet Hung Nguyen, Hongzhi Yin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04063 2025-08-07 cs.LG 85%

Fine-tuning for Better Few Shot Prompting: An Empirical Comparison for Short Answer Grading

Joel Walsh, Siddarth Mamidanna, Benjamin Nye, Mark Core, Daniel Auerbach

机构 * University of Southern California - Institute for Creative Technologies(南加州大学创意技术研究所) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Proceedings of the Second Workshop on Automated Evaluation of Learning and Assessment Content co-located with 26th International Conference on Artificial Intelligence in Education (AIED 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04389 2025-08-07 cs.AI 84%

GuirlVG: Incentivize GUI Visual Grounding via Empirical Exploration on Reinforcement Learning

Weitai Kang, Bin Lei, Gaowen Liu, Caiwen Ding, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Minnesota(明尼苏达大学) Cisco Research(思科研究)

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);post-training(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01936 2025-08-07 cs.LG cs.AI stat.ML 81%

Decision-Focused Fine-Tuning of Time Series Foundation Models for Dispatchable Feeder Optimization

Maximilian Beichter, Nils Friederich, Janik Pinter, Dorina Werling, Kaleb Phipps, Sebastian Beichter, Oliver Neumann, Ralf Mikut, Veit Hagenmeyer, Benedikt Heidrich

机构 * Institute for Automation and Applied Informatics (IAI), Karlsruhe Institute of Technology (KIT)(自动化与应用信息技术研究所(IAI),卡尔斯鲁厄理工学院) Institute of Biological and Chemical Systems (IBCS), Karlsruhe Institute of Technology (KIT)(生物与化学系统研究所(IBCS),卡尔斯鲁厄理工学院) Scientific Computing Center (SCC), Karlsruhe Institute of Technology (KIT)(科学计算中心(SCC),卡尔斯鲁厄理工学院)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

Journal ref Energy and AI Volume 21, September 2025, 100533

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20840 2025-08-07 cs.AI cs.CL cs.LG cs.SE 80%

CodeTool: Enhancing Programmatic Tool Invocation of LLMs via Process Supervision

Yifei Lu, Fanghua Ye, Jian Li, Qiang Gao, Cheng Liu, Haibo Luo, Nan Du, Xiaolong Li, Feiliang Ren

机构 * Northeastern University(东北大学) Hunyuan AI Digital Human(文英AI数字人)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03999 2025-08-07 cs.LG 77%

Tensorized Clustered LoRA Merging for Multi-Task Interference

Zhan Su, Fengran Mo, Guojun Liang, Jinghan Zhang, Bingbing Wen, Prayag Tiwari, Jian-Yun Nie

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06362 2025-08-07 cs.CV cs.MM cs.SD eess.AS 75%

Adaptive Audio-Visual Speech Recognition via Matryoshka-Based Multimodal LLMs

Umberto Cappellazzo, Minsu Kim, Stavros Petridis

机构 * Imperial College London(伦敦帝国学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted to IEEE ASRU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23736 2025-08-07 cs.CV cs.IR 75%

Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval

Haiwen Li, Fei Su, Zhicheng Zhao

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04316 2025-08-07 cs.CV eess.SP 71%

A Foundation Model for DAS Signal Recognition and Visual Prompt Tuning of the Pre-trained Model for Downstream Tasks

Kun Gui, Hongliang Ren, Shang Shi, Jin Lu, Changqiu Yu, Quanjun Cao, Guomin Gu, Qi Xuan

专题命中 指令微调 :foundation model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15807 2025-08-07 cs.CV cs.AI 70%

True Multimodal In-Context Learning Needs Attention to the Visual Context

Shuo Chen, Jianzhe Liu, Zhen Han, Yan Xia, Daniel Cremers, Philip Torr, Volker Tresp, Jindong Gu

机构 * LMU Munich(慕尼黑大学) Technical University of Munich(慕尼黑技术大学) Siemens AG(西门子股份公司) University of Science and Technology of China(中国科学技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Konrad Zuse School of Excellence in Reliable AI (relAI)(Konrad Zuse可靠性人工智能卓越学院) University of Oxford(牛津大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03012 2025-08-07 cs.SE cs.AI 57%

Tool-integrated Reinforcement Learning for Repo Deep Search

Zexiong Ma, Chao Peng, Qunhong Zeng, Pengfei Gao, Yanzhen Zou, Bing Xie

机构 * Peking University(北京大学) ByteDance(字节跳动) Beijing Institute of Technology(北京理工大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02118 2025-08-07 cs.AI 57%

Adversarial Cooperative Rationalization: The Risk of Spurious Correlations in Even Clean Datasets

Wei Liu, Zhongyu Niu, Lang Gao, Zhiying Deng, Jun Wang, Haozhao Wang, Ruixuan Li

机构 * School of Computer Science(计算机科学学院) Technology, Huazhong University of Science(科学技术大学技术学院) Faculty of Artificial Intelligence in Education, Central China Normal University(教育人工智能学院,中国中部师范大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 2 篇

2411.05273 2025-08-07 cs.RO cs.AI cs.LG 81%

Real-World Offline Reinforcement Learning from Vision Language Model Feedback

Sreyas Venkataraman, Yufei Wang, Ziyu Wang, Navin Sriram Ravie, Zackory Erickson, David Held

机构 * Indian Institute of Technology, Kharagpur(印度理工学院,克哈格浦尔分校) IIIS, Tsinghua University(清华大学人工智能研究所) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 后训练与偏好优化 :language model(title,abstract);分类 cs.AI、cs.LG

Comments 7 pages. Accepted at the LangRob Workshop 2024 @ CoRL, 2024. Accepted at 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04524 2025-08-07 cs.CV cs.AI 57%

RAIDX: A Retrieval-Augmented Generation and GRPO Reinforcement Learning Framework for Explainable Deepfake Detection

Tianxiao Li, Zhenglin Huang, Haiquan Wen, Yiwei He, Shuchang Lyu, Baoyuan Wu, Guangliang Cheng

机构 * University of Liverpool(利物浦大学) Beihang University(北航大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 4 篇

2508.04450 2025-08-07 eess.IV cs.CV 78%

TotalRegistrator: Towards a Lightweight Foundation Model for CT Image Registration

Xuan Loc Pham, Gwendolyn Vuurberg, Marjan Doppen, Joey Roosen, Tip Stille, Thi Quynh Ha, Thuy Duong Quach, Quoc Vu Dang, Manh Ha Luu, Ewoud J. Smit, Hong Son Mai, Mattias Heinrich, Bram van Ginneken, Mathias Prokop, Alessa Hering

机构 * Department of Imaging, Radboudumc, Nijmegen, the Netherlands(影像部,Radboudumc,尼姆egen,荷兰) Institute for Medical Informatics, University of Lübeck, Lübeck, Germany(医学信息研究所,吕贝克大学,吕贝克,德国) Department of Nuclear Medicine, Hospital 108, Hanoi, Vietnam(核医学部,108医院,河内,越南) Department of Diagnostic Imaging and Interventional Radiology, Thai Nguyen National Hospital, Thai Nguyen, Vietnam(诊断影像和介入放射科,Thai Nguyen国家医院,Thai Nguyen,越南) Interventional Radiology Center, Tam Anh Hospital, Hanoi, Vietnam(介入放射科中心,Tam Anh医院,河内,越南) FET, Vietnam National University, University of Engineering and Technology, Hanoi, Vietnam(FET,越南国家大学,工程与技术大学,河内,越南)

专题命中 长上下文与记忆 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04257 2025-08-07 cs.CL 70%

KVSink: Understanding and Enhancing the Preservation of Attention Sinks in KV Cache Quantization for LLMs

Zunhai Su, Kehong Yuan

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Published as a conference paper at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03931 2025-08-07 cs.SE 67%

Analyzing Prominent LLMs: An Empirical Study of Performance and Complexity in Solving LeetCode Problems

Everton Guimaraes, Nathalia Nascimento, Chandan Shivalingaiah, Asish Nelapati

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

Comments 11 pages, 13 figures, 29th International Conference on Evaluation and Assessment in Software Engineering (EASE)

详情

展开后加载摘要…

URL PDF HTML 收藏