arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-05 至 2025-11-05 共收录 155 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12 篇

2505.21375 2025-11-05 cs.CV 89%

GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution

Fengxiang Wang, Mingshuo Chen, Yueying Li, Di Wang, Haotian Wang, Zonghao Guo, Zefan Wang, Boqi Shan, Long Lan, Yulin Wang, Hongzhen Wang, Wenjing Yang, Bo Du, Jing Zhang

机构 * College of Computer Science and Technology, National University of Defense Technology, China(中国国防科技大学计算机科学与技术学院) Beijing University of Posts and Telecommunications, China(北京邮电大学) School of Computer Science, Wuhan University, China(武汉大学计算机学院) Zhongguancun Academy, China(中关村学院) Tsinghua University, China(清华大学) Beihang University, China(北航大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

Comments NeurlPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02364 2025-11-05 math.OC 85%

An LLM-powered MILP modelling engine for workforce scheduling guided by expert knowledge

Qingyang Li, Lele Zhang, Vicky Mak-Hau

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18065 2025-11-05 cs.CV cs.AI cs.CL cs.RO 84%

Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation

Ziming Wei, Bingqian Lin, Yunshuang Nie, Jiaqi Chen, Shikui Ma, Hang Xu, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Hunan Artificial Intelligence and Robotics Institute Company Ltd.(湖南人工智能与机器人研究院有限公司) Huawei Noah’s Ark Lab(华为诺亚实验室) Peng Cheng Laboratory(鹏城实验室)

专题命中 预训练与数据 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IEEE Transactions on Neural Networks and Learning Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10392 2025-11-05 cs.CV cs.AI 83%

RoMA: Scaling up Mamba-based Foundation Models for Remote Sensing

Fengxiang Wang, Yulin Wang, Mingshuo Chen, Haiyan Zhao, Yangang Sun, Shuo Wang, Hongzhen Wang, Di Wang, Long Lan, Wenjing Yang, Jing Zhang

机构 * College of Computer Science and Technology, National University of Defense Technology, China(国防科技大学计算机科学与技术学院) Tsinghua University, China(清华大学) Beijing University of Posts and Telecommunications, China(北京邮电大学) School of Computer Science, Wuhan University, China(武汉大学计算机学院) Zhongguancun Academy, China(中关村学院)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15705 2025-11-05 cs.LG cs.AI 81%

Generalisation Bounds of Zero-Shot Economic Forecasting using Time Series Foundation Models

Jittarin Jetwiriyanon, Teo Susnjak, Surangika Ranathunga

机构 * School of Mathematical and Computational Sciences(数学与计算科学学院) Massey University(马斯杰大学)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25067 2025-11-05 cs.CV 75%

DRIP: Dynamic patch Reduction via Interpretable Pooling

Yusen Peng, Sachin Kumar

专题命中 预训练与数据 :language model(abstract);instruction tuning(abstract);pretraining(abstract)

Comments Need more refinement

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23239 2025-11-05 cs.IR cs.CL cs.LG 73%

Beyond Contrastive Learning: Synthetic Data Enables List-wise Training with Multiple Levels of Relevance

Reza Esfandiarpoor, George Zerveas, Ruochen Zhang, Macton Mgonzo, Carsten Eickhoff, Stephen H. Bach

机构 * Brown University(布朗大学) Microsoft(微软) University of Tübingen(图宾根大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Findings of the EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12463 2025-11-05 cs.LG cs.AI 62%

Dense Backpropagation Improves Training for Sparse Mixture-of-Experts

Ashwinee Panda, Vatsal Baherwani, Zain Sarwar, Benjamin Therien, Sambit Sahu, Tom Goldstein, Supriyo Chakraborty

机构 * University of Maryland(马里兰大学) Capital One University of Chicago(芝加哥大学) Mila – Quebec AI Institute(魁北克人工智能研究所)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06910 2025-11-05 cs.CL 57%

Identifying Aspects in Peer Reviews

Sheng Lu, Ilia Kuznetsov, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science(计算机科学系) Hessian Center for AI (hessian.AI)(黑森人工智能中心)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09485 2025-11-05 cs.RO cs.AI cs.GR 57%

Adv-BMT: Bidirectional Motion Transformer for Safety-Critical Traffic Scenario Generation

Yuxin Liu, Zhenghao Peng, Xuanhao Cui, Bolei Zhou

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02793 2025-11-05 eess.IV 50%

Diffusion Models are Robust Pretrainers

Mika Yagoda, Shady Abu-Hussein, Raja Giryes

专题命中 预训练与数据 :pretraining(abstract)

Comments To be published in IEEE Signal Processing Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26197 2025-11-05 cs.ET cs.HC 50%

Structurally Valid Log Generation using FSM-GFlowNets

Riya Samanta

专题命中 预训练与数据 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 9 篇

2511.00130 2025-11-05 cs.LG 90%

A Comparative Analysis of LLM Adaptation: SFT, LoRA, and ICL in Data-Scarce Scenarios

Bernd Bohnet, Rumen Dangovski, Kevin Swersky, Sherry Moore, Arslan Chaudhry, Kathleen Kenealy, Noah Fiedel

机构 * Google(谷歌)

专题命中 指令微调 :LLM(title,abstract);SFT(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02423 2025-11-05 eess.SP 89%

LLM4PG: Adapting Large Language Model for Pathloss Map Generation via Synesthesia of Machines

Mingran Sun, Lu Bai, Xiang Cheng, Jianjun Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02234 2025-11-05 cs.MM cs.CL cs.SD 87%

An Evaluation of Interleaved Instruction Tuning on Semantic Reasoning Performance in an Audio MLLM

Jiawei Liu, Enis Berk Çoban, Zarina Schevchenko, Hao Tang, Zhigang Zhu, Michael I Mandel, Johanna Devaney

机构 * The Graduate Center, CUNY(CUNY研究生中心) Brooklyn College, CUNY(CUNY布鲁克林学院) Borough of Manhattan Community College, CUNY(CUNY曼哈顿社区学院) The City College of New York, CUNY(CUNY纽约城市学院)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12740 2025-11-05 cs.CL cs.AI 81%

Hey, wait a minute: on at-issue sensitivity in Language Models

Sanghee J. Kim, Kanishka Misra

机构 * The University of Chicago(芝加哥大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 5 figures, 3 tables. See https://github.com/sangheek16/hey-wait-a-minute for code and data

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23362 2025-11-05 cs.CL cs.AI 79%

Mixture of Routers

Jia-Chen Zhang, Yu-Jie Xiong, Xi-He Qiu, Chun-Ming Xia, Fei Dai, Zheng Zhou

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(电子电气工程学院,上海工程技术大学) Key Laboratory of Computational Neuroscience and Brain-Inspired Intelligence, Fudan University(计算神经科学与脑启发智能重点实验室,复旦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments Under consideration at Pattern Recognition Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16888 2025-11-05 cs.CV 75%

Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback

Zongjian Li, Zheyuan Liu, Qihui Zhang, Bin Lin, Feize Wu, Shenghai Yuan, Zhiyuan Yan, Yang Ye, Wangbo Yu, Yuwei Niu, Shaodong Wang, Xinhua Cheng, Li Yuan

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01941 2025-11-05 cs.SE cs.AI cs.CR 70%

Detecting Vulnerabilities from Issue Reports for Internet-of-Things

Sogol Masoumzadeh

机构 * Electrical and Computer Engineering(电气与计算机工程) McGill University(麦吉尔大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments ACCEPTED/To Appear in the Proceedings of the 40th IEEE/ACM International Conference on Automated Software Engineering (ASE) 2025. https://conf.researchr.org/details/ase-2025/ase-2025-student-research-competition/5/Detecting-Vulnerabilities-from-Issue-Reports-for-Internet-of-Things

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02395 2025-11-05 cs.CV cs.LG 57%

Self-Supervised Moving Object Segmentation of Sparse and Noisy Radar Point Clouds

Leon Schwarzer, Matthias Zeller, Daniel Casado Herraez, Simon Dierl, Michael Heidingsfeld, Cyrill Stachniss

机构 * CARIAD SE(CARIAD公司) TU Dortmund University(杜伊斯堡-艾森大学) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能与机器学习研究所)

专题命中 指令微调 :pretraining(abstract);分类 cs.LG

Comments Accepted for publication at IEEE International Conference on Intelligent Transportation Systems (ITSC 2025), 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02128 2025-11-05 q-bio.BM 50%

DL4Proteins Jupyter Notebooks Teach how to use Artificial Intelligence for Biomolecular Structure Prediction and Design

Michael Chungyoun, Gabe Au, Britnie Carpentier, Sreevarsha Puvada, Courtney Thomas, Jeffrey J. Gray

专题命中 指令微调 :language model(abstract)

Comments 27 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 5 篇

2509.19999 2025-11-05 cs.MM cs.CV cs.SD 88%

MultiSoundGen: Video-to-Audio Generation for Multi-Event Scenarios via SlowFast Contrastive Audio-Visual Pretraining and Direct Preference Optimization

Jianxuan Yang, Xiaoran Yang, Lipan Zhang, Xinyue Guo, Zhao Wang, Gongping Huang

专题命中 后训练与偏好优化 :pretraining(title,abstract);preference optimization(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08039 2025-11-05 cs.SD cs.CL cs.MM eess.AS 83%

Audio-Thinker: Guiding Audio Language Model When and How to Think via Reinforcement Learning

Shu Wu, Chenxing Li, Wenfu Wang, Hao Zhang, Hualei Wang, Meng Yu, Dong Yu

专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17431 2025-11-05 cs.CL 79%

On Extending Direct Preference Optimization to Accommodate Ties

Jinghong Chen, Guangyu Yang, Weizhe Lin, Jingbiao Mei, Bill Byrne

机构 * Department of Engineering University of Cambridge(工程系剑桥大学)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);分类 cs.CL

Comments 24 pages, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06915 2025-11-05 cs.CL cs.AI 79%

LongRM: Revealing and Unlocking the Context Boundary of Reward Modeling

Zecheng Tang, Baibei Ji, Quantong Qiu, Haitian Wang, Xiaobo Liang, Juntao Li, Min Zhang

机构 * Soochow University(苏州大学) LCM Laboratory(LCM实验室)

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20241 2025-11-05 cs.LG cs.AI 73%

DreamPRM: Domain-Reweighted Process Reward Model for Multimodal Reasoning

Qi Cao, Ruiyi Wang, Ruiyi Zhang, Sai Ashish Somayajula, Pengtao Xie

机构 * University of California, San Diego(加州大学圣地亚哥分校) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 28 pages, 10 figures, to appear in NeurIPS 2025 (Conference on Neural Information Processing Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 5 篇

2511.01805 2025-11-05 cs.CL cs.AI 81%

Accumulating Context Changes the Beliefs of Language Models

Jiayi Geng, Howard Chen, Ryan Liu, Manoel Horta Ribeiro, Robb Willer, Graham Neubig, Thomas L. Griffiths

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02371 2025-11-05 cs.LG 70%

LUMA-RAG: Lifelong Multimodal Agents with Provably Stable Streaming Alignment

Rohan Wandre, Yash Gajewar, Namrata Patel, Vivek Dhalkari

机构 * Dept. of Computer Engineering(计算机工程系) SIES Graduate School of Technology(SIES技术研究生学院) Bharatiya Vidya Bhavan's Sardar Patel Institute of Technology(巴哈里亚·维达·巴万学院萨达尔·帕特尔技术学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25557 2025-11-05 cs.LG cs.AI cs.CL quant-ph 67%

Hybrid Quantum-Classical Recurrent Neural Networks

Wenduan Xu

机构 * Quantinuum Cambridge, UK(Quantinuum剑桥)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Clarified expectation-value-based readouts and made minor text edits

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01952 2025-11-05 cs.CR cs.AI 57%

Black-Box Membership Inference Attack for LVLMs via Prior Knowledge-Calibrated Memory Probing

Jinhua Yin, Peiru Yang, Chen Yang, Huili Wang, Zhiyang Hu, Shangguang Wang, Yongfeng Huang, Tao Qi

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) College of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏