arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-24 至 2025-07-24 共收录 123 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12 篇

2507.16969 2025-07-24 cs.IR 89%

LLM4MEA: Data-free Model Extraction Attacks on Sequential Recommenders via Large Language Models

Shilong Zhao, Fei Sun, Kaike Zhang, Shaoling Jing, Du Su, Zhichao Shi, Zhiyi Yin, Huawei Shen, Xueqi Cheng

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16852 2025-07-24 cs.CR cs.AI cs.LG 86%

SynthCTI: LLM-Driven Synthetic CTI Generation to enhance MITRE Technique Mapping

Álvaro Ruiz-Ródenas, Jaime Pujante Sáez, Daniel García-Algora, Mario Rodríguez Béjar, Jorge Blasco, José Luis Hernández-Ramos

机构 * Department of Information and Communication Engineering, Universidad de Murcia(信息与通信工程系,穆尔西亚大学) Department of Computer Systems, Universidad Politécnica de Madrid(计算机系统系,马德里理工大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11588 2025-07-24 q-bio.GN cs.AI cs.LG 84%

SToFM: a Multi-scale Foundation Model for Spatial Transcriptomics

Suyuan Zhao, Yizhen Luo, Ganbo Yang, Yan Zhong, Hao Zhou, Zaiqing Nie

机构 * Department of Computer Science and Tecnology, Tsinghua University(清华大学计算机科学与技术系) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) PharMolix Inc.(PharMolix公司)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Accpeted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08385 2025-07-24 cs.LG cs.AI cs.CY cs.SE 81%

Language model developers should report train-test overlap

Andy K Zhang, Kevin Klyman, Yifan Mai, Yoav Levine, Yian Zhang, Rishi Bommasani, Percy Liang

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.AI、cs.LG

Comments ICML 2025 Spotlight; 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16820 2025-07-24 cs.SI cs.AI cs.CL cs.DL 73%

Disaster Informatics after the COVID-19 Pandemic: Bibliometric and Topic Analysis based on Large-scale Academic Literature

Ngan Tran, Haihua Chen, Ana Cleveland, Yuhan Zhou

机构 * Department of Information Science, University of North Texas(信息科学系,北卡罗来纳州立大学) Department of Data Science, University of North Texas(数据科学系,北卡罗来纳州立大学)

专题命中 预训练与数据 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 36 pages, 14 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02382 2025-07-24 cs.CL cs.AI 73%

An Efficient and Precise Training Data Construction Framework for Process-supervised Reward Model in Mathematical Reasoning

Wei Sun, Qianlong Du, Fuwei Cui, Jiajun Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04457 2025-07-24 cs.SD cs.CL eess.AS 70%

Miipher-2: A Universal Speech Restoration Model for Million-Hour Scale Data Restoration

Shigeki Karita, Yuma Koizumi, Heiga Zen, Haruko Ishikawa, Robin Scheibler, Michiel Bacchiani

机构 * Google DeepMind(谷歌DeepMind)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to IEEE WASPAA2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16844 2025-07-24 cs.LG 70%

TD-Interpreter: Enhancing the Understanding of Timing Diagrams with Visual-Language Learning

Jie He, Vincent Theo Willem Kenbeek, Zhantao Yang, Meixun Qu, Ezio Bartocci, Dejan Ničković, Radu Grosu

机构 * Technische Universität Wien(维也纳技术大学) Shanghai Jiao Tong University(上海交通大学) AIT Austrian Institute of Technology(奥地利技术研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17220 2025-07-24 cs.CV cs.RO 67%

PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models

Jiansong Wan, Chengming Zhou, Jinkua Liu, Xiangge Huang, Xiaoyu Chen, Xiaohan Yi, Qisen Yang, Baiting Zhu, Xin-Qiang Cai, Lixing Liu, Rushuai Yang, Chuheng Zhang, Sherif Abdelfattah, Hayong Shin, Pushi Zhang, Li Zhao, Jiang Bian

机构 * Microsoft Research(微软研究院)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16834 2025-07-24 eess.AS cs.AI cs.CL 62%

Towards Robust Speech Recognition for Jamaican Patois Music Transcription

Jordan Madden, Matthew Stone, Dimitri Johnson, Daniel Geddez

机构 * Jamaica Artificial Intelligence Association(牙买加人工智能协会)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16832 2025-07-24 eess.AS cs.LG 57%

Does Language Matter for Early Detection of Parkinson's Disease from Speech?

Peter Plantinga, Briac Cordelle, Dominique Louër, Mirco Ravanelli, Denise Klein

机构 * McGill University(麦吉尔大学) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所) Concordia University(Concordia大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments Accepted to IEEE Workshop on Machine Learning for Signal Processing (MLSP) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17359 2025-07-24 cs.CV 50%

Exploring Active Learning for Semiconductor Defect Segmentation

Lile Cai, Ramanpreet Singh Pahwa, Xun Xu, Jie Wang, Richard Chang, Lining Zhang, Chuan-Sheng Foo

专题命中 预训练与数据 :pretraining(abstract)

Comments accepted to ICIP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 6 篇

2503.03460 2025-07-24 cs.CL 88%

Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models

Alessio Galatolo, Zhenbang Dai, Katie Winkle, Meriem Beloucif

机构 * Uppsala University(乌普萨拉大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL25 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17264 2025-07-24 cs.SE cs.AI cs.HC 81%

Understanding Prompt Programming Tasks and Questions

Jenny T. Liang, Chenyang Yang, Agnia Sergeyuk, Travis D. Breaux, Brad A. Myers

机构 * Carnegie Mellon University(卡内基梅隆大学) JetBrains Research(JetBrains研究)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17147 2025-07-24 cs.CL 77%

CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards

Cheng Liu, Yifei Lu, Fanghua Ye, Jian Li, Xingyu Chen, Feiliang Ren, Zhaopeng Tu, Xiaolong Li

专题命中 指令微调 :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16847 2025-07-24 cs.SI cs.IR cs.LG 74%

EVOLVE-X: Embedding Fusion and Language Prompting for User Evolution Forecasting on Social Media

Ismail Hossain, Sai Puppala, Md Jahangir Alam, Sajedul Talukder

机构 * Computer Science University of Texas at El Paso(计算机科学德克萨斯大学埃尔帕索分校) School of Computing Southern Illinois University(计算学院南方伊利诺伊大学)

专题命中 指令微调 :prompting(title);分类 cs.LG

Comments We are submitting this paper to ICWSM 2026 conference on September 15th, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17706 2025-07-24 cs.LG 70%

HydraOpt: Navigating the Efficiency-Performance Trade-off of Adapter Merging

Taha Ceritli, Ondrej Bohdal, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

机构 * Samsung R&D Institute UK(三星英国研发院) Samsung Research(三星研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12122 2025-07-24 cs.RO cs.AI 70%

ICCO: Learning an Instruction-conditioned Coordinator for Language-guided Task-aligned Multi-robot Control

Yoshiki Yano, Kazuki Shibata, Maarten Kokshoorn, Takamitsu Matsubara

机构 * Division of Information Science, Graduate School of Science and Technology, Nara Institute of Science and Technology (NAIST)(信息科学系,科学技术研究生学校,科学与技术国立研究所) Department of Cognitive Robotics, Faculty of Mechanical Engineering, Delft University of Technology(认知机器人系,机械工程学院,代尔夫特理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 9 figures, to be published in the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 4 篇

2503.02832 2025-07-24 cs.CL cs.AI cs.LG 89%

AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation

Songming Zhang, Xue Zhang, Tong Zhang, Bojie Hu, Yufeng Chen, Jinan Xu

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation, (Beijing Jiaotong University), Ministry of Education(大数据与人工智能交通运输联合实验室,(北京交通大学)教育部) School of Computer Science and Technology, Beijing Jiaotong University, Beijing, China(计算机科学与技术学院,北京交通大学,北京,中国) Tencent Inc, China(腾讯公司,中国)

专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);large language model(abstract);RLHF(abstract)

Comments ACL 2025 Main Conference, code available at: https://github.com/songmzhang/AlignDistil

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16826 2025-07-24 cs.IR cs.AI cs.CL 88%

A Query-Aware Multi-Path Knowledge Graph Fusion Approach for Enhancing Retrieval-Augmented Generation in Large Language Models

Qikai Wei, Huansheng Ning, Chunlong Han, Jianguo Ding

机构 * School of Computer and Communication Engineering, University of Science and Technology Beijing(计算机与通信工程学院,北京科技大学) Blekinge Institute of Technology(布莱金厄学院)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16951 2025-07-24 cs.CL 87%

Harnessing RLHF for Robust Unanswerability Recognition and Trustworthy Response Generation in LLMs

Shuyuan Lin, Lei Duan, Philip Hughes, Yuxuan Sheng

机构 * Sichuan University of Science and Engineering(四川理工学院) Zagazig University(扎加齐亚大学)

专题命中 后训练与偏好优化 :RLHF(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17515 2025-07-24 cs.CV cs.CL 86%

URPO: A Unified Reward & Policy Optimization Framework for Large Language Models

Songshuo Lu, Hua Wang, Zhi Chen, Yaohua Tang

专题命中 后训练与偏好优化 :language model(title,abstract);large language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 3 篇

2507.16799 2025-07-24 cs.CL 90%

Test-Time-Matching: Decouple Personality, Memory, and Linguistic Style in LLM-based Role-Playing Language Agent

Xiaoyu Zhan, Xinyu Fu, Hao Sun, Yuanqi Li, Jie Guo, Yanwen Guo

专题命中 长上下文与记忆 :LLM(title,abstract);language agent(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10054 2025-07-24 cs.SE 75%

Explicit Vulnerability Generation with LLMs: An Investigation Beyond Adversarial Attacks

Emir Bosnak, Sahand Moslemi, Mayasah Lami, Anil Koyuncu

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to ICSME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09068 2025-07-24 cs.CV cs.AI cs.IR cs.LG cs.MM 73%

Infinite Video Understanding

Dell Zhang, Xiangyu Chen, Jixiang Luo, Mengxi Jia, Changzhi Sun, Ruilong Ren, Jingren Liu, Hao Sun, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) Peking University(北京大学) Tianjin University(天津大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 14 篇

2507.17273 2025-07-24 cs.LG cs.AI 86%

Leveraging Knowledge Graphs and LLM Reasoning to Identify Operational Bottlenecks for Warehouse Planning Assistance

Rishi Parekh, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

机构 * Quantiphi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16841 2025-07-24 cs.RO 85%

AquaChat: An LLM-Guided ROV Framework for Adaptive Inspection of Aquaculture Net Pens

Waseem Akram, Muhayy Ud Din, Abdelhaleem Saad, Irfan Hussain

机构 * Khalifa University Center for Autonomous Robotic Systems (KUCARS), Khalifa University, United Arab Emirates(卡里法大学自主机器人系统中心(KUCARS)、卡里法大学、阿拉伯联合酋长国)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22334 2025-07-24 cs.CL cs.AI cs.CV cs.LG 80%

Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start

Lai Wei, Yuting Li, Kaipeng Zheng, Chen Wang, Yue Wang, Linghe Kong, Lichao Sun, Weiran Huang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17699 2025-07-24 cs.AI 77%

Thinking Isn't an Illusion: Overcoming the Limitations of Reasoning Models via Tool Augmentations

Zhao Song, Song Yue, Jiahao Zhang

机构 * University of California, Berkeley(加州大学伯克利分校) Northeastern University(东北大学) Large Reasoning Models (LRMs)(大型推理模型)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17168 2025-07-24 cs.AI 77%

Improving LLMs' Generalized Reasoning Abilities by Graph Problems

Qifan Zhang, Nuo Chen, Zehua Li, Miao Peng, Jing Tang, Jia Li

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

Comments COLM2025

详情

展开后加载摘要…

URL PDF HTML 收藏