arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-11 至 2025-08-11 共收录 171 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 14 篇

2504.19811 2025-08-11 cs.CL 89%

Can a Crow Hatch a Falcon? Lineage Matters in Predicting Large Language Model Performance

Takuya Tamura, Taro Yano, Masafumi Enomoto, Masafumi Oyamada

机构 * NEC Corporation(日本电报电话株式会社)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07912 2025-08-11 cs.LG 89%

Echo Chamber: RL Post-training Amplifies Behaviors Learned in Pretraining

Rosie Zhao, Alexandru Meterez, Sham Kakade, Cengiz Pehlevan, Samy Jelassi, Eran Malach

机构 * Harvard University(哈佛大学) Kempner Institute(凯普纳研究所)

专题命中 预训练与数据 :pretraining(title,abstract);post-training(title,abstract);language model(abstract);分类 cs.LG

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16802 2025-08-11 cs.CL cs.AI 86%

Topic Over Source: The Key to Effective Data Mixing for Language Models Pre-training

Jiahui Peng, Xinlin Zhuang, Jiantao Qiu, Ren Ma, Jing Yu, He Zhu, Conghui He

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05734 2025-08-11 cs.CR cs.AI cs.LG 86%

LeakAgent: RL-based Red-teaming Agent for LLM Privacy Leakage

Yuzhou Nie, Zhun Wang, Ye Yu, Xian Wu, Xuandong Zhao, Wenbo Guo, Dawn Song

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06178 2025-08-11 cs.CL 81%

Comparing Knowledge Injection Methods for LLMs in a Low-Resource Regime

Hugo Abonizio, Thales Almeida, Roberto Lotufo, Rodrigo Nogueira

机构 * Faculdade de Engenharia Elétrica e de Computação (FEEC), University of Campinas (Unicamp)(电子工程与计算学院(FEEC),坎皮纳斯大学) Instituto de Computação (IC), University of Campinas (Unicamp)(计算研究所(IC),坎皮纳斯大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00544 2025-08-11 cs.CL cs.LG 81%

PaPaformer: Language Model from Pre-trained Parallel Paths

Joonas Tapaninaho, Mourad Oussala

机构 * University of Oulu, Faculty of Information Technology and Electrical Engineering, CMVS(奥卢大学,信息科技与电气工程学院)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15955 2025-08-11 cs.LG cs.CV stat.ML 79%

Rethinking the Bias of Foundation Model under Long-tailed Distribution

Jiahao Chen, Bin Qin, Jiangmeng Li, Hao Chen, Bing Su

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学耿丽人工智能学院) Beijing Key Laboratory of Big Data Management and Analysis Methods(北京大数据管理与分析方法重点实验室) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) Electrical and Computer Engineering, Carnegie Mellon University(卡内基梅隆大学电气与计算机工程学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.LG

Comments Published as a conference paper in ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05954 2025-08-11 cs.CV cs.AI cs.CL 79%

Bifrost-1: Bridging Multimodal LLMs and Diffusion Models with Patch-level CLIP Latents

Han Lin, Jaemin Cho, Amir Zadeh, Chuan Li, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Lambda

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Project Page: https://bifrost-1.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05637 2025-08-11 cs.HC cs.AI 77%

Automated Visualization Makeovers with LLMs

Siddharth Gangwar, David A. Selby, Sebastian J. Vollmer

机构 * University of Kaiserslautern–Landau (RPTU)(凯撒斯劳滕-兰道大学(RPTU)) Department of Data Science and its Applications, German Research Center for Artificial Intelligence (DFKI)(数据科学及其应用系,德国人工智能研究中心(DFKI))

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02596 2025-08-11 cs.CR cs.CL cs.LG 73%

Towards More Realistic Extraction Attacks: An Adversarial Perspective

Yash More, Prakhar Ganesh, Golnoosh Farnadi

机构 * McGill University(麦吉尔大学) Mila(Mila研究所)

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments To appear in TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07258 2025-08-11 cs.CL cs.AI 73%

No Query, No Access

Wenqiang Wang, Siyuan Liang, Yangshijie Zhang, Xiaojun Jia, Hao Lin, Xiaochun Cao

机构 * Sun Yat-sen University, Guangzhou, China(中山大学) Lanzhou University, Gansu, China(兰州大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06492 2025-08-11 cs.CV cs.CL 70%

Effective Training Data Synthesis for Improving MLLM Chart Understanding

Yuwei Yang, Zeyu Zhang, Yunzhong Hou, Zhuowan Li, Gaowen Liu, Ali Payani, Yuan-Sen Ting, Liang Zheng

机构 * Australian National University(澳大利亚国立大学) Ohio State University(俄亥俄州立大学) Cisco(思科公司) Johns Hopkins University(约翰霍普金斯大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ICCV 2025 (poster). 26 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05722 2025-08-11 cs.CL 70%

PEACH: A sentence-aligned Parallel English-Arabic Corpus for Healthcare

Rania Al-Sabbagh

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Corpora 2024, 19, 3, 395-410

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06836 2025-08-11 cs.LG cond-mat.mtrl-sci cs.AI 62%

CAST: Cross Attention based multimodal fusion of Structure and Text for materials property prediction

Jaewan Lee, Changyoung Park, Hongjun Yang, Sungbin Lim, Woohyung Lim, Sehui Han

机构 * LG AI Research(LG人工智能研究)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 9 篇

2504.04030 2025-08-11 cs.SE cs.CL 89%

OpenCodeInstruct: A Large-scale Instruction Tuning Dataset for Code LLMs

Wasi Uddin Ahmad, Aleksander Ficek, Mehrzad Samadi, Jocelyn Huang, Vahid Noroozi, Somshubra Majumdar, Boris Ginsburg

机构 * NVIDIA Santa Clara, CA 95051, USA(NVIDIA圣克拉拉分校)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06103 2025-08-11 cs.CL cs.IR 87%

Few-Shot Prompting for Extractive Quranic QA with Instruction-Tuned LLMs

Mohamed Basem, Islam Oshallah, Ali Hamdi, Ammar Mohammed

机构 * Faculty of Computer Science MSA University Giza, Egypt(计算机科学学院 MSA大学 埃及吉扎) Faculty of Computer Science MSA University Egypt(计算机科学学院 MSA大学 埃及)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 6 pages , 2 figures , Accepted in IMSA 2025,Egypt , https://imsa.msa.edu.eg/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12901 2025-08-11 cs.CL cs.AI 85%

Architectural Fusion Through Contextual Partitioning in Large Language Models: A Novel Approach to Parameterized Knowledge Integration

Offa Kingsleigh, Alfred Abercrombie, David Woolstencroft, Beorhtric Meadowcroft, Marcus Irvin

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05794 2025-08-11 cs.CL 84%

Structural Perturbation in Large Language Model Representations through Recursive Symbolic Regeneration

Kathlyn Eaglewood, Tobias Featherington, Dorian Mayfair, Sylvester Grimshaw, James Pettigrew

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01979 2025-08-11 cs.CL 84%

Gradient-Regularized Latent Space Modulation in Large Language Models for Structured Contextual Synthesis

Derek Yotheringhay, Beatrix Nightingale, Maximilian Featherstone, Edmund Worthington, Hugo Ashdown

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23543 2025-08-11 cs.CV cs.AI 70%

ART: Adaptive Relation Tuning for Generalized Relation Prediction

Gopika Sudhakaran, Hikaru Shindo, Patrick Schramowski, Simone Schaub-Meyer, Kristian Kersting, Stefan Roth

机构 * Department of Computer Science, TU Darmstadt(图宾根大学计算机科学系) Hessian Center for AI (hessian.AI)(海德堡人工智能中心) German Research Center for AI (DFKI)(德国人工智能研究中心)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.AI

Comments Accepted for publication in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05676 2025-08-11 cs.IR cs.LG 70%

Domain-Specific Fine-Tuning and Prompt-Based Learning: A Comparative Study for developing Natural Language-Based BIM Information Retrieval Systems

Han Gao, Timo Hartmann, Botao Zhong, Kai Lia, Hanbin Luo

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06339 2025-08-11 cs.DC cs.MS 67%

Performant Unified GPU Kernels for Portable Singular Value Computation Across Hardware and Precision

Evelyne Ringoot, Rabab Alomairy, Valentin Churavy, Alan Edelman

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments 12 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03834 2025-08-11 cs.RO cs.CV 50%

CARE: Enhancing Safety of Visual Navigation through Collision Avoidance via Repulsive Estimation

Joonkyung Kim, Joonyeol Sim, Woojun Kim, Katia Sycara, Changjoo Nam

机构 * Department of Electronic Engineering, Sogang University(电子工程系,首尔大学) Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)

专题命中 指令微调 :foundation model(abstract)

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 5 篇

2508.06026 2025-08-11 cs.CL cs.AI 89%

Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future

Yidong Wang, Xin Wang, Cunxiang Wang, Junfeng Fang, Qiufeng Wang, Jianing Chu, Xuran Meng, Shuxun Yang, Libo Qin, Yue Zhang, Wei Ye, Shikun Zhang

专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);large language model(abstract);preference optimization(abstract)

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06124 2025-08-11 cs.CL 84%

AURA: Affordance-Understanding and Risk-aware Alignment Technique for Large Language Models

Sayantan Adak, Pratyush Chatterjee, Somnath Banerjee, Rima Hazra, Somak Aditya, Animesh Mukherjee

专题命中 后训练与偏好优化 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05838 2025-08-11 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 81%

Integrating Vision Foundation Models with Reinforcement Learning for Enhanced Object Interaction

Ahmad Farooq, Kamran Iqbal

机构 * University of Arkansas at Little Rock(阿拉伯塔大学拉夫洛克分校)

专题命中 后训练与偏好优化 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments Published in the Proceedings of the 2025 3rd International Conference on Robotics, Control and Vision Engineering (RCVE'25). 6 pages, 3 figures, 1 table

Journal ref RCVE'25: Proceedings of the 2025 3rd International Conference on Robotics, Control and Vision Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05434 2025-08-11 cs.LG 77%

Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling

Han Qi, Haochen Yang, Qiaosheng Zhang, Zhuoran Yang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Peking University(北京大学) Yale University(耶鲁大学)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06036 2025-08-11 cs.CV 50%

More Is Better: A MoE-Based Emotion Recognition Framework with Human Preference Alignment

Jun Xie, Yingjian Zhu, Feng Chen, Zhenghao Zhang, Xiaohui Fan, Hongzhu Yi, Xinming Wang, Chen Yu, Yue Bi, Zhaoran Zhao, Xiongjun Guan, Zhepeng Wang

机构 * Lenovo Research(联想研究) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学) Beijing Jiaotong University(北京交通大学) Shandong University(山东大学)

专题命中 后训练与偏好优化 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 7 篇

2502.10699 2025-08-11 cs.CL cs.AI cs.NE 87%

Exploring Synaptic Resonance in Large Language Models: A Novel Approach to Contextual Memory Integration

George Applegarth, Christian Weatherstone, Maximilian Hollingsworth, Henry Middlebrook, Marcus Irvin

专题命中 长上下文与记忆 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00246 2025-08-11 cs.CL 86%

Context-Preserving Tensorial Reconfiguration in Large Language Model Training

Larin Tonix, Morgana Baskerville, Nathaniel Stourton, Ophelia Tattershall

专题命中 长上下文与记忆 :language model(title,abstract);large language model(title);分类 cs.CL

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏