arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2505.23661 2025-06-03 cs.CV 67%

OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation

Size Wu, Zhonghua Wu, Zerui Gong, Qingyi Tao, Sheng Jin, Qinyue Li, Wei Li, Chen Change Loy

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) SenseTime Research(商汤科技研究院) SenseTime Research and Tetras.AI(商汤研究与Tetras.AI)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13074 2025-06-02 cs.CL cs.AI cs.LG 67%

Autonomy-of-Experts Models

Ang Lv, Ruobing Xie, Yining Qian, Songhao Wu, Xingwu Sun, Zhanhui Kang, Di Wang, Rui Yan

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23660 2025-05-30 cs.CV 67%

D-AR: Diffusion via Autoregressive Models

Ziteng Gao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05874 2025-05-30 cs.CV cs.AI cs.CL cs.IR cs.LG 67%

VideoRAG: Retrieval-Augmented Generation over Video Corpus

Soyeong Jeong, Kangsan Kim, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14689 2025-05-29 cs.CL cs.AI cs.LG 67%

How to Synthesize Text Data without Model Collapse?

Xuekai Zhu, Daixuan Cheng, Hengli Li, Kaiyan Zhang, Ermo Hua, Xingtai Lv, Ning Ding, Zhouhan Lin, Zilong Zheng, Bowen Zhou

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21128 2025-05-28 stat.AP 67%

Named Entity Swapping for Metadata Anonymization in a Text Corpus

Jan Greve, Lukas Sablica

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19464 2025-05-27 cs.IR 67%

LLMs as Better Recommenders with Natural Language Collaborative Signals: A Self-Assessing Retrieval Approach

Haoran Xin, Ying Sun, Chao Wang, Weijia Zhang, Hui Xiong

专题命中 预训练与数据 :LLM(abstract);pretraining(abstract)

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20499 2025-05-27 cs.SD eess.AS 67%

FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System

Hao-Han Guo, Yao Hu, Fei-Yu Shen, Xu Tang, Yi-Chen Wu, Feng-Long Xie, Kun Xie

机构 * Xiaohongshu(小红书)

专题命中 预训练与数据 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17063 2025-05-26 cs.CL cs.AI cs.LG 67%

Synthetic Data RL: Task Definition Is All You Need

Yiduo Guo, Zhen Guo, Chuanwei Huang, Zi-Ang Wang, Zekai Zhang, Haofei Yu, Huishuai Zhang, Yikang Shen

机构 * Peking University(北京大学) MIT(麻省理工学院) UIUC(伊利诺伊大学香槟分校) MIT-IBM(麻省理工学院-IBM)

专题命中 预训练与数据 :foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05042 2025-05-26 cs.LG cs.AI cs.CL cs.FL 67%

Provably Correct Automata Embeddings for Optimal Automata-Conditioned Reinforcement Learning

Beyazit Yalcinkaya, Niklas Lauffer, Marcell Vazquez-Chanlatte, Sanjit A. Seshia

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10917 2025-05-20 cs.CV 67%

VISTA: Enhancing Vision-Text Alignment in MLLMs via Cross-Modal Mutual Information Maximization

Mingxiao Li, Na Su, Fang Qu, Zhizhou Zhong, Ziyang Chen, Yuan Li, Zhaopeng Tu, Xiaolong Li

机构 * Tencent(腾讯)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04568 2025-05-20 cs.CV cs.AI cs.CL cs.LG 67%

Feedback-Driven Vision-Language Alignment with Minimal Human Supervision

Giorgio Giannone, Ruoteng Li, Qianli Feng, Evgeny Perevodchikov, Rui Chen, Aleix Martinez

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13372 2025-05-20 cs.GR cs.CV 67%

MoVer: Motion Verification for Motion Graphics Animations

Jiaju Ma, Maneesh Agrawala

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments Accepted to ACM Transactions on Graphics (SIGGRAPH 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09155 2025-05-15 cs.CV 67%

AMSnet 2.0: A Large AMS Database with AI Segmentation for Net Detection

Yichen Shi, Zhuofu Tao, Yuhao Gao, Li Huang, Hongyang Wang, Zhiping Yu, Ting-Jung Lin, Lei He

机构 * University of California, Los Angeles, USA(加州大学洛杉矶分校) Tsinghua University, Beijing, China(清华大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments accepted by LAD25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02590 2025-05-13 cs.CV cs.RO 67%

Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling

Xiaowen Qiu, Jincheng Yang, Yian Wang, Zhehuan Chen, Yufei Wang, Tsun-Hsuan Wang, Zhou Xian, Chuang Gan

专题命中 预训练与数据 :language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13333 2025-05-07 cs.DC 67%

Malleus: Straggler-Resilient Hybrid Parallel Training of Large-scale Models via Malleable Data and Model Parallelization

Haoyang Li, Fangcheng Fu, Hao Ge, Sheng Lin, Xuanyu Wang, Jiawen Niu, Yujie Wang, Hailin Zhang, Xiaonan Nie, Bin Cui

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments SIGMOD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02278 2025-05-06 cs.CV 67%

Compositional Image-Text Matching and Retrieval by Grounding Entities

Madhukar Reddy Vongala, Saurabh Srivastava, Jana Košecká

机构 * Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments Accepted at CVPR-W

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21266 2025-05-01 cs.CV 67%

CoCoDiff: Diversifying Skeleton Action Features via Coarse-Fine Text-Co-Guided Latent Diffusion

Zhifu Zhao, Hanyang Hua, Jianan Li, Shaoxin Wu, Fu Li, Yangtao Zhou, Yang Li

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) Guangzhou Institute of technology, Xidian University(广州科技研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16782 2025-04-24 cs.RO 67%

Graph2Nav: 3D Object-Relation Graph Generation to Robot Navigation

Tixiao Shan, Abhinav Rajvanshi, Niluthpol Mithun, Han-Pang Chiu

机构 * Center for Vision Technologies, SRI International(视觉技术中心,SRI国际)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16310 2025-04-24 cs.SE 67%

Improving Automated Secure Code Reviews: A Synthetic Dataset for Code Vulnerability Flaws

Leonardo Centellas-Claros, Juan J. Alonso-Lecaros, Juan Pablo Sandoval Alcocer, Andres Neyem

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments MSR 2025 - Registered Reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15431 2025-04-23 cs.CL cs.AI cs.LG 67%

Trillion 7B Technical Report

Sungjun Han, Juyoung Suk, Suyeong An, Hyungguk Kim, Kyuseok Kim, Wonsuk Yang, Seungtaek Choi, Jamin Shin

机构 * Trillion Labs(Trillion实验室)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preview version

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08857 2025-04-21 cs.CV 67%

DialogGen: Multi-modal Interactive Dialogue System for Multi-turn Text-to-Image Generation

Minbin Huang, Yanxin Long, Xinchi Deng, Ruihang Chu, Jiangfeng Xiong, Xiaodan Liang, Hong Cheng, Qinglin Lu, Wei Liu

机构 * Chinese University of Hong Kong(香港中文大学) Tencent Hunyuan(腾讯混元) Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Project page: https://hunyuan-dialoggen.github.io/. Accepted to NAACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10659 2025-04-16 cs.CV 67%

Relation-Rich Visual Document Generator for Visual Information Extraction

Zi-Han Jiang, Chien-Wei Lin, Wei-Hua Li, Hsuan-Tung Liu, Yi-Ren Yeh, Chu-Song Chen

机构 * National Taiwan University(台湾大学) E.SUN Financial Holding Co., Ltd.(玉山金融控股股份有限公司) National Kaohsiung Normal University(国立高雄师范大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10462 2025-04-15 cs.CV 67%

The Scalability of Simplicity: Empirical Analysis of Vision-Language Learning with a Single Transformer

Weixian Lei, Jiacong Wang, Haochen Wang, Xiangtai Li, Jun Hao Liew, Jiashi Feng, Zilong Huang

机构 * Bytedance Seed(字节跳动 Seed)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09935 2025-04-15 cs.IR 67%

Constrained Auto-Regressive Decoding Constrains Generative Retrieval

Shiguang Wu, Zhaochun Ren, Xin Xin, Jiyuan Yang, Mengqi Zhang, Zhumin Chen, Maarten de Rijke, Pengjie Ren

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments 13 pages, 6 figures, 2 tables, accepted by SIGIR 2025 (Proceedings of the 48th International ACM SIGIR Conference on Research and Development in Information Retrieval)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11606 2025-04-04 cs.CL cs.AI cs.LG 67%

The Foundations of Tokenization: Statistical and Computational Concerns

Juan Luis Gastaldi, John Terilla, Luca Malagutti, Brian DuSell, Tim Vieira, Ryan Cotterell

机构 * ETH Zürich(苏黎世联邦理工学院) City University of New York(纽约城市大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11005 2025-04-03 cs.CV 67%

Cyclic Contrastive Knowledge Transfer for Open-Vocabulary Object Detection

Chuhan Zhang, Chaoyang Zhu, Pingcheng Dong, Long Chen, Dong Zhang

机构 * The Hong Kong University of Science and Technology(香港科技大学) AI Chip Center for Emerging Smart Systems (ACCESS)(新兴智能系统AI芯片中心)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments 10 pages, 5 figures, Published as a conference paper at ICLR 2025

Journal ref Proceedings of the 13th International Conference on Learning Representations (ICLR 2025), Paper ID: 4226

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23508 2025-04-01 cs.CV 67%

Re-Aligning Language to Visual Objects with an Agentic Workflow

Yuming Chen, Jiangyan Feng, Haodong Zhang, Lijun Gong, Feng Zhu, Rui Zhao, Qibin Hou, Ming-Ming Cheng, Yibing Song

机构 * Nankai University(南开大学) SenseTime Research(商汤科技研究院)

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments 33 pages, 20 figures, 17 tables, ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14456 2025-04-01 cs.CL cs.AI cs.LG 67%

RWKV-7 "Goose" with Expressive Dynamic State Evolution

Bo Peng, Ruichong Zhang, Daniel Goldstein, Eric Alcaide, Xingjian Du, Haowen Hou, Jiaju Lin, Jiaxing Liu, Janna Lu, William Merrill, Guangyu Song, Kaifeng Tan, Saiteja Utpala, Nathan Wilce, Johan S. Wind, Tianyi Wu, Daniel Wuttke, Christian Zhou-Zheng

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20748 2025-03-27 cs.CV 67%

UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines

Chen Tang, Xinzhu Ma, Encheng Su, Xiufeng Song, Xiaohong Liu, Wei-Hong Li, Lei Bai, Wanli Ouyang, Xiangyu Yue

机构 * MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) Shanghai AI Lab(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) Shun Hing Institute of Advanced Engineering, The Chinese University of Hong Kong(香港中文大学信兴高等工程研究所)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏