arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 139420 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2507.16287 2025-08-26 cs.CV 75%

Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition

Zefeng Qian, Xincheng Yao, Yifei Huang, Chongyang Zhang, Jiangyong Ying, Hong Sun

机构 * School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(上海交通大学信息科学与电子工程学院) MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能教育部重点实验室) The University of Tokyo(东京大学) Shanghai AI Laboratory(上海人工智能实验室) E-surfing Vision Technology Co., Ltd(亿欧视觉科技有限公司)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16517 2025-08-25 cs.SE cs.PL 75%

ARSP: Automated Repair of Verilog Designs via Semantic Partitioning

Bingkun Yao, Ning Wang, Xiangfeng Liu, Yuxin Du, Yuchen Hu, Hong Gao, Zhe Jiang, Nan Guan

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10893 2025-08-15 cs.CV 75%

STream3R: Scalable Sequential 3D Reconstruction with Causal Transformer

Yushi Lan, Yihang Luo, Fangzhou Hong, Shangchen Zhou, Honghua Chen, Zhaoyang Lyu, Shuai Yang, Bo Dai, Chen Change Loy, Xingang Pan

机构 * S-Lab, Nanyang Technological University, Singapore(南洋理工大学S实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) WICT, Peking University(北京大学WICT学院) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :LLM(abstract);language model(abstract);pretraining(abstract)

Comments TL;DR: Streaming 4D reconstruction using causal transformer. Project page: https://nirvanalan.github.io/projects/stream3r

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08098 2025-08-15 cs.CV 75%

TBAC-UniImage: Unified Understanding and Generation by Ladder-Side Diffusion Tuning

Junzhe Xu, Yuyang Yin, Xi Chen

机构 * Basic Algorithm Center, PCG, Tencent(腾讯基础算法中心、PCG、腾讯)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08821 2025-08-13 cs.CV 75%

3DFroMLLM: 3D Prototype Generation only from Pretrained Multimodal LLMs

Noor Ahmed, Cameron Braunstein, Steffen Eger, Eddy Ilg

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08283 2025-08-13 cs.CL cs.AI cs.LG cs.MA cs.RO 75%

MinionsLLM: a Task-adaptive Framework For The Training and Control of Multi-Agent Systems Through Natural Language

Andres Garcia Rincon, Eliseo Ferrante

机构 * Vrije Universiteit Amsterdam, The Netherlands(阿姆斯特丹自由大学,荷兰) NYU Abu Dhabi, United Arab Emirates(纽约大学阿布扎克分校,阿联酋)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03258 2025-08-06 cs.SE 75%

SmartLLMs Scheduler: A Framework for Cost-Effective LLMs Utilization

Yueyue Liu, Hongyu Zhang, Yuantian Miao

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08549 2025-07-31 cs.SE 75%

Vulnerability Handling of AI-Generated Code -- Existing Solutions and Open Challenges

Sabrina Kaniewski, Dieter Holstein, Fabian Schmidt, Tobias Heer

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted for publication @ IEEE AIxSET 2024; 4 pages, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21538 2025-07-30 cs.CR 75%

Can We End the Cat-and-Mouse Game? Simulating Self-Evolving Phishing Attacks with LLMs and Genetic Algorithms

Seiji Sato, Tetsushi Ohki, Masakatsu Nishigaki

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17743 2025-07-30 cs.CL cs.AI cs.CE cs.LG 75%

ORLM: A Customizable Framework in Training Large Models for Automated Optimization Modeling

Chenyu Huang, Zhengyang Tang, Shixi Hu, Ruoqing Jiang, Xin Zheng, Dongdong Ge, Benyou Wang, Zizhuo Wang

机构 * Shanghai University of Finance and Economics(上海财经大学) The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院) Shanghai Jiao Tong University(上海交通大学) Cardinal Operations Columbia University(哥伦比亚大学) Duke University(杜克大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments accepted by Operations Research

Journal ref Operations Research (2025), published online ahead of print

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13092 2025-07-29 cs.CV 75%

EventVAD: Training-Free Event-Aware Video Anomaly Detection

Yihua Shao, Haojin He, Sijie Li, Siyu Chen, Xinwei Long, Fanhu Zeng, Yuxuan Fan, Muyang Zhang, Ziyang Yan, Ao Ma, Xiaochen Wang, Hao Tang, Yan Wang, Shuyan Li

机构 * Peking University(北京大学) Guangdong University of Technology(广东工业大学) The University of Sheffield(谢菲尔德大学) University of Science and Technology Beijing(北京科技大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Nanjing University(南京大学) University of Trento(特伦特大学) Queen's University Belfast(贝尔法斯特女王大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Paper was accepted by ACM MM 2025; Code: https://github.com/YihuaJerry/EventVAD

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16661 2025-07-23 cs.SE 75%

VulCoCo: A Simple Yet Effective Method for Detecting Vulnerable Code Clones

Tan Bui, Yan Naing Tun, Thanh Phuc Nguyen, Yindu Su, Ferdian Thung, Yikun Li, Han Wei Ang, Yide Yin, Frank Liauw, Lwin Khin Shar, Eng Lieh Ouh, Ting Zhang, David Lo

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07625 2025-07-23 cs.CL cs.AI cs.LG 75%

Autonomous Data Selection with Zero-shot Generative Classifiers for Mathematical Texts

Yifan Zhang, Yifan Luo, Yang Yuan, Andrew C Yao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06273 2025-07-22 cs.CV cs.MM cs.SD eess.AS 75%

Zero-AVSR: Zero-Shot Audio-Visual Speech Recognition with LLMs by Learning Language-Agnostic Speech Representations

Jeong Hun Yeo, Minsu Kim, Chae Won Kim, Stavros Petridis, Yong Man Ro

机构 * KAIST(韩国科学技术院) Imperial College London(伦敦帝国理工学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICCV 2025. Code available at: https://github.com/JeongHun0716/zero-avsr

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15475 2025-07-22 cs.CV 75%

Cube: A Roblox View of 3D Intelligence

Foundation AI Team, Kiran Bhat, Nishchaie Khanna, Karun Channa, Tinghui Zhou, Yiheng Zhu, Xiaoxia Sun, Charles Shang, Anirudh Sudarshan, Maurice Chu, Daiqing Li, Kangle Deng, Jean-Philippe Fauconnier, Tijmen Verhulsdonck, Maneesh Agrawala, Kayvon Fatahalian, Alexander Weiss, Christian Reiser, Ravi Kiran Chirravuri, Ravali Kandur, Alejandro Pelaez, Akash Garg, Michael Palleschi, Jessica Wang, Skylar Litz, Leon Liu, Anying Li, David Harmon, Derek Liu, Liangjun Feng, Denis Goupil, Lukas Kuczynski, Jihyun Yoon, Naveen Marri, Peiye Zhuang, Yinan Zhang, Brian Yin, Haomiao Jiang, Marcel van Workum, Thomas Lane, Bryce Erickson, Salil Pathare, Kyle Price, Steve Han, Yiqing Wang, Anupam Singh, David Baszucki

机构 * Foundation AI Team(基础人工智能团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments Our code and model weights can be found at: https://github.com/Roblox/cube

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02281 2025-07-16 cs.CE 75%

FinRL Contests: Benchmarking Data-driven Financial Reinforcement Learning Agents

Keyi Wang, Nikolaus Holzer, Ziyi Xia, Yupeng Cao, Jiechao Gao, Anwar Walid, Kairong Xiao, Xiao-Yang Liu Yanglet

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments arXiv admin note: text overlap with arXiv:2501.10709

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09676 2025-07-15 cs.CY 75%

Can AI Rely on the Systematicity of Truth? The Challenge of Modelling Normative Domains

Matthieu Queloz

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Journal ref Philosophy and Technology 38 (34): 1-27 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14112 2025-07-08 eess.SP 75%

Large-Language-Model Enabled Semantic Communication Systems

Zhenyi Wang, Li Zou, Shengyun Wei, Kai Li, Feifan Liao, Haibo Mi, Rongxuan Lai

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments accepted by applied sciences

Journal ref Applied Sciences. 2025; 15(13):7227

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23607 2025-07-01 cs.CV 75%

PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum

Shiqi Zhang, Sha Zhang, Jiajun Deng, Yedong Shen, Mingxiao MA, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) The University of Adelaide(阿德莱德大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07584 2025-06-25 cs.IR 75%

Talking to GDELT Through Knowledge Graphs

Audun Myers, Max Vargas, Sinan G. Aksoy, Cliff Joslyn, Benjamin Wilson, Lee Burke, Tom Grimes

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18670 2025-06-24 cs.IR 75%

Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation

Jingming Liu, Yumeng Li, Wei Shi, Yao-Xiang Ding, Hui Su, Kun Zhou

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03249 2025-06-17 cs.LG cs.AI cs.CL 75%

How Much Can We Forget about Data Contamination?

Sebastian Bordt, Suraj Srinivas, Valentyn Boreiko, Ulrike von Luxburg

机构 * University of Tübingen, Tübingen AI Center, Germany Bosch Research North America \& Bosch Center for Artificial Intelligence (BCAI), Sunnyvale, USA

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10952 2025-06-13 cs.CL cs.AI cs.LG 75%

Domain2Vec: Vectorizing Datasets to Find the Optimal Data Mixture without Training

Mozhi Zhang, Howe Tissue, Lu Wang, Xipeng Qiu

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机学院,上海,中国)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09108 2025-06-12 cs.LG cs.AI cs.CL 75%

SensorLM: Learning the Language of Wearable Sensors

Yuwei Zhang, Kumar Ayush, Siyuan Qiao, A. Ali Heydari, Girish Narayanswamy, Maxwell A. Xu, Ahmed A. Metwally, Shawn Xu, Jake Garrison, Xuhai Xu, Tim Althoff, Yun Liu, Pushmeet Kohli, Jiening Zhan, Mark Malhotra, Shwetak Patel, Cecilia Mascolo, Xin Liu, Daniel McDuff, Yuzhe Yang

机构 * Google DeepMind(谷歌DeepMind) Google Research(谷歌研究) University of Cambridge(剑桥大学)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02460 2025-06-12 cs.CL cs.AI cs.LG 75%

Code-Switching Curriculum Learning for Multilingual Transfer in LLMs

Haneul Yoo, Cheonbok Park, Sangdoo Yun, Alice Oh, Hwaran Lee

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear in Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06607 2025-06-10 cs.CL cs.AI cs.LG 75%

Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit

Charles Goddard, Fernando Fernandes Neto

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24009 2025-06-10 cs.CL cs.AI cs.LG 75%

Diversity of Transformer Layers: One Aspect of Parameter Scaling Laws

Hidetaka Kamigaito, Ying Zhang, Jingun Kwon, Katsuhiko Hayashi, Manabu Okumura, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技術大學) RIKEN Center for Advanced Intelligence Project(RIKEN先進 Intelligenceプロジェクト) Chungnam National University(Chungnam國立大學) The University of Tokyo(東京大學) Institute of Science Tokyo(東京科學研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04209 2025-06-05 cs.CV 75%

Language-Image Alignment with Fixed Text Encoders

Jingfeng Yang, Ziyang Wu, Yue Zhao, Yi Ma

机构 * UC Berkeley(伯克利大学) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02868 2025-06-04 cs.CV 75%

Pan-Arctic Permafrost Landform and Human-built Infrastructure Feature Detection with Vision Transformers and Location Embeddings

Amal S. Perera, David Fernandez, Chandi Witharana, Elias Manos, Michael Pimenta, Anna K. Liljedahl, Ingmar Nitze, Yili Yang, Todd Nicholson, Chia-Yu Hsu, Wenwen Li, Guido Grosse

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments 20 pages, 2 column IEEE format, 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11840 2025-06-04 cs.LG cs.AI cs.CL 75%

A Hitchhiker's Guide to Scaling Law Estimation

Leshem Choshen, Yang Zhang, Jacob Andreas

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML

详情

展开后加载摘要…

URL PDF HTML 收藏