arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12460 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12460 篇

2507.16661 2025-07-23 cs.SE 75%

VulCoCo: A Simple Yet Effective Method for Detecting Vulnerable Code Clones

Tan Bui, Yan Naing Tun, Thanh Phuc Nguyen, Yindu Su, Ferdian Thung, Yikun Li, Han Wei Ang, Yide Yin, Frank Liauw, Lwin Khin Shar, Eng Lieh Ouh, Ting Zhang, David Lo

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07625 2025-07-23 cs.CL cs.AI cs.LG 75%

Autonomous Data Selection with Zero-shot Generative Classifiers for Mathematical Texts

Yifan Zhang, Yifan Luo, Yang Yuan, Andrew C Yao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06273 2025-07-22 cs.CV cs.MM cs.SD eess.AS 75%

Zero-AVSR: Zero-Shot Audio-Visual Speech Recognition with LLMs by Learning Language-Agnostic Speech Representations

Jeong Hun Yeo, Minsu Kim, Chae Won Kim, Stavros Petridis, Yong Man Ro

机构 * KAIST(韩国科学技术院) Imperial College London(伦敦帝国理工学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICCV 2025. Code available at: https://github.com/JeongHun0716/zero-avsr

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15475 2025-07-22 cs.CV 75%

Cube: A Roblox View of 3D Intelligence

Foundation AI Team, Kiran Bhat, Nishchaie Khanna, Karun Channa, Tinghui Zhou, Yiheng Zhu, Xiaoxia Sun, Charles Shang, Anirudh Sudarshan, Maurice Chu, Daiqing Li, Kangle Deng, Jean-Philippe Fauconnier, Tijmen Verhulsdonck, Maneesh Agrawala, Kayvon Fatahalian, Alexander Weiss, Christian Reiser, Ravi Kiran Chirravuri, Ravali Kandur, Alejandro Pelaez, Akash Garg, Michael Palleschi, Jessica Wang, Skylar Litz, Leon Liu, Anying Li, David Harmon, Derek Liu, Liangjun Feng, Denis Goupil, Lukas Kuczynski, Jihyun Yoon, Naveen Marri, Peiye Zhuang, Yinan Zhang, Brian Yin, Haomiao Jiang, Marcel van Workum, Thomas Lane, Bryce Erickson, Salil Pathare, Kyle Price, Steve Han, Yiqing Wang, Anupam Singh, David Baszucki

机构 * Foundation AI Team(基础人工智能团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments Our code and model weights can be found at: https://github.com/Roblox/cube

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02281 2025-07-16 cs.CE 75%

FinRL Contests: Benchmarking Data-driven Financial Reinforcement Learning Agents

Keyi Wang, Nikolaus Holzer, Ziyi Xia, Yupeng Cao, Jiechao Gao, Anwar Walid, Kairong Xiao, Xiao-Yang Liu Yanglet

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments arXiv admin note: text overlap with arXiv:2501.10709

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09676 2025-07-15 cs.CY 75%

Can AI Rely on the Systematicity of Truth? The Challenge of Modelling Normative Domains

Matthieu Queloz

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Journal ref Philosophy and Technology 38 (34): 1-27 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14112 2025-07-08 eess.SP 75%

Large-Language-Model Enabled Semantic Communication Systems

Zhenyi Wang, Li Zou, Shengyun Wei, Kai Li, Feifan Liao, Haibo Mi, Rongxuan Lai

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments accepted by applied sciences

Journal ref Applied Sciences. 2025; 15(13):7227

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23607 2025-07-01 cs.CV 75%

PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum

Shiqi Zhang, Sha Zhang, Jiajun Deng, Yedong Shen, Mingxiao MA, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) The University of Adelaide(阿德莱德大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07584 2025-06-25 cs.IR 75%

Talking to GDELT Through Knowledge Graphs

Audun Myers, Max Vargas, Sinan G. Aksoy, Cliff Joslyn, Benjamin Wilson, Lee Burke, Tom Grimes

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18670 2025-06-24 cs.IR 75%

Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation

Jingming Liu, Yumeng Li, Wei Shi, Yao-Xiang Ding, Hui Su, Kun Zhou

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03249 2025-06-17 cs.LG cs.AI cs.CL 75%

How Much Can We Forget about Data Contamination?

Sebastian Bordt, Suraj Srinivas, Valentyn Boreiko, Ulrike von Luxburg

机构 * University of Tübingen, Tübingen AI Center, Germany Bosch Research North America \& Bosch Center for Artificial Intelligence (BCAI), Sunnyvale, USA

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10952 2025-06-13 cs.CL cs.AI cs.LG 75%

Domain2Vec: Vectorizing Datasets to Find the Optimal Data Mixture without Training

Mozhi Zhang, Howe Tissue, Lu Wang, Xipeng Qiu

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机学院,上海,中国)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09108 2025-06-12 cs.LG cs.AI cs.CL 75%

SensorLM: Learning the Language of Wearable Sensors

Yuwei Zhang, Kumar Ayush, Siyuan Qiao, A. Ali Heydari, Girish Narayanswamy, Maxwell A. Xu, Ahmed A. Metwally, Shawn Xu, Jake Garrison, Xuhai Xu, Tim Althoff, Yun Liu, Pushmeet Kohli, Jiening Zhan, Mark Malhotra, Shwetak Patel, Cecilia Mascolo, Xin Liu, Daniel McDuff, Yuzhe Yang

机构 * Google DeepMind(谷歌DeepMind) Google Research(谷歌研究) University of Cambridge(剑桥大学)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02460 2025-06-12 cs.CL cs.AI cs.LG 75%

Code-Switching Curriculum Learning for Multilingual Transfer in LLMs

Haneul Yoo, Cheonbok Park, Sangdoo Yun, Alice Oh, Hwaran Lee

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear in Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06607 2025-06-10 cs.CL cs.AI cs.LG 75%

Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit

Charles Goddard, Fernando Fernandes Neto

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24009 2025-06-10 cs.CL cs.AI cs.LG 75%

Diversity of Transformer Layers: One Aspect of Parameter Scaling Laws

Hidetaka Kamigaito, Ying Zhang, Jingun Kwon, Katsuhiko Hayashi, Manabu Okumura, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技術大學) RIKEN Center for Advanced Intelligence Project(RIKEN先進 Intelligenceプロジェクト) Chungnam National University(Chungnam國立大學) The University of Tokyo(東京大學) Institute of Science Tokyo(東京科學研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04209 2025-06-05 cs.CV 75%

Language-Image Alignment with Fixed Text Encoders

Jingfeng Yang, Ziyang Wu, Yue Zhao, Yi Ma

机构 * UC Berkeley(伯克利大学) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02868 2025-06-04 cs.CV 75%

Pan-Arctic Permafrost Landform and Human-built Infrastructure Feature Detection with Vision Transformers and Location Embeddings

Amal S. Perera, David Fernandez, Chandi Witharana, Elias Manos, Michael Pimenta, Anna K. Liljedahl, Ingmar Nitze, Yili Yang, Todd Nicholson, Chia-Yu Hsu, Wenwen Li, Guido Grosse

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments 20 pages, 2 column IEEE format, 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11840 2025-06-04 cs.LG cs.AI cs.CL 75%

A Hitchhiker's Guide to Scaling Law Estimation

Leshem Choshen, Yang Zhang, Jacob Andreas

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12170 2025-05-29 cs.LG cs.AI cs.CL 75%

MUDDFormer: Breaking Residual Bottlenecks in Transformers via Multiway Dynamic Dense Connections

Da Xiao, Qingye Meng, Shengping Li, Xingyuan Yuan

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the 42nd International Conference on Machine Learning (ICML'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12833 2025-05-29 cs.CV 75%

FocusChat: Text-guided Long Video Understanding via Spatiotemporal Information Filtering

Zheng Cheng, Rendong Wang, Zhicheng Wang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12953 2025-05-28 cs.CL cs.AI cs.LG 75%

Task-Informed Anti-Curriculum by Masking Improves Downstream Performance on Text

Andrei Jarca, Florinel Alin Croitoru, Radu Tudor Ionescu

机构 * University of Bucharest(布加勒斯特大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09617 2025-05-20 cs.HC 75%

How Good is ChatGPT in Giving Advice on Your Visualization Design?

Nam Wook Kim, Yongsu Ahn, Grace Myers, Benjamin Bach

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 34 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12236 2025-05-20 cs.CL cs.AI cs.LG 75%

Bridging Generative and Discriminative Learning: Few-Shot Relation Extraction via Two-Stage Knowledge-Guided Pre-training

Quanjiang Guo, Jinchuan Zhang, Sijie Wang, Ling Tian, Zhao Kang, Bin Yan, Weidong Xiao

机构 * University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) Information Engineering University(信息工程大学) National University of Defense Technology(国防科技大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 6 figures, Appear on IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10562 2025-05-16 cs.CV 75%

End-to-End Vision Tokenizer Tuning

Wenxuan Wang, Fan Zhang, Yufeng Cui, Haiwen Diao, Zhuoyan Luo, Huchuan Lu, Jing Liu, Xinlong Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Dalian University of Technology(大连理工大学) Tsinghua University(清华大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02550 2025-05-12 cs.LG cs.AI cs.CL 75%

Bielik v3 Small: Technical Report

Krzysztof Ociepa, Łukasz Flis, Remigiusz Kinas, Krzysztof Wróbel, Adrian Gwoździej

机构 * SpeakLeash ACK Cyfronet AGH Jagiellonian University(雅盖隆大学) Azurro Enelpol

专题命中 预训练与数据 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18086 2025-05-02 cs.RO cs.AI cs.CL cs.GR cs.LG 75%

Generating Traffic Scenarios via In-Context Learning to Learn Better Motion Planner

Aizierjiang Aiersilan

机构 * Aizierjiang Aiersilan(独立研究者)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments We are excited to announce that this paper has been accepted for oral presentation at the AAAI 2025 Main Conference. We are grateful for the insightful feedback from the reviewers and look forward to contributing to the discussions at AAAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13181 2025-04-30 cs.CV 75%

Perception Encoder: The best visual embeddings are not at the output of the network

Daniel Bolya, Po-Yao Huang, Peize Sun, Jang Hyun Cho, Andrea Madotto, Chen Wei, Tengyu Ma, Jiale Zhi, Jathushan Rajasegaran, Hanoona Rasheed, Junke Wang, Marco Monteiro, Hu Xu, Shiyu Dong, Nikhila Ravi, Daniel Li, Piotr Dollár, Christoph Feichtenhofer

机构 * Meta FAIR Fudan University(复旦大学) Meta Reality Labs

专题命中 预训练与数据 :LLM(abstract);language model(abstract);pretraining(abstract)

Comments Updated refs, fixed typos, and added new COCO SotA: 66.0 val mAP! Code, models, and data at https://github.com/facebookresearch/perception_models

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01163 2025-04-25 cs.CV 75%

3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer

Jiajun Deng, Tianyu He, Li Jiang, Tianyu Wang, Feras Dayoub, Ian Reid

机构 * Australian Institute for Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学) Microsoft Research(微软研究院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学)

专题命中 预训练与数据 :LLM(abstract);instruction tuning(abstract);pretraining(abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04918 2025-04-25 cs.CV 75%

Training-free Zero-shot Composed Image Retrieval via Weighted Modality Fusion and Similarity

Ren-Di Wu, Yu-Yen Lin, Huei-Fang Yang

机构 * National Sun Yat-sen University(国立中山大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments 14 pages, 6 figures, International Conference on Technologies and Applications of Artificial Intelligence (TAAI) Camera Ready

Journal ref Technologies and Applications of Artificial Intelligence, pp. 77-90, Springer, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏