arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2506.20947 2025-08-01 cs.CV cs.MM 67%

Hierarchical Sub-action Tree for Continuous Sign Language Recognition

Dejie Yang, Zhu Xu, Xinjie Gao, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国) State Key Laboratory of General Artificial Intelligence, Peking Universitys, Beijing, China(通用人工智能国家重点实验室,北京大学,北京,中国)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Journal ref ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21489 2025-07-30 cs.CV 67%

Describe, Adapt and Combine: Empowering CLIP Encoders for Open-set 3D Object Retrieval

Zhichuan Wang, Yang Zhou, Zhe Liu, Rui Yu, Song Bai, Yulong Wang, Xinwei He, Xiang Bai

机构 * Huazhong Agricultural University(华中农业大学) Shenzhen University(深圳大学) The University of Hong Kong(香港大学) University of Louisville(路易斯安那大学) ByteDance(字节跳动) Huazhong University of Science and Technology(华中科技大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16708 2025-07-29 cs.IR 67%

Towards More Robust Retrieval-Augmented Generation: Evaluating RAG Under Adversarial Poisoning Attacks

Jinyan Su, Jin Peng Zhou, Zhengxin Zhang, Preslav Nakov, Claire Cardie

专题命中 预训练与数据 :LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17762 2025-07-29 cs.CV 67%

MUSE-VL: Modeling Unified VLM through Semantic Discrete Encoding

Rongchang Xie, Chen Du, Ping Song, Chang Liu

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19054 2025-07-28 cs.CV cs.AI cs.CL cs.IR cs.LG 67%

Closing the Modality Gap for Mixed Modality Search

Binxu Li, Yuhui Zhang, Xiaohan Wang, Weixin Liang, Ludwig Schmidt, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Project page: https://yuhui-zh15.github.io/MixedModalitySearch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17220 2025-07-24 cs.CV cs.RO 67%

PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models

Jiansong Wan, Chengming Zhou, Jinkua Liu, Xiangge Huang, Xiaoyu Chen, Xiaohan Yi, Qisen Yang, Baiting Zhu, Xin-Qiang Cai, Lixing Liu, Rushuai Yang, Chuheng Zhang, Sherif Abdelfattah, Hayong Shin, Pushi Zhang, Li Zhao, Jiang Bian

机构 * Microsoft Research(微软研究院)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16576 2025-07-23 cs.CR 67%

From Text to Actionable Intelligence: Automating STIX Entity and Relationship Extraction

Ahmed Lekssays, Husrev Taha Sencar, Ting Yu

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments This paper is accepted at RAID 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07053 2025-07-22 cs.CL cs.AI cs.LG 67%

Meta4XNLI: A Crosslingual Parallel Corpus for Metaphor Detection and Interpretation

Elisa Sanchez-Bayona, Rodrigo Agerri

机构 * HiTZ Basque Center for Language Technology - Ixa, University of the Basque Country UPV/EHU(巴斯克语言技术中心-ixa,巴斯克国家大学UPV/EHU)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03601 2025-07-22 cs.CL cs.AI cs.LG 67%

APIGen-MT: Agentic Pipeline for Multi-Turn Data Generation via Simulated Agent-Human Interplay

Akshara Prabhakar, Zuxin Liu, Ming Zhu, Jianguo Zhang, Tulika Awalgaonkar, Shiyu Wang, Zhiwei Liu, Haolin Chen, Thai Hoang, Juan Carlos Niebles, Shelby Heinecke, Weiran Yao, Huan Wang, Silvio Savarese, Caiming Xiong

机构 * Salesforce AI Research(Salesforce AI研究院)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 12 pages plus references and appendices; fixes typo in fig 6

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05968 2025-07-17 cs.CV 67%

Jumpstarting Surgical Computer Vision

Deepak Alapatt, Aditya Murali, Vinkle Srivastav, Pietro Mascagni, AI4SafeChole Consortium, Nicolas Padoy

机构 * University of Strasbourg, CNRS, INSERM, ICube, UMR7357, Strasbourg, France(斯特拉斯堡大学、法国国家科学研究中心、法国国家卫生研究院、ICube、UMR7357) IHU-Strasbourg, Institute of Image-Guided Surgery, Strasbourg, France(斯特拉斯堡IHU、影像引导手术研究所) Fondazione Policlinico Universitario Agostino Gemelli IRCCS, Rome, Italy(阿戈斯蒂诺·杰梅利大学附属医院基金会、意大利罗马) Azienda Ospedaliero-Universitaria Sant’Andrea, Rome, Italy(罗马大学附属医院) Fondazione IRCCS Ca’ Granda Ospedale Maggiore Policlinico di Milano, University of Milan, Milan, Italy(米兰Ca’ Granda主要医院基金会、米兰大学) Monaldi Hospital, AORN dei Colli, Naples, Italy(蒙塔尔迪医院、那不勒斯AORN dei Colli)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10737 2025-07-16 cs.CV 67%

Integrating Biological Knowledge for Robust Microscopy Image Profiling on De Novo Cell Lines

Jiayuan Chen, Thai-Hoang Pham, Yuanlong Wang, Ping Zhang

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09615 2025-07-15 cs.CV 67%

Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment Score

Eman Ali, Sathira Silva, Chetan Arora, Muhammad Haris Khan

机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫莫德·本·扎耶德人工智能大学) IIT Delhi(德里印度理工学院) Alexandria University(亚历山大大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05331 2025-07-09 cs.RO 67%

A Careful Examination of Large Behavior Models for Multitask Dexterous Manipulation

TRI LBM Team, Jose Barreiros, Andrew Beaulieu, Aditya Bhat, Rick Cory, Eric Cousineau, Hongkai Dai, Ching-Hsin Fang, Kunimatsu Hashimoto, Muhammad Zubair Irshad, Masha Itkina, Naveen Kuppuswamy, Kuan-Hui Lee, Katherine Liu, Dale McConachie, Ian McMahon, Haruki Nishimura, Calder Phillips-Grafflin, Charles Richter, Paarth Shah, Krishnan Srinivasan, Blake Wulfe, Chen Xu, Mengchao Zhang, Alex Alspach, Maya Angeles, Kushal Arora, Vitor Campagnolo Guizilini, Alejandro Castro, Dian Chen, Ting-Sheng Chu, Sam Creasey, Sean Curtis, Richard Denitto, Emma Dixon, Eric Dusel, Matthew Ferreira, Aimee Goncalves, Grant Gould, Damrong Guoy, Swati Gupta, Xuchen Han, Kyle Hatch, Brendan Hathaway, Allison Henry, Hillel Hochsztein, Phoebe Horgan, Shun Iwase, Donovon Jackson, Siddharth Karamcheti, Sedrick Keh, Joseph Masterjohn, Jean Mercat, Patrick Miller, Paul Mitiguy, Tony Nguyen, Jeremy Nimmer, Yuki Noguchi, Reko Ong, Aykut Onol, Owen Pfannenstiehl, Richard Poyner, Leticia Priebe Mendes Rocha, Gordon Richardson, Christopher Rodriguez, Derick Seale, Michael Sherman, Mariah Smith-Jones, David Tago, Pavel Tokmakov, Matthew Tran, Basile Van Hoorick, Igor Vasiljevic, Sergey Zakharov, Mark Zolotas, Rares Ambrus, Kerri Fetzer-Borelli, Benjamin Burchfiel, Hadas Kress-Gazit, Siyuan Feng, Stacie Ford, Russ Tedrake

机构 * TRI LBM Team(TRI LBM团队)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05165 2025-07-08 cs.CV 67%

Differential Attention for Multimodal Crisis Event Analysis

Nusrat Munia, Junfeng Zhu, Olfa Nasraoui, Abdullah-Al-Zubaer Imran

机构 * University of Kentucky(肯塔基大学) Kentucky Geological Survey(肯塔基地质调查局) University of Louisville(路易斯维尔大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments Presented at CVPRw 2025, MMFM3

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03997 2025-07-04 cs.CV 67%

CAD-Editor: A Locate-then-Infill Framework with Automated Training Data Synthesis for Text-Based CAD Editing

Yu Yuan, Shizhao Sun, Qi Liu, Jiang Bian

机构 * University of Science(科学大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08771 2025-07-03 cs.CV 67%

Admitting Ignorance Helps the Video Question Answering Models to Answer

Haopeng Li, Tom Drummond, Mingming Gong, Mohammed Bennamoun, Qiuhong Ke

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院) School of Mathematics and Statistics, University of Melbourne(墨尔本大学数学与统计学学院) school of Physics, Maths and Computing, The University of Western Australia(西澳大学物理、数学与计算学学院) Department of Data Science & AI, Monash University(墨尔本大学数据科学与人工智能系)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06399 2025-07-03 eess.AS cs.SD 67%

PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection

Jinbo Hu, Yin Cao, Ming Wu, Fang Kang, Feiran Yang, Wenwu Wang, Mark D. Plumbley, Jun Yang

机构 * Key Laboratory of Noise and Vibration Research, Institute of Acoustics, Chinese Academy of Sciences(中国科学院噪声与振动研究所噪声与振动实验室) University of Chinese Academy of Sciences(中国科学院大学) Department of Intelligent Science, Xi’an Jiaotong Liverpool University(西安交通大学利物浦大学智能科学系) Center for Machine Vision and Signal Analysis (CMVS), University of Oulu(奥卢大学机器视觉与信号分析中心) State Key Laboratory of Acoustics, Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所声学国家重点实验室) Centre for Vision, Speech and Signal Processing, University of Surrey(Surrey大学视觉、语音与信号处理中心)

专题命中 预训练与数据 :foundation model(abstract);prompting(abstract)

Comments 16 pages, 9 figures, accepted by IEEE Transactions on Audio, Speech, and Language Processing. The code is available at https://github.com/Jinbo-Hu/PSELDNets

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22752 2025-07-01 cs.SE 67%

Privacy-Preserving Methods for Bug Severity Prediction

Havvanur Dervişoğlu, Ruşen Halepmollası, Elif Eyvaz

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19585 2025-06-25 cs.CV 67%

SMARTIES: Spectrum-Aware Multi-Sensor Auto-Encoder for Remote Sensing Images

Gencer Sumbul, Chang Xu, Emanuele Dalsasso, Devis Tuia

机构 * Ecole Polytechnique Fédérale de Lausanne(瑞士联邦理工学院洛桑分校)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09922 2025-06-25 cs.CV 67%

Cross-sensor self-supervised training and alignment for remote sensing

Valerio Marsocci, Nicolas Audebert

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

Journal ref IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 2025, 18, pp.12278-12289

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00751 2025-06-24 cs.CV 67%

InstructAttribute: Fine-grained Object Attributes editing with Instruction

Xingxi Yin, Jingfeng Zhang, Yue Deng, Zhi Li, Yicheng Li, Yin Zhang

机构 * Zhejiang University(浙江大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14111 2025-06-23 cs.CL cs.AI cs.LG 67%

Essential-Web v1.0: 24T tokens of organized web data

Essential AI, :, Andrew Hojel, Michael Pust, Tim Romanski, Yash Vanjani, Ritvik Kapila, Mohit Parmar, Adarsh Chaluvaraju, Alok Tripathy, Anil Thomas, Ashish Tanwer, Darsh J Shah, Ishaan Shah, Karl Stratos, Khoi Nguyen, Kurt Smith, Michael Callahan, Peter Rushton, Philip Monk, Platon Mazarakis, Saad Jamal, Saurabh Srivastava, Somanshu Singla, Ashish Vaswani

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments include MegaMath-Web-Pro

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01518 2025-06-19 cs.CR 67%

Rubber Mallet: A Study of High Frequency Localized Bit Flips and Their Impact on Security

Andrew Adiletta, Zane Weissman, Fatemeh Khojasteh Dana, Berk Sunar, Shahin Tajik

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14686 2025-06-18 cs.CV 67%

FocalClick-XL: Towards Unified and High-quality Interactive Segmentation

Xi Chen, Hengshuang Zhao

机构 * Department of Computer Science, The University of Hong Kong(计算机科学系,香港大学)

专题命中 预训练与数据 :pretraining(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13813 2025-06-18 q-fin.GN 67%

The Value of Information from Sell-side Analysts

Linying Lv

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05317 2025-06-17 cs.IR cs.AI cs.CL cs.LG 67%

On Synthesizing Data for Context Attribution in Question Answering

Gorjan Radevski, Kiril Gashteovski, Shahbaz Syed, Christopher Malon, Sebastien Nicolas, Chia-Chien Hung, Timo Sztyler, Verena Heußer, Wiem Ben Rim, Masafumi Enomoto, Kunihiro Takeoka, Masafumi Oyamada, Goran Glavaš, Carolin Lawrence

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09022 2025-06-12 cs.CV 67%

Do Multiple Instance Learning Models Transfer?

Daniel Shao, Richard J. Chen, Andrew H. Song, Joel Runevic, Ming Y. Lu, Tong Ding, Faisal Mahmood

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

Comments ICML 2025 (Spotlight). 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16267 2025-06-11 cs.CV cs.AI cs.CL cs.LG 67%

xGen-MM-Vid (BLIP-3-Video): You Only Need 32 Tokens to Represent a Video Even in VLMs

Michael S. Ryoo, Honglu Zhou, Shrikant Kendre, Can Qin, Le Xue, Manli Shu, Jongwoo Park, Kanchana Ranasinghe, Silvio Savarese, Ran Xu, Caiming Xiong, Juan Carlos Niebles

机构 * Salesforce AI Research(Salesforce AI研究院) Stony Brook University(石溪大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03100 2025-06-10 cs.LG cs.AI cs.CL cs.IR math.ST stat.TH 67%

Retrieval-Augmented Generation as Noisy In-Context Learning: A Unified Theory and Risk Bounds

Yang Guo, Yutian Tao, Yifei Ming, Robert D. Nowak, Yingyu Liang

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Salesforce AI Research(Salesforce人工智能研究) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04423 2025-06-06 cs.HC 67%

Reviewriter: AI-Generated Instructions For Peer Review Writing

Xiaotian Su, Thiemo Wambsganss, Roman Rietsche, Seyed Parsa Neshaei, Tanja Käser

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Journal ref Proceedings of the 18th Workshop on Innovative Use of NLP for Building Educational Applications (BEA 2023), Toronto, Canada, July 2023

详情

展开后加载摘要…

URL PDF HTML 收藏