arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12460 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12460 篇

2504.16000 2025-04-23 stat.ML cs.AI cs.CL cs.CR cs.LG 75%

How Private is Your Attention? Bridging Privacy with In-Context Learning

Soham Bonnerjee, Zhen Wei, Yeon, Anna Asch, Sagnik Nandy, Promit Ghosal

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14808 2025-04-22 cs.CL cs.AI cs.IR cs.LG 75%

On Self-improving Token Embeddings

Mario M. Kubek, Shiraj Pokharel, Thomas Böhme, Emma L. McDaniel, Herwig Unger, Armin R. Mikler

机构 * Georgia State University(佐治亚州立大学) Technische Universität Ilmenau(伊伦姆阿大学) FernUniversität in Hagen(哈根弗伦大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, 4 figures, 3 tables, accepted at the 2025 25th International Conference on Innovations for Community Services (I4CS), June 11 - 13, Munich, Germany, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11546 2025-04-07 cs.CL cs.AI cs.LG 75%

Memorization in In-Context Learning

Shahriar Golchin, Mihai Surdeanu, Steven Bethard, Eduardo Blanco, Ellen Riloff

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments v3

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24062 2025-04-01 cs.CL cs.AI cs.LG 75%

Artificial Conversations, Real Results: Fostering Language Detection with Synthetic Data

Fatemeh Mohammadi, Tommaso Romano, Samira Maghool, Paolo Ceravolo

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23448 2025-04-01 cs.SE cs.AI cs.CL cs.LG 75%

Semantic-Preserving Transformations as Mutation Operators: A Study on Their Effectiveness in Defect Detection

Max Hort, Linas Vidziunas, Leon Moonen

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication in Mutation 2025 at the 18th IEEE International Conference on Software Testing, Verification and Validation (ICST 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19199 2025-03-26 cs.CV 75%

Open-Vocabulary Functional 3D Scene Graphs for Real-World Indoor Spaces

Chenyangguang Zhang, Alexandros Delitzas, Fangjinhua Wang, Ruida Zhang, Xiangyang Ji, Marc Pollefeys, Francis Engelmann

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07279 2025-03-26 cs.AI cs.CL cs.LG 75%

The Surprising Effectiveness of Test-Time Training for Few-Shot Learning

Ekin Akyürek, Mehul Damani, Adam Zweiger, Linlu Qiu, Han Guo, Jyothish Pari, Yoon Kim, Jacob Andreas

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09398 2025-03-24 eess.AS cs.SD 75%

Language-Queried Target Sound Extraction Without Parallel Training Data

Hao Ma, Zhiyuan Peng, Xu Li, Yukai Li, Mingjie Shao, Qiuqiang Kong, Ju Liu

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13642 2025-03-20 cs.SE 75%

A Multi-Agent Approach to Fault Localization via Graph-Based Retrieval and Reflexion

Md Nakhla Rafi, Dong Jae Kim, Tse-Hsun Chen, Shaowei Wang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13447 2025-03-18 cs.CL cs.AI cs.LG 75%

MetaScale: Test-Time Scaling with Evolving Meta-Thoughts

Qin Liu, Wenxuan Zhou, Nan Xu, James Y. Huang, Fei Wang, Sheng Zhang, Hoifung Poon, Muhao Chen

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14042 2025-03-12 cs.CV 75%

CAD-Recode: Reverse Engineering CAD Code from Point Clouds

Danila Rukhovich, Elona Dupont, Dimitrios Mallis, Kseniya Cherenkova, Anis Kacem, Djamila Aouada

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05529 2025-03-10 stat.AP cs.SI 75%

PoSSUM: A Protocol for Surveying Social-media Users with Multimodal LLMs

Roberto Cerina

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02318 2025-03-07 cs.CL cs.AI cs.LG cs.LO 75%

Autoformalizing Natural Language to First-Order Logic: A Case Study in Logical Fallacy Detection

Abhinav Lalwani, Tasha Kim, Lovish Chopra, Christopher Hahn, Zhijing Jin, Mrinmaya Sachan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20299 2025-02-28 cs.LG cs.AI cs.CL 75%

An exploration of features to improve the generalisability of fake news detection models

Nathaniel Hoy, Theodora Koulouri

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at Expert Systems with Applications (Elsevier)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19038 2025-02-27 cs.CV 75%

FungalZSL: Zero-Shot Fungal Classification with Image Captioning Using a Synthetic Data Approach

Anju Rani, Daniel O. Arroyo, Petar Durdevic

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 11 pages, 5 Figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17428 2025-02-26 cs.CL cs.AI cs.IR cs.LG 75%

NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models

Chankyu Lee, Rajarshi Roy, Mengyao Xu, Jonathan Raiman, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping

专题命中 预训练与数据 :LLM(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025 (Spotlight). We open-source the model at: https://huggingface.co/nvidia/NV-Embed-v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15370 2025-02-24 cs.CV 75%

Weakly Supervised Video Scene Graph Generation via Natural Language Supervision

Kibum Kim, Kanghoon Yoon, Yeonjun In, Jaehyeong Jeon, Jinyoung Moon, Donghyun Kim, Chanyoung Park

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 10 pages, ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16125 2025-02-12 cs.IR 75%

SampleLLM: Optimizing Tabular Data Synthesis in Recommendations

Jingtong Gao, Zhaocheng Du, Xiaopeng Li, Yichao Wang, Xiangyang Li, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03549 2025-02-11 cs.CV 75%

Kronecker Mask and Interpretive Prompts are Language-Action Video Learners

Jingyi Yang, Zitong Yu, Xiuming Ni, Jia He, Hui Li

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02757 2025-02-07 cs.SE 75%

Too Noisy To Learn: Enhancing Data Quality for Code Review Comment Generation

Chunhua Liu, Hong Yi Lin, Patanamon Thongtanunam

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments The paper is published at the International Conference on Mining Software Repositories (MSR2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15696 2025-02-07 cs.CY 75%

Comparing diversity, negativity, and stereotypes in Chinese-language AI technologies: an investigation of Baidu, Ernie and Qwen

Geng Liu, Carlo Alberto Bono, Francesco Pierri

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract)

Comments This manuscript has been accepted for publication in PeerJ Computer Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03376 2025-02-04 cs.SE 75%

Log Parsing using LLMs with Self-Generated In-Context Learning and Self-Correction

Yifan Wu, Siyu Yu, Ying Li

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by the 33rd IEEE/ACM International Conference on Program Comprehension (ICPC'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19399 2025-02-03 cs.CL cs.AI cs.LG 75%

Scalable-Softmax Is Superior for Attention

Ken M. Nakanishi

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19085 2025-02-03 cs.SE 75%

Enhancing Code Generation for Low-Resource Languages: No Silver Bullet

Alessandro Giagnorio, Alberto Martin-Lopez, Gabriele Bavota

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICPC'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12026 2025-01-30 cs.CV cs.AI cs.CL cs.LG 75%

FlexCap: Describe Anything in Images in Controllable Detail

Debidatta Dwibedi, Vidhi Jain, Jonathan Tompson, Andrew Zisserman, Yusuf Aytar

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14005 2025-01-28 cs.RO 75%

Neural Scaling Laws in Robotics

Sebastian Sartor, Neil Thompson

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19808 2025-01-22 cs.CL cs.AI cs.LG 75%

Can Models Learn Skill Composition from Examples?

Haoyu Zhao, Simran Kaur, Dingli Yu, Anirudh Goyal, Sanjeev Arora

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19223 2025-01-08 cs.CL cs.AI cs.LG 75%

T-FREE: Subword Tokenizer-Free Generative LLMs via Sparse Representations for Memory-Efficient Embeddings

Björn Deiseroth, Manuel Brack, Patrick Schramowski, Kristian Kersting, Samuel Weinbach

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04416 2025-01-03 cs.SD cs.MM eess.AS 75%

Sound-VECaps: Improving Audio Generation with Visual Enhanced Captions

Yi Yuan, Dongya Jia, Xiaobin Zhuang, Yuanzhe Chen, Zhengxi Liu, Zhuo Chen, Yuping Wang, Yuxuan Wang, Xubo Liu, Xiyuan Kang, Mark D. Plumbley, Wenwu Wang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 5 pages with 1 appendix, accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09503 2024-12-31 cs.CL cs.AI cs.LG stat.ML 75%

Out-of-distribution generalization via composition: a lens through induction heads in Transformers

Jiajun Song, Zhuoyan Xu, Yiqiao Zhong

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 46 pages, 27 figures

详情

展开后加载摘要…

URL PDF HTML 收藏