arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-19 至 2025-09-19 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 16 篇

2509.14438 2025-09-19 cs.CL cs.AI 88%

Simulating a Bias Mitigation Scenario in Large Language Models

Kiana Kiashemshaki, Mohammad Jalili Torkamani, Negin Mahmoudi, Meysam Shirdel Bilehsavar

机构 * Department of Computer Science, Bowling Green State University(计算机科学系,布恩维尔州立大学) School of Computing, University of Nebraska–Lincoln(计算学院,内布拉斯加-林肯大学) Department of Civil, Environmental, and Ocean Engineering, Stevens Institute of Technology(土木、环境与海洋工程系,史蒂文斯理工学院) Department of Computer Science, University of South Carolina(计算机科学系,南卡罗来纳大学) Artificial Intelligence Institute, University of South Carolina(人工智能研究院,南卡罗来纳大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments preprint, 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12443 2025-09-19 cs.CR cs.AI cs.LG 88%

Reconstruction of Differentially Private Text Sanitization via Large Language Models

Shuchao Pang, Zhigang Lu, Haichen Wang, Peng Fu, Yongbin Zhou, Minhui Xue

机构 * Nanjing University of Science and Technology(南京理工大学) Western Sydney University(西澳大学) Institute of Information Engineering(信息工程研究所) Chinese Academy of Sciences(中国科学院) Adelaide University(阿德莱德大学) Responsible AI Research (RAIR) Centre, The University of Adelaide(负责任人工智能研究中心,阿德莱德大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments RAID-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14399 2025-09-19 cs.CL 88%

Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models

Gaifan Zhang, Yi Zhou, Danushka Bollegala

机构 * University of Liverpool(利弗池大学) Cardiff University(卡迪夫大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14256 2025-09-19 cs.CL cs.AI 82%

JU-NLP at Touché: Covert Advertisement in Conversational AI-Generation and Detection Strategies

Arka Dutta, Agrik Majumdar, Sombrata Biswas, Dipankar Das, Sivaji Bandyopadhyay

机构 * Department of Computer Science and Engineering, Jadavpur University(计算机科学与工程系,贾瓦德pur大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14735 2025-09-19 cs.CL 81%

Decoupled Proxy Alignment: Mitigating Language Prior Conflict for Multimodal Alignment in MLLM

Chenkun Tan, Pengyu Wang, Shaojun Zhou, Botian Jiang, Zhaowei Li, Dong Zhang, Xinghao Wang, Yaqian Zhou, Xipeng Qiu

机构 * Fudan University(复旦大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted by Findings of EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22723 2025-09-19 cs.LG cs.AI 79%

Zero-Shot LLMs in Human-in-the-Loop RL: Replacing Human Feedback for Reward Shaping

Mohammad Saif Nazir, Chayan Banerjee

机构 * Queensland University of Technology(昆士兰理工大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 3 figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20271 2025-09-19 cs.LG cs.AI cs.CL 78%

Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models

Haoyu Tang, Ye Liu, Xi Zhao, Xukai Liu, Yanghai Zhang, Kai Zhang, Xiaofang Zhou, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 预训练与数据 :language model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14814 2025-09-19 cs.CL 77%

ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance

Hannah Sterz, Fabian David Schmidt, Goran Glavaš, Ivan Vulić

机构 * University of Cambridge(剑桥大学) University of Würzburg(弗赖堡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14608 2025-09-19 cs.CR cs.AI 77%

Enterprise AI Must Enforce Participant-Aware Access Control

Shashank Shreedhar Bhatt, Tanmay Rajore, Khushboo Aggarwal, Ganesh Ananthanarayanan, Ranveer Chandra, Nishanth Chandran, Suyash Choudhury, Divya Gupta, Emre Kiciman, Sumit Kumar Pandey, Srinath Setty, Rahul Sharma, Teijia Zhao

机构 * Microsoft Corporation(微软公司)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14493 2025-09-19 cs.CL 77%

Translate, then Detect: Leveraging Machine Translation for Cross-Lingual Toxicity Classification

Samuel J. Bell, Eduardo Sánchez, David Dale, Pontus Stenetorp, Mikel Artetxe, Marta R. Costa-jussà

机构 * FAIR at Meta(Meta 的 FAIR 研究院) University College London(伦敦大学学院) University of the Basque Country (UPV/EHU)(巴斯克大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14786 2025-09-19 cs.LG 57%

Pre-training under infinite compute

Konwoo Kim, Suhas Kotha, Percy Liang, Tatsunori Hashimoto

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15212 2025-09-19 cs.CV cs.RO 50%

RynnVLA-001: Using Human Demonstrations to Improve Robot Manipulation

Yuming Jiang, Siteng Huang, Shengke Xue, Yaxi Zhao, Jun Cen, Sicong Leng, Kehan Li, Jiayan Guo, Kexiang Wang, Mingxiu Chen, Fan Wang, Deli Zhao, Xin Li

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Lab(虎扑实验室)

专题命中 预训练与数据 :pretraining(abstract)

Comments GitHub Project: https://github.com/alibaba-damo-academy/RynnVLA-001

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15096 2025-09-19 cs.CV 50%

OmniSegmentor: A Flexible Multi-Modal Learning Framework for Semantic Segmentation

Bo-Wen Yin, Jiao-Long Cao, Xuying Zhang, Yuming Chen, Ming-Ming Cheng, Qibin Hou

机构 * VCIP, CS, Nankai University(视觉计算研究所,计算机科学,南开大学)

专题命中 预训练与数据 :pretraining(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14785 2025-09-19 cs.SD 50%

Spatial-CLAP: Learning Spatially-Aware audio--text Embeddings for Multi-Source Conditions

Kentaro Seki, Yuki Okamoto, Kouei Yamaoka, Yuki Saito, Shinnosuke Takamichi, Hiroshi Saruwatari

机构 * The University of Tokyo, Japan(东京大学) Keio University, Japan(庆应大学)

专题命中 预训练与数据 :pretraining(abstract)

Comments Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14755 2025-09-19 cs.CV 50%

Data Augmentation via Latent Diffusion Models for Detecting Smell-Related Objects in Historical Artworks

Ahmed Sheta, Mathias Zinnen, Aline Sindel, Andreas Maier, Vincent Christlein

机构 * Pattern Recognition Lab, Friedrich-Alexander Universität Erlangen-Nürnberg, Germany(模式识别实验室,埃尔朗根-纽伦堡 Friedrich-Alexander 大学)

专题命中 预训练与数据 :pretraining(abstract)

Comments Appeared at the 4th International Workshop on Fine Art Pattern Extraction and Recognition (FAPER 2025), in conjunction with ICIAP 2025; proceedings forthcoming in ICIAP 2025 Workshops (LNCS, Springer)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17101 2025-09-19 cs.CV 50%

Multi-label Scene Classification for Autonomous Vehicles: Acquiring and Accumulating Knowledge from Diverse Datasets

Ke Li, Chenyu Zhang, Yuxin Ding, Xianbiao Hu, Ruwen Qin

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏