arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138999 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2509.11141 2025-09-16 cs.CL 77%

When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity

Shiyao Cui, Xijia Feng, Yingkang Wang, Junxiao Yang, Zhexin Zhang, Biplab Sikdar, Hongning Wang, Han Qiu, Minlie Huang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06196 2025-09-09 cs.CL 77%

Augmented Fine-Tuned LLMs for Enhanced Recruitment Automation

Mohamed T. Younes, Omar Walid, Khaled Shaban, Ali Hamdi, Mai Hassan

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05363 2025-09-09 cs.AI cond-mat.mtrl-sci cs.MA 77%

SasAgent: Multi-Agent AI System for Small-Angle Scattering Data Analysis

Lijie Ding, Changwoo Do

机构 * Neutron Scattering Division, Oak Ridge National Laboratory, Oak Ridge, TN 37831, USA(橡树岭国家实验室中子散射部)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14212 2025-09-04 cs.CL 77%

Bias Analysis and Mitigation through Protected Attribute Detection and Regard Classification

Takuma Udagawa, Yang Zhao, Hiroshi Kanayama, Bishwaranjan Bhattacharjee

机构 * IBM Research - Tokyo(IBM东京研究实验室) IBM T. J. Watson Research Center(IBM T.J. Watson研究中心)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02040 2025-09-03 cs.CL 77%

Attributes as Textual Genes: Leveraging LLMs as Genetic Algorithm Simulators for Conditional Synthetic Data Generation

Guangzeng Han, Weisi Liu, Xiaolei Huang

机构 * Department of Computer Science, University of Memphis(计算机科学系,孟菲斯大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05058 2025-09-03 cs.CL 77%

Not All Data Are Unlearned Equally

Aravind Krishnan, Siva Reddy, Marius Mosbach

机构 * Mila – Quebec AI Institute(魁北克AI研究所) McGill University(麦吉尔大学) Saarland University(萨尔兰大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能 chair)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18648 2025-08-28 cs.CL 77%

Thinking Before You Speak: A Proactive Test-time Scaling Approach

Cong Liu, Wenchang Chai, Hejun Wu, Yan Pan, Pengxu Wei, Liang Lin

机构 * Sun Yat-sen University(中山大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09896 2025-08-27 cs.LG physics.chem-ph q-bio.BM 77%

Instruction-Based Molecular Graph Generation with Unified Text-Graph Diffusion Model

Yuran Xiang, Haiteng Zhao, Chang Ma, Zhi-Hong Deng

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) State Key Laboratory of General Artificial Intelligence, School of Intelligence Science(通用人工智能国家重点实验室,智能科学学院) The University of Hong Kong(香港大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Comments ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17494 2025-08-26 cs.CL cs.SD 77%

Improving French Synthetic Speech Quality via SSML Prosody Control

Nassima Ould Ouali, Awais Hussain Sani, Ruben Bueno, Jonah Dauvet, Tim Luka Horstmann, Eric Moulines

机构 * École Polytechnique(巴黎高等理工学院) Hi! PARIS Research Center(Hi!巴黎研究中心) McGill University(麦吉尔大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments 13 pages, 9 figures, 6 tables. Accepted for presentation at ICNLSP 2025 (Odense, Denmark). Code and demo: https://github.com/hi-paris/Prosody-Control-French-TTS. ACM Class: I.2.7; H.5.5

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14323 2025-08-26 cs.CL 77%

Beyond Semantic Similarity: Reducing Unnecessary API Calls via Behavior-Aligned Retriever

Yixin Chen, Ying Xiong, Shangyu Wu, Yufei Cui, Xue Liu, Nan Guan, Chun Jason Xue

机构 * City University of Hong Kong(香港城市大学) Mohamed Bin Zayed University of Artificial Intelligence(马尔代夫穆罕默德·本·扎耶德人工智能大学) McGill University(麦吉尔大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05637 2025-08-11 cs.HC cs.AI 77%

Automated Visualization Makeovers with LLMs

Siddharth Gangwar, David A. Selby, Sebastian J. Vollmer

机构 * University of Kaiserslautern–Landau (RPTU)(凯撒斯劳滕-兰道大学(RPTU)) Department of Data Science and its Applications, German Research Center for Artificial Intelligence (DFKI)(数据科学及其应用系,德国人工智能研究中心(DFKI))

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05242 2025-08-08 cs.CL 77%

CodeBoost: Boosting Code LLMs by Squeezing Knowledge from Code Snippets with RL

Sijie Wang, Quanjiang Guo, Kai Zhao, Yawei Zhang, Xin Li, Xiang Li, Siqi Li, Rui She, Shangshu Yu, Wee Peng Tay

机构 * Nanyang Technological University(南洋理工大学) University of Electronic Science and Technology of China(电子科技大学) Beihang University(北京航空航天大学) Northeastern University, China(中国东北大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

Comments Technical report. Project page: https://github.com/sijieaaa/CodeBoost

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03712 2025-08-07 cs.CL 77%

How Deep Is Representational Bias in LLMs? The Cases of Caste and Religion

Agrima Seth, Monojit Choudhary, Sunayana Sitaram, Kentaro Toyama, Aditya Vashistha, Kalika Bali

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to AIES 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03117 2025-08-06 cs.AI 77%

Toward a Trustworthy Optimization Modeling Agent via Verifiable Synthetic Data Generation

Vinicius Lima, Dzung T. Phan, Jayant Kalagnanam, Dhaval Patel, Nianjun Zhou

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01326 2025-08-05 cs.CL 77%

Large-Scale Diverse Synthesis for Mid-Training

Xuemiao Zhang, Chengying Tu, Can Ren, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai

专题命中 预训练与数据 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10699 2025-08-05 cs.CL 77%

Thinker-DDM: Modeling Deliberation for Machine Translation with a Drift-Diffusion Process

Hongbin Na, Zimu Wang, Mieradilijiang Maimaiti, Tong Chen, Wei Wang, Tao Shen, Ling Chen

机构 * Australian AI Institute, University of Technology Sydney(澳大利亚人工智能研究院,悉尼技术大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Chinese Academy of Sciences(中国科学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22930 2025-08-01 cs.CL cs.SI 77%

Protecting Vulnerable Voices: Synthetic Dataset Generation for Self-Disclosure Detection

Shalini Jangra, Suparna De, Nishanth Sastry, Saeed Fadaei

机构 * University of Surrey, UK(英国萨里大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments 15 pages, 4 Figures, Accepted in "The 17th International Conference on Advances in Social Networks Analysis and Mining -ASONAM-2025"

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13540 2025-07-31 cs.LG 77%

Provable Low-Frequency Bias of In-Context Learning of Representations

Yongyi Yang, Hidenori Tanaka, Wei Hu

机构 * Computer Science and Engineering, University of Michigan(密歇根大学计算机科学与工程系) CBS-NTT Physics of Intelligence Program, Harvard University(哈佛大学CBS-NTT智能物理计划) Physics of Artificial Intelligence Group, NTT Research, Inc.(NTT研究公司人工智能物理小组)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07783 2025-07-28 cs.CV cs.CL 77%

Parameter-Inverted Image Pyramid Networks for Visual Perception and Multimodal Understanding

Zhaokai Wang, Xizhou Zhu, Xue Yang, Gen Luo, Hao Li, Changyao Tian, Wenhan Dou, Junqi Ge, Lewei Lu, Yu Qiao, Jifeng Dai

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Sensetime

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL

Journal ref TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17766 2025-07-25 cs.DC cs.LG 77%

Incentivised Orchestrated Training Architecture (IOTA): A Technical Primer for Release

Felix Quinque, Alan Aboudib, Szymon Fonau, Rodrigo Lopez Portillo Alcocer, Brian McCrindle, Steffen Cruz

机构 * Macrocosmos AI

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16414 2025-07-23 cs.AI 77%

Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework

Hongyi Tang, Zhihao Zhu, Yi Yang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07457 2025-07-23 cs.CL 77%

LLMs syntactically adapt their language use to their conversational partner

Florian Kandra, Vera Demberg, Alexander Koller

机构 * Department of Language Science and Technology(语言科学与技术系) Saarland University(萨尔兰大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 5 pages, 1 table, 3 figures, accepted at ACL (main conference) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12347 2025-07-18 cs.CL 77%

Synthesizing Privacy-Preserving Text Data via Finetuning without Finetuning Billion-Scale LLMs

Bowen Tan, Zheng Xu, Eric Xing, Zhiting Hu, Shanshan Wu

机构 * Carnegie Mellon University(卡内基梅隆大学) Google Research(谷歌研究) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Code available at https://github.com/tanyuqian/synthetic-private-data

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12372 2025-07-17 cs.CL 77%

Web-Browsing LLMs Can Access Social Media Profiles and Infer User Demographics

Meysam Alizadeh, Fabrizio Gilardi, Zeynab Samei, Mohsen Mosleh

机构 * University of Zurich(苏黎世大学) IPM(伊朗科学院) University of Oxford(牛津大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09485 2025-07-15 cs.CL 77%

Balanced Training Data Augmentation for Aspect-Based Sentiment Analysis

Junjie Liu, Yuanhe Tian, Yan Song

机构 * University of Science and Technology of China(中国科学技术大学) University of Washington(华盛顿大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02240 2025-07-15 cs.CL cs.DB 77%

OmniSQL: Synthesizing High-quality Text-to-SQL Data at Scale

Haoyang Li, Shang Wu, Xiaokang Zhang, Xinmei Huang, Jing Zhang, Fuxin Jiang, Shuai Wang, Tieying Zhang, Jianjun Chen, Rui Shi, Hong Chen, Cuiping Li

机构 * Renmin University of China(中国人民大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08603 2025-07-14 cs.AI cs.SD eess.AS 77%

Unlocking Speech Instruction Data Potential with Query Rewriting

Yonghua Hei, Yibo Yan, Shuliang Liu, Huiyu Zhou, Linfeng Zhang, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Guangxi Zhuang Autonomous Region Big Data Research Institute(广西壮族自治区大数据研究院) The Hong Kong University of Science and Technology(香港科技大学) School of Artificial Intelligence, Shanghai Jiaotong University(上海交通大学人工智能学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15379 2025-07-11 cs.IR cs.AI cs.CV 77%

Diffusion Augmented Retrieval: A Training-Free Approach to Interactive Text-to-Image Retrieval

Zijun Long, Kangheng Liang, Gerardo Aragon-Camarasa, Richard Mccreadie, Paul Henderson

机构 * Hunan University(湖南大学) University of Glasgow(格拉斯哥大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05997 2025-07-09 cs.CL 77%

DocIE@XLLM25: In-Context Learning for Information Extraction using Fully Synthetic Demonstrations

Nicholas Popovič, Ashish Kangen, Tim Schopf, Michael Färber

机构 * ScaDS.AI & TU Dresden(ScaDS.AI与德累斯顿技术大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17495 2025-07-03 cs.AI cs.SI 77%

Human Mobility Modeling with Household Coordination Activities under Limited Information via Retrieval-Augmented LLMs

Yifan Liu, Xishun Liao, Haoxuan Ma, Brian Yueshuai He, Chris Stanford, Jiaqi Ma

机构 * UCLA Mobility Lab, Department of Civil and Environmental Engineering, University of California, Los Angeles, Los Angeles, USA(加州大学洛杉矶分校移动实验室,土木与环境工程系,加州大学洛杉矶分校,洛杉矶,美国) Civil and Environmental Engineering Department, University of Louisville, Louisville, Kentucky, USA(路易斯维尔大学土木与环境工程系,路易斯维尔,肯塔基州,美国) Novateur Research Solutions, Ashburn, VA, USA(Novateur研究解决方案,弗吉尼亚州阿什本,美国)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏