arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140188 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2512.02561 2025-12-03 cs.MA cs.AI 70%

EZYer: A simulacrum of high school with generative agent

EZYer: 一种高中学校的模拟体与生成代理

Jinming Yang, Zimu Ji, Weiqi Luo, Gaoxi Wang, Bin Ma, Yueling Deng

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 EZYer通过生成代理技术模拟高中教学环境,提供结构化教学材料和互动笔记生成,确保学术严谨性和教学适宜性,实验表明其生成内容质量高,应用前景广阔。

Comments AgentIR@SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02273 2025-12-03 cs.CV cs.AI 70%

Progressive Image Restoration via Text-Conditioned Video Generation

通过文本条件视频生成实现渐进式图像修复

Peng Kang, Xijun Wang, Yu Yuan

机构 * Department of Computer Science, University of Illinois Springfield(伊利诺伊大学斯普林菲尔德分校计算机科学系) School of Electrical and Computer Engineering, Purdue University(普渡大学电气与计算机工程学院)

专题命中 预训练与数据 :LLM(abstract);prompting(abstract);分类 cs.AI

AI总结 本研究通过微调CogVideo,利用文本条件视频生成实现图像渐进式修复,提升感知度量并展示强泛化能力。

Comments First two authors contributed equally to this work. IEEE ICNC Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05326 2025-11-27 cs.CL 70%

A Psychology-based Unified Dynamic Framework for Curriculum Learning

基于心理学的统一动态框架用于课程学习

Guangyu Meng, Qingkai Zeng, John P. Lalor, Hong Yu

机构 * University of Notre Dame, Department of Computer Science and Engineering(诺丁汉大学计算机科学与工程系) Nankai University, College of Computer Science(南开大学计算机学院) University of Notre Dame, Department of IT, Analytics, and Operations(诺丁汉大学信息技术、分析与运营系) VA Bedford Healthcare System, Center for Health Optimization and Implementation Research(美国退伍军人事务部贝福德医疗系统健康优化与实施研究中心) University of Massachusetts Amherst, Manning College of Information and Computer Sciences(马萨诸塞大学阿姆赫斯特分校曼宁信息与计算机科学学院) University of Massachusetts Lowell, Miner School of Computer and Information Sciences(马萨诸塞大学洛威分校米纳尔计算机与信息科学学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于心理学的统一动态框架用于课程学习,通过项目反应理论量化训练数据难度并优化数据选择,提升模型训练效率和准确性。

Comments Accepted for publication in Computational Linguistics. This is a pre-MIT Press publication version. Code available at https://github.com/nd-ball/cl-irt

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17256 2025-11-24 cs.CY cs.CL 70%

Cross-cultural value alignment frameworks for responsible AI governance: Evidence from China-West comparative analysis

跨文化价值观对齐框架用于负责任的AI治理:来自中西方比较分析的证据

Haijiang Liu, Jinguang Gu, Xun Wu, Daniel Hershcovich, Qiaoling Xiao

机构 * Wuhan University of Science and Technology(武汉理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Copenhagen(哥本哈根大学) WUST-Madrid Complutense Institute(武汉理工大学-马德里康普顿斯研究所)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出多层审计平台,评估中西方LLM跨文化价值观对齐,发现中国模型在多语言优化上更优,而西方模型存在美国偏见,Mistral系列在跨文化对齐上表现突出。

Comments Presented on Academic Conference "Technology for Good: Driving Social Impact" (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18515 2025-11-21 cs.CR cs.AI cs.MA cs.SE 70%

Securing Smart Contract Languages with a Unified Agentic Framework for Vulnerability Repair in Solidity and Move

用统一的代理框架保障智能合约语言安全:在Solidity和Move中修复漏洞

Rabimba Karanjai, Lei Xu, Weidong Shi

机构 * University Of Houston(德克萨斯大学休斯敦分校) Kent State University(肯特州立大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Smartify,一种利用多代理框架和LLMs自动检测并修复Solidity和Move智能合约漏洞的方法,展现其在提升安全性和可靠性方面的显著成效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09197 2025-11-20 cs.CL 70%

The Learning Dynamics of Subword Segmentation for Morphologically Diverse Languages

Francois Meyer, Jan Buys

机构 * Department of Computer Science University of Cape Town(计算机科学系 哥伦比亚大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12452 2025-11-18 cs.CV cs.CL 70%

DenseAnnotate: Enabling Scalable Dense Caption Collection for Images and 3D Scenes via Spoken Descriptions

Xiaoyu Lin, Aniket Ghorpade, Hansheng Zhu, Justin Qiu, Dea Rrozhani, Monica Lama, Mick Yang, Zixuan Bian, Ruohan Ren, Alan B. Hong, Jiatao Gu, Chris Callison-Burch

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24645 2025-11-18 cs.AI 70%

FunReason-MT Technical Report: Advanced Data Synthesis Solution for Real-world Multi-Turn Tool-use

Zengzhuang Xu, Bingguang Hao, Zechuan Wang, Yuntao Wen, Xinyi Xu, Yang Liu, Long Chen, Dong Wang, Maolin Wang, Tong Zhao, Yicheng Chen, Cunyin Peng, Jinjie Gu, Leilei Gan, Xiangyu Zhao, Chenyi Zhuang, Shi Gu

机构 * Zhejiang University(浙江大学) City University of Hong Kong(香港城市大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12188 2025-11-18 cs.LG 70%

Scaling Law Analysis in Federated Learning: How to Select the Optimal Model Size?

Xuanyu Chen, Nan Yang, Shuai Wang, Dong Yuan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments The extended version of the paper "Scaling Law Analysis in Federated Learning: How to Select the Optimal Model Size?". Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01211 2025-11-18 econ.GN cs.CE cs.CL cs.DL q-fin.EC 70%

Novelty and Impact of Economics Papers

Chaofeng Wu

机构 * Department of Computer Science, Northwestern University(计算机科学系,西北大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09958 2025-11-14 cs.CV cs.AI 70%

Zero-Shot Referring Expression Comprehension via Vison-Language True/False Verification

Jeffrey Liu, Rongbin Hu

专题命中 预训练与数据 :pretraining(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08207 2025-11-14 physics.comp-ph cond-mat.mtrl-sci cs.LG 70%

Are Foundational Atomistic Models Reliable for Finite-Temperature Molecular Dynamics?

Denan Li, Jiyuan Yang, Xiangkai Chen, Lintao Yu, Shi Liu

机构 * Department of Physics, School of Science, Westlake University, Hangzhou, Zhejiang 310030, China(物理系,科学学院,西湖大学,杭州,浙江 310030,中国)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09709 2025-11-14 cs.CL 70%

Contextual morphologically-guided tokenization for Latin encoder models

Marisa Hudspeth, Patrick J. Burns, Brendan O'Connor

机构 * Manning College of Information & Computer Sciences, University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校信息与计算机科学学院) Institute for the Study of the Ancient World, New York University(纽约大学古代世界研究所)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10114 2025-11-11 cs.CL 70%

LinearRAG: Linear Graph Retrieval Augmented Generation on Large-scale Corpora

Luyao Zhuang, Shengyuan Chen, Yilin Xiao, Huachi Zhou, Yujing Zhang, Hao Chen, Qinggang Zhang, Xiao Huang

机构 * The Department of Computing, Hong Kong Polytechnic University, Hong Kong SAR(香港理工大学计算机系)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04234 2025-11-07 cs.CL 70%

Reusing Pre-Training Data at Test Time is a Compute Multiplier

Alex Fang, Thomas Voice, Ruoming Pang, Ludwig Schmidt, Tom Gunter

机构 * Apple(苹果公司) Stanford(斯坦福大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02853 2025-11-06 cs.CL 70%

Modeling Annotator Disagreement with Demographic-Aware Experts and Synthetic Perspectives

Yinuo Xu, Veronica Derricks, Allison Earl, David Jurgens

机构 * University of Michigan(密歇根大学) University of Colorado Boulder(科罗拉多大学波德穆尔分校)

专题命中 预训练与数据 :LLM(abstract);prompting(abstract);分类 cs.CL

Comments 8 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01791 2025-11-04 cs.RO cs.AI 70%

GenDexHand: Generative Simulation for Dexterous Hands

Feng Chen, Zhuxiu Xu, Tianzhe Chu, Xunzhe Zhou, Li Sun, Zewen Wu, Shenghua Gao, Zhongyu Li, Yanchao Yang, Yi Ma

机构 * The University of Hong Kong(香港大学) Transcengram Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01589 2025-11-04 cs.CL 70%

BIRD: Bronze Inscription Restoration and Dating

Wenjie Hua, Hoang H. Nguyen, Gangyan Ge

机构 * Wuhan University(武汉大学) University of Illinois, Chicago(伊利诺伊大学芝加哥分校) Xinjiang University(新疆大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted at EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00875 2025-11-04 cs.IR cs.LG 70%

Controlling Gender Bias in Retrieval via a Backpack Architecture

Amirabbas Afzali, Amirreza Velae, Iman Ahmadi, Mohammad Aliannejadi

机构 * Sharif University of Technology(谢里夫理工大学) University of Amsterdam(阿姆斯特丹大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00446 2025-11-04 cs.CV cs.CR cs.LG 70%

ToxicTextCLIP: Text-Based Poisoning and Backdoor Attacks on CLIP Pre-training

Xin Yao, Haiyang Zhao, Yimin Chen, Jiawei Guo, Kecheng Huang, Ming Zhao

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Miner School of Computer & Information Sciences, University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校Miner计算机与信息科学学院)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23763 2025-11-04 cs.RO cs.CL cs.CV 70%

RoboOmni: Proactive Robot Manipulation in Omni-modal Context

Siyin Wang, Jinlan Fu, Feihong Liu, Xinzhe He, Huangxuan Wu, Junhao Shi, Kexin Huang, Zhaoye Fei, Jingjing Gong, Zuxuan Wu, Yu-Gang Jiang, See-Kiong Ng, Tat-Seng Chua, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23719 2025-11-04 cs.LG 70%

TiRex: Zero-Shot Forecasting Across Long and Short Horizons with Enhanced In-Context Learning

Andreas Auer, Patrick Podest, Daniel Klotz, Sebastian Böck, Günter Klambauer, Sepp Hochreiter

机构 * NXAI GmbH(NXAI公司) ELLIS Unit, LIT AI Lab, Institute for Machine Learning, JKU Linz(ELLIS单元、LIT AI实验室、机器学习研究所) Interdisciplinary Transformation University Austria(跨学科转型大学奥地利)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments presented at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27448 2025-11-03 cs.AI 70%

GeoFM: Enhancing Geometric Reasoning of MLLMs via Synthetic Data Generation through Formal Language

Yuhao Zhang, Dingxin Hu, Tinghao Yu, Hao Liu, Yiting Liu

机构 * Tencent Hunyuan Team(腾讯文言团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12301 2025-11-03 cs.CL 70%

SMOL: Professionally translated parallel data for 115 under-represented languages

Isaac Caswell, Elizabeth Nielsen, Jiaming Luo, Colin Cherry, Geza Kovacs, Hadar Shemtov, Partha Talukdar, Dinesh Tewari, Baba Mamadi Diane, Djibrila Diane, Solo Farabado Cissé, Koulako Moussa Doumbouya, Edoardo Ferrante, Alessandro Guasoni, Christopher Homan, Mamadou K. Keita, Sudhamoy DebBarma, Ali Kuzhuget, David Anugraha, Muhammad Ravi Shulthan Habibi, Genta Indra Winata, Anthony Munthali, Sina Ahmadi, Andrei Chemyshev, Mingfei Lau, Jonathan Eng

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ~10 pages with appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16629 2025-10-31 cs.LG 70%

On the Impossibility of Retrain Equivalence in Machine Unlearning

Jiatong Yu, Yinghui He, Anirudh Goyal, Sanjeev Arora

机构 * Princeton Language and Intelligence(普林斯顿语言与智能)

专题命中 预训练与数据 :LLM(abstract);post-training(abstract);分类 cs.LG

Comments Code available at https://princeton-pli.github.io/impossibility-unlearning/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01737 2025-10-30 cs.LG 70%

Enlightenment Period Improving DNN Performance

Tiantian Liu, Meng Wan, Jue Wang, Ningming Nie

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24019 2025-10-29 cs.SE cs.AI 70%

Lifecycle-Aware code generation: Leveraging Software Engineering Phases in LLMs

Xing Xing, Wei Wang, Lipeng Ma, Weidong Yang, Junjie Zheng

机构 * School of Computer Science, Fudan University(复旦大学计算机科学学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01855 2025-10-29 cs.LG cs.IT math.IT stat.ML 70%

Trade-offs in Data Memorization via Strong Data Processing Inequalities

Vitaly Feldman, Guy Kornowski, Xin Lyu

机构 * Apple(苹果公司) Weizmann Institute of Science(魏茨曼科学研究院) UC Berkeley(伯克利大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Appeared in COLT 2025; this revision includes an improved upper bound in Theorem 3.1, as well as several minor clarifications and modifications

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21561 2025-10-27 cs.CL 70%

Are the LLMs Capable of Maintaining at Least the Language Genus?

Sandra Mitrović, David Kletz, Ljiljana Dolamic, Fabio Rinaldi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15001 2025-10-24 cs.CR cs.AI 70%

VaultGemma: A Differentially Private Gemma Model

Amer Sinha, Thomas Mesnard, Ryan McKenna, Daogao Liu, Christopher A. Choquette-Choo, Yangsibo Huang, Da Yu, George Kaissis, Zachary Charles, Ruibo Liu, Lynn Chua, Pritish Kamath, Pasin Manurangsi, Steve He, Chiyuan Zhang, Badih Ghazi, Borja De Balle Pigem, Prem Eruvbetine, Tris Warkentin, Armand Joulin, Ravi Kumar

机构 * Google Research(谷歌研究) Google DeepMind(谷歌DeepMind)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏