Learning from Prompt itself: the Hierarchical Attribution Prompt Optimization
从提示本身学习:层次归因提示优化
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 HAPO框架通过动态归因机制、语义单元优化和多模态支持,提升提示优化效率,适用于多任务场景。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
从提示本身学习:层次归因提示优化
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 HAPO框架通过动态归因机制、语义单元优化和多模态支持,提升提示优化效率,适用于多任务场景。
异构低带宽预训练大语言模型
机构 * Covenant AI ; Mila, Concordia University(Mila,康科德ia大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 本研究提出一种异构分布式训练框架,结合低带宽流水线并行与SparseLoCo方法,通过激活压缩优化LLM预训练的通信效率与性能。
基于LLM的psychometric量表开发:利用代表性人口数据模拟的可行性
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 本文探讨了利用LLM生成模拟数据在心理量表开发中的可行性,发现其在群体层面具有应用价值,但无法替代个体层面的验证。
SeBERTis:一个用于生成安全相关问题报告分类器的框架
机构 * Electrical \& Computer Engineering McGill University Montréal, Canada ; Cheriton School of Computer Science University of Waterloo Waterloo, Canada ; 2cm Computer \& Information Science 2cm Linköping University 2cm Linköping, Sweden 2cm ; 2cm Electrical \& Computer Engineering 2cm McGill University 2cm Montréal, Canada 2cm
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 SEBERTIS通过训练深度神经网络分类器,有效提升安全相关问题的检测精度,显著优于现有方法。
Comments This is the author pre-print. The manuscript has been accepted for publication at SANER 2026!
基础先验
机构 * Booth School of Business, University of Chicago(芝加哥大学商学院)
专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)
AI总结 本文提出基础先验概念,将生成模型输出视为主观先验,以避免合成数据与真实数据混淆,应用于实证研究和模型改进。
测量Web过滤文本数据集的指纹及其通过训练传播
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 研究发现预训练数据集的指纹可通过训练传播,揭示数据特征及预训练混合比例等信息。
Journal ref NeurIPS 2025 (Spotlight)
基础模型与调整:迈向新一代时间序列预测模型
专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)
AI总结 本文提出通过预训练后微调提升时间序列预测模型在长周期预测中的性能
Comments in French language
机构 * Linknovate Science(Linknovate科学) ; IRLab CITIC Computer Science Department University of A Coruña(IRLab CITIC计算机科学系大学) ; University of A Coruña(阿拉斯卡大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构 * University of Washington(华盛顿大学) ; University of Colorado Boulder(科罗拉多大学 Boulder分校)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Journal ref Text2Story Workshop @ ECIR 2022, CEUR Workshop Proceedings, Vol. 3117, pp. 67-74, 2022. Available at https://ceur-ws.org/Vol-3117/paper7.pdf
机构 * Shanghai Jiao Tong University(上海交通大学) ; Huawei Inc.(华为公司)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments 21 pages, 6 figures
机构 * Indian Institute of Technology New Delhi(印度理工学院新德里)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) ; China Mobile Research Beijing, China(中国移动北京研究院)
专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);post-training(abstract)
机构 * Department of Materials Science and Engineering, University of Delaware, Newark, Delaware 19716, United States(材料科学与工程系,德雷克塞尔大学) ; Department of Chemistry, University of Pennsylvania, Philadelphia, Pennsylvania 19104, United States(化学系,宾夕法尼亚大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Journal ref Chem. Mater. 2025, 37, 7002-7013
机构 * Washington University in St. Louis(圣路易斯华盛顿大学) ; Peking University(北京大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Comments 19 pages
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; Stanford University(斯坦福大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments 9 pages
机构 * Fudan University(复旦大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments Accepted by Findings of EMNLP2025
机构 * Universidade Lusófona(里斯本大学) ; Universitat de Barcelona(巴塞罗那大学) ; Université Paris Cité(巴黎城市大学) ; Cornell Tech(康奈尔科技)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments 14 pages
Journal ref International Conference on Computer-Human Interaction Research and Applications (CHIRA) 2025
机构 * University of Trento(特伦托大学) ; Peoples' Friendship University of Russia (RUDN University)(俄罗斯人民友谊大学(RUDN大学)) ; Joint Institute for Nuclear Research(联合核子研究所) ; Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) ; University of Skövde(斯德哥尔摩大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments Accepted at CLiC-it 2025
机构 * Department of Statistics Ludwig-Maximilian University(统计系路德维希-马克西米利安大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments 9 pages
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)
机构 * Faculdade de Engenharia Elétrica e de Computação (FEEC), University of Campinas (Unicamp)(电子工程与计算学院(FEEC),坎皮纳斯大学) ; Instituto de Computação (IC), University of Campinas (Unicamp)(计算研究所(IC),坎皮纳斯大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构 * Airbus AI Research(空客人工智能研究)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构 * FAIR, Meta(FAIR与Meta公司) ; MIT(麻省理工学院) ; Princeton University(普林斯顿大学) ; New York University(纽约大学)
专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)
Comments 10 pages
机构 * Department of Computer Science University of Kentucky(计算机科学系 哥伦比亚大学) ; Department of Computer Science, Institute for Biomedical Informatics University of Kentucky(计算机科学系 生物医学信息学研究所 哥伦比亚大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
机构 * City University of Hong Kong, Hong Kong, PR China(香港城市大学) ; City University of Hong Kong Shenzhen Research Institute, Shenzhen, PR China(香港城市大学深圳研究院) ; The Hong Kong University of Science and Technology (Guangzhou), Guangzhou PR China(香港科学与技术大学(广州)) ; GreenDynamics, Sydney, NSW, Australia(GreenDynamics公司) ; University of New South Wales, Kensington, NSW, Australia(新南威尔士大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
机构 * Beihang University(北航大学) ; SKLSDE Lab, Beihang University(北航SKLSDE实验室) ; University of Technology Sydney(悉尼大学) ; University of Electronic Science and Technology of China(电子科技大学) ; Peking University(北京大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments 38 pages
机构 * Computer Science Department, UCLA(UCLA计算机科学系)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments 9 pages. accepted to ICLAD'25
机构 * Virginia Tech(弗吉尼亚理工大学)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments Presented at LLM4Eval Workshop, SIGIR 2025 Padova, Italy, July 17, 2025
机构 * Indian Institute of Technology(印度理工学院) ; Sardar Vallabhbhai National Institute of Technology(萨达尔·瓦拉巴希国家理工学院) ; CVIT, International Institute of Information Technology(信息技术国际学院)
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments 40 pages including supplementary, accepted at ICDAR 2025