Unlocking Noisy Real-World Corpora for Foundation Model Pre-Training via Quality-Aware Tokenization
通过质量感知的分词解锁噪声真实世界语料用于基础模型预训练
Arvid E. Gollwitzer, Paridhi Latawa, David de Gruijl, Deepak A. Subramanian, Adrián Noriega de la Colina
机构
*
Broad Institute of MIT and Harvard, Cambridge, MA, USA(麻省理工学院与哈佛大学Broad研究所)
;
Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院)
;
Koch Institute for Integrative Cancer Research, MIT, Cambridge, MA, USA(麻省理工学院Koch整合癌症研究 institute)
;
Department of Neurology and Neurosurgery, McGill University, Montreal, Canada(麦吉尔大学神经学与神经外科系)
;
The Montreal Neurological Hospital-Institute, Montreal, Canada(蒙特利尔神经科学医院-研究所)
机构
*
Department of Intelligence and Information, Seoul National University, Republic of Korea(智能与信息系,首尔国立大学,韩国)
;
Artificial Intelligence Institute, Seoul National University, Republic of Korea(人工智能研究所,首尔国立大学,韩国)
;
Interdisciplinary Program in Artificial Intelligence, Seoul National University, Republic of Korea(人工智能跨学科项目,首尔国立大学,韩国)
MDAgent2: Large Language Model for Code Generation and Knowledge Q&A in Molecular Dynamics
MDAgent2:用于分子动力学中代码生成和知识问答的大型语言模型
Zhuofan Shi, Hubao A, Yufei Shao, Dongliang Huang, Hongxu An, Chunxiao Xin, Haiyang Shen, Zhenyu Wang, Yunshan Na, Gang Huang, Xiang Jing
机构
*
Peking University(北京大学)
;
National Key Laboratory of Data Space Technology and System(国家数据空间技术与系统重点实验室)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Liaoning Technical University(辽宁技术大学)
;
Wenjing Future Lab (Beijing) Technology Co., Ltd(文景未来实验室(北京)科技有限公司)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);post-training(abstract);SFT(abstract)
Menglin Yang, Ram Samarth B B, Aosong Feng, Bo Xiong, Jihong Liu, Irwin King, Rex Ying
机构
*
HKUST(GZ)(香港科技大学(广州))
;
HKUST(香港科技大学)
;
Indian Institute of Science(印度科学研究院)
;
Yale University(耶鲁大学)
;
Stanford University(斯坦福大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG
CommentsThe definitive, peer-reviewed and edited version of this article is published in HHAI 2025 - Proceedings of the Fourth International Conference on Hybrid Human-Artificial Intelligence, Frontiers in Artificial Intelligence and Applications, Volume 408, ISBN 978-1-64368-611-0, pages 423 - 438, 2025
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of Michigan(密歇根大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
VP Lab: a PEFT-Enabled Visual Prompting Laboratory for Semantic Segmentation
VP Lab: 一种支持PEFT的视觉提示实验室用于语义分割
Niccolo Avogaro, Thomas Frick, Yagmur G. Cinar, Daniel Caraballo, Cezary Skura, Filip M. Janicki, Piotr Kluska, Brown Ebouky, Nicola Farronato, Florian Scheidegger, Cristiano Malossi, Konrad Schindler, Andrea Bartezzaghi, Roy Assaf, Mattia Rigotti
机构
*
IBM Research(IBM研究院)
;
ETH Zürich(苏黎世联邦理工学院)
专题命中
指令微调
:prompting(title,abstract)
AI总结
VP Lab通过E-PEFT技术提升视觉提示的语义分割性能,实现高效且交互式的模型部署。
Journal refIEEE/CVF Conference on Computer Vision and Pattern Recognition, 2025
Trifuse: Enhancing Attention-Based GUI Grounding via Multimodal Fusion
Trifuse: 通过多模态融合增强基于注意力的GUI定位
Longhui Ma, Di Zhao, Siwei Wang, Zhao Lv, Miao Wang
机构
*
College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学)
;
Intelligent Game and Decision Lab, Academy of Military Sciences(智能游戏与决策实验室,军事科学院)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.AI