Small or Large? Zero-Shot or Finetuned? Guiding Language Model Choice for Specialized Applications in Healthcare
Lovedeep Gondara, Jonathan Simkin, Graham Sayle, Shebnum Devji, Gregory Arbour, Raymond Ng
机构
*
British Columbia Cancer Registry Provincial Health Services Authority(不列颠哥伦比亚省癌症登记处省级卫生服务局)
;
Data Science Institute University of British Columbia(数据科学研究所不列颠哥伦比亚大学)
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)
Probability Signature: Bridging Data Semantics and Embedding Structure in Language Models
Junjie Yao, Zhi-Qin John Xu
机构
*
Institute of Natural Sciences, MOE-LSC, Shanghai Jiao Tong University(上海交通大学自然科学研究院)
;
School of Mathematical Sciences, Shanghai Jiao Tong University(上海交通大学数学科学学院)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);分类 cs.LG
Pretrained deep models outperform GBDTs in Learning-To-Rank under label scarcity
Charlie Hou, Kiran Koshy Thekumparampil, Michael Shavlovsky, Giulia Fanti, Yesh Dattatreya, Sujay Sanghavi
机构
*
Department of Electrical and Computer Engineering(电气与计算机工程系)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Amazon(亚马逊)
;
Department of Computer Science(计算机科学系)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
专题命中
预训练与数据
:pretraining(abstract);分类 cs.AI、cs.LG
CommentsPublished in TMLR, ICML-MFPL 2023 Workshop Oral, SPIGM@ICML2024
Playpen: An Environment for Exploring Learning Through Conversational Interaction
Nicola Horst, Davide Mazzaccara, Antonia Schmidt, Michael Sullivan, Filippo Momentè, Luca Franceschetti, Philipp Sadler, Sherzod Hakimov, Alberto Testoni, Raffaella Bernardi, Raquel Fernández, Alexander Koller, Oliver Lemon, David Schlangen, Mario Giulianelli, Alessandro Suglia
机构
*
University of Potsdam(波恩大学)
;
University of Trento(特伦特大学)
;
Saarland University(萨尔大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
Amsterdam UMC(阿姆斯特丹医疗中心)
;
Free University of Bozen Bolzano(博兹纳自由大学)
;
University of Amsterdam(阿姆斯特丹大学)
;
Heriot-Watt University(赫里奥特-瓦特大学)
;
DFKI(德意志联邦研究所)
;
UCL(伦敦大学学院)
;
University of Edinburgh(爱丁堡大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)
CommentsAccepted at EMNLP 2025 (Main) Source code: https://github.com/lm-playpen/playpen Please send correspodence to: lm-playschool@googlegroups.com
A Federated Fine-Tuning Paradigm of Foundation Models in Heterogenous Wireless Networks
Jingyi Wang, Zhongyuan Zhao, Qingtian Wang, Zexu Li, Yue Wang, Tony Q. S. Quek
机构
*
Wireless AI System Research Team, China Telecom Research Institute(中国电信研究院无线AI系统研究团队)
;
The State Key Laboratory of Networking and Switching Technology Beijing University of Posts and Telecommunications(北京邮电大学网络与交换技术国家重点实验室)
;
Singapore University of Technology and Design(新加坡科技设计大学)
VisualTrap: A Stealthy Backdoor Attack on GUI Agents via Visual Grounding Manipulation
Ziang Ye, Yang Zhang, Wentao Shi, Xiaoyu You, Fuli Feng, Tat-Seng Chua
机构
*
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
;
East China University of Science and Technology(东华大学)
BAP v2: An Enhanced Task Framework for Instruction Following in Minecraft Dialogues
Prashant Jayannavar, Liliang Ren, Marisa Hudspeth, Risham Sidhu, Charlotte Lambert, Ariel Cordes, Elizabeth Kaplan, Anjali Narayan-Chen, Julia Hockenmaier
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Microsoft(微软)
;
University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)
;
Amazon(亚马逊)
;
Amazon AGI(亚马逊人工智能实验室)
专题命中
指令微调
:LLM(abstract);分类 cs.CL、cs.AI
Commentsmajor revision; few examples of changes: added contemporary LLMs and new SOTA model, improved readability, expanded related work, etc