USF-MAE: Ultrasound Self-Supervised Foundation Model with Masked Autoencoding
Youssef Megahed, Robin Ducharme, Aylin Erman, Mark Walker, Steven Hawken, Adrian D. C. Chan
机构
*
Department of Systems and Computer Engineering, Carleton University(系统与计算机工程系,卡尔顿大学)
;
Department of Clinical Science and Translational Medicine, University of Ottawa(临床科学与转化医学系,渥太华大学)
;
Department of Obstetrics and Gynecology, University of Ottawa(妇产科系,渥太华大学)
;
School of Epidemiology and Public Health, University of Ottawa(流行病学与公共卫生学院,渥太华大学)
;
Department of Methodological and Implementation Research, Ottawa Hospital Research Institute(方法学与实施研究系,渥太华医院研究学院)
;
Department of Acute Care Research, Ottawa Hospital Research Institute(急症护理研究系,渥太华医院研究学院)
What Are the Facts? Automated Extraction of Court-Established Facts from Criminal-Court Opinions
Klára Bendová, Tomáš Knap, Jan Černý, Vojtěch Pour, Jaromir Savelka, Ivana Kvapilíková, Jakub Drápal
机构
*
Faculty of Law, Charles University, Prague, Czechia(法律学院,查尔斯大学,捷克共和国)
;
Faculty of Mathematics and Physics, Charles University, Prague, Czechia(数学与物理学院,查尔斯大学,捷克共和国)
;
School of Computer Science, Carnegie Mellon University, Pittsburgh PA, USA(计算机科学学院,卡内基梅隆大学,美国)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
CommentsPaper accepted to the proceedings of ASAIL 2025 Workshop under ICAIL conference for publication. Paper contains 6 pages (references included) and 2 appendices. It contains 8 tables, no figures
Learning to reason about rare diseases through retrieval-augmented agents
Ha Young Kim, Jun Li, Ana Beatriz Solana, Carolin M. Pirkl, Benedikt Wiestler, Julia A. Schnabel, Cosmin I. Bercea
机构
*
Technical University of Munich(慕尼黑技术大学)
;
GE HealthCare(GE医疗)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Klinikum Rechts der Isar(莱布尼茨医院)
;
Helmholtz Munich(亥姆霍兹慕尼黑研究中心)
;
King's College London(伦敦国王学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsSubmitted on behalf of the PREDICTOM consortium
机构
*
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Pennsylvania(宾夕法尼亚大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
University of Michigan(密歇根大学)
;
Amazon AGI(亚马逊人工通用智能)
专题命中
评测与基准
:large language model(abstract);language model(abstract)
CommentsTo Appear in NeurIPS 2025 Datasets & Benchmarks Track
ConVerse: Benchmarking Contextual Safety in Agent-to-Agent Conversations
Amr Gomaa, Ahmed Salem, Sahar Abdelnabi
机构
*
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))
;
Microsoft(微软)
;
ELLIS Institute Tübingen and MPI for Intelligent Systems(图宾根ELLIS研究所和智能系统研究所)
;
Tübingen AI Center(图宾根人工智能中心)
A Toolbox for Improving Evolutionary Prompt Search
Daniel Grießhaber, Maximilian Kimmich, Johannes Maucher, Ngoc Thang Vu
机构
*
Institute for Applied Artificial Intelligence (IAAI), Stuttgart Media University(应用人工智能研究所(IAAI)、斯图加特媒体大学)
;
Institute for Natural Language Processing (IMS), University of Stuttgart(自然语言处理研究所(IMS)、斯图加特大学)
Surprisal reveals diversity gaps in image captioning and different scorers change the story
Nikolai Ilinykh, Simon Dobnik
机构
*
Centre for Linguistic Theory and Studies in Probability (CLASP), Department of Philosophy, Linguistics and Theory of Science (FLoV), University of Gothenburg(语言理论与概率研究中心(CLASP)、哲学、语言学与科学理论系(FLoV)、哥德堡大学)
GUARD: Role-playing to Generate Natural-language Jailbreakings to Test Guideline Adherence of Large Language Models
Haibo Jin, Ruoxi Chen, Peiyan Zhang, Andy Zhou, Haohan Wang
机构
*
School of Information Sciences University of Illinois at Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
;
Independent Researcher, Starc Institute(Starc研究所独立研究者)
;
Computer Science and Engineering HKUST(HKUST计算机科学与工程学院)
;
Computer Science Lapis Labs University of Illinois Urbana-Champaign(计算机科学Lapis Labs伊利诺伊大学厄巴纳-香槟分校)
;
School of Information Sciences University of Illinois Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG
Measuring what Matters: Construct Validity in Large Language Model Benchmarks
Andrew M. Bean, Ryan Othniel Kearns, Angelika Romanou, Franziska Sofia Hafner, Harry Mayne, Jan Batzner, Negar Foroutan, Chris Schmitz, Karolina Korgul, Hunar Batra, Oishi Deb, Emma Beharry, Cornelius Emde, Thomas Foster, Anna Gausen, María Grandury, Simeng Han, Valentin Hofmann, Lujain Ibrahim, Hazel Kim, Hannah Rose Kirk, Fangru Lin, Gabrielle Kaili-May Liu, Lennart Luettgau, Jabez Magomere, Jonathan Rystrøm, Anna Sotnikova, Yushi Yang, Yilun Zhao, Adel Bibi, Antoine Bosselut, Ronald Clark, Arman Cohan, Jakob Foerster, Yarin Gal, Scott A. Hale, Inioluwa Deborah Raji, Christopher Summerfield, Philip H. S. Torr, Cozmin Ududec, Luc Rocher, Adam Mahdi
机构
*
University of Oxford(牛津大学)
;
EPFL(苏黎世联邦理工学院)
;
Weizenbaum Institute Berlin(柏林Weizenbaum研究所)
;
Technical University Munich(慕尼黑技术大学)
;
Centre for Digital Governance, Hertie School(赫尔姆霍兹学院数字治理中心)
;
Stanford University(斯坦福大学)
;
UK AI Security Institute(英国人工智能安全研究所)
;
SomosNLP
;
Universdad Politécnica de Madrid(马德里理工大学)
;
Yale University(耶鲁大学)
;
Allen Institute for AI(人工智能研究所)
;
University of Washington(华盛顿大学)
;
Meedan
;
UC Berkeley(加州大学伯克利分校)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
Comments39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks
Activation-Informed Merging of Large Language Models
Amin Heyrani Nobari, Kaveh Alim, Ali ArjomandBigdeli, Akash Srivastava, Faez Ahmed, Navid Azizan
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Stony Brook University(石溪大学)
;
MIT-IBM Watson AI Lab & Red Hat AI Innovation(MIT-IBM Watson AI实验室及Red Hat AI创新)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG