Form, Not Content? A Preregistered, Placebo-Controlled Evaluation of Learned Error-Conditioned Self-Repair Through Prompts and Weights in Frozen Small Code Models
形式而非内容?对冻结小代码模型中通过提示和权重进行的学习错误条件自修复的预注册、安慰剂对照评估
Mehmet Iscan
机构
*
PythaLab, Yıldız Technical University, Istanbul, Turkey(PythaLab,Yıldız技术大学,伊斯坦布尔,土耳其)
Kiri L. Wagstaff, Joydeep Biswas, Erich Merrill, Bo An, Ida Camacho, David J. Crandall, Matthew E. Taylor
机构
*
OSU Libraries(俄勒冈州立大学图书馆)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Nanyang Technological University(南洋理工大学)
;
AAAI Washington, DC(AAAI华盛顿特区)
;
Indiana University(印第安纳大学)
;
University of Alberta(阿尔伯塔大学)
Atlas H&E-TME: Scalable AI-Based Tissue Profiling at Expert Pathologist-Level Accuracy
Atlas H&E-TME:基于AI的可扩展组织分析,达到专家病理学家级别的准确性
Kai Standvoss, Miriam Hägele, Rosemarie Krupar, Julika Ribbat-Idel, Jennifer Altschüler, Gerrit Erdmann, Hans Pinckaers, Evelyn Ramberger, Madleen Drinkwitz, Ádám Nárai, Alexander Möllers, Katja Lingelbach, Sebastian Kons, Lukas Hönig, Recepcan Adigüzel, Joana Baião, Alberto Megina Gonzalo, Marius Teodorescu, Marie-Lisa Eich, Paolo Chetta, Shakil Merchant, Verena Aumiller, Simon Schallenberg, Andrew Norgan, Klaus-Robert Müller, Lukas Ruff, Maximilian Alber, Frederick Klauschen
机构
*
Aignostics, Germany(Aignostics,德国)
;
Institute of Pathology, Charité – Universitätsmedizin Berlin, Germany(柏林夏里特医学院病理学研究所)
;
Berlin Institute of Health, Charité – Universitätsmedizin Berlin, Germany(柏林夏里特医学院柏林健康研究所)
;
Massachusetts General Hospital, Department of Pathology, Harvard Medical School, Boston, MA, US(哈佛医学院麻省总医院病理学系)
;
Department of Laboratory Medicine and Pathology, Mayo Clinic, Rochester, MN, US(梅奥诊所检验医学与病理学系)
;
Machine Learning Group, Technische Universität Berlin, Germany(柏林工业大学机器学习组)
;
BIFOLD – Berlin Institute for the Foundations of Learning and Data, Germany(柏林学习与数据基础研究所)
;
Department of Artificial Intelligence, Korea University, Republic of Korea(高丽大学人工智能系)
;
Max-Planck Institute for Informatics, Germany(马克斯·普朗克信息学研究所)
;
German Cancer Research Center (DKFZ) & German Cancer Consortium (DKTK), Berlin & Munich Partner Sites, Germany(德国癌症研究中心及德国癌症联盟柏林和慕尼黑合作站点)
;
Institute of Pathology, Ludwig-Maximilians-Universität München, Germany(慕尼黑大学病理学研究所)
;
Bavarian Cancer Research Center (BZKF), Germany(巴伐利亚癌症研究中心)
Can LLMs Write Reliable Rubrics? A Meta-Evaluation for Experiment Reproduction
大语言模型能写出可靠的评分标准吗?实验复现的元评估
Hanhua Hong, Yizhi Li, Jiaoyan Chen, Luu Gia Huy, Sophia Ananiadou, Jung-jae Kim, Chenghua Lin
机构
*
The University of Manchester(曼彻斯特大学)
;
Institute for Infocomm Research (I²R), A*STAR(资讯通信研究院(I²R),新加坡科技研究局)
;
IQuest Research(IQuest研究公司)
;
ELLIS Manchester(ELLIS曼彻斯特)
;
University of Information Technology, VNU(越南国家大学信息技术大学)
Operationalising Multi-Dimensional Evaluation for Conversational Agents: A Scalable, Governed Pipeline with Selective Re-evaluation and Model Benchmarking
The GEST-Engine: From Event Graphs to Synthetic Video. A Full Technical Report
GEST引擎:从事件图到合成视频。完整技术报告
Nicolae Cudlenco, Mihai Masala, Marius Leordeanu
机构
*
Institute of Mathematics of the Romanian Academy(罗马尼亚科学院数学研究所)
;
National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学)
;
Büchi Labortechnik AG(布赫实验室技术公司)
RoboDesign1M: A Large-scale Dataset for Robot Design Understanding
RoboDesign1M:用于机器人设计理解的大规模数据集
Tri Le, Toan Nguyen, Quang Tran, Quang Nguyen, Baoru Huang, Hoan Nguyen, Minh Nhat Vu, Tung D. Ta, Anh Nguyen
机构
*
FPT Software AI Center(FPT软件人工智能中心)
;
University of Liverpool(利物浦大学)
;
University of Information Technology(信息技术大学)
;
Automation & Control Institute(自动化与控制研究所)
;
Department of Creative Informatics(创意信息系)
;
Faculty of Environment and Information Studies(环境与信息科学系)
机构
*
LSEA Laboratory, Department of Electrical Engineering, University of Medea, 26000, Algeria(里塞阿实验室,电气工程系,梅迪亚大学,阿尔及利亚)
;
Institute of Technology, University Centre Salhi Ahmed, Naama, Algeria(技术研究所,萨利哈·阿赫迈德大学中心,纳马,阿尔及利亚)
;
Cybersecurity Institute, Department of Computer Science, University of Liverpool, L69 3BX, Liverpool, UK(网络安全研究所,计算机科学系,利物浦大学,英国)
;
LCPTS Laboratory, University of Sciences(LCPTS实验室,科学大学)
;
College of Computing(计算学院)
;
Data Science, Nanyang Technological University, Singapore.(数据科学,南洋理工大学,新加坡)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
A Replicate-and-Quantize Strategy for Plug-and-Play Load Balancing of Sparse Mixture-of-Experts LLMs
用于稀疏专家混合模型LLM插拔式负载平衡的复制和量化策略
Zijie Liu, Jie Peng, Jinhao Duan, Zirui Liu, Kaixiong Zhou, Mingfu Liang, Luke Simon, Xi Liu, Zhaozhuo Xu, Tianlong Chen
机构
*
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Minnesota Twin Cities(明尼苏达大学双城分校)
;
North Carolina State University(北卡罗来纳州立大学)
;
Meta AI
;
Stevens Institute of Technology(史蒂文斯理工学院)
专题命中
效率与部署
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG