arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-01-13 至 2026-01-13 共收录 6
2601.07790 2026-01-13 cs.AI

Benchmarking Small Language Models and Small Reasoning Language Models on System Log Severity Classification

在系统日志严重性分类上评估小型语言模型和小型推理语言模型

Yahya Masri, Emily Ma, Zifu Wang, Joseph Rogers, Chaowei Yang

机构 * George Mason University(乔治·马歇尔大学) Harvard University(哈佛大学)

AI总结 本研究评估了小型语言模型和小型推理语言模型在系统日志严重性分类上的性能,发现架构设计、训练目标和上下文整合能力共同影响模型表现。

Comments 28 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07606 2026-01-13 cs.CL cs.AI

Proof of Time: A Benchmark for Evaluating Scientific Idea Judgments

证明时间:评估科学思想判断的基准

Bingyang Ye, Shan Chen, Jingxuan Tu, Chen Liu, Zidi Xiong, Samuel Schmidgall, Danielle S. Bitterman

机构 * Harvard University(哈佛大学) Mass General Brigham(麻省总医院) Boston Children’s Hospital(波士顿儿童医院) Brandeis University(布兰迪大学) Yale University(耶鲁大学) Johns Hopkins University(约翰霍普金斯大学)

AI总结 PoT通过半可验证的基准框架评估科学思想判断,利用时间分区和未来可验证的目标,结合离线沙盒实现可扩展的评估。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07519 2026-01-13 eess.IV cs.CV

Fast Multi-Stack Slice-to-Volume Reconstruction via Multi-Scale Unrolled Optimization

快速多栈切片到体积重建 via 多尺度展开优化

Margherita Firenze, Sean I. Young, Clinton J. Wang, Hyuk Jin Yun, Elfar Adalsteinsson, Kiho Im, P. Ellen Grant, Polina Golland

机构 * MIT(麻省理工学院) Harvard Medical School(哈佛医学院)

AI总结 本文提出了一种快速多栈切片到体积重建框架,通过多尺度展开优化实现高效3D结构恢复与切片对齐,适用于胎儿脑部MRI等医学影像重建任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06726 2026-01-13 eess.IV cs.CV

USFetal: Tools for Fetal Brain Ultrasound Compounding

USFetal: 用于胎儿脑超声成像的复合工具

Mohammad Khateri, Morteza Ghahremani, Sergio Valencia, Camilo Jaimes, Alejandra Sierra, Jussi Tohka, P. Ellen Grant, Davood Karimi

机构 * A. I. Virtanen Institute for Molecular Sciences, Faculty of Health Sciences, University of Eastern Finland(A.I.维塔内恩分子科学研究所,健康科学学院,东芬兰大学) Munich Center for Machine Learning (MCML) at the Technical University of Munich(慕尼黑技术大学机器学习中心(MCML)) Department of Radiology, Massachusetts General Hospital(麻省总医院放射科) Harvard Medical School and Boston Children’s Hospital(哈佛医学院和波士顿儿童医院)

AI总结 USFetal提出用于胎儿脑超声复合的系统分类和方法,涵盖经典与现代技术,并引入自监督和无监督深度学习方法,提供工具箱支持研究与评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06672 2026-01-13 cs.CL

Will it Merge? On The Causes of Model Mergeability

是否会合并?关于模型合并性的原因

Adir Rahamim, Asaf Yehudai, Boaz Carmeli, Leshem Choshen, Yosi Mass, Yonatan Belinkov

机构 * Technion - Israel Institute of Technology(技术ion-以色列理工学院) IBM Research AI(IBM人工智能研究部) MIT(麻省理工学院) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Hebrew University of Jerusalem(耶路撒冷希伯来大学) Kempner Institute, Harvard University(哈弗大学凯普纳研究所)

AI总结 本文研究了模型合并性的原因,提出了一种可测量的定义,并提出了一种加权合并技术以保留基础模型的知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06289 2026-01-13 cs.CL cs.LG

How well can off-the-shelf LLMs elucidate molecular structures from mass spectra using chain-of-thought reasoning?

离线大语言模型如何通过链式推理解析质谱中的分子结构?

Yufeng Wang, Lu Wei, Lin Liu, Hao Xu, Haibin Ling

机构 * Stony Brook University(石溪大学) Stanford University(斯坦福大学) Harvard Medical School(哈佛医学院)

AI总结 本研究评估了离线大语言模型通过链式推理解析质谱数据的能力,发现其在化学准确性上存在局限。

详情

展开后加载摘要…

URL PDF HTML 收藏