arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Northeastern University(东北大学)

2026-02-19 至 2026-02-19 共收录 4
2602.16673 2026-02-19 cs.LG cs.IR

Neighborhood Stability as a Measure of Nearest Neighbor Searchability

邻域稳定性作为最近邻搜索性的度量

Thomas Vecchiato, Sebastian Bruch

机构 * University of Copenhagen, Copenhagen, Denmark(哥本哈根大学) Northeastern University, Boston, MA, USA(东北大学)

AI总结 本文提出两种度量方法,用于评估数据集是否可通过基于聚类的近似最近邻搜索进行搜索,且不依赖特定距离函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16554 2026-02-19 cs.LO cs.AI cs.ET quant-ph

MerLean: An Agentic Framework for Autoformalization in Quantum Computation

MerLean:一个用于量子计算自动形式化的代理框架

Yuanjie Ren, Jinzheng Li, Yidi Qi

机构 * Massachusetts Institute of Technology(麻省理工学院) Northeastern University(东北大学)

AI总结 MerLean通过自动化形式化框架将量子计算论文中的数学语句转化为Lean代码并回译为可读格式,实现端到端验证,为同行评审和合成数据训练提供实用工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00553 2026-02-19 cs.CL

Standardizing the Measurement of Text Diversity: A Tool and a Comparative Analysis of Scores

标准化文本多样性测量:一种工具和评分的比较分析

Chantal Shaib, Venkata S. Govindarajan, Joe Barrow, Jiuding Sun, Alexa F. Siu, Byron C. Wallace, Ani Nenkova

机构 * Northeastern University(东北大学) Adobe Research(Adobe研究) Pattern Data(Pattern Data公司) Ithaca College(伊特纳学院)

AI总结 本文提出了一种标准化文本多样性测量工具,通过开源包和交互平台分析文本重复,发现压缩算法与n-gram同质性评分相似,且多种指标组合能有效报告文本多样性。

Comments AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03310 2026-02-19 cs.CL cs.CR cs.LG

Randomized Masked Finetuning: An Efficient Way to Mitigate Memorization of PIIs in LLMs

随机掩码微调:一种缓解LLM中PII记忆的有效方法

Kunj Joshi, David A. Smith

机构 * Khoury College of Computer Sciences, Northeastern University, Boston, MA, USA(东北大学科里学院计算机科学学院)

AI总结 本文提出随机掩码微调方法,有效减少LLM中PII记忆,同时保持模型性能,通过实验验证其在隐私保护和效用之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏