arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-02-04 至 2026-02-04 共收录 7
2510.22926 2026-02-04 cs.LG

Simple Denoising Diffusion Language Models

简单去噪扩散语言模型

Huaisheng Zhu, Zhengyu Chen, Shijie Zhou, Zhihui Xie, Yige Yuan, Shiqi Chen, Zhimeng Guo, Siyuan Xu, Hangfan Zhang, Vasant Honavar, Teng Xiao

机构 * Penn State University(宾夕法尼亚州立大学) University at Buffalo(布法罗大学) University of Washington(华盛顿大学) The University of Hong Kong(香港大学) City University of Hong Kong(城市大学) Alibaba Group(阿里巴巴集团) Allen Institute for AI (AI2)(人工智能研究所(AI2))

AI总结 本文提出了一种简化且改进的去噪损失公式,用于均匀状态扩散模型,以提高训练稳定性与效率,并在大规模模型上展示了良好的扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03123 2026-02-04 cs.CV cs.AI

Beyond Cropping and Rotation: Automated Evolution of Powerful Task-Specific Augmentations with Generative Models

超越裁剪与轮换:利用生成模型自动化进化强大任务特定增强方法

Judah Goldfeder, Shreyes Kaliyur, Vaibhav Sourirajan, Patrick Minwan Puma, Philippe Martin Wyder, Yuhang Hu, Jiong Lin, Hod Lipson

机构 * Columbia University, New York, NY(哥伦比亚大学) University of Washington, Seattle, WA(华盛顿大学) Harvard University, Cambridge, MA(哈佛大学)

AI总结 本文提出EvoAug,利用生成模型和进化算法自动化学习任务特定增强方法,提升模型鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02930 2026-02-04 cs.LG

Rare Event Early Detection: A Dataset of Sepsis Onset for Critically Ill Trauma Patients

罕见事件早期检测:创伤重症患者脓毒症发病数据集

Yin Jin, Tucker R. Stewart, Deyi Zhou, Chhavi Gupta, Arjita Nema, Scott C. Brakenridge, Grant E. O'Keefe, Juhua Hu

机构 * University of Washington Tacoma WA USA(华盛顿大学塔科马分校) Department of Statistics University of Washington Seattle WA USA(华盛顿大学统计学系) Department of Surgery University of Washington Seattle WA USA(华盛顿大学外科系)

AI总结 本文提出了一种针对创伤重症患者脓毒症早期检测的新数据集和方法,以解决创伤相关炎症与脓毒症临床特征重叠的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23223 2026-02-04 cs.CL

Are you going to finish that? A Practical Study of the Partial Token Problem

你打算完成那个吗?对部分标记问题的实用研究

Hao Xu, Alisa Liu, Jonathan Hayase, Yejin Choi, Noah A. Smith

机构 * Paul G. Allen School of Computer Science(保罗·G·艾伦计算机科学与工程学院) Engineering, University of Washington(华盛顿大学工程学院) Nvidia(Nvidia公司) Allen Institute for AI(艾伦人工智能研究所)

AI总结 本文研究了部分标记问题对语言模型预测的影响,发现词边界与令牌边界不一致导致严重预测偏差,并提出缓解措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22975 2026-02-04 cs.AI

Golden Goose: A Simple Trick to Synthesize Unlimited RLVR Tasks from Unverifiable Internet Text

金 Goose:从不可验证的互联网文本中合成无限 RLVR 任务的简单技巧

Ximing Lu, David Acuna, Jaehun Jung, Jian Hu, Di Zhang, Shizhe Diao, Yunheng Zou, Shaokun Zhang, Brandon Cui, Mingjie Liu, Hyunwoo Kim, Prithviraj Ammanabrolu, Jan Kautz, Yi Dong, Yejin Choi

机构 * NVIDIA(NVIDIA公司) University of Washington(华盛顿大学) University of California San Diego(圣地亚哥大学)

AI总结 Golden Goose 通过从不可验证的互联网文本中合成无限 RLVR 任务,提升大型语言模型在复杂推理和网络安全领域的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12940 2026-02-04 cs.LG cs.NA math.NA

Multi-Level Monte Carlo Training of Neural Operators

神经算子的多级蒙特卡洛训练

James Rowbottom, Stefania Fresca, Pietro Lio, Carola-Bibiane Schönlieb, Nicolas Boullé

机构 * Department of Applied Mathematics and Theoretical Physics, University of Cambridge(应用数学与理论物理系,剑桥大学) Department of Mechanical Engineering, University of Washington(机械工程系,华盛顿大学) Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学) Department of Mathematics, Imperial College London(数学系,伦敦帝国学院)

AI总结 本文提出了一种基于多级蒙特卡洛方法的神经算子训练框架,通过多分辨率数据减少计算成本并提高训练效率。

Comments Accepted in Computer Methods in Applied Mechanics and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01177 2026-02-04 cs.LG

Deep Graph Learning will stall without Network Science

深度图学习在没有网络科学的洞察下将停滞

Christopher Blöcker, Martin Rosvall, Ingo Scholtes, Jevin D. West

机构 * Department of Computing Science, Ume{\aa} Universitet, Ume{\aa}, Sweden(计算科学系,乌梅大学,瑞典) Integrated Science Lab (IceLab), Department of Physics, Ume{\aa} Universitet, Ume{\aa}, Sweden(整合科学实验室(IceLab),物理系,乌梅大学,瑞典) Center for an Informed Public, Information School, University of Washington, Seattle, USA(知情公众中心,信息学院,华盛顿大学,美国)

AI总结 本文指出深度图学习需结合网络科学的洞察以避免停滞,并提出六个行动呼吁以促进该领域的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏