arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-09-01 至 2026-09-01 共收录 4
2608.30502 2026-09-01 cs.LG stat.ME stat.ML 新提交

When the Martingale Never Stops Firing: Anytime-Valid Gating on Real Forecast Streams

当鞅永不停止触发:真实预测流上的任意时刻有效门控机制

Weijia Han, Lisha Qu

机构 * University of Washington(华盛顿大学)

AI总结 本研究针对真实预测流场景,测试了任意时刻有效门控机制在修正时间序列基础模型时的有效性,发现其在真实流上触发异常,采用Huber式门控可显著降低退化,建议相关方法附带空校准控制。

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30076 2026-09-01 cs.CL 新提交

Budget-Aware Compression Pipeline for Single-GPU LLM Inference: Methods, Trade-offs, and Coupling Effects

面向单GPU大语言模型推理的预算感知压缩流水线:方法、权衡与耦合效应

Hongyu Yu, Yifei Shen

机构 * Lenovo Research(联想研究院) University of Washington(华盛顿大学)

AI总结 该研究针对单GPU部署70B参数大语言模型的内存、吞吐量及集成成本问题,构建了含剪枝、量化、KV缓存压缩的预算感知压缩流水线,实现了模型压缩至33GB、57 tokens/s推理速度且精度损失在5%内的效果,提供了设计规则与评估协议。

Comments Accepted by GroundLM 2026 (EMNLP 2026 Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29988 2026-09-01 cs.AI 新提交

AutoCRAT: Within-trajectory Joint Control of Stochasticity and Compute for LLM Reasoning

AutoCRAT:针对大语言模型推理的轨迹内随机性与计算量联合控制

Hanjun Luo, Qiushi Liu, Jingya Zhang, Haihong Pang, Jiaheng Wen, Yifei Ma, Yu Yao, Chengxi Zhang, Hanrong Zhang, Yankai Chen, Hanan Salam

机构 * New York University(纽约大学) New York University Abu Dhabi(纽约大学阿布扎比分校) University of Washington Seattle(华盛顿大学西雅图分校) Harvard University(哈佛大学) Massachusetts Institute of Technology(麻省理工学院) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 AutoCRAT是针对大语言模型推理的轨迹内随机性与计算量联合控制方法,仅在语义边界更新决策,在6个基准上减少推理令牌并提升准确率,且跨主干迁移性强。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28609 2026-09-01 cs.CL cs.AI cs.CV 新提交

Parametric Multimodal User Memory: Storing What Captions Cannot Carry

参数化多模态用户记忆:存储字幕无法承载的内容

Bojie Li, Noah Shi

机构 * Pine AI(派恩人工智能) University of Washington(华盛顿大学)

AI总结 该研究提出参数化多模态用户记忆,结合视觉语言模型与专用编码器,解决传统文本用户记忆丢失感知信息的问题,在PerceptMem数据集上验证了其有效性与可推广性。

详情

展开后加载摘要…

URL PDF HTML 收藏