arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Carnegie Mellon University(卡内基梅隆大学)

2026-08-27 至 2026-08-27 共收录 3
2608.22788 2026-08-27 cs.AI cs.LG 版本更新

TailSieve: Partial-Rollout-Guided Tail Routing for LLM Rollouts

TailSieve:面向大语言模型(LLM)rollout的部分rollout引导式长尾路由

Tianqi Xu, Lu Lv, Haoyang Huang, Wenjie Huang, Zhanming Shen, Yuhao Shen, Baolin Zhang, Xinyi Hu, Shuang Ge, Jun Dai, Tianyu Liu, Suorong Yang, Zhikai Li, Ye Bai, Jun Zhang, Lei Chen, Yue Li, Mingchen Wan

机构 * Qwen Business Unit of Alibaba(阿里巴巴通义千问业务部) Carnegie Mellon University(卡内基梅隆大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 TailSieve是面向LLM rollout的部分rollout引导式框架,通过联合控制长尾路由与副本分配,仅路由即可实现最高1.67倍加速,结合专用推测解码可达2.59倍加速,同时保留策略内生成并避免长度偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21727 2026-08-27 cs.LG cs.AI 版本更新

Reinforcement Learning on Benign Facts Amplifies Leakage of Memorized Private Data

基于良性事实的强化学习会放大模型对已记忆私人数据的泄露

Renfei Zhang, Niloofar Mireshghallah

机构 * Carnegie Mellon University(卡内基梅隆大学)

AI总结 该研究发现,基于良性事实的强化学习可放大指令模型对已记忆个人身份信息的泄露,且推理能力与拒绝率得以保留,为攻击者提供了无需接触私人数据即可提取的途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13584 2026-08-27 cs.RO 版本更新

UNRIO: Uncertainty-Aware Velocity Learning for Radar-Inertial Odometry

UNRIO:面向雷达-惯性里程计的不确定性感知速度学习

Jui-Te Huang, Tianshu Huang, Anthony Rowe, Michael Kaess

机构 * Carnegie Mellon University(卡内基梅隆大学)

AI总结 UNRIO通过直接处理雷达IQ信号预测体坐标系速度,结合Transformer架构和GRT框架,在多模式下实现不确定性估计与姿态图融合,有效提升横向运动轨迹中的里程计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏