arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Microsoft(微软)

2026-07-03 至 2026-07-03 共收录 4
2606.00342 2026-07-03 cs.LG cs.CR cs.DB 版本更新

PE-means: Improved Differentially Private $k$-means Clustering through Private Evolution

PE-means: 通过私有进化改进差分隐私 $k$-均值聚类

Thomas Humphries, Zinan Lin, Sergey Yekhanin

机构 * University of Waterloo(滑铁卢大学) Microsoft Research(微软研究院)

AI总结 针对欧几里得空间中差分隐私 $k$-均值聚类问题,提出PE-means算法,利用私有进化方法仅计算恒定敏感度的私有直方图,在聚类损失上平均比现有最优基线提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08580 2026-07-03 math.OC cs.LG 版本更新

Adjoint Matching through the Lens of the Stochastic Maximum Principle in Optimal Control

通过随机最大原理视角的伴随匹配

Carles Domingo-Enrich, Jiequn Han

机构 * Microsoft Research New England(微软研究院新英格兰) Flatiron Institute(熨斗研究所)

AI总结 本文基于随机最优控制问题,重新推广并严谨推导了伴随匹配方法,将其置于随机最大原理基础上,提出通用Hamiltonian伴随匹配目标,并展示其在连续时间下的实现方法,为随机控制问题提供新的可实施目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
1808.07645 2026-07-03 cs.HC cs.AI cs.CL 版本更新

Playing 20 Question Game with Policy-Based Reinforcement Learning

基于策略的强化学习玩20个问题游戏

Huang Hu, Xianchao Wu, Bingfeng Luo, Chongyang Tao, Can Xu, Wei Wu, Zhan Chen

机构 * Peking University(北京大学) Microsoft Corporation(微软公司) Microsoft Development Co., Ltd(微软开发有限公司)

AI总结 提出基于策略的强化学习方法,使提问者通过与用户持续交互学习最优问题选择策略,并利用奖励网络估计信息奖励,无需知识库且对噪声答案鲁棒。

Comments Withdrawal from the conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03315 2026-07-03 cs.AI 版本更新

Memora: A Harmonic Memory Representation Balancing Abstraction and Specificity

Memora: 一种平衡抽象与特异性的和谐记忆表示

Menglin Xia, Xuchao Zhang, Shantanu Dixit, Paramaguru Harimurugan, Rujia Wang, Victor Ruhle, Robert Sim, Chetan Bansal, Saravan Rajmohan

机构 * Microsoft(微软)

AI总结 提出Memora记忆表示,通过主抽象和线索锚点平衡抽象与特异性,结合检索策略实现高效上下文感知检索,在LoCoMo和LongMemEval基准上达到新最优。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏