arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Microsoft(微软)

2026-07-03 至 2026-07-03 共收录 10
2607.02417 2026-07-03 cs.RO cs.CV cs.LG 新提交

LIME: Learning Intent-aware Camera Motion from Egocentric Video

LIME: 从自我中心视频学习意图感知的相机运动

Boyang Sun, Jiajie Li, Yung-Hsu Yang, Chenyangguang Zhang, Tim Engelbracht, Sunghwan Hong, Cesar Cadena, Marc Pollefeys, Hermann Blum

机构 * ETH Zurich(苏黎世联邦理工学院) Microsoft(微软) University of Bonn(波恩大学)

AI总结 提出LIME模型,从自我中心视频中挖掘多意图相机运动监督,结合自回归观察增益输出与连续流匹配位姿头,实现语言条件相机运动生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02043 2026-07-03 cs.DC cs.AI 新提交

Towards Load-Aware Prefill Deflection for Disaggregated LLM Serving

面向负载感知的预填充偏转用于分离式LLM服务

Shrikara Arun, Anjaly Parayil, Srikant Bharadwaj, Renee St. Amant, Victor Rühle

机构 * Microsoft(微软)

AI总结 针对分离式LLM服务中预填充节点过载而解码节点空闲的问题,提出一种主动预填充偏转调度器,通过将预填充作为分块步骤在解码节点上交错执行,消除节点间KV传输,显著降低P95 TTFT并提高SLO达标率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01733 2026-07-03 cs.CL eess.AS 新提交

Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving

重新思考语音-LLM集成用于ASR:通过交错实现有效的联合语音-文本训练

Ruchao Fan, Yiming Wang, Rui Zhao, Liliang Ren, Keqi Deng, Xiaoyang Chen, Ali Zare, Bo Ren, Yuxuan Hu, Junkun Chen, Yan Huang, Yelong Shen, Jinyu Li

机构 * Microsoft(微软)

AI总结 提出JSTIP,一种面向ASR的预训练策略,通过构建词级和段级交错语音-文本序列,在38k小时数据上相比基线提升了实体识别准确率,并缩小了模态差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01418 2026-07-03 cs.SE cs.AI cs.HC 新提交

Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft's Early 2026 Rollout of Claude Code and GitHub Copilot CLI

命令行AI编码代理的采用与影响:微软2026年初推出Claude Code和GitHub Copilot CLI的研究

Emerson Murphy-Hill, Jenna Butler, Alexandra Savelieva

机构 * Microsoft(微软)

AI总结 研究微软2026年初推出Claude Code和GitHub Copilot CLI时,数万名工程师的采用模式、留存因素及对代码合并的影响,发现社交网络驱动首次使用,编码活跃度关联留存,采用者合并PR数量增加约24%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01251 2026-07-03 cs.CY cs.AI 新提交

Collaborative Disagreement Resolution for Scalable Oversight

协作分歧解决实现可扩展监督

Yuyang Jiang, Chacha Chen, Teng Wu, Liwen Sun, Han Liu, Shi Feng, Chenhao Tan

机构 * Microsoft(微软) Duke University(杜克大学)

AI总结 提出协作分歧解决范式,通过引导AI模型协作识别分歧、检验证据并达成共识,替代对抗性辩论,使非专家模型判断准确率达62.1%。

Comments 27 pages, 6 figures. Accepted to ICML 2026. Codebase link: https://github.com/ChicagoHAI/collaborative-dr.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10231 2026-07-03 eess.AS cs.SD 新提交

LLM can Read Spectrogram: Encoder-free Speech-Language Modeling

LLM 能读频谱图:无编码器的语音语言建模

Ruchao Fan, Yiming Wang, Yuxuan Hu, Bo Ren, Yufei Xia, Xiaofei Wang, Yao Qian, Shujie Liu, Jinyu Li

机构 * Microsoft, USA(微软公司,美国)

AI总结 提出 Mel-LLM,一种无需专用语音编码器、直接将梅尔频谱图补丁通过线性投影输入 LLM 的架构,在 ASR 和 TTS 任务上验证了其可行性,ASR 性能与有编码器方案相当,TTS 初步可行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00342 2026-07-03 cs.LG cs.CR cs.DB 版本更新

PE-means: Improved Differentially Private $k$-means Clustering through Private Evolution

PE-means: 通过私有进化改进差分隐私 $k$-均值聚类

Thomas Humphries, Zinan Lin, Sergey Yekhanin

机构 * University of Waterloo(滑铁卢大学) Microsoft Research(微软研究院)

AI总结 针对欧几里得空间中差分隐私 $k$-均值聚类问题,提出PE-means算法,利用私有进化方法仅计算恒定敏感度的私有直方图,在聚类损失上平均比现有最优基线提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08580 2026-07-03 math.OC cs.LG 版本更新

Adjoint Matching through the Lens of the Stochastic Maximum Principle in Optimal Control

通过随机最大原理视角的伴随匹配

Carles Domingo-Enrich, Jiequn Han

机构 * Microsoft Research New England(微软研究院新英格兰) Flatiron Institute(熨斗研究所)

AI总结 本文基于随机最优控制问题,重新推广并严谨推导了伴随匹配方法,将其置于随机最大原理基础上,提出通用Hamiltonian伴随匹配目标,并展示其在连续时间下的实现方法,为随机控制问题提供新的可实施目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
1808.07645 2026-07-03 cs.HC cs.AI cs.CL 版本更新

Playing 20 Question Game with Policy-Based Reinforcement Learning

基于策略的强化学习玩20个问题游戏

Huang Hu, Xianchao Wu, Bingfeng Luo, Chongyang Tao, Can Xu, Wei Wu, Zhan Chen

机构 * Peking University(北京大学) Microsoft Corporation(微软公司) Microsoft Development Co., Ltd(微软开发有限公司)

AI总结 提出基于策略的强化学习方法,使提问者通过与用户持续交互学习最优问题选择策略,并利用奖励网络估计信息奖励,无需知识库且对噪声答案鲁棒。

Comments Withdrawal from the conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03315 2026-07-03 cs.AI 版本更新

Memora: A Harmonic Memory Representation Balancing Abstraction and Specificity

Memora: 一种平衡抽象与特异性的和谐记忆表示

Menglin Xia, Xuchao Zhang, Shantanu Dixit, Paramaguru Harimurugan, Rujia Wang, Victor Ruhle, Robert Sim, Chetan Bansal, Saravan Rajmohan

机构 * Microsoft(微软)

AI总结 提出Memora记忆表示,通过主抽象和线索锚点平衡抽象与特异性,结合检索策略实现高效上下文感知检索,在LoCoMo和LongMemEval基准上达到新最优。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏