arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Microsoft(微软)

2026-04-16 至 2026-04-16 共收录 10
2604.13824 2026-04-16 cs.LG

Beyond State Consistency: Behavior Consistency in Text-Based World Models

超越状态一致性:文本基础世界模型中的行为一致性

Youling Huang, Guanqiao Chen, Junchi Yao, Lu Wang, Fangkai Yang, Chao Du, ChenZhuo Zhao, Pu Zhao, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Dalian University of Technology(大连理工大学) MBZUAI Peking University(北京大学) Microsoft(微软)

AI总结 本文提出行为一致性训练方法,通过改进世界模型与真实环境的功能一致性,提升长期对齐效果,实验显示在WebShop和TextWorld中表现优异,同时保持单步预测质量。

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18436 2026-04-16 cs.OS cs.AI cs.FL cs.SE

VeruSAGE: A Study of Agent-Based Verification for Rust Systems

VeruSAGE:Rust系统代理验证的研究

Chenyuan Yang, Natalie Neamtu, Chris Hawblitzel, Jacob R. Lorch, Shan Lu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Carnegie Mellon University(卡内基梅隆大学) Microsoft Research(微软研究院) University of Chicago(芝加哥大学)

AI总结 本文研究LLM在Rust系统验证中的能力,提出VeruSAGE-Bench基准测试集,并设计不同代理系统以匹配不同LLM的特性,结果显示最佳组合能完成超过80%的验证任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13739 2026-04-16 cs.LG stat.ML

Spectral Thompson sampling

谱泰普森采样

Tomas Kocak, Michal Valko, Remi Munos, Shipra Agrawal

机构 * SequeL team INRIA Lille - Nord Europe France(INRIA里尔-北欧洲法国SequeL团队) SequeL team INRIA Lille, France(INRIA里尔法国SequeL团队) Microsoft Research NE, USA(美国微软研究院NE部门) ML and Optimization Group Microsoft Research Bangalore, India(印度班加罗尔微软研究院机器学习与优化组)

AI总结 本文提出SpectralTS算法,通过图结构建模解决带状问题,利用有效维度d实现更高效的 regret 控制,适用于推荐系统和广告领域。

Comments Published at AAAI Conference on Artificial Intelligence (AAAI) 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13688 2026-04-16 cs.CV cs.AI

Beyond Voxel 3D Editing: Learning from 3D Masks and Self-Constructed Data

超越体素3D编辑:从3D掩码和自构造数据中学习

Yizhao Xu, Hongyuan Zhu, Caiyun Liu, Tianfu Wang, Keyu Chen, Sicheng Xu, Jiaolong Yang, Nicholas Jing Yuan, Qi Zhang

机构 * The Peking University(北京大学) HKUST(GZ)(香港科技大学(广州)) Microsoft AI(微软人工智能) Microsoft Research(微软研究院)

AI总结 本文提出BVE框架,通过自构造的大规模3D编辑数据集,结合轻量可训练模块,实现高效的文本语义注入,保留局部不变性,生成高质量的文本对齐3D资产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13348 2026-04-16 cs.AI cs.CR

Listening Alone, Understanding Together: Collaborative Context Recovery for Privacy-Aware AI

单听,共理解:面向隐私意识的AI协作上下文恢复

Tanmay Srivastava, Amartya Basu, Shubham Jain, Vaishnavi Ranganathan

机构 * Stony Brook University(石溪大学) Microsoft Research(微软研究院)

AI总结 CONCORD框架通过协作上下文恢复技术,在隐私保护下实现对话上下文的准确恢复,通过时空上下文解析、信息缺口检测和最小化A2A查询提升隐私安全性和对话效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13332 2026-04-16 cs.LG

Selecting Feature Interactions for Generalized Additive Models by Distilling Foundation Models

通过蒸馏基础模型选择广义加性模型中的特征交互

Jingyun Jia, Chandan Singh, Rich Caruana, Ben Lengerich

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) Intelligible AI(可解释AI)

AI总结 本文提出TabDistill方法,利用表格基础模型和事后蒸馏技术,提取显著特征交互以提升广义加性模型的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13318 2026-04-16 cs.AI cs.CL

WebXSkill: Skill Learning for Autonomous Web Agents

WebXSkill:自主网页代理的技能学习

Zhaoyang Wang, Qianhui Wu, Xuchao Zhang, Chaoyun Zhang, Wenlin Yao, Fazle Elahi Faisal, Baolin Peng, Si Qin, Suman Nath, Qingwei Lin, Chetan Bansal, Dongmei Zhang, Saravan Rajmohan, Jianfeng Gao, Huaxiu Yao

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft(微软)

AI总结 WebXSkill通过可执行技能框架解决自主网页代理在长周期任务中的执行与适应问题,提升任务成功率。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12525 2026-04-16 cs.CV

CoD-Lite: Real-Time Diffusion-Based Generative Image Compression

CoD-Lite:基于扩散的实时生成图像压缩

Zhaoyang Jia, Naifu Xue, Zihan Zheng, Jiahao Li, Bin Li, Xiaoyi Zhang, Zongyu Guo, Yuan Zhang, Houqiang Li, Yan Lu

机构 * University of Science(大学科学) Microsoft Research Asia(微软亚洲研究院) Communication University of China(通信大学)

AI总结 本文提出轻量级扩散编码器,通过分析预训练对模型的影响和Transformer的必要性,实现了60FPS编码和42FPS解码,降低比特率85%并接近MS-ILLM的FID性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07422 2026-04-16 cs.CL cs.AI

Two Pathways to Truthfulness: On the Intrinsic Encoding of LLM Hallucinations

通往真实性的两条路径:关于LLM幻觉内在编码的研究

Wen Luo, Guangyue Peng, Wei Li, Shaohang Wei, Feifan Song, Liang Wang, Nan Yang, Xingxing Zhang, Jing Jin, Furu Wei, Houfeng Wang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息处理国家重点实验室,计算机科学学院,北京大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文探讨LLM幻觉的内在编码机制,通过两种信息路径揭示真实性信号的来源,发现其与知识边界和内部表示密切相关,并提出改进幻觉检测的应用。

Comments Accepted to the ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21823 2026-04-16 cs.AI

ProRe: A Proactive Reward System for GUI Agents via Reasoner-Actor Collaboration

ProRe:通过推理器-执行器协作的GUI代理前瞻性奖励系统

Gaole Dai, Shiqi Jiang, Ting Cao, Yuqing Yang, Yuanchun Li, Rui Tan, Mo Li, Lili Qiu

机构 * NTU(国立新加坡大学) Microsoft Research(微软研究院) Tsinghua University(清华大学) HKUST(香港理工大学)

AI总结 ProRe通过推理器与领域特定评估器协作,提升GUI代理奖励准确性与F1分数,实验显示奖励准确性和F1分数提升达5.3%和19.4%。

Comments 23 pages, 12 figures, ICLR'2026

Journal ref The Fourteenth International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏