arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Xiaomi(小米)

2026-06-04 至 2026-06-04 共收录 4
2606.04584 2026-06-04 cs.SD

SHB-AE: Spherical harmonic beamforming based Ambisonics encoding and upscaling method for smartphone microphone array

SHB-AE:基于球谐波束形成的智能手机麦克风阵列Ambisonics编码与升级方法

Yuhuan You, Yufan Qian, Tianshu Qu, Bin Wang, Xueyang Lv

机构 * Peking University(北京大学) Beijing Xiaomi Mobile Software Co., Ltd(北京小米移动软件有限公司) Xiaomi Communications Co., Ltd(小米通讯有限公司)

AI总结 针对智能手机麦克风阵列,提出一种基于球谐波束形成的Ambisonics编码与升级方法SHB-AE,通过设计各阶球谐函数的波束形成器,仅用四个非规则排列的麦克风即可实现四阶Ambisonics编码与升级。

Comments Accepted for presentation at AES Europe 2025 Convention (AES 158th Convention), Warsaw, Poland, May 22-24, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04570 2026-06-04 cs.SD

Flow-HOA: Generative Joint Optimization for Ambisonics Encoding via Flow Matching

Flow-HOA:基于流匹配的Ambisonics编码生成式联合优化

Yuhuan You, Yufan Qian, Tianshu Qu, Bin Wang, Xueyang Lv

机构 * State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) School of Intelligence Science and Technology(智能科学与技术学院) Peking University(北京大学) Beijing Xiaomi Mobile Software Co., Ltd(北京小米移动软件有限公司) Xiaomi Communications Co., Ltd(小米通讯有限公司)

AI总结 提出Flow-HOA生成框架,通过条件流匹配联合优化时域、频谱和空间保真度,生成可部署的FIR编码滤波器组,在合成数据和真实录音上均优于强基线方法。

Comments Accepted for presentation at AES Europe 2026 Convention (AES 160th Convention), Copenhagen, Denmark, May 28-30, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03784 2026-06-04 cs.RO

Revisiting Embodied Chain-of-Thought for Generalizable Robot Manipulation

重新审视具身思维链以实现可泛化的机器人操作

Nan Sun, Yuan Zhang, Yongkun Yang, Wentao Zhao, Peiyan Li, Jun Guo, Wenxuan Song, Pengxiang Ding, Runze Suo, Yifei Su, Xin Xiao, Xinghang Li, Huaping Liu

机构 * Tsinghua University(清华大学) Xiaomi Robotics(小米机器人) Peking University(北京大学) CASIA HKUST(GZ)(香港科技大学(广州)) Zhejiang University(浙江大学) Fudan University(复旦大学) Wuhan University(武汉大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文通过构建最大规模具身思维链语料库,提出ERVLA模型,利用思维链作为表征塑造监督而非测试时推理,显著提升了机器人操作的可泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16919 2026-06-04 cs.CV cs.AI cs.RO

DVGT: Driving Visual Geometry Transformer

DVGT: 驾驶视觉几何变换器

Sicheng Zuo, Zixun Xie, Wenzhao Zheng, Shaoqing Xu, Fang Li, Shengyin Jiang, Long Chen, Zhi-Xin Yang, Jiwen Lu

机构 * Tsinghua University(清华大学) University of Macau(澳门大学) Xiaomi EV(小米电动车) Peking University(北京大学)

AI总结 提出DVGT,一种从无位姿多视角图像序列重建全局稠密3D点图的视觉几何变换器,通过交替注意力机制学习几何关系,无需相机参数和后处理对齐,在多个驾驶数据集上显著优于现有模型。

Comments Code is available at https://github.com/wzzheng/DVGT

详情

展开后加载摘要…

URL PDF HTML 收藏