arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Amazon(亚马逊)

2026-06-29 至 2026-06-29 共收录 5
2606.27581 2026-06-29 cs.RO cs.AI 新提交

SceneBot: Contact-Prompted General Humanoid Whole Body Tracking with Scene-Interaction

SceneBot: 接触提示的通用人形全身跟踪与环境交互

Sirui Chen, Shibo Zhao, Zhen Wu, Jiaman Li, Guanya Shi, C. Karen Liu

机构 * Stanford(斯坦福大学) Amazon FAR(亚马逊 FAR) CMU(卡内基梅隆大学)

AI总结 提出SceneBot框架,通过接触标签和事后场景重建,统一处理自由空间运动、地形穿越和全身操作,实现复杂长时任务。

Comments 15 pages 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27475 2026-06-29 cs.RO cs.LG 新提交

Support-Constrained RL Enables Real-World Policy Improvement without Real-World Experience

支持约束强化学习实现无需真实世界经验的真实世界策略改进

Raymond Yu, William Huey, Mustafa Mukadam, Anusha Nagabandi, Abhishek Gupta

机构 * University of Washington(华盛顿大学) Amazon FAR(亚马逊FAR)

AI总结 提出SCORE框架,通过流导向约束模拟中的强化学习到真实数据预训练生成策略的支持集,实现无需真实世界经验即可改进真实世界操作策略,在八项灵巧操作任务中成功率从37.8%提升至89.9%。

Comments 35 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22600 2026-06-29 cs.LG cs.AI 新提交

On the Position Bias of On-Policy Distillation

论同策略蒸馏中的位置偏差

Yan Xie, Sijie Zhu, Tiansheng Wen, Bo Chen, Yifei Wang

机构 * Xidian University(西安电子科技大学) Georgia Institute of Technology(佐治亚理工学院) Amazon AGI SF Lab(亚马逊AGI旧金山实验室)

AI总结 发现同策略蒸馏中后部token监督质量下降,提出基于重要性加权的IW-OPD方法,通过动态调整token权重提升学习效率和最终性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13544 2026-06-29 eess.AS cs.AI cs.CL 新提交

Adaptive Turn-Taking for Real-time Multi-Party Voice Agents

自适应轮流发言:面向实时多方语音代理

Soumyajit Mitra, Prabhat Pandey, Abhinav Jain, Shanmukha Sahith, K V Vijay Girish

机构 * Amazon AGI(亚马逊人工智能研究院) IIT Kharagpur, India(印度克里ш格布尔理工学院)

AI总结 提出ModeratorLM,一种基于角色条件的语音大模型,通过分块流式处理和链式推理,在多方对话中实现自适应轮流发言,显著提升轮流精度和召回率。

Comments Accepted for publication at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05663 2026-06-29 cs.CV 版本更新

Keeping the Evidence Chain: Semantic Evidence Allocation for Training-Free Token Pruning in Video Temporal Grounding

保持证据链:面向视频时序定位的无训练令牌剪枝的语义证据分配

Jiaqi Li, Shuntian Zheng, Yixian Shen, Jia-Hong Huang, Xiaoman Lu, Minzhe Ni, Yu Guan

机构 * University of Warwick(沃里克大学) University of Amsterdam(阿姆斯特丹大学) Amazon AGI(亚马逊人工智能研究院)

AI总结 提出SemVID无训练剪枝框架,通过证据保留和连接强度原则选择对象、运动和上下文令牌,在仅保留12.5%视觉令牌时保持95.4% mIoU,实现5.8倍预填充加速。

Comments Project at https://jiaqili404.github.io/SemVID

Journal ref The 19th European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏