arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-01-29 至 2026-01-29 共收录 4 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2601.20383 2026-01-29 cs.CV 79%

HINT: Hierarchical Interaction Modeling for Autoregressive Multi-Human Motion Generation

HINT: 用于自回归多人体运动生成的分层交互建模

Mengge Liu, Yan Di, Gu Wang, Yun Qu, Dekai Zhu, Yanyan Li, Xiangyang Ji

机构 * Tsinghua University(清华大学)

专题命中 VLA模型 :action model(title,abstract);分类 cs.CV

AI总结 HINT通过分层交互建模提出了一种自回归框架,实现多人体运动生成,提升了交互建模的精度和长序列的连贯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05580 2026-01-29 cs.AI cs.RO 73%

MetaVLA: Unified Meta Co-training For Efficient Embodied Adaption

MetaVLA:统一的元学习协同训练用于高效的具身适应

Chen Li, Zhantao Yang, Han Zhang, Fangyi Chen, Chenchen Zhu, Anudeepsekhar Bolimera, Marios Savvides

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta Reality Labs, USA(Meta现实实验室(美国))

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.AI

AI总结 MetaVLA通过统一的元学习协同训练方法,实现高效的具身适应,提升任务泛化能力并降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20262 2026-01-29 cs.RO 70%

Shallow-π: Knowledge Distillation for Flow-based VLAs

Shallow-π:基于流的视觉-语言-动作模型的知识蒸馏

Boseong Jeon, Yunho Choi, Taehan Kim

机构 * Samsung Research South Korea(三星韩国研究)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO

AI总结 Shallow-π通过知识蒸馏显著减少基于流的VLA模型的transformer深度,实现更快的推理速度和更高的性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10777 2026-01-29 nucl-th 50%

Microscopic theory of angular momentum distributions across the full range of fission fragments

角动量分布的微观理论:涵盖全部裂变碎片范围

Petar Marević, Nicolas Schunck, Marc Verriere

专题命中 VLA模型 :action model(abstract)

AI总结 本研究通过微观理论预测裂变碎片的角动量分布,揭示了角动量与碎片变形的强相关性,并展示了经验公式在准确性上的不足。

Comments 20 pages, 11 figures

Journal ref Phys. Rev. C 113, 014612 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏