arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-01-14 至 2026-01-14 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 部署与泛化 2 篇

2601.08665 2026-01-14 cs.RO cs.CV 62%

VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory

VLingNav:基于适应性推理和视觉辅助语言记忆的具身导航

Shaoan Wang, Yuanfei Luo, Xingyu Chen, Aocheng Luo, Dongyue Li, Chang Liu, Sheng Chen, Yangang Zhang, Junzhi Yu

机构 * Peking University(北京大学) Zhongguancun Academy(中关村学院)

专题命中 部署与泛化 :VLA(abstract);分类 cs.RO、cs.CV

AI总结 VLingNav通过引入适应性推理和视觉辅助语言记忆,实现了复杂具身导航任务中的高效导航与泛化能力。

Comments Project page: https://wsakobe.github.io/VLingNav-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05097 2026-01-14 cs.CL 50%

MultiCheck: Strengthening Web Trust with Unified Multimodal Fact Verification

MultiCheck: 通过统一多模态事实验证加强网络信任

Aditya Kishore, Gaurav Kumar, Jasabanta Patro

机构 * IISER Bhopal(比哈尔IISER)

专题命中 部署与泛化 :action model(abstract)

AI总结 MultiCheck通过统一多模态事实验证框架,提升网络信任,具备高效、透明和抗噪能力。

详情

展开后加载摘要…

URL PDF HTML 收藏