arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-01-26 至 2026-01-26 共收录 3 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2601.13976 2026-01-26 cs.CV cs.RO 62%

FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation

FantasyVLN: 一种统一的多模态链式推理框架用于视觉-语言导航

Jing Zuo, Lingzhou Mu, Fan Jiang, Chengcheng Ma, Mu Xu, Yonggang Qi

机构 * Fantasy AIGC Team(幻想AIGC团队) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

专题命中 VLA模型 :VLA(abstract);分类 cs.RO、cs.CV

AI总结 FantasyVLN通过统一的隐式推理框架实现视觉-语言导航的实时高效推理,结合多模态信息提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22928 2026-01-26 cs.AI cs.CL 57%

Enhancing Study-Level Inference from Clinical Trial Papers via Reinforcement Learning-Based Numeric Reasoning

通过基于强化学习的数值推理增强临床试验论文的论文级别推断

Massimiliano Pronesti, Michela Lorandi, Paul Flanagan, Oisin Redmond, Anya Belz, Yufang Hou

机构 * IBM Research Europe - Ireland(IBM欧洲研究院-爱尔兰) Dublin City University(都柏林城市大学) IT:U Interdisciplinary Transformation University Austria(IT:U跨学科转型大学奥地利)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 本研究通过强化学习和数值推理提升临床试验论文的论文级别推断,实现更准确的系统评价自动化。

Comments Accepted at EMNLP 2025 Main Conference. This revision corrects a minor typo in the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15633 2026-01-26 cs.DC 50%

Advancing RT Core-Accelerated Fixed-Radius Nearest Neighbor Search

推进基于RT核心的固定半径最近邻搜索

Enzo Meneses, Hugo Bec, Cristóbal A. Navarro, Benoît Crespin, Felipe A. Quezada, Nancy Hitschfeld, Heinich Porro, Maxime Maria

专题命中 VLA模型 :action model(abstract)

AI总结 本文提出三种改进RT核心处理固定半径最近邻搜索的方法,包括优化BVH结构、消除邻居列表需求以及支持周期性边界条件,显著提升了模拟速度和能效。

Comments Journal submission

详情

展开后加载摘要…

URL PDF HTML 收藏