arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-01-13 至 2026-01-13 共收录 5 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2601.03519 2026-01-13 cs.RO 86%

A Vision-Language-Action Model with Visual Prompt for OFF-Road Autonomous Driving

一种具有视觉提示的视觉-语言-动作模型用于越野自动驾驶

Liangdong Zhang, Yiming Nie, Haoyang Li, Fanjie Kong, Baobao Zhang, Shunxin Huang, Kai Fu, Chen Min, Liang Xiao

专题命中 VLA模型 :vision-language-action(title);action model(title);VLA(abstract);分类 cs.RO

AI总结 本文提出OFF-EMMA模型,通过视觉提示和COT-SC策略提升越野自动驾驶轨迹规划的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06451 2026-01-13 cs.RO cs.CV 84%

CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method

CulinaryCut-VLAP:一种用于通过力感知材料点方法进行食物切割的视觉-语言-动作-物理框架

Hyunseo Koh, Chang-Yong Song, Youngjae Choi, Misa Viveiros, David Hyde, Heewon Kim

机构 * Soongsil University(Soongsil大学) Vanderbilt University(范德比大学)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract);分类 cs.RO、cs.CV

AI总结 CulinaryCut-VLAP通过力感知材料点方法构建视觉-语言-动作-物理框架,实现对食物切割的物理真实模拟与高效训练。

Comments 16 pages; 15 figures; 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06214 2026-01-13 cs.LG cs.AI q-bio.QM 76%

Dynamics-inspired Structure Hallucination for Protein-protein Interaction Modeling

受动力学启发的结构幻想用于蛋白质-蛋白质相互作用建模

Fang Wu, Stan Z. Li

机构 * Department of Computer Science(计算机科学系) Stanford University(斯坦福大学) School of Engineering(工程学院) Westlake University(西湖大学)

专题命中 VLA模型 :action model(title);分类 cs.AI、cs.LG

AI总结 本文提出Refine-PPI框架,通过结构细化模块和概率密度云网络,解决突变蛋白质结构获取困难和动态几何不确定性建模问题。

Journal ref Transactions on Machine Learning Research 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07003 2026-01-13 stat.ME cs.LG stat.CO 74%

Unity Forests: Improving Interaction Modelling and Interpretability in Random Forests

统一森林:改进随机森林中的交互建模和可解释性

Roman Hornung, Alexander Hapfelmeier

机构 * Institute for Medical Information Processing, Biometry and Epidemiology, Faculty of Medicine, Ludwig Maximilian University of Munich (LMU)(慕尼黑路德维希-马克西米利安大学医学信息处理与流行病学研究所) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Institute of General Practice and Health Services Research, Department Clinical Medicine, TUM School of Medicine and Health, Technical University of Munich (TUM)(慕尼黑技术大学医学与健康学院一般医学与健康服务研究研究所) Institute of AI and Informatics in Medicine, TUM School of Medicine and Health, Technical University of Munich (TUM)(慕尼黑技术大学医学与健康学院医学人工智能与信息学研究所)

专题命中 VLA模型 :action model(title);分类 cs.LG

AI总结 统一森林通过优化树根分割提升交互建模和可解释性,改进了随机森林的变量重要性度量和预测性能。

Comments 33 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07481 2026-01-13 eess.AS 50%

Directional reflection modeling via wavenumber-domain reflection coefficient for 3D acoustic field simulation

基于波数域反射系数的定向反射建模用于3D声场模拟

Satoshi Hoshika, Takahiro Iwami, Akira Omoto

专题命中 VLA模型 :action model(abstract)

AI总结 本文提出一种基于波数域反射系数的3D声场模拟方法,通过避免显式建模材料内部以降低计算成本,实现对方向依赖性反射和散射的高效模拟。

Comments Submitted to Proceedings of Meetings on Acoustics (PoMA)

详情

展开后加载摘要…

URL PDF HTML 收藏