arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-09-01 至 2026-09-01 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 数据集与评测 2 篇

2608.29005 2026-09-01 cs.RO 新提交 57%

A Degradation-Tolerance Benchmark for Camera-Only End-to-End Driving

仅基于相机的端到端驾驶的抗退化基准测试

Haohua Que, Handong Yao

机构 * College of Engineering, University of Georgia(佐治亚大学工程学院)

专题命中 数据集与评测 :vision-language-action(abstract);分类 cs.RO

AI总结 研究人员提出DriveDegrade基准测试,评估仅基于相机的端到端驾驶模型对各类图像退化的容忍度,发现不同退化对规划的影响差异显著,某视觉-语言-动作规划器被遮挡6个相机仅损失11.5%性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28594 2026-09-01 cs.AI 新提交 57%

From Question-First to Analyst-First: Domain-Expert Skills and Verified Knowledge Compilation for Proactive Enterprise Analytics

从问题优先到分析师优先:面向主动企业分析的领域专家技能与验证知识编译

Harmohit Singh, Rahul Sharma

专题命中 数据集与评测 :action model(abstract);分类 cs.AI

AI总结 该研究提出了一种从问题优先转为分析师优先的主动企业分析系统,通过领域专家技能抽象与离线知识编译循环实现,无需查询日志,可生成验证过的报告与建议问题。

Comments 21 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏