arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-08-28 至 2026-08-28 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 动作表示与策略 2 篇

2608.26673 2026-08-28 cs.RO 新提交 70%

PredVLA: A Sub-Million-Parameter Predictive-Coding Policy for Robot Manipulation

PredVLA:用于机器人操作的亚百万级参数预测编码策略

Hiroki Sawada, Shunichi Kasahara

机构 * Sony Computer Science Laboratory(索尼计算机科学实验室)

专题命中 动作表示与策略 :vision-language-action(abstract);action model(abstract);分类 cs.RO

AI总结 PredVLA是仅0.68M参数的无机器人数据预训练预测编码策略,在LIBERO基准上远超参数匹配的Transformer、LSTM策略,实现强语言条件机器人操作性能且具备显式在线修正机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27443 2026-08-28 cs.HC cs.CR 新提交 50%

Do User-Authored Permission Policies Improve Protection Against AI Agent Overreach?

用户自主编写的权限策略能否提升对智能体越权行为的防护?

Ting Yan

专题命中 动作表示与策略 :action model(abstract)

AI总结 研究对比HITL、AUTO、POLICY三种场景发现,用户自主编写的POLICY策略未显著提升对AI智能体越权行为的防护,因多数规则选“询问”,总干预时间未降低,且偏好与承诺存在差距。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏