arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-08-19 至 2025-08-19 共收录 3 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2508.13103 2025-08-19 cs.RO cs.CV 84%

Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy

Tianyi Zhang, Haonan Duan, Haoran Hao, Yu Qiao, Jifeng Dai, Zhi Hou

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Shanghai AI Lab(上海人工智能实验室) SenseTime Research(商汤科技研究院) Nanjing University(南京大学) Tsinghua University(清华大学)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16752 2025-08-19 cs.IR cs.AI 57%

Action is All You Need: Dual-Flow Generative Ranking Network for Recommendation

Hao Guo, Erpeng Xue, Lei Huang, Shichao Wang, Xiaolei Wang, Lei Wang, Jinpeng Wang, Sheng Chen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Tsinghua University(清华大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11926 2025-08-19 astro-ph.GA 50%

Mapping feedback signatures in 3C 297: A quasar-host merger at Cosmic Noon

Chetna Duggal, Christopher P. O'Dea, Stefi A. Baum, John Jiwa, Grant Tremblay, Marco Chiaberge, George Miley, Carlo Stanghellini, William Sparks

专题命中 VLA模型 :VLA(abstract)

Comments Accepted for publication in ApJ. 17 pages, 9 figures; doi: 10.3847/1538-4357/adfa98

详情

展开后加载摘要…

URL PDF HTML 收藏