arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-01-12 至 2026-01-12 共收录 5 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2503.09527 2026-01-12 cs.CV cs.AI 90%

CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games

CombatVLA: 一种高效的视觉-语言-动作模型,用于3D动作角色扮演游戏中的战斗任务

Peng Chen, Pi Bu, Yingyao Wang, Xinyi Wang, Ziming Wang, Jie Guo, Yingxiu Zhao, Qi Zhu, Jun Song, Siran Yang, Jiamang Wang, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.CV、cs.AI

AI总结 CombatVLA是一种高效的视觉-语言-动作模型,用于3D动作角色扮演游戏中的战斗任务,通过高效的训练和推理方法,在战斗理解基准上表现优异,并实现了游戏战斗的50倍加速。

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24210 2026-01-12 cs.RO 70%

GR-Dexter Technical Report

GR-Dexter 技术报告

Ruoshi Wen, Guangzeng Chen, Zhongren Cui, Min Du, Yang Gou, Zhigang Han, Liqun Huang, Mingyu Lei, Yunfei Li, Zhuohang Li, Wenlei Liu, Yuxiao Liu, Xiao Ma, Hao Niu, Yutao Ouyang, Zeyu Ren, Haixin Shi, Wei Xu, Haoxiang Zhang, Jiajun Zhang, Xiao Zhang, Liwei Zheng, Weiheng Zhong, Yifei Zhou, Zhengming Zhu, Hang Li

机构 * ByteDance Seed(字节跳动种子)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO

AI总结 GR-Dexter 提出了一种综合框架,通过紧凑机械手、双臂遥控系统和训练配方,实现基于VLA的通用灵巧手机器人操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05792 2026-01-12 cs.LG cs.AI q-bio.BM 62%

Tensor-DTI: Enhancing Biomolecular Interaction Prediction with Contrastive Embedding Learning

张量-DTI:通过对比嵌入学习增强生物分子相互作用预测

Manel Gil-Sorribes, Júlia Vilalta-Mor, Isaac Filella-Mercè, Robert Soliva, Álvaro Ciudad, Víctor Guallar, Alexis Molina

机构 * Nostrum Biodiscovery Barcelona Supercomputing Center(巴塞罗那超级计算中心) Faculty of Pharmacy and Food Sciences, University of Barcelona(巴塞罗那大学药学与食品科学系) Catalan Institution for Research and Advanced Studies (ICREA)(加泰罗尼亚研究与高级研究机构) Data Science Dpt., Almirall S.A.(Almirall S.A.数据科学部门)

专题命中 VLA模型 :action model(abstract);分类 cs.AI、cs.LG

AI总结 Tensor-DTI通过整合多模态嵌入与对比学习,提升生物分子相互作用预测的准确性与可靠性。

Comments Accepted at the Generative and Experimental Perspectives for Biomolecular Design Workshop at ICLR 2025 and at the Learning Meaningful Representations of Life Workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05271 2026-01-12 cs.CL cs.LG 57%

Enhancing Foundation Models in Transaction Understanding with LLM-based Sentence Embeddings

利用基于大语言模型的句子嵌入增强交易理解的基础模型

Xiran Fan, Zhimeng Jiang, Chin-Chia Michael Yeh, Yuzhong Chen, Yingtong Dou, Menghai Pan, Yan Zheng

机构 * Visa Research(Visa研究)

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 本文提出一种结合大语言模型生成的句子嵌入与轻量级交易模型的混合框架,以提升交易理解任务的性能和效率。

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: Industry Track (EMNLP 2025), pages 903-911

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09298 2026-01-12 hep-ph hep-lat nucl-th 50%

Charge dependence of mesons with flavored contact-interaction couplings

介子的电荷依赖性与带有风味接触相互作用耦合

Fábio L. Braghin, Bruno El-Bennich, Fernando E. Serna

专题命中 VLA模型 :action model(abstract)

AI总结 本研究通过结合SU(4)味对称性破缺耦合与接触相互作用模型,减少参数数量并统一质量尺度,准确预测介子质量及衰变常数。

Comments 7 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏