arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-08-28 至 2025-08-28 共收录 5 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 2 篇

2508.19497 2025-08-28 cond-mat.mtrl-sci 71%

Band gap formation theory: An alternative to the Bragg diffraction model

Koichi Kajiyama

专题命中 VLA模型 :action model(title)

Comments 12 pages, 6 figures. Submitted to Physical Review B

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14799 2025-08-28 cs.HC cs.AI cs.LG 62%

Analyzing Character Representation in Media Content using Multimodal Foundation Model: Effectiveness and Trust

Evdoxia Taka, Debadyuti Bhattacharya, Joanne Garde-Hansen, Sanjay Sharma, Tanaya Guha

机构 * University of Glasgow(格拉斯哥大学) University of Leeds(利兹大学) University of Warwick(沃里克大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 1 篇

2508.19569 2025-08-28 cs.AI 57%

Skill-based Explanations for Serendipitous Course Recommendation

Hung Chau, Run Yu, Zachary Pardos, Peter Brusilovsky

专题命中 动作表示与策略 :action model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 数据集与评测 1 篇

2506.18088 2025-08-28 cs.RO cs.AI cs.CL cs.CV cs.MA 67%

RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation

Tianxing Chen, Zanxin Chen, Baijun Chen, Zijian Cai, Yibin Liu, Zixuan Li, Qiwei Liang, Xianliang Lin, Yiheng Ge, Zhenyu Gu, Weiliang Deng, Yubin Guo, Tian Nian, Xuanbing Xie, Qiangyu Chen, Kailun Su, Tianling Xu, Guodong Liu, Mengkang Hu, Huan-ang Gao, Kaixuan Wang, Zhixuan Liang, Yusen Qin, Xiaokang Yang, Ping Luo, Yao Mu

机构 * MoE key Lab of Artificial Intelligence, AI Institute, SJTU(人工智能联合实验室、人工智能研究院、上海交通大学) HKU MMLab(香港大学多模态实验室) Shanghai AI Lab(上海人工智能实验室) D-Robotics(D-机器人) SZU(深圳大学) THU(清华大学) TeleAI FDU(福建大学) USTC(中国科学技术大学) SUSTech(南方科技大学) SYSU(深圳大学) CSU(中国科学技术大学) NEU(南京大学) HKU-SH ICRC(香港大学深圳研究院) NJU(南京大学) Lumina EAI

专题命中 数据集与评测 :VLA(abstract);分类 cs.RO、cs.CV、cs.AI

Comments Project Page: https://robotwin-platform.github.io/, Code: https://github.com/robotwin-Platform/robotwin, Doc: https://robotwin-platform.github.io/doc/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 部署与泛化 1 篇

2505.03233 2025-08-28 cs.RO 81%

GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data

Shengliang Deng, Mi Yan, Songlin Wei, Haixin Ma, Yuxin Yang, Jiayi Chen, Zhiqi Zhang, Taoyu Yang, Xuheng Zhang, Wenhao Zhang, Heming Cui, Zhizheng Zhang, He Wang

专题命中 部署与泛化 :vision-language-action(abstract);VLA(abstract);action model(abstract);embodied foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏