arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-10-07 至 2025-10-07 共收录 12 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 9 篇

2510.04246 2025-10-07 cs.RO cs.AI 90%

ContextVLA: Vision-Language-Action Model with Amortized Multi-Frame Context

Huiwon Jang, Sihyun Yu, Heeseung Kwon, Hojin Jeon, Younggyo Seo, Jinwoo Shin

机构 * KAIST(韩国科学技术院) RLWRLD UC Berkeley(伯克利大学)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.RO、cs.AI

Comments Project page: https://huiwon-jang.github.io/contextvla

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04898 2025-10-07 cs.RO cs.AI cs.LG 89%

HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks

Zheng Xiong, Kang Li, Zilin Wang, Matthew Jackson, Jakob Foerster, Shimon Whiteson

机构 * University of Oxford(牛津大学)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04041 2025-10-07 cs.RO 70%

SITCOM: Scaling Inference-Time COMpute for VLAs

Ayudh Saxena, Harsh Shah, Sandeep Routray, Rishi Rajesh Shah, Esha Pahwa

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO

Comments Accepted at the NeurIPS 2025 Workshop on Space in Vision, Language, and Embodied AI (SpaVLE). *Equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25085 2025-10-07 cs.CL cs.AI cs.IR 57%

jina-reranker-v3: Last but Not Late Interaction for Listwise Document Reranking

Feng Wang, Yuqing Li, Han Xiao

机构 * Jina AI GmbH(Jina AI公司) University of Pittsburgh(匹兹堡大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04757 2025-10-07 cs.CL q-bio.QM 50%

ModernBERT + ColBERT: Enhancing biomedical RAG through an advanced re-ranking retriever

Eduardo Martínez Rivera, Filippo Menolascina

机构 * School of Informatics University of Edinburgh(信息学院爱丁堡大学) School of Engineering University of Edinburgh(工程学院爱丁堡大学)

专题命中 VLA模型 :action model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15118 2025-10-07 cs.SI cs.DB 50%

Maximum Degree-Based Quasi-Clique Search via an Iterative Framework

Hongbo Xia, Kaiqiang Yu, Shengxin Liu, Cheng Long, Xun Zhou

专题命中 VLA模型 :action model(abstract)

Comments Appears in the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03994 2025-10-07 math.ST stat.TH 50%

Optimal estimation of a factorizable density using diffusion models with ReLU neural networks

Jianqing Fan, Yihong Gu, Ximing Li

专题命中 VLA模型 :action model(abstract)

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15727 2025-10-07 astro-ph.SR astro-ph.GA 50%

Identification and characterization of nascent planetary nebulae with OH and H$_2$O masers

Roldán A. Cala, José F. Gómez, Luis F. Miranda, Hiroshi Imai, Guillem Anglada, Itziar de Gregorio-Monsalvo, Keiichi Ohnaka, Olga Suárez, Daniel Tafoya, Lucero Uscanga

专题命中 VLA模型 :VLA(abstract)

Comments 31 pages, 13 figures, 14 tables, accepted for publication in A&A

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21345 2025-10-07 quant-ph nlin.CD 50%

Quantum Chaos in Non-Markovian Open Quantum Systems: Interferometric OTOC, Loschmidt Echo and Commutator Operator Norm

Baibhab Bose, Devvrat Tiwari, Subhashish Banerjee

专题命中 VLA模型 :action model(abstract)

Comments 13 pages, 11 figures

Journal ref Chaos 35, 103108 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 1 篇

2509.23931 2025-10-07 cs.CV 70%

AutoPrune: Each Complexity Deserves a Pruning Policy

Hanshi Wang, Yuhao Xu, Zekun Xu, Jin Gao, Yufan Liu, Weiming Hu, Ke Wang, Zhipeng Zhang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),中国科学院自动化所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) Anyverse Intelligence Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京多模态信息超智能安全重点实验室) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 动作表示与策略 :vision-language-action(abstract);action model(abstract);分类 cs.CV

Comments 13 pages, 2 figures

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 数据集与评测 1 篇

2502.16580 2025-10-07 cs.CR 50%

Can Indirect Prompt Injection Attacks Be Detected and Removed?

Yulin Chen, Haoran Li, Yuan Sui, Yufei He, Yue Liu, Yangqiu Song, Bryan Hooi

专题命中 数据集与评测 :action model(abstract)

Comments ACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 部署与泛化 1 篇

2505.01862 2025-10-07 cs.RO 57%

ReLI: A Language-Agnostic Approach to Human-Robot Interaction

Linus Nwankwo, Bjoern Ellensohn, Ozan Özdenizci, Elmar Rueckert

机构 * Chair of Cyber-Physical Systems, Technical University of Leoben(技术大学莱博恩首席物理系统 Chair) Institute of Machine Learning and Neural Computation, Graz University of Technology(格拉茨技术大学机器学习与神经计算研究所)

专题命中 部署与泛化 :action model(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏