arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 7441 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 7441 篇

2307.09166 2023-07-19 cs.AI 57%

Safe Formulas in the General Theory of Stable Models

Joohyung Lee, Vladimir Lifschitz, Ravi Palla

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08087 2023-07-19 cs.AI 57%

A Recursive Bateson-Inspired Model for the Generation of Semantic Formal Concepts from Spatial Sensory Data

Jaime de Miguel-Rodriguez, Fernando Sancho-Caparrini

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08242 2023-07-18 cs.AI 57%

Lifted Sequential Planning with Lazy Constraint Generation Solvers

Anubhav Singh, Miquel Ramirez, Nir Lipovetzky, Peter J. Stuckey

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.11804 2023-07-18 cs.CL cs.AI cs.RO 57%

Robots Learning to Say `No': Prohibition and Rejective Mechanisms in Acquisition of Linguistic Negation

Frank Förster, Joe Saunders, Hagen Lehmann, Chrystopher L. Nehaniv

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments Submitted journal article. 21 pages main paper plus 28 pages supplementary information / appendix. 8 figures in main paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09181 2023-07-18 cs.CV 57%

Global Knowledge Calibration for Fast Open-Vocabulary Segmentation

Kunyang Han, Yong Liu, Jun Hao Liew, Henghui Ding, Yunchao Wei, Jiajun Liu, Yitong Wang, Yansong Tang, Yujiu Yang, Jiashi Feng, Yao Zhao

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.CV

Comments Accepted by ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.03339 2023-07-10 cs.CV 57%

Open-Vocabulary Object Detection via Scene Graph Discovery

Hengcan Shi, Munawar Hayat, Jianfei Cai

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15255 2023-06-28 cs.CV cs.CL 57%

GroundNLQ @ Ego4D Natural Language Queries Challenge 2023

Zhijian Hou, Lei Ji, Difei Gao, Wanjun Zhong, Kun Yan, Chao Li, Wing-Kwong Chan, Chong-Wah Ngo, Nan Duan, Mike Zheng Shou

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments 5 pages, 2 figures, 4 tables, the champion solution for Ego4D Natural Language Queries Challenge in CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12140 2023-06-28 cs.CV cs.MM 57%

Movie101: A New Movie Understanding Benchmark

Zihao Yue, Qi Zhang, Anwen Hu, Liang Zhang, Ziheng Wang, Qin Jin

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14603 2023-06-27 cs.CV 57%

Learning with Difference Attention for Visually Grounded Self-supervised Representations

Aishwarya Agarwal, Srikrishna Karanam, Balaji Vasan Srinivasan

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments 15 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14546 2023-06-27 cs.AI 57%

logLTN: Differentiable Fuzzy Logic in the Logarithm Space

Samy Badreddine, Luciano Serafini, Michael Spranger

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15081 2023-06-21 eess.AS cs.AI cs.CL cs.SD 57%

Word Discovery in Visually Grounded, Self-Supervised Speech Models

Puyuan Peng, David Harwath

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments Interspeech 2022 Oral. Update Table 5

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10651 2023-06-21 cs.DB cs.DS cs.LG 57%

On Distribution Dependent Sub-Logarithmic Query Time of Learned Indexing

Sepanta Zeighami, Cyrus Shahabi

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.LG

Comments Proceedings of 40th International Conference on Machine Learning, ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.05561 2023-06-14 cs.CV 57%

Using Multiple Instance Learning to Build Multimodal Representations

Peiqi Wang, William M. Wells, Seth Berkowitz, Steven Horng, Polina Golland

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02980 2023-06-06 cs.CL cs.AI 57%

KNOW How to Make Up Your Mind! Adversarially Detecting and Alleviating Inconsistencies in Natural Language Explanations

Myeongjun Jang, Bodhisattwa Prasad Majumder, Julian McAuley, Thomas Lukasiewicz, Oana-Maria Camburu

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments Short paper, ACL 2023

Journal ref The 61st Annual Meeting of the Association for Computational Linguistics (ACL 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03517 2023-06-06 cs.CL cs.AI 57%

Few-shot Domain-Adaptive Visually-fused Event Detection from Text

Farhad Moghimifar, Fatemeh Shiri, Van Nguyen, Reza Haffari, Yuan-Fang Li

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12917 2023-06-02 cs.CL cs.AI eess.AS eess.IV 57%

Learning English with Peppa Pig

Mitja Nikolaus, Afra Alishahi, Grzegorz Chrupała

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments Accepted to TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18623 2023-05-31 cs.LG cs.CL 57%

Alfred: A System for Prompted Weak Supervision

Peilin Yu, Stephen H. Bach

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.LG

Comments ACL 2023 System Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17388 2023-05-30 cs.CL cs.CV 57%

MPCHAT: Towards Multimodal Persona-Grounded Conversation

Jaewoo Ahn, Yeda Song, Sangdoo Yun, Gunhee Kim

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments Accepted at ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17337 2023-05-30 cs.CL cs.AI 57%

Benchmarking Diverse-Modal Entity Linking with Generative Models

Sijia Wang, Alexander Hanbo Li, Henry Zhu, Sheng Zhang, Chung-Wei Hang, Pramuditha Perera, Jie Ma, William Wang, Zhiguo Wang, Vittorio Castelli, Bing Xiang, Patrick Ng

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments 15 pages. ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15525 2023-05-26 cs.CL cs.LG 57%

Large Language Models are Few-Shot Health Learners

Xin Liu, Daniel McDuff, Geza Kovacs, Isaac Galatzer-Levy, Jacob Sunshine, Jiening Zhan, Ming-Zher Poh, Shun Liao, Paolo Di Achille, Shwetak Patel

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.13196 2023-05-26 cs.CV 57%

Grounded Affordance from Exocentric View

Hongchen Luo, Wei Zhai, Jing Zhang, Yang Cao, Dacheng Tao

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2203.09905

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14917 2023-05-25 cs.CL cs.AI 57%

Structural Ambiguity and its Disambiguation in Language Model Based Parsers: the Case of Dutch Clause Relativization

Gijs Wijnholds, Michael Moortgat

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12926 2023-05-23 cs.LO cs.AI cs.SC 57%

SCL(FOL) Can Simulate Non-Redundant Superposition Clause Learning

Martin Bromberger, Chaahat Jain, Christoph Weidenbach

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11172 2023-05-19 cs.CV cs.CL cs.SD eess.AS 57%

ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

Peng Wang, Shijie Wang, Junyang Lin, Shuai Bai, Xiaohuan Zhou, Jingren Zhou, Xinggang Wang, Chang Zhou

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments 30 pages, 9 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11056 2023-05-19 eess.SP cs.LG 57%

PETAL: Physics Emulation Through Averaged Linearizations for Solving Inverse Problems

Jihui Jin, Etienne Ollivier, Richard Touret, Matthew McKinley, Karim G. Sabra, Justin K. Romberg

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10714 2023-05-19 cs.CV 57%

Vision-Language Pre-training with Object Contrastive Learning for 3D Scene Understanding

Taolin Zhang, Sunan He, Dai Tao, Bin Chen, Zhi Wang, Shu-Tao Xia

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10654 2023-05-19 cs.AI 57%

Clarifying System 1 & 2 through the Common Model of Cognition

Brendan Conway-Smith, Robert L. West

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

Comments In Proceedings of ICCM 2022 20th International Conference on Cognitive Modelling http://www.frankritter.com/papers/ICCM2022Proceedings.pdf. arXiv admin note: substantial text overlap with arXiv:2305.09091

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09699 2023-05-18 cs.CV 57%

Mobile User Interface Element Detection Via Adaptively Prompt Tuning

Zhangxuan Gu, Zhuoer Xu, Haoxing Chen, Jun Lan, Changhua Meng, Weiqiang Wang

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.CV

Comments Accepted by CVPR23

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06378 2023-05-18 cs.CV 57%

Learning Grounded Vision-Language Representation for Versatile Understanding in Untrimmed Videos

Teng Wang, Jinrui Zhang, Feng Zheng, Wenhao Jiang, Ran Cheng, Ping Luo

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06558 2023-05-12 cs.CV 57%

Segment and Track Anything

Yangming Cheng, Liulei Li, Yuanyou Xu, Xiaodi Li, Zongxin Yang, Wenguan Wang, Yi Yang

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

Comments 8 pages, 3 figures; Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏