arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3389 信号源:cs.CL, cs.AI, cs.LG

1. 视觉空间推理 3389 篇

2402.09052 2024-02-15 cs.AI 57%

L3GO: Language Agents with Chain-of-3D-Thoughts for Generating Unconventional Objects

Yutaro Yamada, Khyathi Chandu, Yuchen Lin, Jack Hessel, Ilker Yildirim, Yejin Choi

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09047 2024-02-15 cs.AI 57%

FGeo-TP: A Language Model-Enhanced Solver for Geometry Problems

Yiming He, Jia Zou, Xiaokai Zhang, Na Zhu, Tuo Leng

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08284 2024-02-14 cs.AI 57%

A Logical Approach to Criminal Case Investigation

Takanori Ugai, Yusuke Koyanagi, Fumihito Nishino

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments 11 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17914 2024-02-01 cs.RO cs.AI 57%

Attention Graph for Multi-Robot Social Navigation with Deep Reinforcement Learning

Erwan Escudie, Laetitia Matignon, Jacques Saraydaryan

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14606 2023-12-25 cs.CV cs.LG 57%

Explainable Multi-Camera 3D Object Detection with Transformer-Based Saliency Maps

Till Beemelmanns, Wassim Zahr, Lutz Eckstein

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11241 2023-12-25 cs.CV cs.LG cs.RO 57%

AutoNeRF: Training Implicit Scene Representations with Autonomous Agents

Pierre Marza, Laetitia Matignon, Olivier Simonin, Dhruv Batra, Christian Wolf, Devendra Singh Chaplot

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03275 2023-12-07 cs.RO cs.AI 57%

VLFM: Vision-Language Frontier Maps for Zero-Shot Semantic Navigation

Naoki Yokoyama, Sehoon Ha, Dhruv Batra, Jiuguang Wang, Bernadette Bucher

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07562 2023-11-14 cs.CV cs.AI 57%

GPT-4V in Wonderland: Large Multimodal Models for Zero-Shot Smartphone GUI Navigation

An Yan, Zhengyuan Yang, Wanrong Zhu, Kevin Lin, Linjie Li, Jianfeng Wang, Jianwei Yang, Yiwu Zhong, Julian McAuley, Jianfeng Gao, Zicheng Liu, Lijuan Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01446 2023-11-03 cs.RO cs.CV cs.LG 57%

Adv3D: Generating Safety-Critical 3D Objects through Closed-Loop Simulation

Jay Sarva, Jingkang Wang, James Tu, Yuwen Xiong, Sivabalan Manivasagam, Raquel Urtasun

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments CoRL 2023. Project page: https://waabi.ai/adv3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02260 2023-10-30 cs.CV cs.CL 57%

Learning to reason over visual objects

Shanka Subhra Mondal, Taylor Webb, Jonathan D. Cohen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments ICLR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14478 2023-10-24 cs.CL 57%

GeoLM: Empowering Language Models for Geospatially Grounded Language Understanding

Zekun Li, Wenxuan Zhou, Yao-Yi Chiang, Muhao Chen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP23 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09755 2023-10-19 cs.CV cs.AI 57%

Beyond Segmentation: Road Network Generation with Multi-Modal LLMs

Sumedh Rasal, Sanjay Kumar Boddhu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07896 2023-10-13 cs.RO cs.CV cs.LG 57%

NoMaD: Goal Masked Diffusion Policies for Navigation and Exploration

Ajay Sridhar, Dhruv Shah, Catherine Glossop, Sergey Levine

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments Project page https://general-navigation-models.github.io/nomad/

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11319 2023-09-19 cs.RO cs.AI 57%

"Tidy Up the Table": Grounding Common-sense Objective for Tabletop Object Rearrangement

Yiqing Xu, David Hsu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments RSSLRL2023 Workshop, Under review for conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16493 2023-09-01 cs.AI cs.RO 57%

Expanding Frozen Vision-Language Models without Retraining: Towards Improved Robot Perception

Riley Tavassoli, Mani Amani, Reza Akhavian

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Preprint submitted to Information Fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04589 2023-08-22 cs.CV cs.AI 57%

Temporal DINO: A Self-supervised Video Strategy to Enhance Action Prediction

Izzeddin Teeti, Rongali Sai Bhargav, Vivek Singh, Andrew Bradley, Biplab Banerjee, Fabio Cuzzolin

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16487 2023-08-22 cs.CV cs.AI 57%

EgoHumans: An Egocentric 3D Multi-Human Benchmark

Rawal Khirodkar, Aayush Bansal, Lingni Ma, Richard Newcombe, Minh Vo, Kris Kitani

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Accepted to ICCV 2023 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02823 2023-08-08 cs.CV cs.AI 57%

A Symbolic Character-Aware Model for Solving Geometry Problems

Maizhen Ning, Qiu-Feng Wang, Kaizhu Huang, Xiaowei Huang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments ACM MM 2023 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05335 2023-07-21 cs.CV cs.CL cs.MM 57%

MAP: Multimodal Uncertainty-Aware Vision-Language Pre-training Model

Yatai Ji, Junjie Wang, Yuan Gong, Lin Zhang, Yanru Zhu, Hongfa Wang, Jiaxing Zhang, Tetsuya Sakai, Yujiu Yang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments CVPR 2023 Main Track Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09636 2023-07-20 cs.CV cs.AI 57%

Traffic-Domain Video Question Answering with Automatic Captioning

Ehsan Qasemi, Jonathan M. Francis, Alessandro Oltramari

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Accepted in ITSC2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16774 2023-06-30 cs.CL 57%

Stop Pre-Training: Adapt Visual-Language Models to Unseen Languages

Yasmine Karoui, Rémi Lebret, Negar Foroutan, Karl Aberer

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to ACL 2023 as short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.08737 2023-06-30 cs.RO cs.AI 57%

N$^2$M$^2$: Learning Navigation for Arbitrary Mobile Manipulation Motions in Unseen and Dynamic Environments

Daniel Honerkamp, Tim Welschehold, Abhinav Valada

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Project website: http://mobile-rl.cs.uni-freiburg.de; Accepted at T-RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.13680 2023-06-05 cs.RO cs.LG 57%

Learning Practically Feasible Policies for Online 3D Bin Packing

Hang Zhao, Chenyang Zhu, Xin Xu, Hui Huang, Kai Xu

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments Science China Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18583 2023-05-31 cs.CV cs.AI 57%

Controllable Text-to-Image Generation with GPT-4

Tianjun Zhang, Yi Zhang, Vibhav Vineet, Neel Joshi, Xin Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18373 2023-05-31 cs.CV cs.CL 57%

KAFA: Rethinking Image Ad Understanding with Knowledge-Augmented Feature Adaptation of Vision-Language Models

Zhiwei Jia, Pradyumna Narayana, Arjun R. Akula, Garima Pruthi, Hao Su, Sugato Basu, Varun Jampani

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.11089 2023-05-25 cs.RO cs.AI cs.SY eess.SP eess.SY 57%

Recent Advancements in Deep Learning Applications and Methods for Autonomous Navigation: A Comprehensive Review

Arman Asgharpoor Golroudbari, Mohammad Hossein Sabour

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14508 2023-05-01 eess.IV cs.CV cs.LG 57%

3D Brainformer: 3D Fusion Transformer for Brain Tumor Segmentation

Rui Nian, Guoyao Zhang, Yao Sui, Yuqi Qian, Qiuying Li, Mingzhang Zhao, Jianhui Li, Ali Gholipour, Simon K. Warfield

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06258 2023-04-17 cs.CV cs.LG eess.IV 57%

MProtoNet: A Case-Based Interpretable Model for Brain Tumor Classification with 3D Multi-parametric Magnetic Resonance Imaging

Yuanyuan Wei, Roger Tam, Xiaoying Tang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

Comments 15 pages, 5 figures, 1 table; accepted for oral presentation at MIDL 2023 (https://openreview.net/forum?id=6Wbj3QCo4U4 ); camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05402 2023-04-13 cs.CV cs.CR cs.LG cs.MM 57%

Boosting Cross-task Transferability of Adversarial Patches with Visual Relations

Tony Ma, Songze Li, Yisong Xiao, Shunchang Liu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02814 2023-03-27 cs.CV cs.CR cs.HC cs.LG 57%

Visual Analytics of Neuron Vulnerability to Adversarial Attacks on Convolutional Neural Networks

Yiran Li, Junpeng Wang, Takanori Fujiwara, Kwan-Liu Ma

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

Comments Accepted by the Special Issue on Human-Centered Explainable AI, ACM Transactions on Interactive Intelligent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏