2503.10905 2025-08-07 cs.AI cs.CV cs.LG 62% Learning to Inference Adaptively for Multimodal Large Language Models Zhuoyan Xu, Khoi Duc Nguyen, Preeti Mukherjee, Saurabh Bagchi, Somali Chaterji, Yingyu Liang, Yin Li 机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; Purdue University(普渡大学) ; The University of Hong Kong(香港大学) 纠错 专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG Comments Published at ICCV 2025 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.04598 2025-08-07 cs.RO 50% $NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything Lingfeng Zhang, Xiaoshuai Hao, Yingbo Tang, Haoxiang Fu, Xinyu Zheng, Pengwei Wang, Zhongyuan Wang, Wenbo Ding, Shanghang Zhang 专题命中 视觉空间推理 :reasoning(abstract) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2508.03725 2025-08-07 cs.CV 50% A Large Language Model Powered Integrated Circuit Footprint Geometry Understanding Yida Wang, Taiting Lu, Runze Liu, Lanqing Yang, Yifan Yang, Zhe Chen, Yuehai Wang, Yixin Liu, Kaiyuan Lin, Xiaomeng Chen, Dian Ding, Yijie Li, Yi-Chao Chen, Yincheng Jin, Mahanth Gowda 机构 * Shanghai Jiao Tong University(上海交通大学) ; Pennsylvania State University(宾夕法尼亚州立大学) ; Microsoft Research(微软研究院) ; National University of Singapore(新加坡国立大学) ; Binghamton University(布ingham顿大学) 纠错 专题命中 视觉空间推理 :reasoning(abstract) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2412.18450 2025-08-07 cs.CV 50% 3DGraphLLM: Combining Semantic Graphs and Large Language Models for 3D Scene Understanding Tatiana Zemskova, Dmitry Yudin 机构 * AIRI ; MIPT(莫斯科国立普希金俄语学院) 纠错 专题命中 视觉空间推理 :reasoning(abstract) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图