arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-05 至 2026-01-05 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 视觉空间推理 2 篇

2512.23328 2026-01-05 cs.AI cs.CL cs.CV 84%

CubeBench: Diagnosing Interactive, Long-Horizon Spatial Reasoning Under Partial Observations

CubeBench: 在部分观察下诊断交互式、长周期空间推理

Huan-ang Gao, Zikang Zhang, Tianwei Luo, Kaisen Yang, Xinzhe Juan, Jiahao Qiu, Tianxing Chen, Bingxiang He, Hao Zhao, Hao Zhou, Shilong Liu, Mengdi Wang

机构 * THU(清华大学) Princeton(普林斯顿大学) SJTU & UMich(上海交通大学 & 密歇根大学) HKU(香港大学)

专题命中 视觉空间推理 :reasoning(title,abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 CubeBench通过魔方基准评估LLM在部分观察下的空间推理和长周期任务能力,揭示LLM在长期规划中的根本缺陷。

Comments Webpage: https://cubebench.c7w.tech/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25008 2026-01-05 cs.CV 50%

FoundationSLAM: Unleashing the Power of Depth Foundation Models for End-to-End Dense Visual SLAM

FoundationSLAM: 释放深度基础模型的力量以实现端到端的密集视觉SLAM

Yuchen Wu, Jiahe Li, Fabio Tosi, Matteo Poggi, Jin Zheng, Xiao Bai

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 FoundationSLAM通过结合深度基础模型与几何推理,实现端到端的密集视觉SLAM,提升轨迹精度和重建质量,实现实时18 FPS运行。

Comments Accept at AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏