arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Johns Hopkins University(约翰斯·霍普金斯大学)

2026-01-09 至 2026-01-09 共收录 4
2509.18693 2026-01-09 cs.CV

MVT: Mask-Grounded Vision-Language Models for Taxonomy-Aligned Land-Cover Tagging

MVT:基于分类对齐的土地覆盖标签的掩码导向视觉-语言模型

Siyi Chen, Kai Wang, Weicong Pang, Ruiming Yang, Ziru Chen, Renjun Gao, Alexis Kai Hon Lau, Dasa Gu, Chenchen Zhang, Cheng Li

机构 * HKUST(香港科技大学) JHU(约翰·霍普金斯大学) CUHKSZ(香港中文大学) NUS(新加坡国立大学) MUST(穆斯林大学)

AI总结 MVT通过三阶段框架结合类无关掩码证据与基于分类的场景解释,提升遥感土地覆盖标签的准确性和信息性。

Comments The project is available at https://charlescsyyy.github.io/MVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04343 2026-01-09 cs.SD cs.AI eess.AS

Summary of The Inaugural Music Source Restoration Challenge

音乐源恢复挑战赛概述

Yongyi Zang, Jiarui Hai, Wanying Ge, Qiuqiang Kong, Zheqi Dai, Helin Wang, Yuki Mitsufuji, Mark D. Plumbley

机构 * Independent Researcher(独立研究者) Johns Hopkins University(约翰霍普金斯大学) The Chinese University of Hong Kong(香港中文大学) Sony AI(索尼人工智能) King's College London(伦敦国王学院)

AI总结 音乐源恢复挑战赛评估了不同系统在恢复退化音频中乐器声部的性能,揭示了不同乐器恢复难度差异及各系统表现

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03905 2026-01-09 cs.AI cs.CL cs.LG

Current Agents Fail to Leverage World Model as Tool for Foresight

当前智能体无法利用世界模型作为前瞻性工具

Cheng Qian, Emre Can Acikgoz, Bingxuan Li, Xiusi Chen, Yuji Zhang, Bingxiang He, Qinyu Luo, Dilek Hakkani-Tür, Gokhan Tur, Yunzhu Li, Heng Ji

机构 * UIUC(伊利诺伊大学香槟分校) THU(清华大学) JHU(约翰霍普金斯大学) Columbia(哥伦比亚大学)

AI总结 本文研究了当前智能体能否利用世界模型作为工具提升前瞻性认知,发现其在模拟调用和结果整合方面存在显著不足。

Comments 36 Pages, 13 Figures, 17 Tables (Meta data updated)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18003 2026-01-09 cs.CV

Name That Part: 3D Part Segmentation and Naming

识别部件:3D部件分割与命名

Soumava Paul, Prakhar Kaushik, Ankit Vaidya, Anand Bhattad, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学)

AI总结 ALIGN-Parts提出了一种高效的一次性3D部件分割与命名方法,通过集合对齐任务实现开放词汇匹配,构建统一本体并引入新指标。

Comments Project page at https://name-that-part.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏