Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
机构 * Brown University(布朗大学) ; Tel Aviv University(特拉维夫大学) ; IIT Kharagpur(印度理工学院卡里帕尔分校) ; New York University(纽约大学) ; University of Tübingen(图宾根大学)
作者
Deep Learning / Vision
机构 * Brown University(布朗大学) ; Tel Aviv University(特拉维夫大学) ; IIT Kharagpur(印度理工学院卡里帕尔分校) ; New York University(纽约大学) ; University of Tübingen(图宾根大学)