ORMOT: A Dataset and Framework for Omnidirectional Referring Multi-Object Tracking
ORMOT: 一个用于全方位参照多目标跟踪的数据集和框架
Sijia Chen, Zihan Zhou, Yanqiu Yu, En Yu, Wenbing Tao
机构
*
State Key Laboratory of Multispectral Information Intelligent Processing Technology, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(多谱信息智能处理技术国家重点实验室,人工智能与自动化学院,华中科技大学)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China Normal University(华东师范大学)
;
Shanghai University of Electric Power(上海电力大学)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.AI
机构
*
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences and University of Chinese Academy of Sciences, Beijing, China(深圳先进技术研究院,中国科学院和中国科学院大学,北京,中国)
;
Department of Pathology, Sun Yat-sen University Cancer Center, State Key Laboratory of Oncology in South China, Guangzhou, China(中山大学肿瘤中心病理科,南方肿瘤临床研究中心,广州,中国)
;
Hong Kong Polytechnic University, Hong Kong SAR, China(香港理工大学,香港特别行政区,中国)
;
Department of Electronic Engineering, The Chinese University of Hong Kong, Hong Kong SAR 999077, China(电子工程系,香港中文大学,香港特别行政区,中国)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences, Shenzhen, China(深圳先进技术研究院,中国科学院,深圳,中国)
专题命中
其他VLM
:visual language model(abstract);分类 cs.CV
机构
*
College of Intelligent Robotics and Advanced Manufacturing(智能机器人与先进制造学院)
;
Fudan University(复旦大学)
;
Fysics Intelligence Technologies Co., Ltd.(Fysics智能科技有限公司)
;
University of Science and Technology Beijing(北京科技大学)
;
ByteDance(字节跳动)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Xi’an Jiaotong University(西安交通大学)
机构
*
Vision and AI Lab, Indian Institute of Science, Bangalore, India(印度科学院视觉与人工智能实验室)
;
Chair for Machine Learning, University of Mannheim(曼海姆大学机器学习主任)
;
Max Planck Institute for Informatics, Saarland Informatics Campus, Saarbrücken, Germany(马克斯·普朗克信息研究所,萨尔兰州信息学院,萨尔布吕肯,德国)
VILLAIN at AVerImaTeC: Verifying Image-Text Claims via Multi-Agent Collaboration
VILLAIN 在 AVerImaTeC 上:通过多智能体协作验证图像-文本声明
Jaeyoon Jung, Yejun Yoon, Kunwoo Park
机构
*
School of AI Convergence, Soongsil University(人工智能融合学院,顺世大学)
;
MAUM AI Inc.(MAUM人工智能公司)
;
Department of Intelligent Semiconductors, Soongsil University(智能半导体系,顺世大学)
AI Gamestore: Scalable, Open-Ended Evaluation of Machine General Intelligence with Human Games
AI 游戏商店:通过人类游戏评估机器通用智能的可扩展性和开放性
Lance Ying, Ryan Truong, Prafull Sharma, Kaiya Ivy Zhao, Nathan Cloos, Kelsey R. Allen, Thomas L. Griffiths, Katherine M. Collins, José Hernández-Orallo, Phillip Isola, Samuel J. Gershman, Joshua B. Tenenbaum
BTReport: A Framework for Brain Tumor Radiology Report Generation with Clinically Relevant Features
BTReport: 一种用于脑肿瘤放射学报告生成的框架,结合临床相关特征
Juampablo E. Heras Rivera, Dickson T. Chen, Tianyi Ren, Daniel K. Low, Asma Ben Abacha, Alberto Santamaria-Pang, Mehmet Kurt
机构
*
University of Washington(华盛顿大学)
;
University of Washington School of Medicine(华盛顿大学医学院)
;
Microsoft Health AI(微软健康人工智能)
;
Johns Hopkins School of Medicine(约翰霍普金斯医学院)
Enhancing Features in Long-tailed Data Using Large Vision Model
利用大视觉模型增强长尾数据特征
Pengxiao Han, Changkun Ye, Jinguang Tong, Cuicui Jiang, Jie Hong, Li Fang, Xuesong Li
机构
*
Australian National University Canberra, Australia
;
The University of Hong Kong Hong Kong SAR
;
Chinese Academy of Sciences China
;
Australian National University\&CSIRO Canberra, Australia
ARGaze: Autoregressive Transformers for Online Egocentric Gaze Estimation
ARGaze:用于在线第一人称注视估计的自回归变换器
Jia Li, Wenjie Zhao, Shijian Deng, Bolin Lai, Yuheng Wu, RUijia Chen, Jon E. Froehlich, Yuhang Zhao, Yapeng Tian
机构
*
Department of Computer Science, University of Texas at Dallas, Richardson, TX, USA.(德克萨斯大学达拉斯分校计算机科学系)
;
College of Computing, Georgia Institute of Technology, Atlanta, GA, USA(佐治亚理工学院计算机学院)
;
Department of Computer Science, University of Wisconsin-Madison, Madison, WI, USA(威斯康星大学麦迪逊分校计算机科学系)
;
Allen School of Computer Science, University of Washington, USA(华盛顿大学阿伦计算机科学学院)