Evaluating Keyframe Layouts for Visual Known-Item Search in Homogeneous Collections
专题命中 跨模态检索 :multimodal(abstract);分类 cs.MM
Comments 28 Pages, 17 Figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :multimodal(abstract);分类 cs.MM
Comments 28 Pages, 17 Figures
机构 * University of Alberta(阿尔伯塔大学) ; Alberta Machine Intelligence Institute (Amii)(阿尔伯塔人工智能研究所) ; Charles University(查尔斯大学) ; EquiLibre Technologies, Inc.(EquiLibre技术公司) ; Allen Institute for AI(艾伦人工智能研究所) ; Sony AI(索尼人工智能)
专题命中 跨模态检索 :multimodal(abstract);分类 cs.AI
专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV
机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全研究中心)
专题命中 跨模态检索 :cross-modal(abstract)
机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) ; Guangdong University of Technology(广东工业大学) ; The Hong Kong Polytechnic University(香港理工大学) ; The Chinese University of Hong Kong(香港中文大学) ; Guizhou University(贵州大学) ; Zhejiang University(浙江大学) ; Nanyang Technological University(南洋理工大学)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.AI
机构 * Opus AI Research(Opus人工智能研究机构) ; Brown University(布朗大学) ; Zhejiang University(浙江大学) ; University of Toronto(多伦多大学)
专题命中 多模态生成 :multi-modal(abstract);MLLM(abstract);分类 cs.CV
Comments working in progress
机构 * Apple(苹果公司) ; University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV、cs.AI、cs.MM
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Alibaba Group(阿里巴巴集团)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.MM、eess.AS
Comments Accepted to EMNLP 2025
机构 * Hosei University(立命馆大学) ; King’s College London(伦敦大学国王学院) ; Kindai University(_kindai大学) ; Tokyo Uni. of Science(东京科学大学) ; University of Sheffield(谢菲尔德大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL、cs.AI
Comments Workshop on Wordplay: When Language Meets Games, EMNLP 2025
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ; Georgia Institute of Technology(佐治亚理工学院) ; University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) ; TwelveLabs
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * University of California, Davis(加州大学戴维斯分校) ; Advanced Micro Devices, Inc.(先进微器件公司)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·宾·扎耶德人工智能大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
机构 * Research Center on Software Technologies and Multimedia Systems for Sustainability (CITSEM), Universidad Politécnica de Madrid (UPM), Spain(软件技术与多媒体系统可持续性研究所以及马德里理工大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
机构 * KAIST(韩国科学技术院)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments Accepted to NeurIPS 2025
机构 * Sichuan University(四川大学) ; Peking University(北京大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract)
Comments Preprint to be published at SE4ADS
Journal ref 2025 IEEE/ACM 1st International Workshop on Software Engineering for Autonomous Driving Systems (SE4ADS), Ottawa, ON, Canada, 2025, pp. 34-37
专题命中 多模态生成 :multimodal(abstract)
Comments 6 pages
机构 * The Ohio State University(俄亥俄州立大学)
专题命中 多模态评测 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
Comments NeurIPS 2025
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 多模态评测 :MLLM(title,abstract);multimodal(abstract);分类 cs.CL
机构 * School of Computing and Augmented Intelligence(计算与增强智能学院) ; Arizona State University(亚利桑那州立大学) ; Department of Computer Science(计算机科学系) ; International Institute of Information Technology(国际信息科技研究所)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Published as a conference paper at COLM 2025
机构 * Dicemed
专题命中 多模态评测 :multi-modal(title);multimodal(abstract);分类 cs.CV、cs.AI
机构 * Center for Machine Vision and Signal Analysis, University of Oulu(机器视觉与信号分析中心,奥卢大学) ; Indian Institute of Technology Roorkee(印度理工学院罗尔基分校) ; State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.AI、cs.MM
机构 * Purdue University(普渡大学) ; Indiana University(印第安纳大学) ; Curtin University(Curtin大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV
Comments The extended full version of the accepted paper in 2025 IEEE BHI conference with title: Evaluating Large Multimodal Models for Nutrition Analysis: A New Benchmark Enriched with Contextual Metadata. Dataset is available at: https://skynet.ecn.purdue.edu/~coburn6/ACETADA/
机构 * Computing Department of Hong Kong Polytechnic University(香港理工大学计算机系) ; Computing Department, The Hong Kong Polytechnic University(香港理工大学计算机系)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.AI
Comments 13 pages, 8 figures. Submitted to IEEE Transactions on Information Forensics & Security
专题命中 多模态评测 :multi-modal(title,abstract);分类 cs.MM
机构 * Autonomous Intelligent Systems, Computer Science Institute VI, Center for Robotics, University of Bonn, Germany(自主智能系统,计算机科学研究所第六研究所,机器人中心,波恩大学,德国)
专题命中 多模态评测 :multimodal(title);分类 cs.CV、cs.AI
Comments 12 pages, 4 figures, 2 tables, 19th International Conference on Intelligent Autonomous Systems (IAS), Genoa, Italy, June 2025
机构 * Center For Research in Computer Vision, University of Central Florida, USA(计算机视觉研究中心,中央佛罗里达大学)
专题命中 多模态评测 :cross-modal(abstract);分类 cs.CV、cs.CL
专题命中 多模态评测 :multimodal(abstract);分类 cs.CV、cs.AI