Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers
多模态生成式引擎优化:针对视觉-语言模型排序器的排名操纵
Yixuan Du, Chenxiao Yu, Haoyan Xu, Ziyi Wang, Yue Zhao, Xiyang Hu
机构
*
Georgetown University(乔治城大学)
;
University of Southern California(南加州大学)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
Arizona State University(亚利桑那州立大学)
TraversalBench: Challenging Paths to Follow for Vision Language Models
TraversalBench: 为视觉语言模型设计的复杂路径挑战测试集
Clara Petrova, Zhuo Chen, Marin Soljačić
机构
*
Massachusetts Institute of Technology, Department of Physics(麻省理工学院物理系)
;
Massachusetts Institute of Technology, Institute for Data, Systems, and Society(麻省理工学院数据、系统与社会研究所)
;
NSF AI Institute for Artificial Intelligence and Fundamental Interactions(国家科学基金会人工智能与基本相互作用AI研究所)
专题命中
视觉定位与Grounding
:vision language model(title);vision-language model(abstract);grounding(abstract);分类 cs.CV
CommentsAccepted to the IEEE ICRA 2026 International Joint Workshop on Ontologies, Semantic Maps and Autonomous Robotics Standardization (J-WOSMARS 2026), Vienna, 2026
MemoVAD: Resource-Efficient Video Anomaly Detection via Dynamic Semantic Memory in Edge Computing Scenarios
MemoVAD: 边缘计算场景下基于动态语义记忆的资源高效视频异常检测
Guo Li, Jiandian Zeng, Yang Li, Zihao Peng, Ke Chen, Tian Wang
机构
*
Institute of Artificial Intelligence and Future Networks, Beijing Normal University(北京师范大学人工智能与未来网络研究院)
;
School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院)
;
Engineering Research Center of Cloud-Edge Intelligent Collaboration on Big Data, Ministry of Education, Beijing Normal University(北京师范大学大数据云边智能协同教育部工程研究中心)
机构
*
College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部)
;
Faculty of Computer Science and Artificial Intelligence, Shenzhen University of Advanced Technology(深圳理工大学计算机科学与人工智能学院)
;
School of Artificial Intelligence, Nanchang University(南昌大学人工智能学院)
SAGE: Shape-Adapting Gated Experts for Adaptive Histopathology Image Segmentation
SAGE:适应性组织病理图像分割的形状自适应门控专家
Gia Huy Thai, Hoang-Nguyen Vu, Anh-Minh Phan, Quang-Thinh Ly, Thi-Ngoc-Truc Nguyen, Nhat Ho
机构
*
University of Science, VNU-HCM(越南国家大学科学学院)
;
Trivita AI
;
University of Technology, VNU-HCM(越南国家大学技术学院)
;
Michigan State University, USA(美国密歇根州立大学)
;
The University of Texas at Austin(德克萨斯大学奥斯汀分校)