PixRec: Leveraging Visual Context for Next-Item Prediction in Sequential Recommendation
PixRec: 利用视觉上下文进行序列推荐中的下一项预测
Sayak Chakrabarty, Souradip Pal
机构
*
Department of Computer Science, Northwestern University(北western大学计算机科学系)
;
Elmore Family School of Electrical and Computer Engineering(电气与计算机工程学院)
Ming Wen, Yuxuan Liu, Kun Yang, Yunhao Feng, Zhuoer Xu, Yuhao Sun, Shiwen Cui, Xiang Zheng, Yi Liu, Xingjun Ma, Yu-Gang Jiang
机构
*
Institute of Trustworthy Embodied AI(可信具身人工智能研究院)
;
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Ant Group(蚂蚁集团)
;
Zhejiang University(浙江大学)
;
City University of Hong Kong(香港城市大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Ablation-Corrected Evaluation of Attribution Maps in Echocardiographic Ejection-Fraction Models
解剖结构忠实但时间上盲目:超声心动图左心室射血分数估计的归因审核
Hyunkyung Han, Min Jung Kim
机构
*
School of Integrated Medicine, Yonsei University(延世大学统合医学院)
;
Department of Radiology, Research Institute of Radiologic Science, Yonsei University College of Medicine(延世大学医学院放射科学研究所放射科)
Comments12 pages, 4 figures. v2: the chance level is now measured rather than computed, which corrects the ratios reported in v1. Adds a composition-matched ablation with an equal-area control, a reliability estimate for it, an ablation-derived score to report alongside overlap, seed repetition, and pediatric validation
Token-Based Detection of Spurious Correlations in Vision Transformers
基于Token的视觉Transformer虚假相关性检测
Solha Kang, Esla Timothy Anzaku, Wesley De Neve, Arnout Van Messem, Joris Vankerschaver, Francois Rameau, Utku Ozbulak
机构
*
Center for Biosystems and Biotech Data Science(生物系统与生物技术数据科学中心)
;
Ghent University Global Campus(根特大学全球校区)
;
State University of New York Korea(纽约州立大学韩国分校)
;
Department of Mathematics(数学系)
;
Université de Liège(列日大学)
;
Department of Applied Mathematics, Computer Science and Statistics(应用数学、计算机科学与统计学系)
;
Ghent University(根特大学)
;
Department of Electronics and Information Systems(电子与信息系统系)
Resolution Meets Reduction: Efficient Visual Context for 3D Radiology Report Generation
分辨率与压缩结合:面向3D放射报告生成的高效视觉上下文
Jonathan Suprijadi, Raphael Stock, Moritz Langenberg, David Zimmerer, Kim-Celine Kahl, Stefan Denner, Yannick Kirchhoff, Karol Gotkowski, Maximilian Rokuss, Jeremias Traub, Tassilo Wald, Constantin Ulrich, Klaus Maier-Hein
机构
*
German Cancer Research Center (DKFZ)(德国癌症研究中心)
机构
*
East China Normal University Shanghai China
;
Centre for Artificial Intelligence
;
Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences Hong Kong China
;
Department of Computing, The Hong Kong Polytechnic University Hong Kong China
;
East China Normal University
;
Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences
;
Department of Computing, The Hong Kong Polytechnic University
Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitration for Strict Zero-Shot Image Captioning
裁决式字幕生成:用于严格零样本图像字幕生成的多智能体对齐评分与共识蒸馏束仲裁
Duy Tran Thanh, Thien-Phuc Doan, Long Nguyen-Vu, Ngo Tan Vu Khanh
机构
*
AI Platform OneNexus, OneMount(OneMount AI平台OneNexus)
;
School of Electronic Engineering, Soongsil University(崇实大学电子工程学院)
;
MoAdata(MoAdata公司)
;
University of Economics Ho Chi Minh City (UEH)(胡志明市经济大学)
Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance
重新思考胸部X射线机器学习中的临床相关性:评估参考如何定义性能
Panagiotis Fytas, Ian Selby, Clemens Karner, Judith Babar, Simon Baker, Jake Beckford, Timothy J. Sadler, Shahab Shahipasand, Arthikkaa Thavakumar, John Li Chen, Alex Sawer, Michael Roberts, Jonathan Weir-McCall, J. H. F. Rudd, Carola-Bibiane Schönlieb, Anna Korhonen, Anna Breger
Comments† Equal contribution. Affiliations: 1: The University of Hong Kong 2: The University of Sydney 3: University of Electronic Science and Technology of China Corresponding authors: Zihan Deng (zhdeng@hku.hk), Chuanzhi Xu (chuanzhi.xu@sydney.edu.au) Project page: https://frankdengai.github.io/SciFigQual-Bench Source code & dataset: https://github.com/FrankDengAI/SciFigQual-Bench