arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Meituan(美团)

2026-01-13 至 2026-01-13 共收录 2
2502.20313 2026-01-13 cs.CV

FlexVAR: Flexible Visual Autoregressive Modeling without Residual Prediction

FlexVAR: 无需残差预测的灵活视觉自回归建模

Siyu Jiao, Gengwei Zhang, Yinlong Qian, Jiancheng Huang, Yao Zhao, Humphrey Shi, Lin Ma, Yunchao Wei, Zequn Jie

机构 * Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学学院) University of Technology Sydney(悉尼科技大学) Meituan(美团) Georgia Institute of Technology(佐治亚理工学院)

AI总结 FlexVAR通过无需残差预测的灵活视觉自回归建模,在低分辨率图像上实现高分辨率图像生成和多种图像任务处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19142 2026-01-13 cs.CV

CLIP-GS: Unifying Vision-Language Representation with 3D Gaussian Splatting

CLIP-GS: 通过3D高斯点划法统一视觉-语言表示

Siyu Jiao, Haoye Dong, Yuyang Yin, Zequn Jie, Yinlong Qian, Yao Zhao, Humphrey Shi, Yunchao Wei

机构 * Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学学院) National University of Singapore(新加坡国立大学) Meituan(美团) Georgia Institute of Technology(佐治亚理工学院) Picsart AI Research (PAIR)(Picsart AI研究(PAIR))

AI总结 CLIP-GS通过3D高斯点划法统一视觉-语言表示,利用对比损失和图像投票损失提升多模态检索和分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏