arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Google(谷歌)

2026-04-16 至 2026-04-16 共收录 7
2604.13883 2026-04-16 cs.CV cs.LG

Context Sensitivity Improves Human-Machine Visual Alignment

上下文敏感性提升人机视觉对齐

Frieda Born, Tom Neuhäuser, Lukas Muttenthaler, Brett D. Roads, Bernhard Spitzer, Andrew K. Lampinen, Matt Jones, Klaus-Robert Müller, Michael C. Mozer

机构 * Technische Universität Berlin(技术大学柏林) BIFOLD Max Planck Institute for Human Development(人类发展马克斯·普朗克研究所) Aignostics Helmholtz Munich(慕尼黑海德堡研究所) Technical University of Munich(慕尼黑技术大学) University College London(伦敦大学学院) Technische Universität Dresden(德累斯顿技术大学) Google DeepMind(谷歌DeepMind) University of Colorado Boulder(科罗拉多大学博尔德分校) Korea University(韩国大学) Max Planck Institute for Informatics(信息马克斯·普朗克研究所)

AI总结 本文提出一种基于神经网络嵌入的上下文敏感相似性计算方法,用于解决三元组异类识别任务,通过锚图提供同时上下文,使模型在异类识别准确率上提升15%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13942 2026-04-16 cs.CV cs.AI cs.LG

Frozen Forecasting: A Unified Evaluation

冻结预测:一种统一的评估

Jacob C Walker, Pedro Vélez, Luisa Polania Cabrera, Guangyao Zhou, Sayna Ebrahimi, Rishabh Kabra, Carl Doersch, Maks Ovsjanikov, João Carreira, Shiry Ginosar

机构 * Google DeepMind(谷歌DeepMind) Toyota Technological Institute at Chicago(丰田技术研究所(芝加哥))

AI总结 本文提出一种统一的评估框架,用于评估冻结视觉骨干在多样化任务和抽象层次上的预测能力,通过训练潜在扩散模型直接在表示空间中预测未来特征,发现预测性能与感知质量密切相关,视频预训练模型表现优于图像预训练模型。

Comments New Title, Additional Author

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13738 2026-04-16 stat.ML cs.LG

Covariance-adapting algorithm for semi-bandits with application to sparse rewards

协方差适应算法用于半带隙问题及其在稀疏奖励中的应用

Pierre Perrault, Vianney Perchet, Michal Valko

机构 * Inria Lille & ENS Paris-Saclay(法国里尔研究所与巴黎-萨克雷高等科学研究院) ENSAE & Criteo AI Lab(高等统计研究院与Criteo人工智能实验室) DeepMind Paris(伦敦DeepMind巴黎分公司)

AI总结 本文研究了随机组合半带隙问题,探讨了新的亚指数分布族,推导了更紧的期望遗憾下界,并构造了基于协方差估计的算法,应用于稀疏奖励场景。

Comments Published at Conference on Learning Theory (COLT) 2020

Journal ref Proceedings of the 33rd Annual Conference on Learning Theory (COLT 2020), PMLR 125, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13452 2026-04-16 cs.CL

CANVAS: Continuity-Aware Narratives via Visual Agentic Storyboarding

CANVAS:通过视觉代理脚本实现连续性叙事

Ishani Mondal, Yiwen Song, Mihir Parmar, Palash Goyal, Jordan Boyd-Graber, Tomas Pfister, Yale Song

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Google(谷歌)

AI总结 CANVAS通过多代理框架实现多镜头叙事中的视觉连续性,提升背景、角色和道具的一致性,优于现有基准,背景连续性提升21.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13287 2026-04-16 cs.LG

MOONSHOT : A Framework for Multi-Objective Pruning of Vision and Large Language Models

MOONSHOT:一种用于视觉和大语言模型多目标剪枝的框架

Gabriel Afriat, Xiang Meng, Shibal Ibrahim, Hussein Hazimeh, Rahul Mazumder

机构 * Google(谷歌) OpenAI Massachusetts Institute of Technology(麻省理工学院)

AI总结 MOONSHOT通过联合优化层重建误差和训练损失的二阶泰勒近似,提升视觉和大语言模型在无重新训练下的压缩效果,显著提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13171 2026-04-16 cs.CV

3DRealHead: Few-Shot Detailed Head Avatar

3DRealHead: 少样本详细头部虚拟形象

Jalees Nehvi, Timo Bolkart, Thabo Beeler, Justus Thies

机构 * Technical University of Darmstadt(达姆斯塔特技术大学) Google(谷歌)

AI总结 本文提出3DRealHead方法,通过单目视频流提取表达信号,实现少样本头部虚拟形象重建,利用Style U-Net生成3D高斯体并实现高表达性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15970 2026-04-16 cs.DB cs.AI

100x Cost & Latency Reduction: Performance Analysis of AI Query Approximation using Lightweight Proxy Models

100倍成本与延迟降低:利用轻量级代理模型分析AI查询近似性能

Yeounoh Chung, Rushabh Desai, Jian He, Yu Xiao, Thibaud Hottelier, Yves-Laurent Kom Samo, Pushkar Khadilkar, Xianshun Chen, Sam Idicula, Fatma Özcan, Alon Halevy, Yannis Papakonstantinou

机构 * Google Cloud(谷歌云)

AI总结 本文研究了AI查询近似方法,通过轻量级代理模型实现100倍成本和延迟降低,提升语义过滤和排序性能,适用于OLAP和HTAP数据库。

详情

展开后加载摘要…

URL PDF HTML 收藏