arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Google(谷歌)

2026-04-15 至 2026-04-15 共收录 6
2604.13022 2026-04-15 quant-ph cs.LG math.OC stat.ML

Classical and Quantum Speedups for Non-Convex Optimization via Energy Conserving Descent

非凸优化中的经典与量子加速方法:能量守恒下降

Yihang Sun, Huaijin Wang, Patrick Hayden, Jose Blanchet

机构 * Stanford University(斯坦福大学) Stanford University, Google DeepMind(斯坦福大学,谷歌深Mind)

AI总结 本文首次分析了能量守恒下降算法,提出了一种具有能量守恒噪声的随机ECD动态和量子ECD哈密顿量的量子类比,证明了在双谷目标函数中,sECD和qECD在梯度下降基础上实现指数加速,尤其在高壁垒目标中qECD进一步加速。

Comments 33 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12952 2026-04-15 cs.LG math.CO stat.ML

An Optimal Sauer Lemma Over $k$-ary Alphabets

在k进制字母表上的最优Sauer引理

Steve Hanneke, Qinglin Meng, Shay Moran, Amirreza Shaeiri

机构 * Purdue University, USA(美国普渡大学) Technion, Israel and Google Research(技术学院(以色列)和谷歌研究)

AI总结 本文提出了一种针对多类和列表预测的最优Sauer不等式,通过DS维度和扩展的列表DS维度,改进了多类学习和列表预测的样本复杂度上界。

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12894 2026-04-15 cs.CV

Representing 3D Faces with Learnable B-Spline Volumes

用可学习的B样条体积表示3D人脸

Prashanth Chandran, Daoye Wang, Timo Bolkart

机构 * Google(谷歌)

AI总结 本文提出CUBE方法,结合B样条体积与学习特征,用于3D扫描配准和单目3D人脸重建,通过高维控制特征提升模型表达能力,实现局部表面编辑。

Comments Accepted to CVPR 2026 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21697 2026-04-15 cs.CV cs.LG

Visual Diffusion Models are Geometric Solvers

视觉扩散模型是几何求解器

Nir Goren, Shai Yehezkel, Omer Dahary, Andrey Voynov, Or Patashnik, Daniel Cohen-Or

机构 * Tel Aviv University(特拉维夫大学) Google DeepMind(谷歌DeepMind)

AI总结 本文展示视觉扩散模型可直接解决几何问题,通过像素空间推理,解决四边形内接问题及Steiner树问题等,将几何推理转化为图像生成。

Comments Project page: https://kariander1.github.io/visual-geo-solver/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12012 2026-04-15 cs.CV

TIPSv2: Advancing Vision-Language Pretraining with Enhanced Patch-Text Alignment

TIPSv2:通过增强的补丁-文本对齐推进视觉-语言预训练

Bingyi Cao, Koert Chen, Kevis-Kokitsi Maninis, Kaifeng Chen, Arjun Karpur, Ye Xia, Sahil Dua, Tanmaya Dabral, Guangxing Han, Bohyung Han, Joshua Ainslie, Alex Bewley, Mithun Jacob, René Wagner, Washington Ramos, Krzysztof Choromanski, Mojtaba Seyedhosseini, Howard Zhou, André Araujo

机构 * Google(谷歌) DeepMind(深度Mind)

AI总结 本文提出TIPSv2,通过改进的预训练方法提升视觉-语言模型的补丁-文本对齐能力,实验表明其在多种任务和数据集上表现优异。

Comments CVPR2026 camera-ready + appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25326 2026-04-15 cs.AI cs.CY

Evaluating Language Models for Harmful Manipulation

评估用于有害操控的语言模型

Canfer Akbulut, Rasmi Elasmar, Abhishek Roy, Anthony Payne, Priyanka Suresh, Lujain Ibrahim, Seliem El-Sayed, Charvi Rastogi, Ashyana Kachra, Will Hawkins, Kristian Lum, Laura Weidinger

机构 * Google(谷歌)

AI总结 本文提出评估AI有害操控的框架,通过人机交互研究评估AI模型在公共政策、金融和健康领域中的操控行为,发现情境影响操控效果,需在高风险情境中评估。

详情

展开后加载摘要…

URL PDF HTML 收藏