arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

NVIDIA(英伟达)

2026-05-14 至 2026-05-14 共收录 6
2605.13724 2026-05-14 cs.CV cs.AI

AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation

AnyFlow: 任意步视频扩散模型与在线策略流图蒸馏

Yuchao Gu, Guian Fang, Yuxin Jiang, Weijia Mao, Song Han, Han Cai, Mike Zheng Shou

机构 * NVIDIA Show Lab, National University of Singapore(新加坡国立大学Show实验室) MIT(麻省理工学院)

AI总结 AnyFlow通过优化完整ODE采样轨迹,解决一致性蒸馏在任意步视频生成中的性能退化问题,实现高效在线蒸馏以减少测试时误差。

Comments Project page at https://nvlabs.github.io/AnyFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24649 2026-05-14 cs.CV

MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows

MedOpenClaw 和 MedFlowBench:在完整研究流程中审计医疗代理

Weixiang Shen, Chengzhi Shen, Yanzhu Hu, Che Liu, Junde Wu, Jiayuan Zhu, Xiao Han, Zongyue Li, Jingpei Wu, Min Xu, Daguang Xu, Yueming Jin, Benedikt Wiestler, Daniel Rueckert, Jiazhen Pan

机构 * Technical University of Munich(慕尼黑技术大学) TUM University Hospital(TUM大学医院) LMU Munich(慕尼黑大学) Imperial College London(伦敦帝国理工学院) University of Oxford(牛津大学) Carnegie Mellon University(卡内基梅隆大学) NVIDIA(NVIDIA公司) National University of Singapore(新加坡国立大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

AI总结 本文提出 MedFlowBench 和 MedOpenClaw,用于评估医疗影像代理在完整研究流程中生成可审计证据的能力,发现仅依赖答案评分不够,需结合正确证据验证。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13093 2026-05-14 cs.CV

RoSplat: Robust Feed-Forward Pixel-wise Gaussian Splatting for Varying Input Views and High-Resolution Rendering

RoSplat:用于变化输入视角和高分辨率渲染的鲁棒前馈像素级高斯散射

Hoang Chuong Nguyen, Renjie Wu, Jose M. Alvarez, Miaomiao Liu

机构 * Australian National University(澳大利亚国立大学) NVIDIA

AI总结 本文提出RoSplat,通过引入alpha归一化策略和辅助3D采样正则化器,解决高斯散射在不同输入视角下的过亮问题和高分辨率渲染中的孔洞 artifacts,提升渲染质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10305 2026-05-14 cs.LG physics.ao-ph

Data-Driven Integration Kernels for Interpretable Nonlocal Operator Learning

数据驱动的集成核用于可解释的非局部算子学习

Savannah L. Ferretti, Jerry Lin, Sara Shamekh, Jane W. Baldwin, Michael S. Pritchard, Tom Beucler

机构 * Department of Earth System Science(地球系统科学系) University of California, Irvine(加州大学伊维福分校) Department of Computing and Data Science(计算与数据科学系) Boston University(波士顿大学) The Center for Atmosphere Ocean Science(大气海洋科学中心) New York University(纽约大学) NVIDIA Corporation(NVIDIA公司) Faculty of Geosciences and Environment(地球科学与环境学院) University of Lausanne(洛桑大学) Expertise Center for Climate Extremes(极端气候专家中心)

AI总结 本文提出数据驱动的集成核框架,通过分离非局部信息聚合与局部非线性预测,提升非局部算子学习的可解释性与泛化能力,通过南亚季风降水实验验证其有效性。

Comments Presented at Climate Informatics 2026 (14 pages, 5 figures, 1 table)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21204 2026-05-14 cs.LG cs.AI cs.CV

Test-Time Training with KV Binding Is Secretly Linear Attention

测试时训练与KV绑定实际上是秘密的线性注意力

Junchen Liu, Sven Elflein, Or Litany, Zan Gojcic, Ruilong Li

机构 * NVIDIA, Toronto, Ontario, Canada(NVIDIA,多伦多,安大略省,加拿大) University of Toronto, Toronto, Ontario, Canada(多伦多大学,多伦多,安大略省,加拿大) Vector Institute, Toronto, Ontario, Canada(向量研究所,多伦多,安大略省,加拿大) Technion -- Israel Institute of Technology, Haifa, Israel(技术ion -- 以色列理工学院,海法,以色列)

AI总结 本文揭示测试时训练与KV绑定实际上是学习的线性注意力,而非记忆,提出简化架构、并行计算和统一模型形式的改进方法。

Comments ICML 2026, Webpage: https://research.nvidia.com/labs/sil/projects/tttla/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03548 2026-05-14 cs.CV cs.AI

Unmasking Puppeteers: Leveraging Biometric Leakage to Expose Impersonation in AI-Based Videoconferencing

揭示操控者:利用生物特征泄露来揭露AI视频会议中的冒充行为

Danial Samadi Vahdati, Tai Duc Nguyen, Ekta Prashnani, Koki Nagano, David Luebke, Orazio Gallo, Matthew Stamm

机构 * Drexel University(德雷克斯el大学) NVIDIA

AI总结 本文提出一种基于姿态-表情潜在特征的对比编码器,通过分离持久身份线索来检测视频会议中的身份冒充行为,实验表明其在实时检测中性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏