arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

NVIDIA(英伟达)

2026-07-10 至 2026-07-10 共收录 8
2607.08741 2026-07-10 cs.GR cs.CV cs.LG cs.RO 新提交

ARDY: Autoregressive Diffusion with Hybrid Representation for Interactive Human Motion Generation

ARDY:用于交互式人体运动生成的具有混合表示的自回归扩散

Kaifeng Zhao, Mathis Petrovich, Haotian Zhang, Tingwu Wang, Siyu Tang, Davis Rempe

机构 * NVIDIA(英伟达) ETH Zürich(苏黎世联邦理工学院)

AI总结 研究旨在解决交互式应用中人体运动生成问题,提出ARDY框架,采用混合表示和两阶段自回归变压器去噪器,能通过在线文本提示和运动学约束实现高保真运动生成,经评估验证了有效性和实用性。

Comments ACM Transactions on Graphics (SIGGRAPH 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08284 2026-07-10 cs.AI 新提交

Understanding Axes of Difficulty For Long Context Tasks Via PredicateLongBench

通过PredicateLongBench理解长上下文任务的难度轴

Siddhartha Jain, Ameya Velingker

机构 * NVIDIA

AI总结 研究针对大语言模型长上下文能力评估不足,提出PredicateLongBench基准,通过识别满足谓词的最长连续子序列压力测试长上下文推理,探索多个难度轴,用两种生成管道实验,发现前沿模型在难度提升时表现不佳,助于理解能力局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08162 2026-07-10 cs.CV cs.AI cs.LG 新提交

ProsMAE: Multi-Source MAE Pretraining for ISUP Grade Classification

ProsMAE:用于ISUP分级分类的多源MAE预训练

Anna Jung, Kyeonghun Kim, Youngung Han, Eunseob Choi, Jiwon Yang, Ken Ying-Kai Liao, Hyuk-Jae Lee, Nam-Joon Kim

机构 * Seoul National University(首尔国立大学) GIST(韩国科学技术院) NVIDIA(英伟达)

AI总结 针对全切片图像模型训练难题,提出多源MAE框架ProsMAE,利用多数据集切片预训练编码器,通过ProsCLS用于ISUP分级分类,在不相交PANDA分割下比普通MAE冻结线性探针基线有更高QWK。

Comments Accepted to APCCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08152 2026-07-10 cs.CL cs.AI cs.HC cs.LG 新提交

LEXIC: Lightweight Eye-tracking eXtension via Injected Complexity

LEXIC:通过注入复杂度实现轻量级眼动追踪扩展

Sumin Lee, Kyeonghun Kim, Subeen Lee, Jiwon Yang, Tien Nguyen, Ken Ying-Kai Liao, Nam-Joon Kim

机构 * Seoul National University(首尔国立大学) NVIDIA(英伟达)

AI总结 研究从眼动预测阅读理解中仅注视模型的提升,基于LEXIC-Base提出两种机制注入难度信号,在一站式阅读理解任务中实验,两种机制使未见文本AUROC增益,LEXIC-Concat提升未见读者表现,LEXIC-Res存在架构边界问题。

Comments Accepted to APCCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11408 2026-07-10 cs.RO 新提交

Dynamic Execution Horizon Prediction for Chunk-based Robot Policies

基于分块的机器人策略的动态执行视界预测

Yuchi Zhao, Miroslav Bogdanovic, Arjun Sohal, Liyu Tao, Kourosh Darvish, Alán Aspuru-Guzik, Florian Shkurti, Animesh Garg

机构 * University of Toronto(多伦多大学) Vector Institute for Artificial Intelligence(向量人工智能研究所) Acceleration Consortium(加速联盟) Canadian Institute for Advanced Research (CIFAR)(加拿大高等研究院) Georgia Institute of Technology(佐治亚理工学院) NVIDIA(英伟达)

AI总结 提出DEHP方法,通过在线强化学习训练轻量级执行视界预测分支,在冻结预训练分块策略的情况下动态调整执行步数,显著提升高精度和长时域操作任务的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21917 2026-07-10 cs.CV cs.AI 版本更新

MAVEN: A Multi-stage Agentic Annotation Pipeline for Video Reasoning Tasks

MAVEN:一种多阶段代理标注管道用于视频推理任务

Han Zhang, Wanting Jiang, Tomasz Kornuta, Tian Zheng, Vidya Murali

机构 * NVIDIA

AI总结 本文提出MAVEN,一种多阶段代理标注管道,通过链式推理轨迹生成多任务训练数据,用于视频事件推理任务,核心方法是多尺度时空事件描述,支持代理驱动的领域适应,通过分层细化循环改进数据质量,并在多个数据集上验证了其有效性。

Comments CVPR 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01204 2026-07-10 cs.CV cs.AI cs.GR cs.LG 版本更新

Neural Harmonic Textures for High-Quality Primitive Based Neural Reconstruction

基于神经谐波纹理的高质量基于原始体的神经重建

Jorge Condor, Nicolas Moenne-Loccoz, Merlin Nimier-David, Piotr Didyk, Zan Gojcic, Qi Wu

机构 * NVIDIA(英伟达) Università della Svizzera italiana(瑞士意大利语区大学)

AI总结 本文提出神经谐波纹理,通过虚拟框架锚定潜在特征向量,实现高效实时视图合成,融合原始体与神经场方法,提升高频细节建模能力。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13632 2026-07-10 cs.CV cs.LG eess.IV 版本更新

Data Alchemy: Mitigating Cross-Site Model Variability Through Test Time Data Calibration

数据炼金术:通过测试时数据校准减轻跨站点模型变异性

Abhijeet Parida, Antonia Alomar, Zhifan Jiang, Pooneh Roshanitabrizi, Austin Tapp, Maria Ledesma-Carbayo, Ziyue Xu, Syed Muhammed Anwar, Marius George Linguraru, Holger R. Roth

机构 * Children’s National Hospital, Washington, DC, USA(儿童医院国家医院) Universidad Politécnica de Madrid, Madrid, Spain(马德里理工大学) Universitat Pompeu Fabra, Barcelona, Spain(庞培法布拉大学) Nvidia Corporation, Santa Clara, CA, USA(英伟达公司) George Washington University, Washington, DC, USA(乔治华盛顿大学)

AI总结 研究针对跨临床站点部署深度学习成像工具的挑战,提出数据炼金术方法,结合可解释染色归一化与测试时数据校准及模板学习框架,提升肿瘤分类性能,缩小多站点分类域差距,助力精准医学推广。

Comments accepted to Machine Learning in Medical Imaging (MLMI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏