arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

NVIDIA(英伟达)

2026-03-02 至 2026-03-02 共收录 3
2602.24245 2026-03-02 cs.LG

Chunk-wise Attention Transducers for Fast and Accurate Streaming Speech-to-Text

分块注意力转录机:用于快速准确的流式语音到文本

Hainan Xu, Vladimir Bataev, Travis M. Bartley, Jagadeesh Balam

机构 * NVIDIA Corporation(英伟达公司)

AI总结 CHAT通过分块注意力机制提升流式语音处理效率与准确性,实现内存、训练和推断速度的显著提升,并在多语言任务中展现更优性能。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24156 2026-03-02 cs.RO

Humanoid Robots as First Assistants in Endoscopic Surgery

人形机器人作为内窥手术中的第一助手

Sue Min Cho, Jan Emily Mangulabnan, Han Zhang, Zhekai Mao, Yufan He, Pengfei Guo, Daguang Xu, Gregory Hager, Masaru Ishii, Mathias Unberath

机构 * Johns Hopkins University(约翰霍普金斯大学) Johns Hopkins Medical Institutions(约翰霍普金斯医学院) NVIDIA Corporation(NVIDIA公司)

AI总结 本文展示了一人形机器人通过遥控协助完成尸体内窥手术,验证了其在手术辅助中的可行性并指出了后续发展的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24014 2026-03-02 cs.CV cs.AI

Interpretable Debiasing of Vision-Language Models for Social Fairness

可解释的视觉-语言模型社会公平性偏见消除

Na Min An, Yoonna Jang, Yusuke Hirota, Ryo Hachiuma, Isabelle Augenstein, Hyunjung Shim

机构 * KAIST AI(韩国科学技术院人工智能研究所) University of Copenhagen(哥本哈根大学) NVIDIA(英伟达公司)

AI总结 本研究提出DeBiasLens框架,通过稀疏自编码器局部化VLM中的社会属性神经元,以可解释的方式消除模型中的社会偏见,同时保持语义知识。

Comments 25 pages, 30 figures, 13 Tables Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏