Video Depth Propagation
视频深度传播
机构 * ETH Zürich(苏黎世联邦理工学院) ; Toyota Motor Europe(丰田欧洲公司) ; INSAIT, Sofia University St. Kliment Ohridski(索菲亚大学圣克莱门特·奥赫里德斯学院)
AI总结 VeloDepth通过引入传播模块和结构化时间一致性设计,实现了高效且稳健的视频深度估计,提供更准确且快速的实时深度解决方案。
高校专区
视频深度传播
机构 * ETH Zürich(苏黎世联邦理工学院) ; Toyota Motor Europe(丰田欧洲公司) ; INSAIT, Sofia University St. Kliment Ohridski(索菲亚大学圣克莱门特·奥赫里德斯学院)
AI总结 VeloDepth通过引入传播模块和结构化时间一致性设计,实现了高效且稳健的视频深度估计,提供更准确且快速的实时深度解决方案。
通过强化学习增强放射学报告生成和视觉基础识别
机构 * University of Zurich(苏黎世大学) ; ETH Zurich(苏黎世联邦理工学院) ; Zurich University of Applied Sciences(苏黎世应用科学大学)
AI总结 本研究通过强化学习和思考机制提升放射学报告生成和视觉基础识别的性能,展示了在医学VLMs中RL作为SFT的有效补充。
Comments 10 pages main text (3 figures, 3 tables), 31 pages in total
点wise互信息作为检索增强生成的性能评估指标
机构 * ETH Zürich(苏黎世联邦理工学院) ; CLCG, University of Groningen(格罗宁根大学认知语言学中心) ; University of Toronto(多伦多大学)
AI总结 本文提出利用点wise互信息作为检索增强生成的性能评估指标,通过实验验证其在提升生成性能中的有效性。
Comments NAACL 2025 Main Conference. Code is available at https://github.com/lyutyuh/poptimizer