arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Tencent(腾讯)

2026-07-27 至 2026-07-27 共收录 2
2506.13553 2026-07-27 cs.CV 版本更新

Geometry-Guided Representations for Coherent Lane and Traffic Topology Reasoning in Driving Scenes

用于驾驶场景中连贯车道和交通拓扑推理的几何引导表示

Yueru Luo, Changqing Zhou, Yiming Yang, Erlong Li, Chao Zheng, Shuguang Cui, Zhen Li

机构 * FNii SSE, CUHK-Shenzhen HKUST-Guangzhou(HKUST-广州) Tencent Map T-Lab(腾讯地图T实验室)

AI总结 研究自动驾驶中道路拓扑推理问题,提出CoPo统一框架,通过整合感知层、推理层和监督层的几何引导关系建模,实现感知与推理的端到端联合优化,实验证明该方法在多个指标上优于现有方法。

Comments KDD2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08797 2026-07-27 cs.CV 版本更新

HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation

混元视频-HOMA:多模态驱动人体动画中的通用人机交互

Ziyao Huang, Zixiang Zhou, Juan Cao, Yifeng Ma, Yi Chen, Zejing Rao, Zhiyong Xu, Hongmei Wang, Qin Lin, Yuan Zhou, Qinglin Lu, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯混元)

AI总结 针对人体-物体交互视频生成的局限,提出混元视频-HOMA弱条件多模态驱动框架,通过稀疏解耦运动引导等方法,将外观和运动信号编码融合,经优化训练,在弱监督下性能达先进水平,还具文本生成和物体操纵通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏