arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-08-05 至 2026-08-05 共收录 3
2605.22882 2026-08-05 cs.CV cs.RO 版本更新

GEM-4D: Geometry-Enhanced Video World Models for Robot Manipulation

GEM-4D:用于机器人操作的几何增强视频世界模型

Kaichen Zhou, Yuzhen Chen, Fangneng Zhan, Hang Hua, Grace Chen, Xinhai Chang, Ao Qu, Yilun Du, Zhuang Liu, Paul Pu Liang, Mengyu Wang

机构 * Harvard AI and Robotics Lab(哈佛人工智能与机器人实验室) Harvard University(哈佛大学) Media Lab and EECS(媒体实验室和电子工程与计算机科学系) MIT(麻省理工学院) Princeton University(普林斯顿大学) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)

AI总结 提出GEM-4D,通过注入从预训练几何基础模型蒸馏的密集4D对应监督,增强视频世界模型的几何一致性,并引入逆动力学模块将视频滚动转换为可执行机器人轨迹,提升操作成功率。

Comments Robotic World Model, Video Generative Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24929 2026-08-05 cs.AI cs.CL cs.IT math.IT 版本更新

LogitScope: A Framework for Analyzing LLM Uncertainty Through Information Metrics

LogitScope:通过信息度量分析大语言模型不确定性框架

Farhan Ahmed, Yuya Jeremy Ong, Chad DeLuca

机构 * IBM Research(IBM研究院) Plastic Labs

AI总结 LogitScope通过计算概率分布中的信息度量,分析大语言模型生成过程中的不确定性,揭示模型置信度模式,识别潜在幻觉并暴露高不确定决策点,无需标注数据或语义解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09445 2026-08-05 cs.CL cs.AI 版本更新

Where Knowledge Collides: A Mechanistic Study of Intra-Memory Knowledge Conflict in Language Models

知识碰撞之处:语言模型中内存知识冲突的机理研究

Minh Vu Pham, Hsuvas Borkakoty, Yufang Hou

机构 * IT:U Austria(因特大学奥地利分校) IBM Research(IBM研究院)

AI总结 本研究通过机理可解释性方法揭示语言模型中预训练数据冲突知识的编码位置,探讨冲突知识在模型内部的存储机制及干预方法。

详情

展开后加载摘要…

URL PDF HTML 收藏