arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2026-01-08 至 2026-01-08 共收录 7
2601.04137 2026-01-08 cs.RO cs.AI cs.CV

Wow, wo, val! A Comprehensive Embodied World Model Evaluation Turing Test

哇,哇,val!一个综合的具身世界模型评估图灵测试

Chun-Kai Fan, Xiaowei Chi, Xiaozhu Ju, Hao Li, Yong Bao, Yu-Kai Wang, Lizhang Chen, Zhiyuan Jiang, Kuangzhi Ge, Ying Li, Weishi Mi, Qingpo Wuwu, Peidong Jia, Yulin Luo, Kevin Zhang, Zhiyuan Qin, Yong Dai, Sirui Han, Yike Guo, Shanghang Zhang, Jian Tang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) Beijing Innovation Center of Humanoid Robotics(人形机器人创新中心) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出Wow-wo-val基准测试,评估视频基础模型在具身人工智能中的生成能力,发现其在长期规划和物理一致性上表现有限,揭示了现实世界与生成视频之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07332 2026-01-08 cs.MA cs.RO

The Combined Problem of Online Task Assignment and Lifelong Path Finding in Logistics Warehouses: Rule-Based Systems Matter

物流仓库中在线任务分配与终身路径寻找的联合问题:基于规则的系统至关重要

Fengming Zhu, Weijia Xu, Yifei Guo, Fangzhen Lin

机构 * Hong Kong University of Science and Technology(香港科技大学) Meituan Academy of Robotics Shenzhen(美团机器人研究院(深圳))

AI总结 本文提出了一种基于规则的系统,用于解决物流仓库中的在线任务分配与终身路径寻找问题,通过提高效率和经济性,展示了其在实际应用中的优势。

Comments In Proceedings ICLP 2025, arXiv:2601.00047

Journal ref EPTCS 439, 2026, pp. 167-187

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01045 2026-01-08 cs.CV cs.GR

WonderHuman: Hallucinating Unseen Parts in Dynamic 3D Human Reconstruction

WonderHuman: 在动态3D人体重建中生成未见部分

Zilong Wang, Zhiyang Dou, Yuan Liu, Cheng Lin, Xiao Dong, Yunhui Guo, Chenxu Zhang, Xin Li, Wenping Wang, Xiaohu Guo

机构 * Department of Computer Science, The University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Computer Graphics Group, The University of Hong Kong(香港大学计算机图形组) School of Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学工程学院) Guangdong Provincial/Zhuhai Key Laboratory of IRADS, Beijing Normal-Hong Kong Baptist University(广东/珠海IRADS重点实验室,北京师范大学-香港 Baptist大学) Department of Computer Science & Engineering, Texas A&M University(德克萨斯A&M大学计算机科学与工程系)

AI总结 WonderHuman通过双空间优化和分数蒸馏采样技术,从单目视频实现高保真动态人体重建,尤其擅长生成未见人体部分。

Journal ref IEEE Transactions on Visualization and Computer Graphics, vol. 31, no. 12, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03717 2026-01-08 cs.CL

MIND: From Passive Mimicry to Active Reasoning through Capability-Aware Multi-Perspective CoT Distillation

MIND:通过能力感知的多视角CoT蒸馏从被动模仿到主动推理

Jin Cui, Jiaqi Guo, Jiepeng Zhou, Ruixuan Yang, Jiayi Lu, Jiajun Xu, Jiangcheng Song, Boran Zhao, Pengju Ren

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, and Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究所) Nankai University(南开大学) The Hong Kong University of Science and Technology(Guangzhou)(香港科技大学(广州)) School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院)

AI总结 MIND通过能力感知的多视角CoT蒸馏,从被动模仿转向主动推理,提升模型在分布内和分布外任务中的性能。

Comments 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03655 2026-01-08 cs.CV

VideoMemory: Toward Consistent Video Generation via Memory Integration

VideoMemory: 通过记忆整合实现一致的视频生成

Jinsong Zhou, Yihua Du, Xinli Xu, Luozhou Wang, Zijie Zhuang, Yehang Zhang, Shuaibo Li, Xiaojun Hu, Bolan Su, Ying-cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) ByteDance(字节跳动)

AI总结 VideoMemory通过动态记忆库整合叙事规划与视觉生成,实现多镜头中角色、道具和环境的一致性生成。

Comments Project page: https://hit-perfect.github.io/VideoMemory/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03542 2026-01-08 cs.CL cs.AI

Layer-Order Inversion: Rethinking Latent Multi-Hop Reasoning in Large Language Models

层序倒置:重新思考大语言模型中的潜在多跳推理

Xukai Liu, Ye Liu, Jipeng Zhang, Yanghai Zhang, Kai Zhang, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出"层序倒置"现象,通过概率性回忆与提取框架解释大语言模型中多跳推理的机制,揭示了层序倒置与总跳步数的关系,并提供了多跳失败的诊断方法。

Comments 16 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20278 2026-01-08 cs.CL

Quantifying LLM Biases Across Instruction Boundary in Mixed Question Forms

量化混合问题形式中跨指令边界的LLM偏见

Zipeng Ling, Shuliang Liu, Yuehao Tang, Chen Huang, Gaoyang Jiang, Shenghong Fu, Junqi Yang, Yao Wan, Jiawan Zhang, Kejia Huang, Xuming Hu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Pennsylvania(宾夕法尼亚大学) Huazhong University of Science and Technology(华中科技大学) Hong Kong Polytechnic University(香港理工大学) Nanjing University of Posts and Telecommunications(南京邮电大学)

AI总结 本文提出BiasDetector基准,用于评估LLM在混合问题形式数据集下对稀疏标签混合的识别能力,揭示用户指令对LLM偏见的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏