arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2025-12-18 至 2025-12-18 共收录 6
2512.15716 2025-12-18 cs.CV cs.AI

Spatia: Video Generation with Updatable Spatial Memory

基于可更新空间记忆的视频生成

Jinjing Zhao, Fangyun Wei, Zhening Liu, Hongyang Zhang, Chang Xu, Yan Lu

机构 * The University of Sydney(悉尼大学) Microsoft Research(微软研究院) HKUST(香港科技大学) University of Waterloo(滑铁卢大学)

AI总结 Spatia通过可更新的空间记忆机制,实现视频生成中的长期空间与时间一致性,支持动态实体生成和3D交互编辑。

Comments Project page: https://zhaojingjing713.github.io/Spatia/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15603 2025-12-18 cs.CV

Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition

Qwen-Image-Layered: 通过层分解实现内在可编辑性

Shengming Yin, Zekai Zhang, Zecheng Tang, Kaiyuan Gao, Xiao Xu, Kun Yan, Jiahao Li, Yilei Chen, Yuxiang Chen, Heung-Yeung Shum, Lionel M. Ni, Jingren Zhou, Junyang Lin, Chenfei Wu

机构 * HKUST(GZ)(香港科技大学(广州)) Alibaba(阿里巴巴)

AI总结 Qwen-Image-Layered通过层分解实现图像的内在可编辑性,提出端到端扩散模型及多阶段训练策略,提升图像分解质量与编辑一致性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15601 2025-12-18 cs.CL

You Never Know a Person, You Only Know Their Defenses: Detecting Levels of Psychological Defense Mechanisms in Supportive Conversations

你无法了解一个人,你只能了解他们的防御:在支持性对话中检测心理防御机制的层次

Hongbin Na, Zimu Wang, Zhaoming Chen, Peilin Zhou, Yining Hua, Grace Ziqi Zhou, Haiyang Zhang, Tao Shen, Wei Wang, John Torous, Shaoxiong Ji, Ling Chen

机构 * University of Technology Sydney(悉尼技术大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Utah(犹他大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harvard University(哈佛大学) The University of Sydney(悉尼大学) ELLIS Institute Finland(芬兰ELLIS研究所) University of Turku(图尔库大学)

AI总结 本文提出PsyDefConv语料库和DMRS Co-Pilot流程,用于检测支持性对话中心理防御机制的层次,通过标注和实验验证其有效性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15047 2025-12-18 cs.RO cs.AI cs.CL cs.CV

HERO: Hierarchical Traversable 3D Scene Graphs for Embodied Navigation Among Movable Obstacles

HERO:用于在可移动障碍物间进行具身导航的分层可通行3D场景图

Yunheng Wang, Yixiao Feng, Yuetong Fang, Shuning Zhang, Tan Jing, Jian Li, Xiangrui Jiang, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 HERO通过构建分层可通行3D场景图,重新定义可通行性以提升在复杂环境中的导航效率和可达性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15742 2025-12-18 cs.CV

Scaling Instruction-Based Video Editing with a High-Quality Synthetic Dataset

通过高质量合成数据集扩展基于指令的视频编辑

Qingyan Bai, Qiuyu Wang, Hao Ouyang, Yue Yu, Hanlin Wang, Wen Wang, Ka Leong Cheng, Shuailei Ma, Yanhong Zeng, Zichen Liu, Yinghao Xu, Yujun Shen, Qifeng Chen

机构 * HKUST(香港科技大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Northeastern University(东北大学)

AI总结 Ditto通过高效数据生成管道和智能代理,构建大规模高质量数据集,提升基于指令的视频编辑性能。

Comments Project page: https://ezioby.github.io/Ditto_page Code: https://github.com/EzioBy/Ditto

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23049 2025-12-18 cs.LG cs.CL

DenoiseRotator: Enhance Pruning Robustness for LLMs via Importance Concentration

DenoiseRotator: 通过重要性集中增强大语言模型的剪枝鲁棒性

Tianteng Gu, Bei Liu, Bo Xiao, Ke Zeng, Jiacheng Liu, Yanmin Qian

机构 * Shanghai Jiao Tong University(上海交通大学) HKUST(香港科技大学) Meituan(美团)

AI总结 DenoiseRotator通过重要性集中提升大语言模型剪枝鲁棒性,采用可学习正交变换优化参数重要性分布,有效减少稀疏性约束下的性能下降。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏