arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2026-08-28 至 2026-08-28 共收录 11
2608.27286 2026-08-28 cs.LG 新提交

MM-Spectrum: Multimodal Multi-spectral Molecular Structural Elucidation with a Stable MoE Framework

MM-Spectrum:基于稳定MoE框架的多模态多光谱分子结构解析

Hai-tao Yu, Nan Min, Zheng Fang, Hongyu Zhan, Yusen Tan, Yuhan Wang, Jun Xia

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Southeast University(东南大学) Fudan University(复旦大学)

AI总结 针对多光谱序列直接连接的性能下降问题,提出MM-Spectrum稳定MoE框架,引入模态感知路由与异质专家,在分子结构解析的多模态设置下取得显著改进。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27265 2026-08-28 cs.CL 新提交

SCIT: Testing Causal Cache Carriers in Latent Chain-of-Thought Models

SCIT:测试潜在思维链模型中的因果缓存载体

Yi Ding, Lijun Huang, Menglin Yang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本研究提出SCIT因果协议,测试潜在思维链模型的缓存载体,发现反事实算术主要通过值缓存后缀轨迹传递,且载体机制随模型规模和类型存在差异。

Comments accept by emnlp2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27233 2026-08-28 cs.LG 新提交

HALO: A Heterogeneity-Aware Language-Aligned IMU Foundation Model for Open-Set Human Activity Recognition

HALO:一种用于开放集人体活动识别的异构性感知语言对齐IMU基础模型

Zihan Ding, Liyu Zhang, Xiaomin Ouyang

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 提出HALO异构性感知语言对齐IMU基础模型,通过两阶段训练解决HAR的异构性与泛化问题,在多数据集上优于基线,零样本准确率提升13.7个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27181 2026-08-28 cs.CV 新提交

SSMB: Self-Supervised Local Feature Detection under Motion Blur

SSMB:运动模糊下的自监督局部特征检测

Zhenjun Zhao, Fabio Bellavia, Wenting Wang, Fan Zhu, Jiajun Wu, Suryansh Kumar, Mingqiang Wei, Haoang Li, Javier Civera

机构 * University of Zaragoza(萨拉戈萨大学) University of Palermo(巴勒莫大学) The Chinese University of Hong Kong(香港中文大学) Tohoku University(东北大学) Central South University(中南大学) Texas A&M University(德克萨斯农工大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 针对运动模糊下关键点检测的挑战,提出无去模糊的自监督关键点检测器SSMB,通过LDE模块及两阶段训练实现,在多项任务上优于现有基线,达到稀疏关键点检测的新最优性能。

Comments 20 pages, 11 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27128 2026-08-28 cs.CL 新提交

TwinKV: A Composable Repair Pass for KV Cache Eviction via Pairwise Key Redundancy

TwinKV:一种通过成对键冗余实现KV缓存驱逐的可组合修复通路

Hong Chen, Yudong Zeng, Yongwei Huang, Zuhao Ouyang, Junyan Zhang, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Bosum Institute of Management Science(博深管理科学研究院)

AI总结 TwinKV是一种无训练、无注意力的KV缓存可组合修复通路,通过识别上下文键的近重复项交换冗余供体与孤儿令牌,在多个长上下文基准上提升了多数驱逐策略的性能,但对少样本分类任务无帮助。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27127 2026-08-28 cs.AI 新提交

TransMeme: A Multi-Agent Framework for Cross-Cultural Meme Transcreation

TransMeme:用于跨文化梗图再创作的多智能体框架

Jingyi Zheng, Yule Liu, Zifan Peng, Tianyi Hu, Yuemeng Zhao, Xinhu Zheng, Xinlei He

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Wuhan University(武汉大学) Aarhus University(奥胡斯大学)

AI总结 本研究针对跨文化梗图再创作的三大核心挑战,提出多智能体框架TransMeme,经中英双向梗图再创作的人工评估与LLM评判,性能优于所有基线,为该领域未来幽默迁移研究指明方向。

Comments 10 pages, 4 figures. Accepted at the 34th ACM International Conference on Multimedia (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27073 2026-08-28 cs.CV cs.RO 新提交

SpatialCrafter: Single Image World Modeling with Generative 3D Proxies

SpatialCrafter:基于生成式3D代理的单图像世界建模

Chuan Fang, Lingteng Qiu, Yixun Liang, Rui Chen, Kunming Luo, Zhaohua Zheng, Tongyuan Bai, Feipeng Tian, Zilong Dong, Zihan Zhou, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) ManyCore Tech Inc.(ManyCore科技公司) Jilin University(吉林大学)

AI总结 SpatialCrafter是解决图像到场景生成问题的两阶段框架,通过3D代理及相关策略提升3D一致性,构建了115K场景的新数据集,性能优于现有方法且鲁棒性强。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27070 2026-08-28 cs.LG cs.CL 新提交

Unifying Detection and Adaptation in Task-Free Continual Learning

统一无任务持续学习中的检测与适配

Dezheng Han, Anbang Zhang, Zhihao Zhu, Shuaishuai Guo

机构 * School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) The Hong Kong University of Science and Technology(香港科技大学) Shandong University(山东大学) Qilu Hospital of Shandong University(山东大学齐鲁医院)

AI总结 本文提出FiUni框架,通过K-FAC近似的Fisher主子空间正交性检测批量级任务,结合LoRA实现参数高效适配,动态平衡知识共享与任务隔离,缓解LLM持续学习的灾难性遗忘,性能优于先进方法且参数更少。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26821 2026-08-28 cs.RO 新提交

TemporalFlow-VLA: Learning Physically Grounded Execution History for Long-Horizon Robot Manipulation

TemporalFlow-VLA:学习基于物理基础的执行历史以实现长 horizon 机器人操作

Jiarui Yang, Yehao Lu, Yuning Su, Yu Zhong, Yufeng Xie, Yazhou Zhang, Haiyu Lan, Kaixiang Lu, Peiwen Lin, Chuang Wang, Junwei Liang, Enyu Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zhejiang University(浙江大学) Simon Fraser University(西蒙菲莎大学) AgiBot(云圣智能科技(上海)有限公司)

AI总结 TemporalFlow-VLA 针对长 horizon 机器人操作中视觉相似状态需不同动作的问题,通过物理监督学习紧凑执行历史,在 LIBERO、RoboTwin 等任务上取得优异性能,且部署无额外开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26583 2026-08-28 cs.RO 新提交

SOLO: Stable Omni-terrain Long-Horizon Perceptive Humanoid Locomotion

SOLO:稳定全地形长视距感知类人机器人运动

Pihai Sun, Gang Han, Jingkai Sun, Jiahao Ma, Zeran Su, Zelin Tao, Peiran Liu, Shuai Shi, Wei Cui, Zifan Wang, Jialin Yu, Wen Zhao, Kangning Yin, Jiaxu Wang, Jiahang Cao, Lingfeng Zhang, Hao Cheng, Jian Tang, Yijie Guo, Qiang Zhang

机构 * Artificial General Intelligence Institute, University of Science and Technology of China(中国科学技术大学通用人工智能研究院) X-Humanoid(X-人形机器人) The University of Hong Kong(香港大学) The Australian National University(澳大利亚国立大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学)

AI总结 SOLO是解决长视距类人机器人运动脆弱性的统一框架,通过QR与TA-MSE蒸馏提升地形感知与策略学习,仿真及实际测试中通行成功率显著优于基线方法,可零样本完成长距离复杂地形任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26355 2026-08-28 cs.CV cs.LG 新提交

Finding the Right Evidence: Factor-Guided Coarse-to-Fine Reasoning for Long Videos

寻找合适的证据:因子引导的长视频由粗到细推理

Baixuan Xu, Yinyui Xu, Tianshi Zheng, Zhaowei Wang, Weiqi Wang, Haochen Shi, Jiayu Liu, Qing Zong, Xiyu Ren, Xinyu Geng, Zhitao He, Yangqiu Song

机构 * Department of Computer Science and Engineering, HKUST(香港科技大学计算机科学与工程学系)

AI总结 针对长视频问答的证据稀疏、选项区分困难问题,提出因子引导的PACE框架,经实验在多基准数据集上优于现有方法,实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏