arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

2026-01-29 至 2026-01-29 共收录 10
2601.20575 2026-01-29 eess.IV cs.CV

SegRap2025: A Benchmark of Gross Tumor Volume and Lymph Node Clinical Target Volume Segmentation for Radiotherapy Planning of Nasopharyngeal Carcinoma

SegRap2025:鼻咽癌放疗计划中GTV和淋巴结临床靶区体积分割的基准测试

Jia Fu, Litingyu Wang, He Li, Zihao Luo, Huamin Wang, Chenyuan Bian, Zijun Gao, Chunbin Gu, Xin Weng, Jianghao Wu, Yicheng Wu, Jin Ye, Linhao Li, Yiwen Ye, Yong Xia, Elias Tappeiner, Fei He, Abdul qayyum, Moona Mazher, Steven A Niederer, Junqiang Chen, Chuanyi Huang, Lisheng Wang, Zhaohu Xing, Hongqiu Wang, Lei Zhu, Shichuan Zhang, Shaoting Zhang, Wenjun Liao, Guotai Wang

机构 * School of Mechanical and Electrical Engineering, University of Electronic Science and Technology of China(电子科技大学机械与电子工程学院) Department of Radiation Oncology, Sichuan Cancer Center, Radiation Oncology Key Laboratory of Sichuan Province, Sichuan Clinical Research Center for Cancer, Sichuan Cancer Hospital and Institute, University of Electronic Science and Technology of China(四川省肿瘤医院放射肿瘤科) Shanghai AI Lab, Shanghai, China(上海人工智能实验室) The Affiliated Hospital of Qingdao University, Qingdao, China(青岛大学附属医院) Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China(香港中文大学计算机科学与工程系) Faculty of Information Technology, Monash University, Melbourne, Australia(墨尔本大学信息科技学院) Department of Computing and Department of Brain Sciences, Imperial College London, United Kingdom(伦敦帝国理工学院计算机系和脑科学系) School of Computer Science and Engineering, Northwestern Polytechnical University, Xi'an, China(西北工业大学计算机科学与工程学院) UMIT Tirol - Private University for Health Sciences and Health Technology, Austria(蒂罗尔大学(私人健康科学与健康技术大学)) School of Information and Communication Engineering, University of Electronic Science and Technology of China(电子科技大学信息与通信工程学院) National Heart and Lung Institute, Imperial College London, London, United Kingdom(伦敦帝国理工学院国家心脏和肺研究所) Hawkes Institute, Department of Computer Science, University College London, London, United Kingdom(伦敦大学学院霍克斯研究所) Shanghai MediWorks Precision Instruments Co., Ltd., China(上海 MediWorks 精密仪器有限公司) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(上海交通大学自动化与智能感知学院) Department of Systems Hub, Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China(香港科技大学(广州)系统中心)

AI总结 SegRap2025旨在通过多中心、多模态的基准测试提升鼻咽癌放疗计划中GTV和LN CTV分割的通用性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20326 2026-01-29 cs.CL cs.AI cs.LG

Beyond Speedup -- Utilizing KV Cache for Sampling and Reasoning

超越加速 -- 利用KV缓存进行采样与推理

Zeyu Xing, Xing Li, Hui-Ling Zhen, Mingxuan Yuan, Sinno Jialin Pan

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 本文提出将KV缓存作为轻量级表示用于采样与推理,展示了其在链式嵌入和快速/缓慢思考切换任务中的有效性,显著提升了推理效率。

Comments Accepted by ICLR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20300 2026-01-29 cs.CL eess.AS

MiLorE-SSL: Scaling Multilingual Capabilities in Self-Supervised Models without Forgetting

MiLorE-SSL: 在不遗忘的前提下扩展多语言能力的自监督模型

Jing Xu, Minglin Wu, Xueyuan Chen, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 MiLorE-SSL通过结合LoRA和软MoE机制,实现高效多语言自监督学习,有效缓解遗忘问题,仅用2.14%参数在新语言上取得优异表现。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18631 2026-01-29 cs.AI cs.CL cs.CV cs.MA

AdaReasoner: Dynamic Tool Orchestration for Iterative Visual Reasoning

AdaReasoner: 多步骤视觉推理中的动态工具协调

Mingyang Song, Haoyu Sun, Jiawei Gu, Linjie Li, Luxin Xu, Ranjay Krishna, Yu Cheng

机构 * Fudan University(复旦大学) Tongji University(同济大学) National University of Singapore(新加坡国立大学) University of Washington(华盛顿大学) University of Electronic Science and Technology of China(电子科技大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 AdaReasoner通过动态工具协调提升多模态模型的视觉推理能力,实现工具自适应和泛化,超越现有系统性能。

Comments 28 pages, 10 figures and 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08430 2026-01-29 cs.AI

RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation

RubricHub: 通过自动化粗到细生成构建一个全面且高度判别性的评分标准数据集

Sunzhu Li, Jiale Zhao, Miteto Wei, Huimin Ren, Yang Zhou, Jingwen Yang, Shunyu Liu, Kaike Zhang, Wei Chen

机构 * Li Auto Inc. Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳))

AI总结 RubricHub通过自动化粗到细生成方法构建了一个大规模多领域评分标准数据集,通过后训练流程显著提升了模型在HealthBench上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18206 2026-01-29 eess.AS cs.SD eess.SP

Adaptive Per-Channel Energy Normalization Front-end for Robust Audio Signal Processing

自适应通道能量归一化前端用于鲁棒音频信号处理

Hanyu Meng, Vidhyasaharan Sethu, Eliathamby Ambikairajah, Qiquan Zhang, Haizhou Li

机构 * The University of New South Wales, Sydney, Australia(新南威尔士大学) Tongyi Speech Lab, Alibaba Group, China(通义语音实验室) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院)

AI总结 本文提出了一种自适应通道能量归一化前端,通过闭环神经控制器提升音频信号处理的鲁棒性与适应性。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16922 2026-01-29 cs.CV

MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual Recognition

MSPCaps: 一种具有跨共识路由的多尺度补丁化胶囊网络用于视觉识别

Yudong Hu, Yueju Han, Rui Sun, Jinke Ren

机构 * CUHK-Shenzhen(香港中文大学(深圳))

AI总结 MSPCaps通过多尺度特征学习和跨共识路由提升视觉识别性能,实现高效且鲁棒的特征表示学习。

Comments 9 pages, 4 figures; Code is available at https://github.com/abdn-hyd/MSPCaps

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13332 2026-01-29 cs.CL

The Imitation Game: Turing Machine Imitator is Length Generalizable Reasoner

模仿游戏:图灵机模仿器是长度可推广的推理机

Zhouqi Hua, Wenwei Zhang, Chengqi Lyu, Yuzhe Gu, Songyang Gao, Kuikun Liu, Dahua Lin, Kai Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 本文提出TAIL方法,通过合成图灵机执行过程的链式思维数据,提升LLM的长度泛化能力,超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04207 2026-01-29 cs.LG cs.AI cs.CL cs.CV

Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning

推动多模态推理:从优化冷启动到分阶段强化学习

Shuang Chen, Yue Guo, Zhaochen Su, Yafu Li, Yulun Wu, Jiacheng Chen, Jiayu Chen, Weijie Wang, Xiaoye Qu, Yu Cheng

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Soochow University(苏州大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出ReVisual-R1,通过优化冷启动和分阶段强化学习提升多模态推理能力,在多个挑战性基准测试中取得新突破。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01256 2026-01-29 cs.CV cs.LG

NLPrompt: Noise-Label Prompt Learning for Vision-Language Models

NLPrompt: 噪声标签提示学习用于视觉-语言模型

Bikang Pan, Qun Li, Xiaoying Tang, Wei Huang, Zhen Fang, Feng Liu, Jingya Wang, Jingyi Yu, Ye Shi

机构 * ShanghaiTech University(上海科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) RIKEN Center for Advanced Intelligence Project(日本RIKEN高级智能项目中心) University of Technology Sydney(悉尼科技大学) University of Melbourne(墨尔本大学)

AI总结 NLPrompt通过结合PromptMAE和PromptOT,提升视觉-语言模型在噪声标签下的提示学习鲁棒性与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏