arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-09-01 至 2026-09-01 共收录 16
2608.31014 2026-09-01 cs.CL 新提交

Evidence-Bounded Mental Health Reasoning from Heterogeneous Speech Protocols

基于异构语音协议的证据受限心理健康推理

Chengyuan Gao, Jiang Wu, Tao Lu, Jiayan Guo, Mingkun Xu, Tianyi Zang, Shangyang Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Harbin Institute of Technology(哈尔滨工业大学) Renyixun Health Technology Co., Ltd.(仁医讯健康科技有限公司) GDIIST(广东省智能制造研究所) Tencent(腾讯)

AI总结 本研究针对现有心理健康筛查模型的证据边界问题,提出协议感知的证据控制框架EviBound,在抑郁症筛查任务中达到0.8658的AUROC,且实现零宣称违规。

Comments Accepted to Findings of the Association for Computational Linguistics: EMNLP 2026. Long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30316 2026-09-01 cs.CV 新提交

Knowing Beyond the Known: Reinforced Knowledge Specification for Multi-Label Class-Incremental Learning

超越已知的认知:面向多标签类增量学习的强化知识规范

Aoting Zhang, Dongbao Yang, Chang Liu, Xiaopeng Hong, Can Ma, Yu Zhou

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Nankai University(南开大学) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 针对多标签类增量学习中已知与未知知识边界模糊的问题,提出KBK框架,通过分层特征纯化等模块缓解遗忘,在MS-COCO基准上超越最优方法2.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30305 2026-09-01 cs.CV 新提交

Learning to Restore More: Continual Capability Expansion for Pretrained Image Restoration Models

学习恢复更多:预训练图像恢复模型的持续能力扩展

Hu Gao, Yulong Chen, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 RestoreMore框架将预训练图像恢复模型作为冻结锚点,通过双层路由机制学习残差扩展模块,在不遗忘旧能力的前提下持续获取新恢复能力,经多基准实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29896 2026-09-01 cs.RO 新提交

EMERGE-Policy: A Robot Mind Emerges Beyond a Single Policy

EMERGE-Policy:超越单一策略的机器人心智涌现

Zhirui Fang, Qingchi Yu, Ziyang Chen, Longfei Li, Haoran Ma, Keru Zhou, Xinrun Xu, Samith Va, Yuxuan Hu, Peixuan Song, Qiang Du, Bin Qian, Yongkang Deng, Xin Li, Yezhen Wang, Zhe Li, Hao Luo, Shuyan Li, Ziwei Wang, Weijian Deng, Xiu Li

机构 * Tsinghua University(清华大学) Nanjing University of Science and Technology(南京理工大学) Xi’an Jiaotong University(西安交通大学) Xidian University(西安电子科技大学) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学)

AI总结 EMERGE-Policy是一种图结构智能体框架,通过多角色子智能体协作划分功能子任务,无需额外微调即可在公开基准和真实机器人实验中实现出色性能,扩展了机器人策略的应用范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29804 2026-09-01 cs.CV 新提交

Beyond Global Realism: Virtual Try-On Evaluation and Optimization with Dimension-wise Garment Fidelity Assessment

超越全局真实感:基于维度化服装保真度评估的虚拟试穿评估与优化

Kaidong Zhang, Yukang Ding, Xiaoyu Liu, Ying Chen

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝与天猫集团) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 针对现有虚拟试穿评估指标难以捕捉服装多维保真度的问题,提出DAT框架,分解服装一致性为7个维度并训练专用评估模型,其性能优于多款专有模型,还可用于优化Qwen-Image-Edit的虚拟试穿生成。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29680 2026-09-01 cs.CV 新提交

GeoRay: Gauge-Aware Feed-Forward Satellite 3D Reconstruction in the Geodetic Frame

GeoRay:大地坐标系下量规感知的前馈卫星三维重建

Zhe Dong, Wanqing Wu, Yuzhe Sun, Haochen Jiang, Yuchen Ma, Lecheng Ren, Tianzhu Liu, Yanfeng Gu

机构 * School of Electronics and Information Engineering, Harbin Institute of Technology(哈尔滨工业大学电子与信息工程学院) th Research Institute, China Electronics Technology Group Corporation(中国电子科技集团公司第五十四研究所) State Key Laboratory of Comprehensive PNT Network and Equipment Technology(综合PNT网络与装备技术国家重点实验室) School of Electrical and Electronic Engineering, University of Manchester(曼彻斯特大学电气与电子工程学院)

AI总结 GeoRay针对卫星三维重建问题,通过射线一致适配器、显式基准机制和逆方差融合技术,在绝对大地坐标系下实现了高精度、高覆盖率的前馈卫星三维重建,性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29662 2026-09-01 cs.CL 新提交

ACTD: Anchor-Based Cross-Tokenizer Distillation with Residual Regularization

ACTD:带残差正则化的基于锚点的跨分词器蒸馏

Huiyi Zhang, Zijian Li, Xiaocheng Feng, Weitao Ma, Xiaoliang Yang, Yichong Huang, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室)

AI总结 针对跨分词器蒸馏的词汇与序列不对齐及对齐噪声问题,提出带残差正则化的ACTD方法,在五个推理基准上用三种教师模型评估取得SOTA,多教师扩展版性能优于基线。

Comments Accepted by EMNLP 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29537 2026-09-01 cs.RO cs.AI 新提交

AGM: Achievement-Grounded Memory for Closed-Loop Agents with Frozen VLA Policies

AGM:基于成就的闭环智能体记忆,适用于冻结的视觉-语言-动作(VLA)策略

Hongbo Gao, Zeyu Ni, Xin Wen, Siyu Xu, Ruifeng Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) The University of Sydney(悉尼大学) StellarEdge AI(星边人工智能)

AI总结 针对冻结VLA策略无法跟踪任务进度的问题,提出AGM框架,通过物理证据验证子目标实现闭环,在RoboMME基准和物理机器人上均取得显著性能提升。

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29066 2026-09-01 cs.CL cs.AI 新提交

Not All or None: Dynamic Construction of Target-aware Memory Graph for Conversational Stance Detection

非全即无:面向对话式立场检测的目标感知记忆图的动态构建

Yifan Xiang, Bin Liang, Yuqi Huang, Ruifeng Xu, Kam-Fai Wong

机构 * The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 针对对话式立场检测中历史对话信息利用的噪声问题,提出目标感知记忆图TamGraph,通过熵引导回溯机制动态构建目标感知图,提升LLM在该任务上的性能。

Comments Accepted in EMNLP 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28693 2026-09-01 cs.RO cs.CV 新提交

RoboGesture: Real-Time Semantic-aligned Co-Speech Gestures Generation for Humanoid Interaction

RoboGesture:面向人形机器人交互的实时语义对齐式伴随语音手势生成

Zifan Wang, Ziang Ren, Pengyang Shi, Zirui Wang, Chenghuai Lin, Tianze Wang, Zekun Qi, Liangliang Zhao, He Wang, Li Yi

机构 * Tsinghua University(清华大学) Galbot Inc.(Galbot公司) Beijing Institute of Technology(北京理工大学) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学) Shanghai Qi Zhi Institute(上海智知研究院)

AI总结 本研究提出 RoboGesture 框架,构建专属数据集并设计相关算法,使人形机器人可实时生成语义对齐的伴随语音手势,在 Unitree G1 机器人上的实验表明其性能优于现有最优方法。

Comments Accepted at ECCV 2026. Project page: https://RoboGesture.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18613 2026-09-01 cs.CL cs.AI 版本更新

Are LLMs Ready to Assist Physicians? PhysAssistBench for Interactive Doctor-Patient-EHR Assistance

LLMs 是否已准备好辅助医生?PhysAssistBench:交互式医患-电子病历辅助基准

Tianming Du, Peijie Yu, Sihan Shang, Danli Shi, My Linh Nguyen, Shengbo Gao, Guangyuan Li, Yinghong Yu, Yan Jiang, Qianlong Zhao, Behzad Bozorgtabar, Shaoxiong Ji, Jiazhen Pan, Daniel Rueckert, Jiancheng Yang

机构 * Aalto University(阿尔托大学) Tencent(腾讯) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Hong Kong Polytechnic University(香港理工大学) Aarhus University(奥胡斯大学) Technical University of Munich(慕尼黑工业大学)

AI总结 提出PhysAssistBench基准,通过构建交互式患者代理评估LLM在医患-EHR交互中的协调能力,发现当前模型不可靠,瓶颈在于多维度协调而非单一能力。

Comments 35 pages with 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15932 2026-09-01 cs.CL 版本更新

Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence

超越NL2Code:多模态代码智能的结构化综述

Xuanle Zhao, Qiushi Sun, Jingyu Xiao, Xuexin Liu, Haoyue Yang, Qiaosheng Chen, Xianzhen Luo, Jing Huang, Yufeng Zhong, Lei Chen, Shuai Fu, Zhenlin Wei, Jinhe Bi, Lei Jiang, Haibo Qiu, Siqi Yang, Peng Shi, Jian Hu, Zhixiong Zeng

机构 * Meituan(美团) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学) Australian Institute for Machine Learning, Adelaide University(阿德莱德大学澳大利亚机器学习研究所) Ludwig Maximilian University of Munich(慕尼黑大学) University of Science and Technology of China(中国科学技术大学) Queen Mary University of London(伦敦玛丽女王大学)

AI总结 本文系统综述多模态代码智能,将任务按代码角色分类,覆盖GUI、科学可视化、结构化图形及前沿任务,并提出四个基于验证的未来方向。

Comments Accepted by TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06944 2026-09-01 cs.RO 版本更新

T-GMP: Terrain-conditioned Generative Motion Priors for Versatile and Natural Humanoid Locomotion

T-GMP: 基于地形条件的生成式运动先验用于多功能且自然的人形机器人 locomotion

Junhong Guo, Hao Hu, Chen Chen, Haoxuan Han, Linao Gong, Xin Yang, Zhicheng He, Yao Su, Fenghua He

机构 * Harbin Institute of Technology(哈尔滨工程大学) Leju Robotics(莱居机器人)

AI总结 提出 T-GMP 模块,利用条件变分自编码器从少量专家演示中学习地形条件潜在运动流形,结合对抗学习与立足点惩罚,实现统一策略下适应地形变化的多功能自然运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28006 2026-09-01 cs.CL cs.AI 版本更新

Integrated and Cross-Architecture Interpretation of LLM Reasoning

LLM推理的集成与跨架构解释

Leonardo Matthew Yauw, Wei-Bin Kou, Yujiu Yang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 提出集成跨架构推理(IAR)框架,通过带宽校准的MIP与Tukey IQR峰值检测、重叠分析及Jaccard稳定性度量,统一解释LLM推理模式。

Comments Accepted as main conference paper by EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20884 2026-09-01 cs.CL 版本更新

MemoNoveltyAgent: A Historical Research Memory-Aware Agent Workflow for Paper Novelty Assessment

MemoNoveltyAgent:一种用于论文新颖性评估的历史研究记忆感知智能体工作流

Jiajun Hou, Hexuan Deng, Wenxiang Jiao, Xuebo Liu, Xiaopeng Ke, Derek F. Wong, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能研究院,哈尔滨工业大学深圳校区,中国) Xiaohongshu Inc.(小红书公司) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国) NLP 2 CT Lab, Department of Computer and Information Science, University of Macau, China(自然语言处理2实验室,计算机与信息科学系,澳门大学,中国)

AI总结 提出MemoNoveltyAgent多智能体系统,通过分层抽象记忆、细粒度新颖点分解和自验证机制,生成忠实的新颖性报告,在评估中比GPT-5 DeepResearch提升13.69%。

Comments Accepted to the Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13073 2026-09-01 cs.RO cs.CV 版本更新

Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey

用于机器人操作的基于大型VLM的视觉-语言-动作模型:综述

Rui Shao, Wei Li, Lingsen Zhang, Renshan Zhang, Zhiyang Liu, Ran Chen, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳))

AI总结 本综述首次系统分类梳理用于机器人操作的基于大型VLM的VLA模型,明确其定义与两类架构,考察其与先进领域的集成等内容,整合进展并提供更新项目页面

Comments Under Minor Revision at IEEE TPAMI, Project Page: https://github.com/JiuTian-VL/Large-VLM-based-VLA-for-Robotic-Manipulation

详情

展开后加载摘要…

URL PDF HTML 收藏