arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-02-03 至 2026-02-03 共收录 21
2602.02195 2026-02-03 cs.LG cs.AI

State Rank Dynamics in Linear Attention LLMs

线性注意力大语言模型中的状态排名动态

Ao Sun, Hongtao Zhang, Heng Zhou, Yixuan Ma, Yiran Qin, Tongrui Su, Yan Liu, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Chinese Academy of Sciences(中国科学院大学) CAS Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院人工智能安全重点实验室) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学) University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 本研究揭示了线性注意力模型中状态排名分层现象,提出联合秩-范数剪枝策略,有效降低KV缓存开销并维持模型准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02180 2026-02-03 cs.LG

STILL: Selecting Tokens for Intra-Layer Hybrid Attention to Linearize LLMs

STILL: 选择令牌以实现层内混合注意力以线性化大语言模型

Weikang Meng, Liangyu Huo, Yadan Luo, Jiawen Guan, Jingyi Zhang, Yingjian Li, Zheng Zhang

机构 * SMULL Group, Harbin Institute of Technology, Shenzhen(SMULL小组,哈尔滨工业大学,深圳) Pengcheng Laboratory(Pengcheng实验室) UQMM Lab, University of Queensland(UQMM实验室,昆士兰大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 STILL通过自显著性分数和NP-Map实现LLM的高效线性化,提升长上下文任务性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02099 2026-02-03 cs.CL cs.LG

Think Dense, Not Long: Dynamic Decoupled Conditional Advantage for Efficient Reasoning

思考密集,而非冗长:动态解耦条件优势用于高效推理

Keqin Peng, Yuanxin Ouyang, Xuebo Liu, Zhiliang Tian, Ruijian Han, Yancheng Yuan, Liang Ding

机构 * Beihang University(北航) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) National University of Defense Technology(国防科技大学) Hong Kong Polytechnic University(香港理工大学) Alibaba Group(阿里巴巴集团)

AI总结 DDCA通过动态解耦条件优势提升强化学习的效率-准确性平衡,减少生成token数量并保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01982 2026-02-03 cs.CL

S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs

S3-CoT:自采样简洁推理实现高效链式推理LLM

Yanrui Du, Sendong Zhao, Yibo Gao, Danyang Zhao, Qika Lin, Ming Ma, Jiayun Li, Yi Jiang, Kai He, Qianyi Xu, Bing Qin, Mengling Feng

机构 * Harbin Institute of Technology(哈尔滨工业大学) National University of Singapore(新加坡国立大学)

AI总结 S3-CoT通过自采样简洁推理实现高效链式推理LLM,解决冗余推理问题,提升模型性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01741 2026-02-03 cs.CV

Tail-Aware Post-Training Quantization for 3D Geometry Models

面向尾部的训练后量化用于3D几何模型

Sicheng Pan, Chen Tang, Shuzhao Xie, Ke Yang, Weixiang Zhang, Jiawei Li, Bin Chen, Shu-Tao Xia, Zhi Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国) MMLab, The Chinese University of Hong Kong, Hong Kong, China(MMLab,香港中文大学,香港,中国) Harbin Institute of Technology Shenzhen, China(哈尔滨工业大学深圳,中国) Huawei Technology, Shenzhen, China(华为技术,深圳,中国)

AI总结 TAPTQ通过面向尾部的训练后量化方法,提升3D几何模型的部署效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01558 2026-02-03 cs.LG

How Implicit Bias Accumulates and Propagates in LLM Long-term Memory

隐性偏见如何在LLM长期记忆中积累和传播

Yiming Ma, Lixu Wang, Lionel Z. Wang, Hongkun Yang, Haoming Sun, Xin Xu, Jiaqi Wu, Bin Chen, Wei Dong

机构 * International Research Center for Artificial Intelligence, Harbin Institute of Technology (Shenzhen), Shenzhen, China Chongqing Research Institute of Harbin Institute of Technology, Chongqing, China College of Computing Data Science, Nanyang Technological University, Singapore Department of Management Marketing, The Hong Kong Polytechnic University, Hong Kong Haide College, Ocean University of China, Qingdao, China School of Computer Science, The University of Sheffield, Sheffield, UK Department of Automation, Tsinghua University, Beijing, China

AI总结 本文研究了LLM长期记忆中隐性偏见的积累与传播,提出动态内存标记方法以缓解偏见问题。

Comments Under review, and the first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01547 2026-02-03 cs.SD eess.AS

Attention-weighted Centered Kernel Alignment for Knowledge Distillation in Large Audio-Language Models Applied to Speech Emotion Recognition

基于注意力加权中心核对齐的知识蒸馏:用于大音频-语言模型的语音情感识别

Qingran Yang, Botao Zhao, Zuheng Kang, Xue Li, Yayun He, Chuhang Liu, Xulong Zhang, Xiaoyang Qu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 PL-Distill通过结合投影层和输出层蒸馏方法,有效压缩大音频-语言模型并提升语音情感识别性能。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02649 2026-02-03 cs.RO cs.AI

Effective Online 3D Bin Packing with Lookahead Parcels Using Monte Carlo Tree Search

有效在线三维装箱使用蒙特卡洛树搜索和前瞻性包裹

Jiangyi Fang, Bowen Zhou, Haotian Wang, Xin Zhu, Leye Wang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education China(高可信软件技术重点实验室(北京大学)) Faculty of Computing, Harbin Institute of Technology, Harbin, China(计算机学院,哈尔滨工业大学,哈尔滨,中国) JD Logistic, Beijing, China(京东物流,北京,中国) School of Computer Science, Peking University, Beijing, China(计算机科学学院,北京大学,北京,中国)

AI总结 本文提出了一种基于蒙特卡洛树搜索和前瞻性包裹的在线三维装箱方法,通过动态探索先验平衡强化学习策略与稳健随机策略,有效应对物流中的短期分布变化,实现显著的装箱效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16600 2026-02-03 cs.AI

You Only Forward Once: An Efficient Compositional Judging Paradigm

你只需一次转发:一种高效的组合判断范式

Tianlong Zhang, Hongwei Xue, Shilin Yan, Di Wu, Chen Xu, Guannan Zhang, Yunyun Yang

机构 * School of Science, Harbin Institute of Technology, Shenzhen, Guangdong Province, China(哈尔滨工业大学深圳校区科学学院) Accio, Alibaba Group, Hangzhou, Zhejiang Province, China(阿里集团杭州Accio)

AI总结 YOFO通过单次前向传递高效判断多模态大语言模型的结构化要求,实现速度与可解释性的平衡,同时支持依赖分析和事后CoT。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01283 2026-02-03 cs.CV

Who Transfers Safety? Identifying and Targeting Cross-Lingual Shared Safety Neurons

谁负责安全转移?识别和定位跨语言共享安全神经元

Xianhui Zhang, Chengyu Xie, Linxia Zhu, Yonghui Yang, Weixiang Zhao, Zifeng Cheng, Cong Wang, Fei Shen, Tat-Seng Chua

机构 * Nanjing University of Science and Technology(南京理工大学) National University of Singapore(新加坡国立大学) Harbin Institute of Technology(哈尔滨工业大学) Nanjing University(南京大学)

AI总结 本文提出通过识别和定位跨语言共享安全神经元,提升非高资源语言的安全性,采用神经元导向的训练策略增强模型跨语言防御一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01089 2026-02-03 cs.CV

Differential Vector Erasure: Unified Training-Free Concept Erasure for Flow Matching Models

微分向量擦除:用于流匹配模型的无训练概念擦除

Zhiqi Zhang, Xinhao Zhong, Yi Sun, Shuoyang Sun, Bin Chen, Shu-Tao Xia, Xuan Wang

机构 * Jilin University(吉林大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出DVE,一种针对流匹配模型的无训练概念擦除方法,通过微分向量场实现精确概念抑制,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00749 2026-02-03 cs.CV

HSI-VAR: Rethinking Hyperspectral Restoration through Spatial-Spectral Visual Autoregression

HSI-VAR: 通过空间-光谱视觉自回归重新思考高光谱图像恢复

Xiangming Wang, Benteng Sun, Yungeng Liu, Haijin Zeng, Yongyong Chen, Jingyong Su, Jie Liu

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Harvard University(哈佛大学)

AI总结 HSI-VAR通过空间-光谱视觉自回归方法,高效解决高光谱图像恢复问题,实现计算成本降低50%和推理速度提升95.5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00733 2026-02-03 cs.CL cs.AI

EchoReview: Learning Peer Review from the Echoes of Scientific Citations

EchoReview: 从科学引文的回声中学习同行评审

Yinuo Zhang, Dingcheng Huang, Haifeng Suo, Yizhuo Li, Ziya Zhao, Junhao Xu, Zhiying Tu, Dianhui Chu, Deming Zhai, Xianming Liu, Xiaoyan Yu, Dianbo Sui

机构 * Harbin Institute of Technology, China(哈尔滨工业大学) Beijing Institute of Technology, China(北京理工大学)

AI总结 EchoReview通过引用上下文驱动的数据合成方法,构建了首个大规模跨会议、跨年度的评审数据集,并训练出能提升核心评审维度的自动化评审员。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00686 2026-02-03 cs.RO

Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching

通过自适应视觉令牌缓存学习加速视觉-语言-动作模型

Yujie Wei, Jiahan Fan, Jiyu Guo, Ruichen Zhen, Rui Shao, Xiu Su, Zeke Xie, Shuo Yang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院) Central South University(中南大学) HKUST(GZ)(香港科技大学(广州))

AI总结 本文提出通过自适应视觉令牌缓存学习加速VLA模型,提升推理效率并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00557 2026-02-03 cs.RO

ConLA: Contrastive Latent Action Learning from Human Videos for Robotic Manipulation

ConLA:从人类视频中通过对比学习学习机器人操作

Weisheng Dai, Kai Lan, Jianyi Zhou, Bo Zhao, Xiu Su, Junwen Tong, Weili Guan, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) State Key Laboratory of Mobile Network and Mobile Multimedia Technology, Shenzhen(移动网络与移动多媒体技术国家重点实验室(深圳)) ZTE Corporation(中兴通讯) Shanghai Jiao Tong University(上海交通大学) Central South University(中南大学)

AI总结 ConLA通过对比学习从人类视频中学习机器人操作,有效解决潜在表示中的捷径学习问题,提升机器人学习的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00551 2026-02-03 cs.RO cs.CV

APEX: A Decoupled Memory-based Explorer for Asynchronous Aerial Object Goal Navigation

APEX:一种解耦的记忆型探索者用于异步空中目标导航

Daoxuan Zhang, Ping Chen, Xiaobo Xia, Xiu Su, Ruichen Zhen, Jianqiang Xiao, Shuo Yang

机构 * Harbin Institute of Technology(哈尔滨工业大学) National University of Singapore(新加坡国立大学) Central South University(中南大学) Meituan Academy of Robotics(美团机器人研究院)

AI总结 APEX通过分层异步架构实现高效空中目标导航,提升探索效率与目标识别精度。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00500 2026-02-03 cs.RO

Inject Once Survive Later: Backdooring Vision-Language-Action Models to Persist Through Downstream Fine-tuning

一次注入,后期存活:向视觉-语言-动作模型注入后门以在下游微调中持续存在

Jianyi Zhou, Yujie Wei, Ruichen Zhen, Bo Zhao, Xiaobo Xia, Rui Shao, Xiu Su, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Harbin Institute of Technology(哈尔滨工业大学) Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院) Shanghai Jiaotong University(上海交通大学) National University of Singapore(新加坡国立大学) Central South University(中南大学)

AI总结 本文提出INFUSE框架,首次实现对VLA模型的后门攻击,使其在用户微调后仍能保持有效性,显著提升攻击成功率并保持任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22400 2026-02-03 cs.CV

Closing the Safety Gap: Surgical Concept Erasure in Visual Autoregressive Models

弥合安全鸿沟:视觉自回归模型中的手术概念擦除

Xinhao Zhong, Yimin Zhou, Zhiqi Zhang, Junhao Li, Yi Sun, Bin Chen, Shu-Tao Xia, Xuan Wang, Ke Xu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Jilin University(吉林大学) Peng Cheng Laboratory(鹏城实验室) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

AI总结 本文提出S-VARE方法,通过过滤交叉熵损失和保留损失实现VAR模型中的精确概念擦除,有效解决安全性和生成质量之间的平衡问题。

Comments Accepted toICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19743 2026-02-03 cs.CV

Rectified Decoupled Dataset Distillation: A Closer Look for Fair and Comprehensive Evaluation

纠正解耦数据集蒸馏:对公平和全面评估的深入探讨

Xinhao Zhong, Shuoyang Sun, Xulin Gu, Chenyang Zhu, Bin Chen, Yaowei Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出RD$^3$,通过系统研究后评估设置对测试准确率的影响,揭示性能差异主要源于评估不一致,而非合成数据质量,同时提出改进蒸馏数据集效果的通用策略。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20727 2026-02-03 cs.LG stat.ML

AverageTime: Enhance Long-Term Time Series Forecasting with Simple Averaging

AverageTime: 通过简单平均增强长期时间序列预测

Gaoxiang Zhao, Chunmao Huang, Li Zhou, Xiaoqiang Wang

机构 * School of Mathematics and Statistics, Shandong University(山东大学数学与统计学学院) Department of Mathematics, Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)数学系) Research Center for Data Hub and Security, Zhejiang Lab(浙江实验室数据枢纽与安全研究中心)

AI总结 AverageTime通过简单平均操作提升长期时间序列预测性能,采用可扩展架构生成多序列并结合通道聚类技术,实现高效准确的预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00143 2026-02-03 cs.LG cs.AI cs.CV

Invariant Representation Guided Multimodal Sentiment Decoding with Sequential Variation Regularization

不变表示引导的多模态情感解码与序列变化正则化

Guoyang Xu, Zhenxi Song, Junqi Xue, Yuxin Liu, Zirui Wang, Zhiguo Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳校区)

AI总结 本文提出了一种通过模态不变融合和序列变化正则化相结合的方法,以提升多模态情感解码的稳定性和准确性。

Comments change Title, Authors, Abstract

详情

展开后加载摘要…

URL PDF HTML 收藏