arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2025-11-25 至 2025-11-25 共收录 12
2511.19080 2025-11-25 cs.MM cs.CV

Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach

面向可泛化的深度伪造检测的伪造感知音频视觉适应:一种变分贝叶斯方法

Fan Nie, Jiangqun Ni, Jian Zhang, Bin Zhang, Weizhe Zhang, Bin Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of New Networks, Pengcheng Laboratory(鹏城实验室网络部) School of Cyber Science and Technology, Sun Yat-sen University(中山大学网络安全科学与技术学院) School of Computer Science and Cyber Engineering, Guangzhou University(广州大学计算机科学与网络工程学院) School of Cyberspace Science, Harbin Institute of Technology(哈尔滨工业大学网络空间科学学院)

AI总结 本文提出基于变分贝叶斯的伪造感知音频视觉适应方法,通过估计音频视觉相关性来提升深度伪造检测的泛化能力。

Comments TIFS AQE

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18889 2025-11-25 cs.CL cs.AI

CoreEval: Automatically Building Contamination-Resilient Datasets with Real-World Knowledge toward Reliable LLM Evaluation

CoreEval: 通过现实世界知识自动构建抗污染数据集以实现可靠的LLM评估

Jingqian Zhao, Bingbing Wang, Geng Tu, Yice Zhang, Qianlong Wang, Bin Liang, Jing Li, Ruifeng Xu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies(广东省新型安全智能技术重点实验室) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 CoreEval通过现实世界知识自动更新数据集,提升LLM评估的抗污染能力,减少数据污染导致的性能高估问题。

Comments ACL'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16091 2025-11-25 cs.CV cs.RO

Rad-GS: Radar-Vision Integration for 3D Gaussian Splatting SLAM in Outdoor Environments

Rad-GS:用于户外环境的雷达-视觉融合3D高斯点云SLAM

Renxiang Xiao, Wei Liu, Yuanfan Zhang, Yushuai Chen, Jinming Chen, Zilu Wang, Liang Hu

机构 * Department of Automation, School of Mechanical Engineering and Automation, Harbin Institute of Technology(自动化系、机械工程与自动化学院、哈尔滨工业大学) School of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术学院、哈尔滨工业大学)

AI总结 Rad-GS通过融合雷达与视觉信息,实现公里级户外环境的3D高斯点云SLAM,提升定位精度与场景重建能力。

Journal ref IEEE Robotics and Automation Letters 10(12), 13359-13366 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00350 2025-11-25 cs.LG cs.CV

BOOD: Boundary-based Out-Of-Distribution Data Generation

基于边界的Out-Of-Distribution数据生成

Qilin Liao, Shuo Yang, Bo Zhao, Ping Luo, Hengshuang Zhao

机构 * The University of Hong Kong, Hong Kong, China(香港大学) School of AI, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Department of Computer Science, Harbin Institute of Technology (Shenzhen), Shenzhen, China(哈尔滨工业大学(深圳)计算机科学系)

AI总结 BOOD通过在潜在空间中识别决策边界并生成高质量OOD特征,提升OOD检测性能,实验显示在CIFAR-100数据集上显著优于现有方法。

Comments 14 pages, 8 figures, To be published in the Proceedings of the International Conference on Machine Learning (ICML) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16123 2025-11-25 cs.AI q-bio.BM

Gradient Propagation in Retrosynthetic Space: An Efficient Framework for Synthesis Plan Generation

反合成空间中的梯度传播:一种高效的合成计划生成框架

Chengyang Tian, Yuhang Chang, Yangpeng Zhang, Yang Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出一种基于梯度传播的反合成路径探索算法,通过梯度传播评估节点贡献,实现高效合成计划生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17992 2025-11-25 cs.RO

Unobservable Subspace Evolution and Alignment for Consistent Visual-Inertial Navigation

不可观测子空间的演化与对齐用于一致的视觉-惯性导航

Chungeng Tian, Fenghua He, Ning Hao

机构 * School of Astronautics, Harbin Institute of Technology(航天学院,哈尔滨工业大学)

AI总结 本文提出不可观测子空间演化与对齐方法,通过分析估计步骤中的可观测性不匹配问题,解决视觉-惯性导航系统中的一致性挑战。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17941 2025-11-25 cs.CV

V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction

V2X-RECT: 一种通过冗余交互过滤和轨迹误差修正的高效V2X轨迹预测框架

Xiangyan Kong, Xuecheng Wu, Xiongwei Zhao, Xiaodong Li, Yunyun Shi, Gang Wang, Dingkang Yang, Yang Liu, Hong Chen, Yulong Gao

机构 * Communication Research Center, Harbin Institute of Technology(哈尔滨工业大学通信研究所) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)电子与信息工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)

AI总结 V2X-RECT通过冗余交互过滤和轨迹误差修正,提升高密度环境下的轨迹预测效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17914 2025-11-25 cs.CV cs.AI

Rectifying Soft-Label Entangled Bias in Long-Tailed Dataset Distillation

校正长尾数据集蒸馏中的软标签纠缠偏见

Chenyang Jiang, Hang Zhao, Xinyu Zhang, Zhengcen Li, Qiben Shan, Shaocong Wu, Jingyong Su

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室)

AI总结 ADSA通过校正长尾数据集蒸馏中的软标签纠缠偏见,显著提升尾部类别准确率和整体准确率。

Comments 10 pages, accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17567 2025-11-25 cs.NE cs.AI cs.CV

Temporal-adaptive Weight Quantization for Spiking Neural Networks

时空自适应权重量化用于脉冲神经网络

Han Zhang, Qingyan Meng, Jiaqi Wang, Baiyu Chen, Zhengyu Ma, Xiaopeng Fan

机构 * Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) Institute of Computing and Intelligence (ICI), Harbin Institute of Technology(哈尔滨工业大学计算机与智能信息学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本文提出了一种基于时空动态的权重量化方法TaWQ,用于提升脉冲神经网络的能效,同时保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12609 2025-11-25 cs.CL cs.AI cs.CV

Uni-MoE-2.0-Omni: Scaling Language-Centric Omnimodal Large Model with Advanced MoE, Training and Data

Uni-MoE-2.0-Omni: 通过先进MoE、训练和数据扩展语言导向的多模态大模型

Yunxin Li, Xinyu Chen, Shenyuan Jiang, Haoyuan Shi, Zhenyu Liu, Xuanyu Zhang, Nanhao Deng, Zhenran Xu, Yicheng Ma, Meishan Zhang, Baotian Hu, Min Zhang

机构 * Research Institute of Computing and Intelligence(计算与智能研究 institute) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 Uni-MoE-2.0-Omni通过先进MoE、训练和数据技术,实现了语言导向的多模态大模型,展现出在多模态理解、推理和生成任务中的卓越性能。

Comments 47 pages,10 Figures, Project Website: https://idealistxy.github.io/Uni-MoE-v2.github.io/ Codes: https://github.com/HITsz-TMG/Uni-MoE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22633 2025-11-25 cs.CL cs.AI cs.CV cs.LG cs.MM

Spatial Knowledge Graph-Guided Multimodal Synthesis

基于空间知识图的多模态合成

Yida Xue, Zhen Bi, Jinnan Yang, Jungang Lou, Kehai Chen, Min Zhang, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Nanjing University of Science and Technology(南京理工大学) Huzhou University(湖州大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 SKG2DATA通过空间知识图引导多模态合成,提升多模态大语言模型的空间感知与推理能力。

Comments IEEE/ACM Transactions on Audio, Speech and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11789 2025-11-25 cs.LG cs.NA math.NA

PINNsFailureRegion Localization and Refinement through White-box AdversarialAttack

通过白盒对抗攻击实现PINNs失效区域定位与精修

Shengzhu Shi, Yao Li, Zhichang Guo, Boying Wu, Yang Zhao

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) School of Astronautics, Harbin Institute of Technology(哈尔滨工业大学航天学院)

AI总结 本文提出WbAR方法,通过白盒对抗攻击定位并精修PINNs在求解复杂PDEs时的失效区域,提升求解精度与稳定性。

Journal ref Neurocomputing (2025): 132055

详情

展开后加载摘要…

URL PDF HTML 收藏