arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-01-06 至 2026-01-06 共收录 8
2511.06057 2026-01-06 cs.CL cs.MM

MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection

注意你的推理:一种用于多模态立场检测双推理的元认知直观-反思网络

Bingbing Wang, Zhengda Jin, Bin Liang, Wenjie Li, Jing Li, Ruifeng Xu, Min Zhang

机构 * Harbin Institute of Technology(哈尔滨工业大学) The Hong Kong Polytechnic University(香港理工大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 MIND通过元认知直观-反思机制,在多模态立场检测中实现双推理,提升立场判断的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01875 2026-01-06 cs.AI q-bio.QM

Toward Auditable Neuro-Symbolic Reasoning in Pathology: SQL as an Explicit Trace of Evidence

迈向病理学中的可审计神经符号推理:SQL作为证据的显式轨迹

Kewen Cao, Jianxu Chen, Yongbing Zhang, Ye Zhang, Hongxiao Wang

机构 * Capital Normal University, Beijing, China(首都师范大学) Leibniz-Institut für Analytische Wissenschaften-ISAS, Dortmund, Germany(莱比锡分析科学研究所-ISAS) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳校区)

AI总结 本文提出一种基于SQL的神经符号推理框架,通过可执行的SQL轨迹实现病理分析的可审计性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01535 2026-01-06 cs.CV

Improving Flexible Image Tokenizers for Autoregressive Image Generation

改进灵活的图像标记器以用于自回归图像生成

Zixuan Fu, Lanqing Guo, Chong Wang, Binbin Song, Ding Liu, Bihan Wen

机构 * Nanyang Technological University(南洋理工大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Harbin Institute of Technology(哈尔滨工业大学) Meta AI

AI总结 ReToK通过冗余标记填充和层次语义正则化改进灵活图像标记器,提升自回归图像生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01454 2026-01-06 cs.CV

PartImageNet++ Dataset: Enhancing Visual Models with High-Quality Part Annotations

PartImageNet++数据集:通过高质量部分标注增强视觉模型

Xiao Li, Zilong Liu, Yining Liu, Zhuhong Li, Na Dong, Sitian Qin, Xiaolin Hu

机构 * Department of Computer Science and Technology, BNRist, Institute for Artificial Intelligence, IDG/McGovern Institute for Brain Research, Tsinghua University(计算机科学与技术系,BNRist,人工智能研究所,IDG/McGovern脑科学研究所,清华大学) School of Computer Science and Technology, Shandong University(计算机科学与技术学院,山东大学) Harbin Institute of Technology(哈尔滨工业大学) Duke University(杜克大学) Beijing Institute of Technology(北京理工大学) Chinese Institute for Brain Research(中国脑科学研究所)

AI总结 PartImageNet++数据集通过高质量部分标注提升视觉模型,提出多尺度部分监督模型并验证其在下游任务中的有效性。

Comments arXiv admin note: substantial text overlap with arXiv:2407.10918

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23650 2026-01-06 cs.RO

Do You Have Freestyle? Expressive Humanoid Locomotion via Audio Control

你有即兴能力吗?通过音频控制实现 expressive 人形 locomotion

Zhe Li, Cheng Chi, Yangyang Wei, Boan Zhu, Tao Huang, Zhenguo Sun, Yibo Peng, Pengwei Wang, Zhongyuan Wang, Fangzhou Liu, Chang Xu, Shanghang Zhang

机构 * BAAI(北京人工智能研究院) University of Sydney(悉尼大学) Harbin Institute of Technology(哈尔滨工业大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

AI总结 RoboPerform 是首个通过音频直接生成音乐舞蹈和语音手势的人形运动框架,实现了低延迟、高保真的即兴运动表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22535 2026-01-06 cs.AI cs.CL

OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models

OFFSIDE: 多模态大语言模型中误信信息消除的基准测试

Hao Zheng, Zirui Pang, Ling li, Zhijie Deng, Yuhan Pu, Zhaowei Zhu, Xiaobo Xia, Jiaheng Wei

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) BIAI, ZJUT & D5Data.ai(BIAI、浙江工业大学及D5Data.ai) National University of Singapore(新加坡国立大学)

AI总结 OFFSIDE通过足球转会谣言数据集,评估多模态大语言模型中误信信息消除的挑战与方法,揭示现有技术的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07890 2026-01-06 cs.CL cs.AI

GRAPHMOE: Amplifying Cognitive Depth of Mixture-of-Experts Network via Introducing Self-Rethinking Mechanism

GRAPHMOE: 通过引入自我反思机制提升混合专家网络的认知深度

Bo Lv, Chen Tang, Zifan Zheng, Bohao Yang, Kun Zhao, Ning Liao, Xiaoxing Wang, Feiyu Xiong, Zhiyu Li, Nayu Liu, Jingchi Jiang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) The University of Manchester(曼彻斯特大学) The University of Pittsburgh(匹兹堡大学) Harbin Institute of Technology(哈尔滨工业大学) University of Sydney(悉尼大学)

AI总结 GRAPHMOE通过引入自我反思机制,提升混合专家网络的认知深度,实现语言模型的先进性能。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00904 2026-01-06 stat.ME cs.LG stat.ML

Deep Deterministic Nonlinear ICA via Total Correlation Minimization with Matrix-Based Entropy Functional

基于总相关性最小化的深度确定性非线性ICA

Qiang Li, Shujian Yu, Liang Ma, Chen Ma, Jingyu Liu, Tulay Adali, Vince D. Calhoun

机构 * Tri-Institutional Center for Translational Research in Neuroimaging and Data Science(翻译神经影像与数据科学转化研究联合中心) Emory University(埃默里大学) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Harbin Institute of Technology(哈尔滨工业大学) Georgia State University(佐治亚州立大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

AI总结 本文提出DDICA,一种基于矩阵熵函数的深度神经网络框架,通过总相关性最小化实现非线性独立成分分析,提升噪声环境下的分离性能。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏