arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2025-12-11 至 2025-12-11 共收录 6
2512.09663 2025-12-11 cs.CV

IF-Bench: Benchmarking and Enhancing MLLMs for Infrared Images with Generative Visual Prompting

IF-Bench:基于生成视觉提示的多模态大语言模型在红外图像上的基准测试与增强

Tao Zhang, Yuyang Hong, Yang Xia, Kun Ding, Zeyu Zhang, Ying Wang, Shiming Xiang, Chunhong Pan

机构 * MAIS, Institute of Automation(自动化研究所信息处理中心) School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院) Research Center of Aerospace Information, Institute of Automation(自动化研究所航空信息研究中心)

AI总结 IF-Bench通过生成视觉提示方法提升多模态大语言模型对红外图像的理解能力,提供首个高质量基准测试及实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09487 2025-12-11 cs.CL cs.AI cs.IR

RouteRAG: Efficient Retrieval-Augmented Generation from Text and Graph via Reinforcement Learning

RouteRAG: 通过强化学习实现文本和图的高效检索增强生成

Yucan Guo, Miao Su, Saiping Guan, Zihao Sun, Xiaolong Jin, Jiafeng Guo, Xueqi Cheng

机构 * CAS Key Laboratory of Network Data Science and Technology, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所网络数据科学与技术重点实验室) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)

AI总结 RouteRAG通过强化学习实现文本和图的高效混合检索增强生成,提升多轮推理和复杂任务的适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00718 2025-12-11 cs.CV

VFM-ISRefiner: Towards Better Adapting Vision Foundation Models for Interactive Segmentation of Remote Sensing Images

VFM-ISRefiner: 向更适应交互分割遥感图像的视觉基础模型迈进

Deliang Wang, Peng Liu, Yan Ma, Rongkai Zhuang, Lajiao Chen, Bing Li, Yi Zeng

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) School of Information Science and Technology, Beijing Forestry University(北京林业大学信息科学与技术学院)

AI总结 VFM-ISRefiner提出了一种基于点击的交互分割框架,通过适配器调优和混合注意力机制提升遥感图像分割的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03166 2025-12-11 cs.CV

RingMoE: Mixture-of-Modality-Experts Multi-Modal Foundation Models for Universal Remote Sensing Image Interpretation

RingMoE:面向通用遥感图像解释的多模态专家混合多模态基础模型

Hanbo Bi, Yingchao Feng, Boyuan Tong, Mengyu Wang, Haichen Yu, Yongqiang Mao, Hao Chang, Wenhui Diao, Peijin Wang, Yue Yu, Hanyang Peng, Yehong Zhang, Kun Fu, Xian Sun

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(目标认知与应用技术重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Peng Cheng Laboratory, Shenzhen(鹏城实验室)

AI总结 RingMoE是一种多模态专家混合模型,通过自监督学习和物理信息嵌入,提升遥感图像的多模态处理能力,实现从单模态到多模态的高效适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05593 2025-12-11 cs.CV

Semantic Data Augmentation Enhanced Invariant Risk Minimization for Medical Image Domain Generalization

语义数据增强增强不变风险最小化用于医学图像领域泛化

Yaoyao Zhu, Xiuding Cai, Yingkai Wang, Yu Yao, Xu Luo, Zhongliang Fu

机构 * Chengdu Institute of Computer Application, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出一种基于语义数据增强的不变风险最小化方法,通过领域导向的增强方向选择器提升医学图像领域泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20090 2025-12-11 cs.CV

Towards Robust Infrared Small Target Detection: A Feature-Enhanced and Sensitivity-Tunable Framework

迈向鲁棒的红外小目标检测:一种特征增强和灵敏度可调的框架

Jinmiao Zhao, Zelin Shi, Chuang Yu, Yunpeng Liu, Yimian Dai

机构 * Key Laboratory of Opto-Electronic Information Processing, Chinese Academy of Sciences(光电信息处理重点实验室,中国科学院) Shenyang Institute of Automation, Chinese Academy of Sciences(沈阳自动化研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Nankai University(南开大学)

AI总结 本文提出FEST框架,通过特征增强和灵敏度调节提升红外小目标检测性能,增强模型鲁棒性和适应性。

Comments Accepted by Knowledge-Based Systems 2025

详情

展开后加载摘要…

URL PDF HTML 收藏