EyeMVP: OCT-Informed Fundus Representation Learning via Paired CFP--OCT Pretraining
EyeMVP: 通过配对CFP-OCT预训练实现OCT启发的眼底表征学习
Zhuo Deng, Ruiheng Zhang, Ziheng Zhang, Weihao Gao, Yitong Li, Qian Wang, Lei Shao, Jiaoyue Dong, Zhixi Zeng, Lijian Fang, Haibo Wang, Xiaobin Lin, Tao Liu, Zhicheng Du, Zhengwei Zhang, Lin Yang, Zheng Gong, Xinyu Zhao, Zhenquan Wu, Fang Li, Zhiguang Zhou, Guoming Zhang, Sun Jing, Han Lv, Wenbin We, Lan Ma
机构
*
Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
;
Beijing Tongren Eye Center, Beijing Tongren Hospital, Capital Medical University(首都医科大学附属北京同仁医院北京同仁眼科中心)
;
Liangxiang Hospital of Beijing Fangshan District, Capital Medical University(首都医科大学北京市房山区良乡医院)
;
The Third People's Hospital of Dalian(大连市第三人民医院)
;
National Clinical Research Center for Endocrine and Metabolic Diseases, The Second Xiangya Hospital of Central South University(中南大学湘雅二医院国家内分泌代谢病临床医学研究中心)
;
The Central Hospital of Baoji City(宝鸡市中心医院)
;
Wuxi No.2 People's Hospital, Affiliated Wuxi Clinical College of Nantong University(南通大学附属无锡临床学院无锡市第二人民医院)
;
Shenzhen Eye Hospital, Southern Medical University(南方医科大学深圳眼科医院)
;
Beijing Friendship Hospital, Capital Medical University(首都医科大学附属北京友谊医院)
LaVIDE: Language-Prompted Satellite Change Detection via Map-Image Alignment
LaVIDE: 通过地图-图像对齐的语言提示卫星变化检测
Shuguo Jiang, Fang Xu, Chuandong Liu, Hong Tan, Shengyang Li, Lei Yu, Wen Yang, Sen Jia, Gui-Song Xia
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
;
Technology and Engineering Center for Space Utilization and the Key Laboratory of Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与重点实验室)
;
School of Aeronautics and Astronautics, University of Chinese Academy of Sciences(中国科学院大学航空宇航学院)
;
School of Electronic Information, Wuhan University(武汉大学电子信息学院)
;
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)
Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning
自信号驱动的多LLM辩论以实现高效准确的推理
Xuhang Chen, Zhifan Song, Deyi Ji, Shuo Gao, Lanyun Zhu
机构
*
University of Cambridge(剑桥大学)
;
Sorbonne Université(索邦大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Beihang University(北航大学)
;
Nanyang Technological University(南洋理工大学)
IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning
IVR-R1:通过强化学习中的迭代视觉基础推理优化轨迹
Chenghao Li, Fusheng Hao, Xikai Zhang, Likang Xiao, Yanwei Ren, Fuxiang Wu, Quan Chen, Liu Liu
机构
*
Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Kuaishou Technology(快手科技)
;
Shenzhen Institute of Advanced Integration Technology, Shenzhen(深圳先进集成技术研究院)
机构
*
Peking University(北京大学)
;
MIT(麻省理工学院)
;
TUM(技术大学(TUM))
;
Meituan(美团)
;
Peking University School of CIT, MCML, MDSIEECS and CSAIL(北京大学计算机学院、MCML、MDSIEECS以及CSAIL)
Neural Visual Decoding via Cognitive guided Adaptive Blurring and Information Constrained Alignment
通过认知引导的自适应模糊和信息受限对齐实现神经视觉解码
Fan Yin, Chuhang Zheng, Peiliang Gong, Donghai Guan, Qi Zhu
机构
*
Department of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院)
;
Department of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
分解式视觉-语言对齐用于细粒度开放词汇分割
Chenhao Wang, Yingrui Ji, Yu Meng, Yao Zhu
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Zhejiang University(浙江大学)
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
Juhaokan Technology Co.,Ltd(极皓科技有限公司)
;
Nanjing University(南京大学)
;
University of Science and Technology of China(中国科学技术大学)
When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs
当观察不足时:视觉注意结构揭示大语言模型中的幻觉
Fanpu Cao, Xin Zou, Xuming Hu, Hui Xiong
机构
*
Thrust of Artificial Intelligence, HKUST (Guangzhou)(人工智能前沿 thrust,香港科技大学(广州))
;
Department of Computer Science and Engineering, HKUST(计算机科学与工程系,香港科技大学)
Turning Drift into Constraint: Robust Reasoning Alignment in Non-Stationary Multi-Stream Environments
将漂移转化为约束:非稳态多流环境中的鲁棒推理对齐
Xiaoyu Yang, En Yu, Wei Duan, Jie Lu
机构
*
Australian Artificial Intelligence Institute (AAII)(澳大利亚人工智能研究所)
;
Faulty of Engineering and Information Technology(工程与信息技术学院)
;
University of Technology Sydney(悉尼技术大学)
;
Australia(澳大利亚)
DAPE: Dynamic Non-uniform Alignment and Progressive Detail Enhancement Techniques for Improving the Performance of Efficient Visual Language Models
DAPE:动态非均匀对齐与渐进细节增强技术以提升高效视觉语言模型的性能
Mengyuan Tian, Qiyan Zhao, Yanan Wang, Da-Han Wang
机构
*
The Wang Yanan Institute for Studies in Economics, Xiamen University, Xiamen 361005, China(厦门大学王文安经济研究所)
;
Fujian Key Laboratory of Pattern Recognition and Image Understanding, School of Computer and Information Engineering, Xiamen University of Technology, Xiamen 361024, China(福建pattern识别与图像理解重点实验室,厦门理工大学计算机与信息工程学院)