arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-08-27 至 2026-08-27 共收录 5
2608.26095 2026-08-27 cs.CV cs.AI 新提交

A Visual Dependence-Aware Framework for Multimodal Unsupervised Continual Post-Training

面向多模态无监督持续后训练的视觉依赖感知框架

Kaichen Li, Zhilin Zhu, Jianhao Huang, Zhengqin Lai, Baochen Xiong, Zibo Shao, Yaguang Song, Linhui Xiao, Xiaoshan Yang, Changsheng Xu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) Pengcheng Laboratory(鹏城实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 针对多模态无监督持续后训练中现有方法忽略视觉依赖的问题,提出含VC-OT和VMA组件的VDA框架,可同时维持旧任务稳定性与新任务可塑性,经实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25813 2026-08-27 cs.LG 新提交

Canalization Before Generalization: Grokking as a Dynamical Probe

泛化前的 canalization:将 Grokking 作为动态探测工具

Yiming Lin

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 该研究将 Grokking 作为动态探测工具,通过扫描权重衰减脉冲,发现功能选择的 canalization 现象,即剂量有序时间效应在可见泛化前出现,且测试损失障碍收敛时该效应仍持续。

Comments 21 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25659 2026-08-27 cs.RO 新提交

GaussianDream++: Efficient 3D Gaussian World Modeling for Robotic Manipulation

Yuqing Jiang, Zijian Zhang, Weitao Zhou, Jiawei Wang, Junjie He, Lei Yang, Haifang Qing, Si Liu, Ding Zhao, Ping Luo, Haibao Yu

机构 * Tuojing Intelligence(拓境智能) University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学)

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25412 2026-08-27 cs.CV 新提交

AdaptiveEmbed: Sample-Adaptive Multi-Vector Representation for Multimodal Retrieval

AdaptiveEmbed:面向多模态检索的样本自适应多向量表示

Xinze Liu, Lei Yang, Dayan Wu, Hengjie Zhu, Zihao Zhang, Hanqi Wu, Tianzhu Hu, Peng Fu, Zheng Lin, Weiping Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

AI总结 本研究提出样本自适应多向量表示(SAMVR)新设定,构建AdaptiveEmbed框架,通过多组对比学习等技术实现样本级自适应容量分配,在多模态检索基准上验证其性能优于固定容量方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25334 2026-08-27 cs.CV 新提交

GraftSR: Grafting Authentic Textures for Real-World Image Super-Resolution via Identical-Instance Guidance

GraftSR:通过相同实例引导嫁接真实纹理以实现真实世界图像超分辨率

Qifan Yu, Haoran Bai, Zongyao He, Weijie He, Sibin Deng, Honggang Qi, Ying Chen

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝天猫集团) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 针对扩散图像超分辨率的纹理幻觉问题,提出GraftSR框架,采用双掩码参考引导机制,构建TexRefSR-141K数据集,在新基准上实现SOTA,LPIPS降低20.2%。

Comments 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏