ModernVBERT: Towards Smaller Visual Document Retrievers
ModernVBERT: 向更小的视觉文档检索器迈进
专题命中 多模态RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR
AI总结 ModernVBERT通过优化视觉文档检索模型,实现了在文档检索任务中性能优于更大模型的高效轻量级模型。
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
ModernVBERT: 向更小的视觉文档检索器迈进
专题命中 多模态RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR
AI总结 ModernVBERT通过优化视觉文档检索模型,实现了在文档检索任务中性能优于更大模型的高效轻量级模型。
VideoMem: 通过自适应内存管理增强超长视频理解
机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) ; Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学)
专题命中 多模态RAG :RAG(abstract)
AI总结 VideoMem通过自适应内存管理框架,有效提升超长视频理解任务的性能,采用PRPO算法和两个核心模块实现高效训练和长期记忆保留。