TAMEing Long Contexts in Personalization: Towards Training-Free and State-Aware MLLM Personalized Assistant
在个性化中延长上下文:迈向无训练和状态感知的MLLM个性化助手
Rongpei Hong, Jian Lang, Ting Zhong, Yong Wang, Fan Zhou
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Aiwen Technology Co., Ltd.(Aiwen科技有限公司)
;
Intelligent Digital Media Technology Key Laboratory of Sichuan Province(四川省智能数字媒体技术重点实验室)
专题命中
VLM训练与架构
:MLLM(title,abstract);multimodal large language model(abstract);分类 cs.CV
Fixed-Budget Parameter-Efficient Training with Frozen Encoders Improves Multimodal Chest X-Ray Classification
固定预算参数高效训练结合冻结编码器提升多模态胸片分类
Md Ashik Khan, Md Nahid Siddique
机构
*
Department of Computer Science and Engineering, Indian Institute of Technology Kharagpur, India(计算机科学与工程系,印度理工学院Kharagpur分校)
;
Knight Foundation School of Computing and Information Sciences, Florida International University, Florida, USA(骑士基金会计算与信息科学学院,佛罗里达国际大学)
RLLaVA: An RL-central Framework for Language and Vision Assistants
RLLaVA: 一种面向语言和视觉助手的强化学习中心框架
Lei Zhao, Zihao Ma, Boyu Lin, Yuhe Liu, Wenjun Wu, Lei Huang
机构
*
SKLCCSE, Institute of Artificial Intelligence, Beihang University, Beijing, China(信息与电子技术学院,人工智能研究院,北京航空航天大学,北京,中国)
;
Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, Beihang University(未来区块链与隐私计算先进创新中心,北京航空航天大学)
;
Hangzhou International Innovation Institute, Beihang University, Hangzhou, China(杭州国际创新研究院,北京航空航天大学,杭州,中国)