PyVision-RL: Forging Open Agentic Vision Models via RL
通过强化学习构建开放代理视觉模型:PyVision-RL
机构 * Shanghai AI Lab(上海人工智能实验室) ; Rice University(里士满大学) ; Shanda AI Research, Tokyo(上海沙达人工智能研究东京)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
AI总结 PyVision-RL通过强化学习框架解决多模态代理的交互崩溃问题,结合回放策略和累积奖励提升多轮推理能力,实现高效视频理解与处理。
Comments preprint