arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2026-02-16 至 2026-02-16 共收录 1 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 多模态Agent 1 篇

2602.12565 2026-02-16 cs.HC 50%

GatheringSense: AI-Generated Imagery and Embodied Experiences for Understanding Literati Gatherings

GatheringSense: 基于人工智能生成影像与具身体验的文人聚会理解

You Zhou, Bingyuan Wang, Hongcheng Guo, Rui Cao, Zeyu Wang

专题命中 多模态Agent :multimodal(abstract)

AI总结 GatheringSense通过AI生成影像与具身体验相结合,探索文人聚会的文化理解与共鸣,提出双路径框架并提供设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏