arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-08-29 至 2025-08-29 共收录 3 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 多模态Agent 3 篇

2508.20528 2025-08-29 cs.CV 79%

Learning What is Worth Learning: Active and Sequential Domain Adaptation for Multi-modal Gross Tumor Volume Segmentation

Jingyun Yang, Guoqing Zhang, Jingge Wang, Yang Li

机构 * Shenzhen Key Laboratory of Ubiquitous Data Enabling, Tsinghua Shenzhen International Graduate School, Tsinghua University(深圳 ubiquitous 数据赋能重点实验室、清华大学深圳国际研究生院、清华大学)

专题命中 多模态Agent :multi-modal(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21037 2025-08-29 cond-mat.mtrl-sci physics.app-ph 78%

Predicting Trends in $V_{OC}$ Through Rapid, Multimodal Characterization of State-of-the-Art p-i-n Perovskite Devices

Amy E. Louks, Brandon T. Motes, Anthony T. Troupe, Axel F. Palmstrom, Joseph J. Berry, Dane W. deQuilettes

专题命中 多模态Agent :multimodal(title,abstract)

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20370 2025-08-29 cs.SE cs.AI 57%

Adaptive Root Cause Localization for Microservice Systems with Multi-Agent Recursion-of-Thought

Lingzhe Zhang, Tong Jia, Kangjin Wang, Weijie Hong, Chiming Duan, Minghua He, Ying Li

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团)

专题命中 多模态Agent :cross-modal(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏