arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2026-02-11 至 2026-02-11 共收录 3 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 多模态Agent 3 篇

2602.09771 2026-02-11 physics.app-ph 79%

A large scale multi-modal workflow for battery characterization: from concept to implementation

大规模多模态工作流程用于电池表征:从概念到实现

François Cadiou, Cinthya Herrera, Duncan Atkins, Elixabete Ayerbe, Giorgio Baraldi, Stéphanie Belin, Anass Benayad, Didier Blanchard, Federico Capone, Ennio Capria, Isidora Cekic Laskovic, Robert Dominko, Kristina Edström, Ajay Gautam, Lukas Helfen, Antonella Iadecola, Quentin Jacquet, Gregor Kapun, Xinyu Li, Aleksandar Matic, Nataliia Mozhzhukhina, Andrew J Naylor, Poul Norby, Chris O Keefe, Alexandre Ponrouch, Jean Pascal Rueff, Elena Tchernykova, Deyana Tchitchekova, Israel Temprano, Nikita Vostrov, Marnix Wagemaker, Martin Winter, Christian Wölke, Tejs Vegge, Sandrine Lyonnard

专题命中 多模态Agent :multi-modal(title,comments);multimodal(abstract)

AI总结 本文提出了一种大规模多模态工作流程,用于电池表征,通过整合多种技术分析电极材料的演变和电解质成分的影响,展示了标准化流程和多属性元视图的应用。

Comments 32 pages, 6 figures, research article, keywords: Battery, Workflow, Experimental characterization, Multi-modal, Large scale, Correlation, Aging

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10109 2026-02-11 cs.RO 50%

ST4VLA: Spatially Guided Training for Vision-Language-Action Models

ST4VLA:基于空间引导的视觉-语言-动作模型训练

Jinhui Ye, Fangjing Wang, Ning Gao, Junqiu Yu, Yangkun Zhu, Bin Wang, Jinyu Zhang, Weiyang Jin, Yanwei Fu, Feng Zheng, Yilun Chen, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology(香港科技大学) Southern University of Science and Technology(南方科技大学) Fudan University(复旦大学)

专题命中 多模态Agent :multimodal(abstract)

AI总结 ST4VLA通过空间引导训练提升视觉-语言-动作模型的性能,实现对机器人任务的更稳健和可泛化的学习。

Comments Spatially Training for VLA, Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10054 2026-02-11 cs.HC 50%

AIDED: Augmenting Interior Design with Human Experience Data for Designer-AI Co-Design

AIDED: 通过人类经验数据增强室内设计以实现设计师-人工智能协同设计

Yang Chen Lin, Chen-Ying Chen, Kai-Hsin Hou, Hung-Yu Chen, Po-Chih Kuo

专题命中 多模态Agent :multimodal(abstract)

AI总结 AIDED通过整合人类经验数据提升室内设计的创造力和客户互动,探索不同数据模态对设计结果的影响,并提出未来AI工具的设计方向。

Comments 29 pages, 14 figures, Accepted to CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏