arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-12-09 至 2025-12-09 共收录 6 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 6 篇

2512.06225 2025-12-09 physics.app-ph 78%

Curation and Dissemination of Complex Multi-modal Data Sets for Radiation Detection, Localization, and Tracking

辐射检测、定位与跟踪的复杂多模态数据集的整理与传播

Nicolas Abgrall, Mark S. Bandstra, Reynold J. Cooper, Marco Salathe, Brian J. Quiter, Rajesh Sankaran, Yongho Kim, Sean Shahkarami

专题命中 其他多模态 :multi-modal(title,abstract)

AI总结 本文介绍了PANDAWN传感器网络,展示了其在多模态数据整理与传播方面的应用,以促进辐射检测、定位和跟踪算法的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07153 2025-12-09 eess.SY cs.SY q-bio.QM 71%

A Structured Review of Fixed and Multimodal Sensing Techniques for Bat Monitoring

蝙蝠监测中固定与多模态传感技术的结构化综述

Maatla Sefawe, Sravya Ganti, Julianna Segalla, Erwei He, Isaac Tourner, Julia Gersey

专题命中 其他多模态 :multimodal(title)

AI总结 本文综述了蝙蝠监测中固定与多模态传感技术的优缺点,为未来研究提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07733 2025-12-09 cs.CV 57%

SpatialDreamer: Incentivizing Spatial Reasoning via Active Mental Imagery

SpatialDreamer: 通过主动心理意象激励空间推理

Meng Cao, Xingyu Li, Xue Liu, Ian Reid, Xiaodan Liang

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·宾·扎耶德人工智能大学) Sun Yat-sen University(孙中山大学)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 SpatialDreamer通过主动心理意象和几何策略优化,提升多模态大语言模型在复杂空间推理任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07040 2025-12-09 cs.LG cs.CV 57%

Transformation of Biological Networks into Images via Semantic Cartography for Visual Interpretation and Scalable Deep Analysis

通过语义制图将生物网络转换为图像以实现可视化解释和可扩展深度分析

Sakib Mostafa, Lei Xing, Md. Tauhidul Islam

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 Graph2Image通过将生物网络转换为图像,实现可扩展的深度分析和可视化解释,提升分类准确率并揭示生物一致性模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01268 2025-12-09 cs.CL cs.LG 57%

Deep Learning and Machine Learning, Advancing Big Data Analytics and Management: Unveiling AI's Potential Through Tools, Techniques, and Applications

深度学习与机器学习:推动大数据分析与管理,通过工具、技术和应用揭示人工智能的潜力

Pohsun Feng, Ziqian Bi, Yizhu Wen, Xuanhe Pan, Benji Peng, Ming Liu, Jiawei Xu, Keyu Chen, Junyu Liu, Caitlyn Heqi Yin, Sen Zhang, Jinlang Wang, Qian Niu, Ming Li, Tianyang Wang, Xinyuan Song, Zekun Jiang

机构 * National Taiwan Normal University(国立台湾师范大学) Indiana University(印第安纳大学) University of Hawaii(夏威夷大学) Kyoto University(京都大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Georgia Institute of Technology(佐治亚理工学院) Rutgers University(罗格斯大学) Purdue University(普渡大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Emory University(埃默里大学) Sichuan University(四川大学)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CL

AI总结 本文探讨深度学习与机器学习在大数据分析中的应用,通过工具和技术揭示AI潜力,强调伦理与公平性,推动各领域创新。

Comments This book contains 155 pages and 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06829 2025-12-09 cs.RO 50%

MagicSkin: Balancing Marker and Markerless Modes in Vision-Based Tactile Sensors with a Translucent Skin

MagicSkin: 通过透明皮肤平衡标记与无标记模式在基于视觉的触觉传感器中的应用

Oluwatimilehin Tijani, Zhuo Chen, Jiankang Deng, Shan Luo

机构 * Robot Perception Lab, Centre for Robotics Research, Department of Engineering, King’s College London(机器人感知实验室,机器人研究研究中心,工程系,伦敦国王学院) Imperial College London(帝国理工学院伦敦校区)

专题命中 其他多模态 :multimodal(abstract)

AI总结 MagicSkin通过半透明标记平衡标记与无标记模式,提升触觉传感器在物体分类、纹理识别和力预测中的性能。

Comments Submitted to ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏