arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-12-01 至 2025-12-01 共收录 4 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 4 篇

2502.19674 2025-12-01 cs.CV 79%

Reliable Multimodal Learning Via Multi-Level Adaptive DeConfusion

通过多级自适应去混淆实现可靠的多模态学习

Tong Zhang, Shu Shen, C. L. Philip Chen

机构 * Guangdong Provincial Key Laboratory of Computational AI Models and Cognitive Intelligence(广东省计算人工智能模型与认知智能重点实验室) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) Pazhou Lab(琶洲实验室) Engineering Research Center of the Ministry of Education on Health Intelligent Perception and Paralleled Digital-Human(教育部健康智能感知与平行数字人工程研究中心)

专题命中 其他多模态 :multimodal(title,abstract);分类 cs.CV

AI总结 本文提出多级自适应去混淆方法,通过消除多模态数据中的类间和样本特定混淆,提升多模态模型的分类可靠性。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23126 2025-12-01 econ.GN q-fin.EC 78%

Does cross-modal discounting generalize to non-WEIRD cultures? A comparison of the USA and Japan

跨模态折扣是否能推广到非WEIRD文化?对美国和日本的比较

Shohei Yamamoto, Rebecca McDonald, Daniel Read

专题命中 其他多模态 :cross-modal(title,abstract)

AI总结 该研究比较了美国和日本,发现跨模选择在不同文化中均表现出更大的耐心,且效应在被试间实验中更显著,支持跨模效应的普遍性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22174 2025-12-01 cs.LO math.LO 78%

Nested Sequents for Intuitionistic Multi-Modal Logics: Cut-Elimination and Lyndon Interpolation

嵌套序列为直觉多模逻辑:切消和Lyndon插值

Tim S. Lyon

专题命中 其他多模态 :multi-modal(title,abstract)

AI总结 本文提出了一种单结论嵌套序列表演算,用于直觉多模逻辑,并证明了切消性和Lyndon插值性质。

Comments in review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09464 2025-12-01 cs.GR cs.CV 74%

Hybrid Rendering for Multimodal Autonomous Driving: Merging Neural and Physics-Based Simulation

多模态自动驾驶的混合渲染:融合神经网络与基于物理的模拟

Máté Tóth, Péter Kovács, Réka Bencses, Zoltán Bendefy, Zoltán Hortsin, Balázs Teréki, Tamás Matuszka

机构 * aiMotive

专题命中 其他多模态 :multimodal(title);分类 cs.CV

AI总结 本文提出混合渲染方法,结合神经网络与基于物理的模拟,提升自动驾驶模拟中新颖视角合成质量及实时渲染效率。

详情

展开后加载摘要…

URL PDF HTML 收藏