arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-10-28 至 2025-10-28 共收录 129 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 11 篇

2510.21812 2025-10-28 cs.IR cs.AI cs.LG 80%

Unifying Inductive, Cross-Domain, and Multimodal Learning for Robust and Generalizable Recommendation

Chanyoung Chung, Kyeongryul Lee, Sunbin Park, Joyce Jiyoung Whang

机构 * KAIST(韩国科学技术院)

专题命中 其他多模态 :multimodal(title,abstract);分类 cs.AI

Comments 7 pages, 3 figures, and 4 tables. International Workshop on Multimodal Generative Search and Recommendation (MMGenSR) at The 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22751 2025-10-28 cs.AI cs.CL 76%

Multi-Modal Fact-Verification Framework for Reducing Hallucinations in Large Language Models

Piyushkumar Patel

机构 * Microsoft(微软)

专题命中 其他多模态 :multi-modal(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21765 2025-10-28 cond-mat.soft 71%

Beyond mechanochromism: Programmable multimodal actuation in cholesteric liquid crystal elastomer hollow fibers

Jiazhe Ma, John S. Biggins, Fan Feng, Zhongqiang Yang

专题命中 其他多模态 :multimodal(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22729 2025-10-28 cs.AI cs.CL 62%

Critical Insights into Leading Conversational AI Models

Urja Kohli, Aditi Singh, Arun Sharma

专题命中 其他多模态 :multimodal(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 7 tables, 3 figures. Open-access preprint intended for journal or conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17047 2025-10-28 cs.CL 57%

Modeling Bottom-up Information Quality during Language Processing

Cui Ding, Yanning Yin, Lena A. Jäger, Ethan Gotlieb Wilcox

专题命中 其他多模态 :multimodal(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02366 2025-10-28 cs.LG cs.CL q-fin.TR 57%

Language Model Guided Reinforcement Learning in Quantitative Trading

Adam Darmanin, Vince Vella

机构 * University of Malta(马耳他大学)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CL

Comments 12 pages (4 pages appendix and references) and 6 figures. Accepted for presentation at FLLM 2025, Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14677 2025-10-28 cs.CV 57%

Visionary-R1: Mitigating Shortcuts in Visual Reasoning with Reinforcement Learning

Jiaer Xia, Yuhang Zang, Peng Gao, Sharon Li, Kaiyang Zhou

机构 * Hong Kong Baptist University(香港 Baptist 大学) Shanghai AI Lab(上海人工智能实验室) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23362 2025-10-28 cs.LG stat.ML 50%

Robust Non-negative Proximal Gradient Algorithm for Inverse Problems

Hanzhang Wang, Zonglin Liu, Jingyi Xu, Chenyang Wang, Zhiwei Zhong, Qiangqiang Shen

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Beihang University(北京航空航天大学) Harbin Institute of Technology(哈尔滨工业大学) City University of Hong Kong(香港城市大学)

专题命中 其他多模态 :multi-modal(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22913 2025-10-28 eess.SP cs.HC cs.LG cs.RO q-bio.NC 50%

Clinic-Oriented Feasibility of a Sensor-Fused Wearable for Upper-Limb Function

Thanyanee Srichaisak, Arissa Ieochai, Aueaphum Aueawattthanaphisut

专题命中 其他多模态 :multimodal(abstract)

Comments 19 pages, 7 figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏