arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

2025-08-13 至 2025-08-13 共收录 10 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 10 篇

2508.08633 2025-08-13 cs.AI cs.LO 79%

Diminution: On Reducing the Size of Grounding ASP Programs

HuanYu Yang, Fengming Zhu, YangFan Wu, Jianmin Ji

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08761 2025-08-13 cs.CL cs.AI 74%

DevNous: An LLM-Based Multi-Agent System for Grounding IT Project Management in Unstructured Conversation

Stavros Doropoulos, Stavros Vologiannidis, Ioannis Magnisalis

专题命中 视觉定位与Grounding :grounding(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11747 2025-08-13 cs.CV cs.AI 62%

OE3DIS: Open-Ended 3D Point Cloud Instance Segmentation

Phuc D. A. Nguyen, Minh Luu, Anh Tran, Cuong Pham, Khoi Nguyen

机构 * Movian AI Posts & Telecommunications Inst. of Tech(电信技术研究所)

专题命中 视觉定位与Grounding :multimodal large language model(abstract);分类 cs.CV、cs.AI

Comments Accepted at ICCVW'25 - OpenSUN3D: 5th Workshop on Open-World 3D Scene Understanding with Foundation Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09087 2025-08-13 cs.CV 57%

Addressing Bias in VLMs for Glaucoma Detection Without Protected Attribute Supervision

Ahsan Habib Akash, Greg Murray, Annahita Amireskandari, Joel Palko, Carol Laxson, Binod Bhattarai, Prashnna Gyawali

机构 * West Virginia University(西弗吉尼亚大学) University of Aberdeen(阿伯丁大学)

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.CV

Comments 3rd Workshop in Data Engineering in Medical Imaging (DEMI), MICCAI-2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08781 2025-08-13 cs.CV 57%

SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)

Trong-Thuan Nguyen, Viet-Tham Huynh, Quang-Thuc Nguyen, Hoang-Phuc Nguyen, Long Le Bao, Thai Hoang Minh, Minh Nguyen Anh, Thang Nguyen Tien, Phat Nguyen Thuan, Huy Nguyen Phong, Bao Huynh Thai, Vinh-Tiep Nguyen, Duc-Vu Nguyen, Phu-Hoa Pham, Minh-Huy Le-Hoang, Nguyen-Khang Le, Minh-Chinh Nguyen, Minh-Quan Ho, Ngoc-Long Tran, Hien-Long Le-Hoang, Man-Khoi Tran, Anh-Duong Tran, Kim Nguyen, Quan Nguyen Hung, Dat Phan Thanh, Hoang Tran Van, Tien Huynh Viet, Nhan Nguyen Viet Thien, Dinh-Khoi Vo, Van-Loc Nguyen, Trung-Nghia Le, Tam V. Nguyen, Minh-Triet Tran

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) University of Information Technology, VNU-HCM(越南胡志明市信息技术大学) Vietnam National University(越南国家大学) University of Dayton(戴维森大学)

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08632 2025-08-13 cs.AI 57%

AgriGPT: a Large Language Model Ecosystem for Agriculture

Bo Yang, Yu Zhang, Lanfei Feng, Yunkui Chen, Jianyu Zhang, Xiao Xu, Nueraili Aierken, Yurui Li, Yuxuan Chen, Guijun Yang, Yong He, Runhe Huang, Shijian Li

机构 * College of Computer Science and Technology, Zhejiang University, China(浙江大学计算机科学与技术学院) College of Software Technology, Zhejiang University, China(浙江大学软件学院) School of Geological Engineering and Geomatics, Chang’an University, China(长安大学地质工程与测绘学院) College of Biosystems Engineering and Food Science, Zhejiang University, China(浙江大学生物系统工程与食品科学学院) Faculty of Computer and Information Sciences, Hosei University, Japan(立命馆大学计算机与信息科学系)

专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10066 2025-08-13 cs.MM cs.CV 57%

LayLens: Improving Deepfake Understanding through Simplified Explanations

Abhijeet Narang, Parul Gupta, Liuyijia Su, Abhinav Dhall

机构 * Monash University(墨尔本大学)

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.CV

Comments Accepted to ACM ICMI 2025 Demos

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02488 2025-08-13 cs.CV 57%

SCB-Dataset: A Dataset for Detecting Student and Teacher Classroom Behavior

Fan Yang

机构 * Fan Yang

专题命中 视觉定位与Grounding :vision-language model(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08737 2025-08-13 cs.HC 50%

From Data to Insight: Using Contextual Scenarios to Teach Critical Thinking in Data Visualisation

Jonathan C. Roberts, Peter Butcher, Panagiotis D. Ritsos

专题命中 视觉定位与Grounding :grounding(abstract)

Comments 6 pages, 5 figures, IEEE VIS Workshop on Visualization Education, Literacy, and Activities 2025, Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21110 2025-08-13 gr-qc astro-ph.CO hep-th 50%

The frozen vanilla model: Exploring dark sector interactions with delta effective theories

Martín G. Richarte, Luiz F. Guimarães, Susana J. Landau, Júlio C. Fabris

专题命中 视觉定位与Grounding :grounding(abstract)

Comments 37 pages (double column format), 18 figures, and 4 appendices. References updated and version improved; accepted for publication in PRD

Journal ref Phys. Rev. D 112, 043510 2025

详情

展开后加载摘要…

URL PDF HTML 收藏