arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 665 信号源:cs.CV, cs.AI, cs.LG

1. 文档图表理解 665 篇

2310.04592 2023-10-10 cs.CL cs.HC 50%

From Nuisance to News Sense: Augmenting the News with Cross-Document Evidence and Context

Jeremiah Milbauer, Ziqi Ding, Zhijin Wu, Tongshuang Wu

专题命中 文档图表理解 :grounding(abstract)

Comments EMNLP 2023 (Demo Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.09486 2022-02-16 cs.CL 50%

Linking-Enhanced Pre-Training for Table Semantic Parsing

Bowen Qin, Lihan Wang, Binyuan Hui, Ruiying Geng, Zheng Cao, Min Yang, Jian Sun, Yongbin Li

专题命中 文档图表理解 :grounding(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08609 2021-11-17 cs.CL 50%

Document AI: Benchmarks, Models and Applications

Lei Cui, Yiheng Xu, Tengchao Lv, Furu Wei

专题命中 文档图表理解 :visual question answering(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.08426 2021-01-22 cs.CL 50%

Content Selection Network for Document-grounded Retrieval-based Chatbots

Yutao Zhu, Jian-Yun Nie, Kun Zhou, Pan Du, Zhicheng Dou

专题命中 文档图表理解 :grounding(abstract)

Comments ECIR 2021 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.04362 2019-06-12 cs.CL 50%

A Document-grounded Matching Network for Response Selection in Retrieval-based Chatbots

Xueliang Zhao, Chongyang Tao, Wei Wu, Can Xu, Dongyan Zhao, Rui Yan

专题命中 文档图表理解 :grounding(abstract)

Journal ref IJCAI 2019

详情

展开后加载摘要…

URL PDF HTML 收藏