arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 10577 信号源:cs.CL, cs.AI, cs.LG

1. 推理评测 10577 篇

2203.12184 2022-07-18 cs.CL 57%

A Theoretically Grounded Benchmark for Evaluating Machine Commonsense

Henrique Santos, Ke Shen, Alice M. Mulvehill, Yasaman Razeghi, Deborah L. McGuinness, Mayank Kejriwal

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05875 2022-07-14 cs.CL 57%

A Novel DeBERTa-based Model for Financial Question Answering Task

Yanbo J. Wang, Yuming Li, Hui Qin, Yuhang Guan, Sheng Chen

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments 6 pages,3 figures,conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.00498 2022-06-14 cs.CL 57%

CUP: Curriculum Learning based Prompt Tuning for Implicit Event Argument Extraction

Jiaju Lin, Qin Chen, Jie Zhou, Jian Jin, Liang He

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accpeted by IJCAI 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.03021 2022-06-08 cs.CL 57%

Plot Writing From Pre-Trained Language Models

Yiping Jin, Vishakha Kadam, Dittaya Wanvarie

专题命中 推理评测 :planning(abstract);分类 cs.CL

Comments Accepted to INLG 2022; 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.01718 2022-06-06 cs.CV cs.CL 57%

A-OKVQA: A Benchmark for Visual Question Answering using World Knowledge

Dustin Schwenk, Apoorv Khandelwal, Christopher Clark, Kenneth Marino, Roozbeh Mottaghi

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.10090 2022-06-03 cs.AI cs.LO 57%

Meet MASKS: A novel Multi-Classifier's verification approach

Amirhoshang Hoseinpour Dehkordi, Majid Alizadeh, Ali Movaghar

专题命中 推理评测 :reasoning(abstract);分类 cs.AI

Comments 34 pages, 12 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.15022 2022-06-02 cs.CL 57%

'Just because you are right, doesn't mean I am wrong': Overcoming a Bottleneck in the Development and Evaluation of Open-Ended Visual Question Answering (VQA) Tasks

Man Luo, Shailaja Keyur Sampat, Riley Tallman, Yankai Zeng, Manuha Vancha, Akarshan Sajja, Chitta Baral

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments accepted to EACL 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.03065 2022-05-25 cs.CL 57%

Semantic-Enhanced Explainable Finetuning for Open-Domain Dialogues

Yinhe Zheng, Yida Wang, Pei Ke, Zhenyu Yang, Minlie Huang

专题命中 推理评测 :planning(abstract);分类 cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04467 2022-05-17 cs.CL 57%

How Does Data Corruption Affect Natural Language Understanding Models? A Study on GLUE datasets

Aarne Talman, Marianna Apidianaki, Stergios Chatzikyriakidis, Jörg Tiedemann

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments *SEM 2022 camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.06203 2022-05-13 cs.CL 57%

Predicting Human Psychometric Properties Using Computational Language Models

Antonio Laverghetta, Animesh Nighojkar, Jamshidbek Mirzakhalov, John Licato

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments To appear in Quantitative Psychology, The 86th Annual Meeting of the Psychometric Society, Virtual. arXiv admin note: substantial text overlap with arXiv:2106.06849

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.01523 2022-05-04 cs.CL 57%

ElitePLM: An Empirical Study on General Language Ability Evaluation of Pretrained Language Models

Junyi Li, Tianyi Tang, Zheng Gong, Lixin Yang, Zhuohao Yu, Zhipeng Chen, Jingyuan Wang, Wayne Xin Zhao, Ji-Rong Wen

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accepted by NAACL 2022 main conference (Long Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.14114 2022-05-02 cs.CL 57%

Developmental Negation Processing in Transformer Language Models

Antonio Laverghetta, John Licato

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments To appear as a short paper at ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.13921 2022-05-02 cs.CL 57%

QRelScore: Better Evaluating Generated Questions with Deeper Understanding of Context-aware Relevance

Xiaoqiang Wang, Bang Liu, Siliang Tang, Lingfei Wu

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08075 2022-04-28 cs.CL cs.CV 57%

Things not Written in Text: Exploring Spatial Commonsense from Visual Signals

Xiao Liu, Da Yin, Yansong Feng, Dongyan Zhao

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accepted by ACL 2022 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.03162 2022-04-26 cs.CV cs.CL 57%

Winoground: Probing Vision and Language Models for Visio-Linguistic Compositionality

Tristan Thrush, Ryan Jiang, Max Bartolo, Amanpreet Singh, Adina Williams, Douwe Kiela, Candace Ross

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.07302 2022-04-18 cs.CV cs.CL 57%

Improving Cross-Modal Understanding in Visual Dialog via Contrastive Learning

Feilong Chen, Xiuyi Chen, Shuang Xu, Bo Xu

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments ICASSP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.04541 2022-04-12 cs.CL 57%

KOBEST: Korean Balanced Evaluation of Significant Tasks

Dohyeong Kim, Myeongjun Jang, Deuk Sin Kwon, Eric Davis

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.02384 2022-03-07 eess.IV cs.CV cs.LG 57%

AutoMO-Mixer: An automated multi-objective Mixer model for balanced, safe and robust prediction in medicine

Xi Chen, Jiahuan Lv, Dehua Feng, Xuanqin Mou, Ling Bai, Shu Zhang, Zhiguo Zhou

专题命中 推理评测 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.08320 2022-02-18 cs.LG 57%

TorchDrug: A Powerful and Flexible Machine Learning Platform for Drug Discovery

Zhaocheng Zhu, Chence Shi, Zuobai Zhang, Shengchao Liu, Minghao Xu, Xinyu Yuan, Yangtian Zhang, Junkun Chen, Huiyu Cai, Jiarui Lu, Chang Ma, Runcheng Liu, Louis-Pascal Xhonneux, Meng Qu, Jian Tang

专题命中 推理评测 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.08541 2021-12-07 cs.AI 57%

DACBench: A Benchmark Library for Dynamic Algorithm Configuration

Theresa Eimer, André Biedenkapp, Maximilian Reimer, Steven Adriaensen, Frank Hutter, Marius Lindauer

专题命中 推理评测 :planning(abstract);分类 cs.AI

Comments Accepted at IJCAI 2021

Journal ref 30th International Joint Conference on Artificial Intelligence (IJCAI 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.07991 2021-11-09 cs.RO cs.CV cs.GR cs.LG 57%

ObjectFolder: A Dataset of Objects with Implicit Visual, Auditory, and Tactile Representations

Ruohan Gao, Yen-Yu Chang, Shivani Mall, Li Fei-Fei, Jiajun Wu

专题命中 推理评测 :reasoning(abstract);分类 cs.LG

Comments In CoRL 2021. Chang and Mall contributed equally to this work. Project page: https://ai.stanford.edu/~rhgao/objectfolder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.12053 2021-10-26 cs.AI 57%

Towards Dynamic Consistency Checking in Goal-directed Predicate Answer Set Programming

Joaquín Arias, Manuel Carro, Gopal Gupta

专题命中 推理评测 :reasoning(abstract);分类 cs.AI

Comments Submitted to PADL'22. arXiv admin note: text overlap with arXiv:2106.14566

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.11899 2021-10-25 cs.CV cs.CL 57%

Challenges in Procedural Multimodal Machine Comprehension:A Novel Way To Benchmark

Pritish Sahu, Karan Sikka, Ajay Divakaran

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.00371 2021-10-15 cs.CL 57%

On-the-Fly Attention Modulation for Neural Generation

Yue Dong, Chandra Bhagavatula, Ximing Lu, Jena D. Hwang, Antoine Bosselut, Jackie Chi Kit Cheung, Yejin Choi

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.06376 2021-10-14 cs.CL 57%

ALL Dolphins Are Intelligent and SOME Are Friendly: Probing BERT for Nouns' Semantic Properties and their Prototypicality

Marianna Apidianaki, Aina Garí Soler

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accepted to BlackboxNLP 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.07833 2021-10-14 cs.CL cs.HC 57%

Does External Knowledge Help Explainable Natural Language Inference? Automatic Evaluation vs. Human Ratings

Hendrik Schuff, Hsiu-Yu Yang, Heike Adel, Ngoc Thang Vu

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments BlackboxNLP @ EMNLP2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.08161 2021-10-14 cs.CL 57%

Back to Square One: Artifact Detection, Training and Commonsense Disentanglement in the Winograd Schema

Yanai Elazar, Hongming Zhang, Yoav Goldberg, Dan Roth

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08381 2021-09-23 cs.LG 57%

From Known to Unknown: Knowledge-guided Transformer for Time-Series Sales Forecasting in Alibaba

Xinyuan Qi, Kai Hou, Tong Liu, Zhongzhong Yu, Sihao Hu, Wenwu Ou

专题命中 推理评测 :planning(abstract);分类 cs.LG

Comments 8 pages, 7 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05620 2021-09-14 cs.CL 57%

RockNER: A Simple Method to Create Adversarial Examples for Evaluating the Robustness of Named Entity Recognition Models

Bill Yuchen Lin, Wenyang Gao, Jun Yan, Ryan Moreno, Xiang Ren

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2021 as a short paper. Project website: https://inklab.usc.edu/rockner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.12758 2021-09-10 cs.CL 57%

NUANCED: Natural Utterance Annotation for Nuanced Conversation with Estimated Distributions

Zhiyu Chen, Honglei Liu, Hu Xu, Seungwhan Moon, Hao Zhou, Bing Liu

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments Findings of EMNLP 2021

详情

展开后加载摘要…

URL PDF HTML 收藏