IDE-Net: Interactive Driving Event and Pattern Extraction from Human Data
专题命中 推理评测 :planning(abstract);分类 cs.AI、cs.LG
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 推理评测 :planning(abstract);分类 cs.AI、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments 15 pages, 9 figures, 4 tables. Accepted at CoNLL 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments 12 pages, 4 figures. Accepted to EMNLP'20 Findings
专题命中 推理评测 :planning(abstract);分类 cs.AI、cs.LG
Comments 20 pages, 8 figures, 1 table
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments Accepted to ICLR 2020, 17 pages, 15 figures. Main paper has 9 pages
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
Comments To Appear at ACL 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments Accepted by SIGDIAL 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
Comments ACL 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.AI、cs.LG
Comments Accepted at IJCAI 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
Comments Adding results with ALBERT
专题命中 推理评测 :reasoning(abstract);分类 cs.AI、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
Comments Accepted by ICLR 2020
专题命中 推理评测 :reasoning(abstract);分类 cs.AI、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments To appear in the Proceedings of the Human-Centered AI: Trustworthiness of AI Models & Data (HAI) track at AAAI Fall Symposium, DC, November 7-9, 2019
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
Comments Accepted to EMNLP 2019
专题命中 推理评测 :reasoning(abstract);分类 cs.AI、cs.LG
Comments AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE) 2019
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.LG
Comments 8 pages, Appeared in RepEval 2019
专题命中 推理评测 :planning(abstract);分类 cs.CL、cs.LG
专题命中 推理评测 :planning(abstract);分类 cs.AI、cs.LG
Comments Preprint submitted to ASME JMD
专题命中 推理评测 :reasoning(abstract);分类 cs.AI、cs.LG
Comments 4th Multidisciplinary Conference on Reinforcement Learning and Decision Making
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI
PinpointQA: 一个用于室内视频中微小物体中心空间理解的数据集和基准
机构 * Jilin University(吉林大学) ; National Taiwan University(国立台湾大学)
专题命中 推理评测 :reasoning(abstract,comments);分类 cs.AI
AI总结 本文提出PinpointQA数据集,用于评估多模态大语言模型在室内视频中对微小物体空间定位的精准理解能力,通过四个递进任务验证模型性能,并展示其作为诊断基准和训练数据集的效果。
Comments Accepted at the ECCV 2026 Workshop on Embodied Multimodal Reasoning in Physical Environments (EMR)
Mini-BEHAVIOR-Gran:揭示指令粒度对语言引导的具身智能体的影响
机构 * Faculty of Information Technology, Monash University(信息技术学院,莫纳什大学)
专题命中 推理评测 :planning(abstract,comments);分类 cs.AI
AI总结 本文提出Mini-BEHAVIOR-Gran基准,通过多级指令变体研究指令粒度对具身智能体性能的影响,发现粒度与性能呈非单调U型关系,粗粒度性能反弹与浅层 grounding 有关。
Comments 23 pages, Keywords: Language Grounding, Language Granularity, Instruction Following Agent, Width-based Planning Research Area: Multimodality and Language Grounding to Vision, Robotics and Beyond Research Area Keywords: vision language navigation, multimodality, neurosymbolic approaches
观察者,而非玩家:通过游戏观察模拟大语言模型中的理论心理论
机构 * Department of Management Information Systems, National ChengChi University(管理信息系,国立中正大学)
专题命中 推理评测 :reasoning(abstract,comments);分类 cs.AI
AI总结 通过游戏观察模拟大语言模型中的理论心理论,评估其在顺序行为中的推理能力。
Comments Accepted at NeurIPS Workshop on Foundations of Reasoning in Language Models and Workshop on Bridging Language, Agent, and World Model