arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-11 至 2025-12-11 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3 篇

2512.09340 2025-12-11 cs.AI cs.CV cs.LG 73%

Visual Categorization Across Minds and Models: Cognitive Analysis of Human Labeling and Neuro-Symbolic Integration

跨心灵与模型的视觉分类:人类标注与神经符号整合的认知分析

Chethana Prasad Kabgere

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过对比人类与AI在低分辨率图像标注中的表现,探讨了认知策略与神经符号整合方法的异同,旨在推动更可解释和认知对齐的AI系统发展。

Comments 12 pages, 3 figures. Research manuscript based on the final project for CS6795 (Introduction to Cognitive Science), Georgia Tech

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15843 2025-12-11 cs.CL cs.AI 62%

Enhanced Sentiment Interpretation via a Lexicon-Fuzzy-Transformer Framework

通过词典-模糊-变换器框架提升情感解释

Shayan Rokhva, Mousa Alizadeh, Maryam Abdollahi Shamami

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种结合规则启发式、上下文深度学习和模糊逻辑的混合框架,用于提升领域特定文本中情感极性和强度的识别精度。

Comments The manuscript was uploaded in error and is scientifically invalid. It is an incomplete draft with major flaws. Co-authors were not aware of or consenting to this submission and do not endorse it

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09187 2025-12-11 cs.MA cs.AI 57%

WOLF: Werewolf-based Observations for LLM Deception and Falsehoods

基于狼人游戏的LLM欺骗与虚假信息观测

Mrinal Agarwal, Saad Rana, Theo Sundoro, Hermela Berhe, Spencer Kim, Vasu Sharma, Sean O'Brien, Kevin Zhu

机构 * Algoverse AI Research(Algoverse AI研究院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 WOLF通过狼人游戏构建多智能体社交推理基准,评估LLM在欺骗生成与检测中的能力,展示动态交互提升欺骗识别性能。

Comments Spotlight Multi-Turn Interactions in Large Language Models (MTI-LLM) Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏