arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-08-27 至 2025-08-27 共收录 46 信号源:cs.CL, cs.AI, cs.LG

1. 推理评测 10 篇

2508.18430 2025-08-27 cs.CV cs.AI 57%

CLARIFY: A Specialist-Generalist Framework for Accurate and Lightweight Dermatological Visual Question Answering

Aranya Saha, Tanvir Ahmed Khan, Ismam Nur Swapnil, Mohammad Ariful Haque

机构 * Aranya Saha ∗ , Tanvir Ahmed Khan ∗ , Ismam Nur Swapnil ∗ , and Mohammad Ariful Haque ∗(无明确机构)

专题命中 推理评测 :reasoning(abstract);分类 cs.AI

Comments 10 pages, 8 figures, Prepared for submission to IEEE Transactions on Human-Machine Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14137 2025-08-27 cs.CV cs.CL 57%

VAGUE: Visual Contexts Clarify Ambiguous Expressions

Heejeong Nam, Jinwoo Ahn, Keummin Ka, Jiwan Chung, Youngjae Yu

机构 * Brown University(布朗大学) UC Berkeley(加州大学伯克利分校) Yonsei University(延世大学)

专题命中 推理评测 :reasoning(abstract);分类 cs.CL

Comments ICCV 2025, 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16902 2025-08-27 cs.AI 57%

Integrating Large Language Model for Improved Causal Discovery

Taiyu Ban, Lyuzhou Chen, Derui Lyu, Xiangyu Wang, Qinrui Zhu, Qiang Tu, Huanhuan Chen

机构 * School of Computer Science and Technology, University of Science and Technology of China(计算机科学与技术学院,中国科学技术大学) University of Science and Technology of China(中国科学技术大学) Laboratory for Big Data and Decision, University of Science and Technology of China(大数据与决策实验室,中国科学技术大学) First Affiliated Hospital of University of Science and Technology of China(中国科学技术大学第一附属医院)

专题命中 推理评测 :reasoning(abstract);分类 cs.AI

Comments 13 pages, 5 figures

Journal ref IEEE Transactions on Artificial Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18372 2025-08-27 cs.CV 50%

OpenEvents V1: Large-Scale Benchmark Dataset for Multimodal Event Grounding

Hieu Nguyen, Phuc-Tan Nguyen, Thien-Phuc Tran, Minh-Quang Nguyen, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science(科学大学) University of Dayton(戴维森大学)

专题命中 推理评测 :reasoning(abstract)

Comments ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他推理 12 篇

2508.18773 2025-08-27 cs.CL 83%

ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models

Qianyu He, Siyu Yuan, Xuefeng Li, Mingxuan Wang, Jiangjie Chen

机构 * Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) SIA-Lab of Tsinghua AIR(清华大学AIR实验室)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04422 2025-08-27 cs.CL 83%

Long-context Language Models Fail in Basic Retrieval Tasks Without Sufficient Reasoning Steps

Yijiong Yu, Yongfeng Huang, Zhixiao Qi, Wei Wang, Weifeng Liu, Ran Chen, Ji Pei

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments Our code is publicly available at https://github.com/yuyijiong/hard_retrieval_for_llm and the datasets is at https://huggingface.co/datasets/yuyijiong/difficult_retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05520 2025-08-27 cs.AI 79%

Architecting Clinical Collaboration: Multi-Agent Reasoning Systems for Multimodal Medical VQA

Karishma Thakrar, Shreyas Basavatia, Akshay Daftardar

机构 * Georgia Institute of Technology Atlanta, GA, USA(佐治亚理工学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20533 2025-08-27 cs.CL 79%

Accelerate Parallelizable Reasoning via Parallel Decoding within One Sequence

Yijiong Yu

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments Our code is available in https://github.com/yuyijiong/parallel-decoding-in-one-sequence

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18763 2025-08-27 cs.AI 57%

Dynamic Collaboration of Multi-Language Models based on Minimal Complete Semantic Units

Chao Hao, Zezheng Wang, Yanhua Huang, Ruiwen Xu, Wenzhe Niu, Xin Liu, Zitong Yu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments Accepted by EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18588 2025-08-27 cs.LG cs.DC 57%

History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL

Jingkai He, Tianjian Li, Erhu Feng, Dong Du, Qian Liu, Tao Liu, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学) ByteDance(字节跳动)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18467 2025-08-27 cs.AI 57%

The AI in the Mirror: LLM Self-Recognition in an Iterated Public Goods Game

Olivia Long, Carter Teplica

机构 * Columbia University(哥伦比亚大学) Mila, Polytechnique Montréal(蒙特利尔大学Mila)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18387 2025-08-27 cs.CL 57%

Integral Transformer: Denoising Attention, Not Too Much Not Too Little

Ivan Kobyzev, Abbas Ghaddar, Dingtao Hu, Boxing Chen

机构 * Huawei Noah’s Ark Lab, Montreal Research Center, Canada(华为诺亚实验室,蒙特利尔研究中心,加拿大)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04633 2025-08-27 cs.CV cs.AI 57%

M$^2$IV: Towards Efficient and Fine-grained Multimodal In-Context Learning via Representation Engineering

Yanshu Li, Yi Cao, Hongyang He, Qisen Cheng, Xiang Fu, Xi Xiao, Tianyang Wang, Ruixiang Tang

机构 * Brown University(布朗大学) University of Warwick(沃里克大学) Samsung US(三星美国分公司) Boston University(波士顿大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Rutgers University(罗格斯大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments COLM 2025, 30 pages, 10 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19402 2025-08-27 cs.LG 57%

General Intelligence Requires Reward-based Pretraining

Seungwook Han, Jyothish Pari, Samuel J. Gershman, Pulkit Agrawal

机构 * Improbable AI Lab, MIT(Improbable AI Lab,麻省理工学院) Department of Psychology(心理学系) Center for Brain Science, Harvard University(哈佛大学脑科学中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

Comments https://improbableai.notion.site/General-Intelligence-Requires-Reward-Based-Pretraining-2023b66e4cf580d3ab44c7860b75d25f?pvs=73

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18725 2025-08-27 cs.NI cs.IT math.IT 50%

Toward Edge General Intelligence with Agentic AI and Agentification: Concepts, Technologies, and Future Directions

Ruichen Zhang, Guangyuan Liu, Yinqiu Liu, Changyuan Zhao, Jiacheng Wang, Yunting Xu, Dusit Niyato, Jiawen Kang, Yonghui Li, Shiwen Mao, Sumei Sun, Xuemin Shen, Dong In Kim

专题命中 其他推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18499 2025-08-27 cs.HC 50%

Skeptik: A Hybrid Framework for Combating Potential Misinformation in Journalism

Arlen Fan, Fan Lei, Steven R. Corman, Ross Maciejewski

专题命中 其他推理 :reasoning(abstract)

Comments Arlen Fan and Fan Lei contributed equally to this research. Accepted by ACM Transactions on Interactive Intelligent Systems (TiiS)

详情

展开后加载摘要…

URL PDF HTML 收藏