arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-02 至 2026-03-02 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 11 篇

2602.22453 2026-03-02 cs.CL 83%

Bridging Latent Reasoning and Target-Language Generation via Retrieval-Transition Heads

通过检索-过渡头桥接潜在推理与目标语言生成

Shaswat Patel, Vishvesh Trivedi, Yue Han, Yihuai Hong, Eunsol Choi

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本研究通过引入检索-过渡头(RTH)揭示多语言模型中负责目标语言生成的关键注意力机制,并通过实验验证其在链式推理中的重要性。

Comments In the paper, there are still many statements that are unclear and lack sufficient justification. Since it is difficult for us to estimate how much time would be required to properly revise and correct these issues, we would like to request a withdrawal of the paper in this moment. Thank you!

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22543 2026-03-02 cs.LG 79%

FAPO: Flawed-Aware Policy Optimization for Efficient and Reliable Reasoning

FAPO:面向高效可靠推理的缺陷感知策略优化

Yuyang Ding, Chi Zhang, Juntao Li, Haibin Lin, Min Zhang

机构 * Soochow University(苏州大学) ByteDance Seed(字节跳动种子)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 FAPO通过引入缺陷感知机制,优化策略以提升大语言模型在高效可靠推理中的性能,提高结果正确性与训练稳定性。

Comments ICLR 2026. Project page: https://fapo-rl.github.io/; Infra Doc: https://verl.readthedocs.io/en/latest/advance/reward_loop.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02090 2026-03-02 cs.CL cs.AI 73%

LEC-KG: An LLM-Embedding Collaborative Framework for Domain-Specific Knowledge Graph Construction -- A Case Study on SDGs

LEC-KG: 一种基于大语言模型嵌入的领域知识图谱构建协作框架——以可持续发展目标为例

Yikai Zeng, Yingchao Piao, Changhua Pei, Jianhui Li

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 LEC-KG通过结合大语言模型与知识图谱嵌入的双向协作框架,有效解决领域知识图谱构建中的长尾关系问题,提升低频关系的识别与验证能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24100 2026-03-02 cs.AI cs.LG 62%

Artificial Agency Program: Curiosity, compression, and communication in agents

人工代理计划:代理中的好奇心、压缩与交流

Richard Csaky

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出人工代理计划,旨在通过整合好奇心、压缩与交流机制,构建资源受限的AI代理系统,以提升感知、理解和行动能力并减少人机交互摩擦。

Comments This is a working draft. Feedback and criticism is most welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00306 2026-03-02 q-bio.CB cs.AI cs.LG 62%

VCWorld: A Biological World Model for Virtual Cell Simulation

VCWorld:一种用于虚拟细胞模拟的生物世界模型

Zhijian Wei, Runze Ma, Zichen Wang, Zhongmin Li, Shuotong Song, Shuangjia Zheng

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 VCWorld通过整合生物学知识与大语言模型的推理能力,构建了可解释的虚拟细胞模拟模型,实现了对细胞扰动的高效预测和机理阐释。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24014 2026-03-02 cs.CV cs.AI 57%

Interpretable Debiasing of Vision-Language Models for Social Fairness

可解释的视觉-语言模型社会公平性偏见消除

Na Min An, Yoonna Jang, Yusuke Hirota, Ryo Hachiuma, Isabelle Augenstein, Hyunjung Shim

机构 * KAIST AI(韩国科学技术院人工智能研究所) University of Copenhagen(哥本哈根大学) NVIDIA(英伟达公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究提出DeBiasLens框架,通过稀疏自编码器局部化VLM中的社会属性神经元,以可解释的方式消除模型中的社会偏见,同时保持语义知识。

Comments 25 pages, 30 figures, 13 Tables Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23792 2026-03-02 cs.CL 57%

Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding

分而治之:通过自适应并行解码加速扩散式大语言模型

Xiangzhong Luo, Yilin An, Zhicheng Yu, Weichen Liu, Xu Yang

机构 * Southeast University(东南大学) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 DiCo通过分而治之的自适应并行解码方法,提升扩散式大语言模型的推理速度并保持生成质量。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19364 2026-03-02 cs.AI cs.MA 57%

Integrating LLM in Agent-Based Social Simulation: Opportunities and Challenges

将大语言模型整合到基于代理的社会模拟中:机遇与挑战

Patrick Taillandier, Jean Daniel Zucker, Arnaud Grignard, Benoit Gaudou, Nghi Quang Huynh, Alexis Drogoul

机构 * UR MIAT, University of Toulouse, INRAE, Castanet-Tolosan, France(法国图卢兹大学UR MIAT,INRAE,Castanet-Tolosan分校) UMI 209 UMMISCO, IRD/Sorbonne University, Bondy, France(法国Bondy IRD/索邦大学UMI 209 UMMISCO) LMI ACROSS, Thuyloi University, Hanoi, Vietnam(越南胡志明大学LMI ACROSS) UMR 5505 IRIT, University of Toulouse Capitole, Toulouse, France(法国图卢兹大学Capitole UMR 5505 IRIT) CICT, Can Tho University, Can Tho, Vietnam(越南金瓯大学CICT)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨了大语言模型在社会模拟中的应用,分析其潜力与局限,并提出混合宪法架构作为整合LLM与传统代理模型的可行方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23400 2026-03-02 cs.LG 57%

U-CAN: Utility-Aware Contrastive Attenuation for Efficient Unlearning in Generative Recommendation

U-CAN:面向生成推荐中高效遗忘的效用感知对比衰减

Zezheng Wu, Rui Wang, Xinghe Cheng, Yang Shao, Qing Yang, Jiapu Wang, Jingwei Zhang

机构 * Guilin University of Electronic Technology(桂林电子科技大学) University of Southampton(南安普顿大学) Jinan University(暨南大学) Nanjing University of Science and Technology(南京理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 U-CAN通过低秩适配器实现生成推荐中的高效隐私遗忘,利用效用感知对比衰减机制提升效用保留与计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24041 2026-03-02 cs.CV 50%

Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation

仔细观察:多模态大语言模型中的自适应视觉增强以缓解幻觉

Xingyu Zhu, Kesen Zhao, Liang Yi, Shuo Wang, Zhicai Wang, Beier Zhu, Hanwang Zhang

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(信息与电子技术联合实验室,中国科学技术大学) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究提出自适应视觉增强框架AIR,通过减少冗余标记和选择性整合补丁来缓解多模态大语言模型中的幻觉问题。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23952 2026-03-02 cs.CV 50%

CC-VQA: Conflict- and Correlation-Aware Method for Mitigating Knowledge Conflict in Knowledge-Based Visual Question Answering

CC-VQA: 一种考虑冲突和相关性的方法,用于缓解基于知识的视觉问答中的知识冲突

Yuyang Hong, Jiaqi Gu, Yujin Lou, Lubin Fan, Qi Yang, Ying Wang, Kun Ding, Yue Wu, Shiming Xiang, Jieping Ye

机构 * School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) MAIS, Institute of Automation(自动化研究所MAIS) Alibaba Cloud Computing(阿里云计算)

专题命中 其他推理 :reasoning(abstract)

AI总结 CC-VQA提出了一种无训练、考虑冲突和相关性的方法,通过视觉中心的上下文冲突推理和相关性引导的编码解码,提升基于知识的视觉问答的准确率。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏