arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-16 至 2026-02-16 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 7 篇

2512.19135 2026-02-16 cs.AI 79%

Understanding Chain-of-Thought in Large Language Models via Topological Data Analysis

通过拓扑数据分析理解大语言模型中的推理链

Chenghao Li, Chaoning Zhang, Yi Lu, Shuxu Chen, Xudong Wang, Jiaquan Zhang, Zhicheng Wang, Zhengxun Jin, Kuien Liu, Sung-Ho Bae, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * UESTC CNU KHU CAS Tongji Univ(同济大学)

专题命中 复杂问题求解 :chain-of-thought(title);reasoning(abstract);分类 cs.AI

AI总结 本文通过拓扑数据分析评估大语言模型推理链的结构复杂性,揭示其与准确性的正相关关系,为优化推理过程提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13134 2026-02-16 cs.IR 78%

Awakening Dormant Users: Generative Recommendation with Counterfactual Functional Role Reasoning

唤醒沉睡用户:基于反事实功能角色推理的生成推荐

Huishi Luo, Shuokai Li, Hanchen Yang, Zhongbo Sun, Haojie Ding, Boheng Zhang, Zijia Cai, Renliang Qian, Fan Yang, Tingting Gao, Chenyi Lei, Wenwu Ou, Fuzhen Zhuang

专题命中 复杂问题求解 :reasoning(title,abstract)

AI总结 RoleGen通过反事实功能角色推理和生成行为骨干,有效提升沉睡用户转化率,实现Recall@1和订单量的显著增长。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04884 2026-02-16 cs.CL cs.CV cs.LG 62%

Reinforced Attention Learning

强化注意力学习

Bangzheng Li, Jianmo Ni, Chen Qu, Ian Miao, Liu Yang, Xingyu Fu, Muhao Chen, Derek Zhiyuan Cheng

机构 * UC Davis(加州大学戴维斯分校) Google(谷歌) DeepMind(深Mind) Google DeepMind(谷歌DeepMind) Princeton University(普林斯顿大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 强化注意力学习通过优化内部注意力分布提升多模态模型的感知能力,实验显示其在多模态后期训练中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11079 2026-02-16 cs.AI 57%

Difficulty-Aware Agentic Orchestration for Query-Specific Multi-Agent Workflows

面向查询难度的代理 orchestration 为查询特定的多代理工作流

Jinwei Su, Qizhen Lan, Yinghui Xia, Lifan Sun, Weiyou Tian, Tianyu Shi, Xinyuan Song, Lewei He, Yang Jingsong

机构 * South China Normal University(华南师范大学) The University of Texas Health Science Center(德克萨斯大学健康科学中心) The Hong Kong University of Science(香港科学大学) University of California(加州大学) Peking University(北京大学) University of Toronto(多伦多大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出难度感知的代理 orchestration 方法,通过动态生成查询特定的多代理工作流,提升查询处理的准确性和效率。

Comments Accepted to WWW2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12311 2026-02-16 cs.SE cs.AI 57%

Perceptual Self-Reflection in Agentic Physics Simulation Code Generation

感知性自我反思在代理物理模拟代码生成中的应用

Prashant Shende, Bradley Camburn

机构 * Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 复杂问题求解 :self-correction(abstract);分类 cs.AI

AI总结 本文提出了一种多代理框架,通过感知性自我反思机制提升物理模拟代码生成的准确性与稳定性,验证了视觉反馈在物理模拟任务中的有效性。

Comments 15 pages, 2 figures, 2 tables. Introduces a multi-agent architecture for physics simulation code generation with perceptual self-reflection via vision-based validation. Includes qualitative evaluation across multiple physics domains

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03704 2026-02-16 cs.LG 57%

Memory Injection Attacks on LLM Agents via Query-Only Interaction

通过仅查询交互对LLM代理进行内存注入攻击

Shen Dong, Shaochen Xu, Pengfei He, Yige Li, Jiliang Tang, Tianming Liu, Hui Liu, Zhen Xiang

机构 * Michigan State University(密歇根州立大学) University of Georgia(佐治亚大学) Singapore Management University(新加坡管理大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.LG

AI总结 本文提出MINJA攻击,通过仅查询交互向LLM代理注入恶意记录,破坏其内存安全,揭示了代理内存安全的潜在风险。

Comments Code released

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12927 2026-02-16 cs.GT 50%

Solving Qualitative Multi-Objective Stochastic Games

求解定性多目标随机博弈

Moritz Graf, Anthony Lin, Rupak Majumdar

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 该研究探讨了多目标随机博弈的复杂性和确定性,证明了特定目标组合的博弈在PSPACE完全,而完整布尔组合则为NEXPTIME难。

Comments Accepted as a full paper at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏