arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-29 至 2026-01-29 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 11 篇

2601.19061 2026-01-29 cs.CR cs.LG 89%

Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models

思维转移:链式思维推理模型的间接针对性污染攻击

Harsh Chaudhari, Ethan Rathbun, Hanna Foerster, Jamie Hayes, Matthew Jagielski, Milad Nasr, Ilia Shumailov, Alina Oprea

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出了一种名为思维转移的新型攻击方法,通过操纵不同任务学习的推理痕迹,对链式思维推理模型进行间接针对性污染攻击,成功影响目标任务的输出并提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01544 2026-01-29 cs.LG cs.AI cs.CL 85%

Compositional Reasoning with Transformers, RNNs, and Chain of Thought

基于变换器、RNN和思维链的组合推理

Gilad Yehudai, Noah Amsel, Joan Bruna

机构 * Courant Institute of Mathematical Sciences(Courant数学科学研究所) New York University(纽约大学) Center for Data Science(数据科学中心) Center for Computational Mathematics(计算数学中心) Flatiron Institute(Flatiron研究所)

专题命中 复杂问题求解 :reasoning(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了变换器、RNN和思维链架构在解决组合推理问题上的表现,证明了不同架构在处理此类问题时各有优劣,无一严格优于其他。

Comments NeurIPS CR version

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04207 2026-01-29 cs.LG cs.AI cs.CL cs.CV 82%

Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning

推动多模态推理:从优化冷启动到分阶段强化学习

Shuang Chen, Yue Guo, Zhaochen Su, Yafu Li, Yulun Wu, Jiacheng Chen, Jiayu Chen, Weijie Wang, Xiaoye Qu, Yu Cheng

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Soochow University(苏州大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ReVisual-R1,通过优化冷启动和分阶段强化学习提升多模态推理能力,在多个挑战性基准测试中取得新突破。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19952 2026-01-29 cs.SD cs.AI eess.AS 79%

LTS-VoiceAgent: A Listen-Think-Speak Framework for Efficient Streaming Voice Interaction via Semantic Triggering and Incremental Reasoning

LTS-VoiceAgent: 一种基于语义触发和增量推理的高效语音交互流式框架

Wenhao Zou, Yuwei Miao, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Jingwen Xu

机构 * Meituan(美团) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 LTS-VoiceAgent通过语义触发和增量推理实现高效语音交互,提升流式处理的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18543 2026-01-29 cs.CV 78%

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

GenAgent:通过代理多模态推理扩展文本到图像生成

Kaixun Jiang, Yuzheng Wang, Junjie Zhou, Pandeng Li, Zhihang Liu, Chen-Wei Xie, Zhaoyu Chen, Yun Zheng, Wenqiang Zhang

机构 * Fudan University(复旦大学) Tongyi Lab(通义实验室) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学)

专题命中 复杂问题求解 :reasoning(title,abstract)

AI总结 GenAgent通过代理多模态推理提升文本到图像生成性能,采用两阶段训练策略实现自主多轮交互与任务自适应推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08477 2026-01-29 cs.CL 70%

Read as You See: Guiding Unimodal LLMs for Low-Resource Explainable Harmful Meme Detection

读取即可见:引导单模LLM进行低资源可解释有害迷因检测

Fengjun Pan, Xiaobao Wu, Tho Quan, Anh Tuan Luu

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) Ho Chi Minh City University of Technology(胡志明市技术大学) VinUniversity(文大学)

专题命中 复杂问题求解 :reasoning(abstract);CoT(abstract);分类 cs.CL

AI总结 U-CoT+通过轻量级单模LLM和高保真迷因到文本管道,实现低资源、可解释的有害迷因检测,有效提升模型灵活性和适应性。

Comments Accepted to ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19942 2026-01-29 cs.LG cs.CL 62%

Latent Object Permanence: Topological Phase Transitions, Free-Energy Principles, and Renormalization Group Flows in Deep Transformer Manifolds

隐含物体恒存:深度变换器流形中的拓扑相变、自由能原理与重整化群流

Faruk Alpay, Bugra Kilictas

机构 * Department of Computer Engineering, Bahçeşehir University(计算机工程系,巴切谢希尔大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 研究深度变换器模型中多步推理的隐含物体恒存现象,通过拓扑相变和重整化群流揭示低熵区域的形成机制。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19620 2026-01-29 cs.LG cs.AI 62%

R^3: Replay, Reflection, and Ranking Rewards for LLM Reinforcement Learning

R^3: 为大语言模型强化学习的回放、反思与奖励排名

Zhizheng Jiang, Kang Zhao, Weikai Xu, Xinkui Lin, Wei Liu, Jian Luan, Shuo Shang, Peng Han

机构 * University of Electronic Science and Technology of China(电子科学与技术大学) Unaffiliated(无隶属机构) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 R^3通过回放、反思和奖励排名机制,提升大语言模型在强化学习中的稳定性和效率,实现数学领域性能突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00856 2026-01-29 econ.EM cs.AI 57%

Can AI Master Econometrics? Evidence from Econometrics AI Agent on Expert-Level Tasks

AI能否掌握计量经济学?来自计量经济学AI代理在专家级任务上的证据

Qiang Chen, Tianyang Han, Jin Li, Ye Luo, Zigan Wang, Yuxiao Wu, Xiaowei Zhang, Tuo Zhou

专题命中 复杂问题求解 :planning(abstract);分类 cs.AI

AI总结 本文提出MetricsAI,一个基于MetaGPT框架的计量经济学AI代理,通过实证分析展示其在专家级任务中超越传统模型的能力,推动社会科学研究的智能化与教育应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03578 2026-01-29 cs.MA cs.AI 57%

LLM Multi-Agent Systems: Challenges and Open Problems

大语言模型多智能体系统:挑战与开放问题

Shanshan Han, Qifan Zhang, Weizhao Jin, Zhaozhuo Xu

机构 * University of California, Irvine, CA, USA(加州大学尔湾分校) University of Southern California, Los Angeles, CA, USA(南加州大学) Stevens Institute of Technology, Hoboken, NJ, USA(史蒂文斯理工学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了多智能体系统在任务分配、推理增强和内存管理方面的挑战,并探讨其在区块链中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20552 2026-01-29 cs.CV 50%

DeepSeek-OCR 2: Visual Causal Flow

DeepSeek-OCR 2: 视觉因果流

Haoran Wei, Yaofeng Sun, Yukun Li

机构 * DeepSeek-AI

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 DeepSeek-OCR 2通过两个级联的一维因果推理结构实现二维图像理解,提升视觉处理的语义连贯性与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏