arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-12 至 2026-02-12 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 8 篇

2505.11924 2026-02-12 cs.CL cs.AI cs.LG 82%

Intrinsic Self-Correction in LLMs: Towards Explainable Prompting via Mechanistic Interpretability

大语言模型中的内在自我修正:通过机制可解释性实现可解释的提示

Yu-Ting Lee, Fu-Chieh Chang, Yu-En Shu, Hui-Ying Shih, Pei-Yuan Wu

机构 * Graduate Institute of Communication Engineering, National Taiwan University, Taipei, Taiwan(通讯工程研究院,国立台湾大学) MediaTek Research, Taipei, Taiwan(联发科研究,台北,台湾) Department of Electrical Engineering, National Taiwan University, Taipei, Taiwan(电气工程系,国立台湾大学) Department of Electrical Engineering, National Tsing Hua University, Hsinchu, Taiwan(电气工程系,国立清华大学) AI Research Center (AINTU), National Taiwan University, Taipei, Taiwan(人工智能研究中心(AINTU),国立台湾大学)

专题命中 复杂问题求解 :self-correction(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究通过机制可解释性揭示大语言模型中内在自我修正的机制,证明提示引导隐藏表示偏移是其核心驱动因素。

Journal ref 4th Deployable AI Workshop at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10148 2026-02-12 cs.CR cs.AI 79%

Red-teaming the Multimodal Reasoning: Jailbreaking Vision-Language Models via Cross-modal Entanglement Attacks

多模态推理的红队测试:通过跨模态纠缠攻击劫持视觉-语言模型

Yu Yan, Sheng Sun, Shengjia Cheng, Teli Liu, Mingfeng Li, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) People’s Public Security University of China(中国人民公安大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出CrossTALK方法,通过跨模态纠缠攻击提升对视觉-语言模型的劫持效果,实现高攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11114 2026-02-12 cs.MA cs.AI cs.LG cs.SE 62%

Learning to Compose for Cross-domain Agentic Workflow Generation

跨领域代理工作流生成中的学习组合

Jialiang Wang, Shengxiang Xu, Hanmo Liu, Jiachuan Wang, Yuyu Luo, Shimin Di, Min-Ling Zhang, Lei Chen

机构 * Hong Kong University of Science and Technology(香港理工大学) Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Southeast University(东南大学) University of Tsukuba(茨口大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于分解-重组-决策机制的跨领域代理工作流生成方法,通过学习可重用能力实现单次生成,提升效率并减少迭代成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10458 2026-02-12 cs.AI cs.LG 62%

Found-RL: foundation model-enhanced reinforcement learning for autonomous driving

Found-RL: 基于基础模型的强化学习用于自动驾驶

Yansong Qu, Zihao Sheng, Zilin Huang, Jiancong Chen, Yuhao Luo, Tianyi Wang, Yiheng Feng, Samuel Labi, Sikai Chen

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Found-RL通过异步批量推理和多样化监督机制,提升自动驾驶中强化学习的效率与实时性。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25112 2026-02-12 cs.AI cs.MA 57%

AI Driven Discovery of Bio Ecological Mediation in Cascading Heatwave Risks

由人工智能驱动的生物生态中介在连锁热浪风险中的发现

Yiquan Wang, Tin-Yeh Huang, Qingyun Gao, Yuhan Chang, Jialin Zhang

机构 * College of Mathematics and System Science, Xinjiang University, Urumqi, Xinjiang, China(数学与系统科学学院,新疆大学) Institute of Geographic Sciences and Natural Resources Research, Chinese Academy of Sciences, Beijing, China(地理科学与自然资源研究所,中国科学院) Department of Industrial and Systems Engineering, The Hong Kong Polytechnic University, Hong Kong, China(工业与系统工程系,香港理工大学) Xinya College, Tsinghua University, Beijing, China(清华学院) College of Architectural Engineering, Xinjiang University, Urumqi, Xinjiang, China(建筑工程学院,新疆大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本研究提出HeDA框架,通过构建知识图谱发现生物生态中介效应,揭示热浪风险的复杂系统性影响,并推动适应策略向动态跨系统韧性转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15922 2026-02-12 cs.CL 57%

Aligning Dialogue Agents with Global Feedback via Large Language Model Multimodal Reward Decomposition

通过大语言模型多模态奖励分解对齐对话代理

Dong Won Lee, Hae Won Park, Cynthia Breazeal, Louis-Philippe Morency

机构 * MIT(麻省理工学院) CMU(卡内基梅隆大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种基于大语言模型的多模态奖励分解方法,通过分解会话级反馈来提升对话生成质量,无需人工反馈。

Comments 9 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10146 2026-02-12 cs.CV cs.CL 57%

VERA: Identifying and Leveraging Visual Evidence Retrieval Heads in Long-Context Understanding

VERA:识别和利用长上下文理解中的视觉证据检索头

Rongcan Pei, Huan Li, Fang Guo, Qi Zhu

机构 * Tongji University(同济大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Amazon Web Services(亚马逊网络服务)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 VERA通过识别和利用视觉证据检索头,提升长上下文理解能力,显著提高开源VLMs的性能。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11409 2026-02-12 cs.CR cs.AI 57%

LLMs as Hackers: Autonomous Linux Privilege Escalation Attacks

大语言模型作为黑客:自主Linux提权攻击

Andreas Happe, Aaron Kaplan, Juergen Cito

机构 * TU Wien(维也纳技术大学) Deep-Insight AI(深洞察AI)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出hackingBuddyGPT,通过LLM实现自主Linux提权攻击,评估不同模型在提权任务中的性能,发现GPT-4-Turbo表现优异,接近人类渗透测试员水平。

详情

展开后加载摘要…

URL PDF HTML 收藏