arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-10 至 2026-02-10 共收录 192 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 48 篇

2602.08815 2026-02-10 cs.AI 57%

Negative-Aware Diffusion Process for Temporal Knowledge Graph Extrapolation

面向时间知识图谱外推的负感知扩散过程

Yanglei Gan, Peng He, Yuxiang Cai, Run Lin, Guanyu Zhou, Qiao Liu

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 NADEx通过引入负感知扩散模型,改进时间知识图谱外推中正负上下文的平衡与去噪嵌入校准,实现更准确的未来事实预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08234 2026-02-10 cs.LG 57%

SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning

SkillRL: 通过递归技能增强强化学习进化智能体

Peng Xia, Jianwen Chen, Hanyang Wang, Jiaqi Liu, Kaide Zeng, Yu Wang, Siwei Han, Yiyang Zhou, Xujiang Zhao, Haifeng Chen, Zeyu Zheng, Cihang Xie, Huaxiu Yao

机构 * University of Chicago(芝加哥大学) University of California San Diego(加州大学圣地亚哥分校) NEC Labs America(NEC美国实验室) University of California Berkeley(加州大学伯克利分校) University of California Santa Cruz(加州大学圣克鲁兹分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 SkillRL通过递归技能增强强化学习,有效提升智能体在复杂任务中的表现与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21868 2026-02-10 cs.HC cs.CL 57%

What Makes LLM Agent Simulations Useful for Policy Practice? An Iterative Design Study in Emergency Preparedness

是什么使大语言模型代理模拟对政策实践有用?一项关于应急准备的迭代设计研究

Yuxuan Li, Sauvik Das, Hirokazu Shirado

机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 本文通过迭代设计研究,探讨了LLM代理模拟在应急准备中的应用,发现通过可验证场景建立信任、获取隐性知识以及共同进化模拟与政策实施是提升其对政策实践有用性的关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07848 2026-02-10 cs.LG 57%

MARTI-MARS$^2$: Scaling Multi-Agent Self-Search via Reinforcement Learning for Code Generation

MARTI-MARS$^2$:通过强化学习实现多智能体自搜索的扩展用于代码生成

Shijie Wang, Pengfei Li, Yikun Fu, Kaifeng Liu, Fangyuan Li, Yang Liu, Xiaowei Sun, Zonglin Li, Siyao Zhao, Jian Zhao, Kai Tian, Dong Li, Junqi Gao, Yutong Zhang, Yiqun Chen, Yuqiang Li, Zoe Li, Weinan Zhang, Peng Ye, Shuyue Hu, Lei Bai, Bowen Zhou, Kaiyan Zhang, Biqing Qi

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Shanghai Jiao Tong University(上海交通大学) Institute of Automation(自动化研究所) Fudan University(复旦大学) High School Affiliated to Fudan University(复旦大学附属高中) Renmin University of China(中国人民大学) University of Washington(华盛顿大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 MARTI-MARS2通过多智能体强化学习实现代码生成的扩展,突破单智能体限制,提升性能和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07755 2026-02-10 cs.AI 57%

Learning to Continually Learn via Meta-learning Agentic Memory Designs

通过元学习代理记忆设计实现持续学习

Yiming Xiong, Shengran Hu, Jeff Clune

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute(向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出ALMA框架,通过元学习自动设计记忆模块,使代理系统在多样化领域实现持续学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07652 2026-02-10 cs.CR cs.AI 57%

Agent-Fence: Mapping Security Vulnerabilities Across Deep Research Agents

Agent-Fence: 在深度研究代理中映射安全漏洞

Sai Puppala, Ismail Hossain, Md Jahangir Alam, Yoonpyo Lee, Jay Yoo, Tanzim Ahad, Syed Bahauddin Alam, Sajedul Talukder

机构 * Computer Science Department, Southern Illinois University(索尔坦大学计算机科学系) Computer Science Department, University of Texas(德克萨斯大学计算机科学系) Hanyang University(翰阳大学) The Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格雷格尔工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 Agent-Fence通过定义14种信任边界攻击类别,评估深度代理的安全性,发现高风险类别如Denial-of-Wallet和Authorization Confusion,揭示代理在持久交互中的安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07609 2026-02-10 cs.SE cs.AI 57%

Evaluating Large Language Models for Detecting Architectural Decision Violations

评估大型语言模型在检测架构决策违规方面的表现

Ruoyu Su, Alexander Bakhtin, Noman Ahmad, Matteo Esposito, Valentina Lenarduzzi, Davide Taibi

机构 * University of Oulu, Finland(奥卢大学,芬兰) University of Southern Denmark, Vejle, Denmark(南部丹麦大学,维杰)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究评估了大型语言模型在检测架构决策违规方面的有效性,发现其在显式决策上表现良好,但在隐式决策上存在局限,需结合专家评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07398 2026-02-10 cs.CR cs.AI 57%

AgentSys: Secure and Dynamic LLM Agents Through Explicit Hierarchical Memory Management

AgentSys: 通过显式分层内存管理实现安全且动态的LLM代理

Ruoyao Wen, Hao Li, Chaowei Xiao, Ning Zhang

机构 * Washington University in St. Louis(圣路易斯华盛顿大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 AgentSys通过显式分层内存管理有效防御间接提示注入攻击,显著降低攻击成功率并提升LLM代理的安全性和动态性。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00030 2026-02-10 cs.LG 57%

RAPTOR-AI for Disaster OODA Loop: Hierarchical Multimodal RAG with Experience-Driven Agentic Decision-Making

RAPTOR-AI用于灾难OODA循环:基于经验驱动的多模态RAG框架

Takato Yasuno

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 RAPTOR-AI通过分层多模态RAG框架,结合经验驱动的代理控制和LoRA适应,提升灾害响应中的检索精度、情境基础性和任务分解准确性。

Comments 8 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22009 2026-02-10 cs.AI 57%

OpenPhone: Mobile Agentic Foundation Models

OpenPhone: 移动代理基础模型

Yangqin Jiang, Chao Huang

机构 * The University of Hong Kong(香港大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 OpenPhone通过设备-云协作提升移动GUI代理性能,结合设备端高效模型与云端强大能力,实现成本降低与性能提升的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15476 2026-02-10 cs.CV cs.AI 57%

LGMSNet: Thinning a medical image segmentation model via dual-level multiscale fusion

LGMSNet: 通过双级多尺度融合来简化医学图像分割模型

Chengqi Dong, Fenghe Tang, Rongge Mao, Xinpei Gao, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences Medicine, University of Science Center for Medical Imaging, Robotics, Analytic Computing \& Learning (MIRACLE), Suzhou Institute for Advance Research, USTC, Suzhou, 215123, China Key Laboratory of Intelligent Information Processing of Chinese Academy of Sciences (CAS), Institute of Computing Technology, CAS, Beijing, 100190, China Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology, Suzhou, 215123, China State Key Laboratory of Precision \& Intelligent Chemistry, USTC, Hefei, China

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 LGMSNet通过双级多尺度融合技术,实现轻量级医学图像分割模型的高效性能与高泛化能力。

Comments Accepted by ECAI 2025

Journal ref Frontiers in Artificial Intelligence and Applications, 413, 739-746 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08822 2026-02-10 cs.CV 50%

Any-to-All MRI Synthesis: A Unified Foundation Model for Nasopharyngeal Carcinoma and Its Downstream Applications

任意到全部MRI合成:鼻咽癌及其下游应用的统一基础模型

Yao Pu, Yiming Shi, Zhenxi Zhang, Peixin Yu, Yitao Zhuang, Xiang Wang, Hongzhao Chen, Jing Cai, Ge Ren

专题命中 规划推理 :planning(abstract)

AI总结 本文提出统一基础模型实现任意到全部MRI合成,提升鼻咽癌放疗的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08421 2026-02-10 cs.RO 50%

Decentralized Intent-Based Multi-Robot Task Planner with LLM Oracles on Hyperledger Fabric

基于Hyperledger Fabric的去中心化意图多机器人任务规划器与LLM预言机

Farhad Keramat, Salma Salimi, Tomi Westerlund

专题命中 规划推理 :planning(abstract)

AI总结 本文提出基于Hyperledger Fabric的去中心化多机器人任务规划器,结合LLM预言机与新聚合方法,实现意图分解与多机器人协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08368 2026-02-10 cs.MM cs.GR cs.HC cs.MA 50%

T2VTree: User-Centered Visual Analytics for Agent-Assisted Thought-to-Video Authoring

T2VTree: 以用户为中心的视觉分析用于代理辅助的思维到视频创作

Zhuoyun Zheng, Yu Dong, Gaorong Liang, Guan Li, Guihua Shan, Shiyu Cheng, Dong Tian, Jianlong Zhou, Jie Liang

专题命中 规划推理 :planning(abstract)

AI总结 T2VTree通过树形可视化和可编辑代理计划,支持多场景视频创作中的可靠细化、局部比较和实用重用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21449 2026-02-10 cs.RO cs.DC 50%

Nimbus: A Unified Embodied Synthetic Data Generation Framework

Nimbus:一个统一的具身合成数据生成框架

Zeyu He, Yuchang Zhang, Yuanzhen Zhou, Miao Tao, Hengjie Li, Hui Wang, Yang Tian, Jia Zeng, Tai Wang, Wenzhe Cai, Yilun Chen, Ning Gao, Jiangmiao Pang

专题命中 规划推理 :planning(abstract)

AI总结 Nimbus通过统一的四层架构和解耦执行模型,提升合成数据生成的吞吐量和稳定性,支持大规模分布式环境下的持续高吞吐数据生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17541 2026-02-10 cs.RO 50%

Distributed Spatial-Temporal Trajectory Optimization for Unmanned-Aerial-Vehicle Swarm

分布式空间-时间轨迹优化用于无人机群

Xiaobo Zheng, Pan Tang, Defu Lin, Shaoming He

机构 * School of Aerospace Engineering, 5th Zhongguancun South Street(航空航天工程学院,中关村南大街5号) No.1 Beijing Dahongmen South Road(北京红门南街1号)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种分布式空间-时间轨迹优化框架,利用ADMM和DDP实现无人机群的多智能体共识与快速局部规划,通过参数化DDP和自适应调节准则提升大规模无人机群的轨迹优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07663 2026-02-10 math.OC cs.DS 50%

A Two-Layer Framework for Joint Online Configuration Selection and Admission Control

一种用于联合在线配置选择和接入控制的双层框架

Owen Shen, Haoran Xu, Yinyu Ye, Peter Glynn, Patrick Jaillet

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种双层框架,用于联合在线配置选择和接入控制,通过SP-UCB--OLP算法实现了~O(√(KT))的遗憾界。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 视觉空间推理 14 篇

2602.08339 2026-02-10 cs.AI cs.CV 88%

CoTZero: Annotation-Free Human-Like Vision Reasoning via Hierarchical Synthetic CoT

CoTZero:通过分层合成CoT实现无标注的人类级视觉推理

Chengyi Du, Yazhe Niu, Dazhong Shen, Luxin Xu

机构 * University of Electronic Science and Technology of China(电子科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong MMLab(香港中文大学 MMLab) The College of Computer Science and Technology(计算机科学与技术学院) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 视觉空间推理 :reasoning(title,abstract);CoT(title,abstract);分类 cs.AI

AI总结 CoTZero通过双阶段数据合成和认知对齐训练,实现无标注的人类级视觉推理,提升模型的层次推理和泛化能力。

Comments 16 pages 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07082 2026-02-10 cs.CV cs.AI 83%

MosaicThinker: On-Device Visual Spatial Reasoning for Embodied AI via Iterative Construction of Space Representation

MosaicThinker: 通过迭代构建空间表示实现设备端具身AI的视觉空间推理

Haoming Wang, Qiyao Xue, Weichen Liu, Wei Gao

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) University of Pittsburgh(匹兹堡大学)

专题命中 视觉空间推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 MosaicThinker通过迭代构建空间表示,提升设备端具身AI在复杂跨帧空间推理任务中的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11397 2026-02-10 cs.CV 82%

EAGLE: Elevating Geometric Reasoning through LLM-empowered Visual Instruction Tuning

通过LLM赋能的视觉指令微调提升几何推理能力

Zhihao Li, Yao Du, Yang Liu, Yan Zhang, Yufang Liu, Mengdi Zhang, Xunliang Cai, Charles Ling, Boyu Wang

机构 * Department of Computer Science, Western University(计算机科学系,西部大学) Meituan Inc.(美团公司) Department of Automation, Tsinghua University(自动化系,清华大学) School of Computer Science and Technology, East China Normal University(计算机科学与技术学院,东华大学)

专题命中 视觉空间推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 EAGLE通过视觉增强框架提升几何推理能力,解决MLLMs在几何理解与视觉感知上的不足。

Comments revised version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07555 2026-02-10 cs.CV cs.AI 79%

VISOR: VIsual Spatial Object Reasoning for Language-driven Object Navigation

VISOR:基于语言驱动的对象导航的视觉空间对象推理

Francesco Taioli, Shiping Yang, Sonia Raychaudhuri, Marco Cristani, Unnat Jain, Angel X Chang

机构 * Polytechnic of Turin(都灵理工大学) Simon Fraser University(Simon Fraser大学) University of Verona(威尼斯大学) University of Reykjavik(雷克雅未克大学) University of California, Irvine(加州大学尔湾分校)

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.AI

AI总结 VISOR提出了一种紧凑的3B参数VLA智能体,通过显式图像基础推理实现人类般的具身推理,提升对象识别和动作选择的可解释性、泛化能力和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18845 2026-02-10 cs.AI 79%

UNeMo: Collaborative Visual-Language Reasoning and Navigation via a Multimodal World Model

UNeMo:通过多模态世界模型实现协作的视觉-语言推理与导航

Changxin Huang, Lv Tang, Zhaohuan Zhan, Lisha Yu, Runhao Zeng, Zun Liu, Zhengjie Wang, Jianqiang Li

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.AI

AI总结 UNeMo通过多模态世界模型实现视觉-语言推理与导航的协作优化,提升导航准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04333 2026-02-10 cs.CV cs.RO 78%

RAP: 3D Rasterization Augmented End-to-End Planning

RAP: 3D 像素化增强端到端规划

Lan Feng, Yang Gao, Eloi Zablocki, Quanyi Li, Wuyang Li, Sichao Liu, Matthieu Cord, Alexandre Alahi

机构 * EPFL(苏黎世联邦理工学院) Sorbonne Université(索邦大学)

专题命中 视觉空间推理 :planning(title,abstract)

AI总结 RAP通过3D像素化增强端到端规划,利用轻量级像素化和特征对齐实现可扩展的数据增强,提升闭环鲁棒性和长尾泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08241 2026-02-10 cs.AI cs.CV 77%

Do MLLMs Really See It: Reinforcing Visual Attention in Multimodal LLMs

MLLMs真的能看见吗:在多模态大语言模型中强化视觉注意力

Siqu Ou, Tianrui Wan, Zhiyuan Zhao, Junyu Gao, Xuelong Li

机构 * Shanghai Jiao Tong University(上海交通大学) Northwestern Polytechnical University(西北工业大学)

专题命中 视觉空间推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 SAYO通过强化学习框架引入区域级视觉注意力奖励,提升多模态大语言模型的视觉聚焦能力,从而在多种推理和感知任务中取得性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09002 2026-02-10 cs.RO cs.AI 70%

From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection

从障碍到礼仪:基于VLM引导路径选择的机器人社交导航

Zilin Fang, Anxing Xiao, David Hsu, Gim Hee Lee

机构 * School of Computing(计算机学院) Smart Systems Institute(智能系统研究所)

专题命中 视觉空间推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种结合几何规划与上下文社交推理的机器人社交导航框架,通过VLM模型优化路径选择,以减少对人类活动的干扰并遵守社会规范。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19942 2026-02-10 cs.SE 67%

Prometheus: Towards Long-Horizon Codebase Navigation for Repository-Level Problem Solving

Prometheus:面向仓库级问题解决的长周期代码库导航

Yue Pan, Zimin Chen, Siyu Lu, Zhaoyang Chu, Xiang Li, Han Li, Yang Feng, Claire Le Goues, Federica Sarro, Martin Monperrus, He Ye

专题命中 视觉空间推理 :reasoning(abstract);planning(abstract)

AI总结 Prometheus通过统一知识图谱和增强内存引擎,实现长周期代码库导航,提升仓库级问题解决的效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07061 2026-02-10 cs.LG cs.AI 62%

TACIT: Transformation-Aware Capturing of Implicit Thought

TACIT:面向隐式思维的变换感知捕捉

Daniel Nobrega

机构 * Independent Researcher(独立研究者)

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 TACIT提出一种基于扩散的Transformer模型,通过像素空间中的校正流实现可解释的视觉推理,在迷宫求解中展示了隐式思维的同步涌现特性。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08448 2026-02-10 cs.CV cs.AI 57%

Vista: Scene-Aware Optimization for Streaming Video Question Answering under Post-Hoc Queries

Vista:面向事后查询的场景感知流视频问答优化

Haocheng Lu, Nan Zhang, Wei Tao, Xiaoyang Qu, Guokuan Li, Jiguang Wan, Jianzong Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

AI总结 Vista通过场景感知分割、压缩和召回技术,实现了高效且可扩展的流视频问答,提升了长上下文推理能力,同时保持低延迟和内存效率。

Comments Accepted to AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07277 2026-02-10 cs.CV cs.LG 57%

Cross-View World Models

跨视角世界模型

Rishabh Sharma, Gijs Hogervorst, Wayne E. Mackey, David J. Heeger, Stefano Martiniani

机构 * Simons Center for Computational Physical Chemistry(Simon计算物理化学中心) Center for Soft Matter Research, Department of Physics(软物质研究中心,物理系) Statespace Labs, Inc.(Statespace公司) Center for Neural Science, New York University(神经科学中心,纽约大学) Department of Psychology, New York University(心理学系,纽约大学) Courant Institute of Mathematical Sciences, New York University(Courant数学科学研究所,纽约大学)

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

AI总结 本文提出跨视角世界模型,通过多视角预测训练智能体在不同视角下进行规划,提升空间感知与多智能体协作能力。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19191 2026-02-10 cs.CV 50%

Reading Images Like Texts: Sequential Image Understanding in Vision-Language Models

像阅读文本一样理解图像:视觉-语言模型中的序列图像理解

Yueyan Li, Chenggong Zhao, Zeyuan Zang, Caixia Yuan, Xiaojie Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 本文提出通过序列化方法理解图像内容,揭示视觉-语言模型中对象识别与空间感知的机制,改进解码效率并增强空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏