arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-06 至 2026-01-06 共收录 110 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 53 篇

2601.00928 2026-01-06 cs.CV cs.AI cs.RO 57%

Analyzing the Shopping Journey: Computing Shelf Browsing Visits in a Physical Retail Store

分析购物旅程:在物理零售店中计算货架浏览访问

Luis Yoichi Morales, Francesco Zanlungo, David M. Woollard

机构 * Standard AI University of Palermo(巴勒莫大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本研究提出一种算法用于计算物理零售店中的货架浏览访问,通过机器视觉和顶视相机获取轨迹数据,分析顾客浏览行为与实际购买的关系,为零售规划和人机交互提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22615 2026-01-06 cs.CV cs.CL 57%

Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone

Dream-VL & Dream-VLA: 基于扩散语言模型的开放视觉语言和视觉语言-动作模型

Jiacheng Ye, Shansan Gong, Jiahui Gao, Junming Fan, Shuang Wu, Wei Bi, Haoli Bai, Lifeng Shang, Lingpeng Kong

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 基于扩散语言模型构建的Dream-VL和Dream-VLA在视觉语言和视觉语言-动作任务中表现出色,实现了领先的性能。

Comments Add real-world experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21887 2026-01-06 cs.RO cs.AI 57%

Aerial World Model for Long-horizon Visual Generation and Navigation in 3D Space

空域世界模型用于3D空间中的长视距视觉生成与导航

Weichen Zhang, Peizhi Tang, Xin Zeng, Fanhang Man, Shiquan Yu, Zichao Dai, Baining Zhao, Hongjin Chen, Yu Shang, Wei Wu, Chen Gao, Xinlei Chen, Xin Wang, Yong Li, Wenwu Zhu

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ANWM是一种空域导航世界模型,通过预测未来视觉观察来提升无人机在大规模3D空间中的长视距导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14329 2026-01-06 cs.CE cs.AI 57%

Wearable-informed generative digital avatars predict task-conditioned post-stroke locomotion

基于可穿戴设备的生成式数字虚拟人预测任务条件下的中风后步态

Yanning Dai, Chenyu Tang, Ruizhi Zhang, Wenyu Yang, Yilan Zhang, Yuhui Wang, Junliang Chen, Xuhang Chen, Ruimou Xie, Yangyue Cao, Qiaoying Li, Jin Cao, Tao Li, Hubin Zhao, Yu Pan, Arokia Nathan, Xin Gao, Peter Smielewski, Shuo Gao

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 基于可穿戴设备的生成式数字虚拟人通过动态预测中风后步态,提升个性化康复效果。

Comments 27 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13201 2026-01-06 cs.CR cs.LG cs.MA 57%

CEE: An Inference-Time Jailbreak Defense for Embodied Intelligence via Subspace Concept Rotation

CEE: 通过子空间概念旋转实现体智能中的推断时间劫持防御

Jirui Yang, Zheyu Lin, Zhihui Lu, Yinggui Wang, Lei Wang, Tao Wei, Qiang Duan, Xin Du, Shuhan Yang

机构 * Fudan University(复旦大学) Dalian University of Technology(大连理工大学) Ant Group(蚂蚁集团) Pennsylvania State University(宾夕法尼亚州立大学) Zhejiang University(浙江大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 CEE通过动态构建子空间并应用SLERP旋转,实现体智能系统中高效的推断时间劫持防御,提升安全性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03600 2026-01-06 physics.soc-ph cs.AI cs.CY 57%

Social Media Informatics for Sustainable Cities and Societies: An Overview of the Applications, associated Challenges, and Potential Solutions

社交媒体信息学用于可持续城市与社会:应用、相关挑战和潜在解决方案的综述

Jebran Khan, Kashif Ahmad, Senthil Kumar Jagatheesaperumal, Nasir Ahmad, Kyung-Ah Sohn

机构 * Department of Artificial Intelligence, Ajou University Suwon South Korea Munster Technological University Cork Ireland Department of Electronics \& Communication Engineering, Mepco Schlenk Engineering College Sivakasi India Department of Software Computer Engineering, Ajou University Suwon South Korea , Department of Artificial Intelligence, Ajou University Suwon South Korea Department of Artificial Intelligence, Ajou University Munster Technological University Department of Electronics \& Communication Engineering, Mepco Schlenk Engineering College Computer Engineering, Ajou University

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文综述了社交媒体信息学在可持续城市和社会中的应用、挑战及解决方案,旨在为未来研究提供基础。

Comments 35 pages, 3 tables, and 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03104 2026-01-06 cs.AI 57%

ChatTS: Aligning Time Series with LLMs via Synthetic Data for Enhanced Understanding and Reasoning

通过合成数据对齐时间序列,利用大语言模型进行增强的理解与推理

Zhe Xie, Zeyan Li, Xiao He, Longlong Xu, Xidao Wen, Tieying Zhang, Jianjun Chen, Rui Shi, Dan Pei

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 ChatTS通过合成数据生成方法,首次实现了多变量时间序列的多模态大语言模型,显著提升了时间序列的理解与推理性能。

Comments accepted by VLDB' 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02210 2026-01-06 cs.ET 50%

Impact of Spatial Proximity on Drone Services

空间接近对无人机服务的影响

Vejaykarthy Srithar, Syeda Amna Rizvi, Amani Abusafia, Athman Bouguettaya, Balsam Alkouz

专题命中 规划决策 :planning(abstract)

AI总结 研究探讨无人机在近距离飞行时的能量消耗影响,通过实验和GUI分析揭示空间接近对无人机配送服务的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02207 2026-01-06 math.OC 50%

Risk-Averse Markov Decision Processes: Applications to Electricity Grid and Reservoir Management

风险规避的马尔可夫决策过程:应用于电力电网和水库管理

Arash Khojaste, Jonathan Pearce, Daniela Pucci de Farias, Geoffrey Pritchard, Golbon Zakeri

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于风险规避的马尔可夫决策过程模型,用于电力电网和水库管理,结合CVaR和可靠性导向的风险度量,提供高效求解方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02069 2026-01-06 econ.EM 50%

Reinforcement Learning Based Computationally Efficient Conditional Choice Simulation Estimation of Dynamic Discrete Choice Models

基于强化学习的计算高效条件选择模拟估计动态离散选择模型

Ahmed Khwaja, Sonal Srivastava

专题命中 规划决策 :agent(abstract)

AI总结 本文提出一种基于强化学习的计算高效条件选择模拟方法,用于高维动态离散选择模型的估计,结合了机器学习的可扩展性与结构模型的可解释性,提升模型在营销领域的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01948 2026-01-06 cs.RO 50%

Learning Diffusion Policy from Primitive Skills for Robot Manipulation

从基本技能学习扩散策略用于机器人操作

Zhihao Gu, Ming Yang, Difan Zou, Dong Xu

机构 * Dong Xu(东旭教授)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出SDP,一种基于技能的扩散策略,通过整合可解释的技能学习与条件动作规划,提升机器人操作中技能一致性与性能。

Comments Accepted to AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11480 2026-01-06 cs.CV 50%

CADMorph: Geometry-Driven Parametric CAD Editing via a Plan-Generate-Verify Loop

CADMorph: 通过计划-生成-验证循环实现几何驱动的参数化CAD编辑

Weijian Ma, Shizhao Sun, Ruiyu Wang, Jiang Bian

机构 * Fudan University(复旦大学) Microsoft Research, Asia(微软亚洲研究院) University of Toronto(多伦多大学)

专题命中 规划决策 :planning(abstract)

AI总结 CADMorph通过计划-生成-验证循环实现几何驱动的参数化CAD编辑,利用预训练模型在数据稀少情况下保持结构、语义和形状保真度,超越现有方法并支持下游应用。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12752 2026-01-06 cs.RO 50%

MOON: Multi-Objective Optimization-Driven Object-Goal Navigation Using a Variable-Horizon Set-Orienteering Planner

MOON:基于多目标优化的物体-目标导航变量视距集导向规划器

Daigo Nakajima, Kanji Tanaka, Daiki Iwata, Kouki Terashima

机构 * University of Fukui(福井大学)

专题命中 规划决策 :planning(abstract)

AI总结 MOON通过多目标优化解决大规模复杂环境中的导航问题,结合可变视距集导向规划和高效神经规划器,提升全局规划与实时决策效率。

Comments 9 pages, 7 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01864 2026-01-06 physics.ao-ph 50%

Extending SST Anomaly Forecasts Through Simultaneous Decomposition of Seasonal and PDO Modes

通过同时分解季节性和PDO模式扩展SST异常预测

Rameshan Kallummal

专题命中 规划决策 :planning(abstract)

AI总结 本文提出通过同时分解季节性和PDO模式来提高SST预测精度,揭示了PDO与季节性变率的耦合关系,为北太平洋气候研究提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01618 2026-01-06 cs.RO 50%

Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation

动作草图生成器:通过视觉草图实现从推理到动作的长周期机器人操作

Huajie Tan, Peterson Co, Yijie Xu, Shanyu Rong, Yuheng Ji, Cheng Chi, Xiansheng Chen, Qiongyu Zhang, Zhongxia Zhao, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(1 多媒体信息处理国家重点实验室,计算机科学学院,北京大学) Beijing Academy of Artificial Intelligence(2 北京人工智能研究院) University of Sydney(3 新南威尔士大学) Institute of Automation, Chinese Academy of Sciences(4 中国科学院自动化研究所)

专题命中 规划决策 :workflow(abstract)

AI总结 动作草图生成器通过视觉草图实现从推理到动作的长周期机器人操作,结合视觉-语言-动作框架提升任务执行的鲁棒性和可解释性。

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01507 2026-01-06 cs.CV 50%

DiffKD-DCIS: Predicting Upgrade of Ductal Carcinoma In Situ with Diffusion Augmentation and Knowledge Distillation

DiffKD-DCIS:基于扩散增强与知识蒸馏的导管癌原位癌升级预测

Tao Li, Qing Li, Na Li, Hui Xie

机构 * School of Medical Imaging, Laboratory Medicine and Rehabilitation, Xiangnan University(医学影像学院、实验室医学与康复学院,湘南大学) Department of Radiotherapy, Affiliated Hospital (Clinical College) of Xiangnan University(放疗科,湘南大学附属医院(临床学院)) Faculty of Applied Sciences, Macao Polytechnic University(应用科学学院,澳门 polytechnic 大学)

专题命中 规划决策 :planning(abstract)

AI总结 DiffKD-DCIS通过扩散增强与知识蒸馏方法,实现对导管癌原位癌升级的准确预测,提升诊断效率与临床价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01344 2026-01-06 stat.ME 50%

Adaptive Kernel Regression for Constrained Route Alignment: Theory and Iterative Data Sharpening

自适应核回归在约束路线对齐中的应用:理论与迭代数据锐化

Shiyin Du, Yiting Chen, Wenzhi Yang, Qiong Li, Xiaoping Shi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出自适应核回归方法,用于解决约束路线对齐问题,通过理论分析和实证应用,实现了平衡平滑性和精确点遵守的高效解决方案。

Comments 31 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01282 2026-01-06 cs.RO 50%

SAHA: Supervised Autonomous HArvester for selective forest thinning

SAHA:监督自主森林采伐机用于选择性森林疏伐

Fang Nan, Meher Malladi, Qingqing Li, Fan Yang, Joonas Juola, Tiziano Guadagnino, Jens Behley, Cesar Cadena, Cyrill Stachniss, Marco Hutter

专题命中 规划决策 :planning(abstract)

AI总结 SAHA 是一种基于小型机械采伐机的监督自主系统,用于在森林中进行选择性疏伐,通过先进的感知、规划和控制技术实现自主导航和精确操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01196 2026-01-06 cs.RO 50%

EduSim-LLM: An Educational Platform Integrating Large Language Models and Robotic Simulation for Beginners

EduSim-LLM: 一个整合大语言模型和机器人模拟的教育平台,用于初学者

Shenqi Lu, Liangwei Zhang

机构 * Hangzhou Dianzi University Information Engineering College(杭州电子科技大学信息工程学院)

专题命中 规划决策 :planning(abstract)

AI总结 EduSim-LLM通过整合大语言模型与机器人模拟,实现自然语言到机器人行为的转换,提升初学者在人机交互和多机器人协作中的控制与操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01174 2026-01-06 physics.geo-ph 50%

An Analytic Solution to the Optimal Spherical Dubins Path Problem with Geodesic Curvature Constraints

球面上具有测地曲率约束的最优Dubins路径问题的解析解

Linhong Li, Qi Feng, Yangang Liang, Kebo Li

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种解析方法,用于球面上具有测地曲率约束的最优Dubins路径计算,实现了高精度和高效能的解法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01125 2026-01-06 cs.DC 50%

Performance and Security Aware Distributed Service Placement in Fog Computing

雾计算中面向性能和安全的分布式服务部署

Mohammad Goudarzi, Arash Shaghaghi, Zhiyu Wang, Rajkumar Buyya

专题命中 规划决策 :agent(abstract)

AI总结 本文提出SPA-DDRL框架,通过深度强化学习优化雾计算中服务响应时间和安全合规性,实验显示在响应时间和收敛速度上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00981 2026-01-06 cs.RO cs.CV cs.SY eess.SY 50%

Simulations of MRI Guided and Powered Ferric Applicators for Tetherless Delivery of Therapeutic Interventions

用于无绳递送治疗干预的MRI引导和供电铁磁装置的模拟

Wenhui Chu, Khang Tran, Nikolaos V. Tsekos

机构 * MRI Lab, University of Houston(MRI实验室,休斯顿大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种MRI供电装置的计算平台,用于术前规划和建模,通过虚拟走廊和磁场梯度波形实现无绳血管内治疗干预的精准操控。

Comments 9 pages, 8 figures, published in ICBBB 2022

Journal ref 2022 12th International Conference on Bioscience, Biochemistry and Bioinformatics (ICBBB '22), January 7-10, 2022, Tokyo, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00975 2026-01-06 astro-ph.IM 50%

Website with interactive visualization of multivariate astronomical time series

具有多变量天体时间序列交互可视化功能的网站

M. Volkov, M. Demianenko, D. Matveev, K. A. Grishin, I. V. Chilingarian

专题命中 规划决策 :planning(abstract)

AI总结 本文介绍两个网页平台Fulu和VALC,用于交互式可视化多变量天体时间序列,支持暂现事件和低质量活动星系核的研究。

Comments 7 pages, 3 figures, accepted to Communications of BAO, Vol.72, Issue 2, 2025, pp.334-340

Journal ref Communications of BAO, Vol.72, Issue 2, 2025, pp.334-340

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00922 2026-01-06 eess.IV cs.CV 50%

MetaFormer-driven Encoding Network for Robust Medical Semantic Segmentation

基于MetaFormer的编码网络用于鲁棒的医学语义分割

Le-Anh Tran, Chung Nguyen Tran, Nhan Cach Dang, Anh Le Van Quoc, Jordi Carrabina, David Castells-Rufas, Minh Son Nguyen

专题命中 规划决策 :planning(abstract)

AI总结 本文提出MFEnNet,通过引入MetaFormer和优化模块,实现高效的医学图像语义分割,降低计算成本并提升分割精度。

Comments 10 pages, 5 figures, MCT4SD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09907 2026-01-06 cs.CV 50%

VisualActBench: Can VLMs See and Act like a Human?

VisualActBench: VLMs能否像人一样看见并行动?

Daoan Zhang, Pai Liu, Xiaofei Zhou, Yuan Ge, Guangchen Lan, Jing Bi, Christopher Brinton, Ehsan Hoque, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) Purdue University(普渡大学) Northeastern University(东北大学)

专题命中 规划决策 :AI agent(abstract)

AI总结 VisualActBench通过评估VLMs在视觉行动推理任务中的表现,揭示了其在主动推理和高优先级动作生成方面与人类能力的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09877 2026-01-06 eess.SY cs.SY 50%

Stretching Rubber, Not Budgets: Accurate Parking Utilization on a Shoestring

拉伸橡胶,而非预算:在有限预算下准确的停车利用

Christopher K. Allsup

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种低成本高精度的停车利用测量方法,利用气动道路管和Python脚本实现自动化计数,帮助社区规划者在有限预算内做出更明智的决策。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 11 篇

2601.02021 2026-01-06 cs.NI 92%

AgentVNE: LLM-Augmented Graph Reinforcement Learning for Affinity-Aware Multi-Agent Placement in Edge Agentic AI

AgentVNE: 基于大语言模型的图强化学习用于面向亲和力的多智能体部署

Runze Zheng, Yuqing Zheng, Zhengyi Cheng, Long Luo, Haoxiang Luo, Gang Sun, Hongfang Yu, Dusit Niyato

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 AgentVNE通过结合大语言模型与图强化学习,解决边缘智能体部署中的动态资源分配与亲和力约束问题,提升服务效率与响应速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01831 2026-01-06 cs.MA cs.AI cs.IR cs.SE 90%

ARIES: A Scalable Multi-Agent Orchestration Framework for Real-Time Epidemiological Surveillance and Outbreak Monitoring

ARIES:一种可扩展的多智能体编排框架,用于实时流行病监测和爆发监控

Aniket Wattamwar, Sampson Akwafuo

机构 * Department of Computer Science(计算机科学系) California State University(加州州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 ARIES是一种专为流行病监测设计的多智能体框架,通过自动化数据提取和逻辑综合,实现实时监测和突发公共卫生事件的快速响应。

Comments 6 pages, 14 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00848 2026-01-06 cs.AI cs.CR 90%

Temporal Attack Pattern Detection in Multi-Agent AI Workflows: An Open Framework for Training Trace-Based Security Models

多智能体AI工作流中的时间攻击模式检测:一种用于训练基于轨迹的安全模型的开放框架

Ron F. Del Rosario

机构 * SAP OWASP Gen AI Security Project(OWASP生成人工智能安全项目) Agentic Security Initiative (ASI)(代理安全倡议(ASI))

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract,comments);分类 cs.AI

AI总结 本文提出了一种开放框架,通过合成轨迹生成和微调语言模型,提升多智能体AI工作流中时间攻击模式检测的准确性,并公开了相关数据集和评估基准。

Comments 26 pages, 3 figures, 7 tables. Datasets and code: https://huggingface.co/guerilla7/agentic-safety-gguf

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20629 2026-01-06 cs.LG cs.AI 89%

Learning Evolving Latent Strategies for Multi-Agent Language Systems without Model Fine-Tuning

为多智能体语言系统学习演化的潜在策略而无需模型微调

Wenlong Tang

机构 * Independent Researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究提出一种无需微调的多智能体语言系统框架,通过双环架构实现持续策略进化,利用外部潜在空间提供可解释的抽象战略表示。

Comments 17 pages, 5 figures. Code available at https://github.com/wltang-dev/Latent-Strategy-RL-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏