arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-15 至 2026-01-15 共收录 3 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 3 篇

2601.09248 2026-01-15 cs.CV cs.AI 57%

Hybrid guided variational autoencoder for visual place recognition

混合引导变分自编码器用于视觉地点识别

Ni Wang, Zihan You, Emre Neftci, Thorben Schoepe

机构 * Amazon Development Center Germany GmbH, Berlin, Germany(亚马逊德国开发中心) Southeast University, Nanjing, China(东南大学) Forschungszentrum Jülich GmbH, Aachen, Germany(尤利希研究中心) imec, Luven, Belgium(imec)

专题命中 GUI与网页智能体 :autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一种混合引导变分自编码器用于视觉地点识别,结合事件视觉传感器和脉冲神经网络,实现紧凑、鲁棒且具有泛化能力的模型,提升移动机器人导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08868 2026-01-15 cs.CV cs.AI cs.RO 57%

Residual Cross-Modal Fusion Networks for Audio-Visual Navigation

残差跨模态融合网络用于音频视觉导航

Yi Wang, Yinfeng Yu, Bin Ren

机构 * School of Computer Science and Technology, Xinjiang University, Urumqi, China(新疆大学计算机科学与技术学院) Joint International Research Laboratory of Silk Road Multilingual Cognitive(丝绸之路多语认知联合国际实验室) School of Mechatronic Engineering and Automation Shanghai University, Shanghai, China(上海大学机电工程与自动化学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出残差跨模态融合网络,通过双向残差交互实现音频视觉信息互补建模,提升跨域导航性能。

Comments Main paper (10 pages). Accepted for publication by the 14th international conference on Computational Visual Media (CVM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09318 2026-01-15 cs.RO cs.SY eess.SY 50%

Feedback-Based Mobile Robot Navigation in 3-D Environments Using Artificial Potential Functions Technical Report

基于反馈的三维环境移动机器人导航人工势场方法技术报告

Ro'i Lang, Elon Rimon

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出了一种用于三维环境中移动机器人导航的人工势场方法,通过多项式函数构造并验证了在存在障碍物时的导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏