HATS: Hardness-Aware Trajectory Synthesis for GUI Agents
HATS: 为GUI代理的硬度感知轨迹合成
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 HATS通过硬度感知轨迹合成框架,解决GUI代理训练中语义模糊性问题,提升任务执行鲁棒性。
Comments Accepted by CVPR 2026
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
HATS: 为GUI代理的硬度感知轨迹合成
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 HATS通过硬度感知轨迹合成框架,解决GUI代理训练中语义模糊性问题,提升任务执行鲁棒性。
Comments Accepted by CVPR 2026
OnFly:面向安全与效率的机载零样本空中视觉语言导航
机构 * School of Artificial Intelligence, Sun Yat-Sen University(中山大学人工智能学院) ; Southern University of Science and Technology(南方科技大学) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 OnFly通过共享感知双智能体架构和混合记忆机制,实现高效稳定的零样本空中视觉语言导航,提升安全性和效率。
图上的探索者导演游戏变种
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文研究了图上的探索者-导演游戏变种,分析了f_d(G,v)和f_p(G,v)之间的差异,证明了两者可以相差任意大的n。
本体感知安全主动导航与探索用于行星环境
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 PSANE通过本体感知技术在未知变形环境中实现安全导航与探索,利用腿部与地形的交互信息提升地形可通行性评估与导航性能。
Comments 9 pages, 7 figures
NaviNote: 使现场空间标注创作成为支持盲人和低视力人群探索与导航的手段
专题命中 GUI与网页智能体 :agentic(abstract)
AI总结 NaviNote通过结合高精度视觉定位与代理架构,为盲人和低视力人群提供语音驱动的注释创作与导航支持,显著提升导航性能。
从反应式到基于地图的AI:针对目标导航的语义区域推断的调优本地LLM
机构 * Graduate School of Engineering, University of Fukui(福井大学工学研究科)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文提出一种基于地图的AI方法,利用调优的本地LLM进行语义区域推断,以提升对象-目标导航任务中的成功率和路径效率。
Comments 6 pages, 5 figures, technical report
MWM: 移动世界模型用于动作条件一致预测
机构 * School of Computer Science, Peking University(北京大学计算机科学系)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 MWM提出了一种移动世界模型,通过两阶段训练框架和推理一致状态蒸馏提升动作条件一致性的图像目标导航性能。
PanoDP:利用全景深度与可微物理学习无碰撞导航
机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) ; Beihang University, Beijing, China(北京航空航天大学) ; The University of Queensland, Australia(昆士兰大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 PanoDP通过结合全景深度感知与可微物理训练信号,提升在杂乱环境中无碰撞导航的性能和泛化能力。
AiRWeb:利用AR扩展网页浏览超越手持屏幕
专题命中 GUI与网页智能体 :workflow(abstract)
AI总结 AiRWeb通过AR技术扩展网页浏览,允许用户灵活卸载内容到周围空间,实现个性化组织,提升移动浏览体验。
Comments CHI EA '26: Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems
一种用于室内外机器人导航的对比式少样本RGBD可 traversability 分割框架
机构 * Department of Computer Science and Engineering, University of Texas at Arlington(计算机科学与工程系,德克萨斯大学阿灵顿分校) ; Uber(优步) ; Cognitive Robotics Lab, Department of Electrical Engineering and Computer Science, University of Arkansas(认知机器人实验室,电气工程与计算机科学系,阿肯色大学)
专题命中 GUI与网页智能体 :autonomous agent(abstract)
AI总结 本文提出了一种基于对比学习的少样本RGBD分割框架,利用负例原型和稀疏深度信息提升室内机器人导航的可 traversability 分割性能。
Journal ref IEEE International Conference on Robotics & Automation 2026 (ICRA)
在边缘硬件上实现四足机器人在地下矿井中高效自主导航
机构 * Department of Mining and Explosive Engineering, Missouri University of Science and Technology(采矿与爆炸工程系,密苏里科技大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本研究提出了一种在边缘硬件上运行的四足机器人自主导航系统,无需GPU和网络连接,实现了在地下矿井中高效、可靠的自主导航。
侦察-轮式机器人合作:行星类比探索中的在线地形强度映射与通行风险估计
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出了一种scout-rover合作框架,通过腿式和轮式机器人联合实现行星类比探索中的地形强度在线映射和通行风险估计,提升科学探索的鲁棒性和可达性。
Comments 8 figures
基于高斯混合的逆感知合同用于不确定性感知的机器人导航
机构 * Department of Computer Science, Columbia University(计算机科学系,哥伦比亚大学) ; Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出基于高斯混合的逆感知合同,通过联合椭球置信集表示不确定性,提升机器人导航的安全性和适应性。
Comments 8 pages, 5 figures. Accepted to ACC 2026 (American Control Conference)
自主水运船舶的碰撞规避与搁浅预防:符合国际海上避碰规则
机构 * Department of Mechanical Engineering, Texas A&M University, College Station, USA(德克萨斯A&M大学机械工程系) ; American Bureau of Shipping, Spring, TX, USA(美国船舶局)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出了一种基于凸优化的运动规划方法,用于自主水运船舶的碰撞规避、COLREGs合规性和搁浅预防。
SFCo-Nav: 通过慢LLM与快速属性图对齐的协作实现高效的零样本视觉语言导航
机构 * Shanghai Key Laboratory of Navigation and Location Based Services, Shanghai Jiao Tong University(上海导航与位置基于服务重点实验室,上海交通大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 SFCo-Nav通过慢LLM与快速属性图对齐的协作,实现了高效的零样本视觉语言导航,显著提升效率并降低计算成本。
Comments Accepted by 2026 IEEE International Conference on Robotics and Automation (ICRA)
Openfly:面向空中视觉-语言导航的综合性平台
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Northwestern Polytechnical University(西北工业大学) ; Beihang University(北航) ; Shanghai Jiao Tong University(上海交通大学) ; The University of Hong Kong(香港大学) ; Zhejiang University(浙江大学) ; University of Science and Technology of China(中国科学技术大学) ; East China University of Science and Technology(东华大学) ; Fudan University(复旦大学) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; TeleAI
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 OpenFly平台通过整合多种渲染引擎和自动化工具链,构建大规模空中VLN数据集,并提出关键帧感知的VLN模型,提升户外空中视觉-语言导航的研究与应用。
Comments accepted by ICLR 2026
城市微小区Pinching-antenna系统中移动用户的动态天线放置
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文提出双层优化框架,通过软演员-评论家算法实现动态天线定位和波束成形预编码,提升城市微小区网络的频谱效率和鲁棒性。
异质人群中的最优时间跨度社会机器人导航
机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) ; Nation Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心) ; Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) ; Xi’an Jiaotong University(西安交通大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出了一种基于社会条件优化的机器人导航框架,通过时空Transformer和强化学习策略动态调整预测时间跨度,提升在异质人群中的导航效率与安全性。
Comments 7 pages, 5 figures
JanusVLN: 通过双隐式记忆解耦语义与空间性用于视觉-语言导航
机构 * Xi’an Jiaotong University(西安交通大学) ; Amap, Alibaba Group(阿里巴巴集团)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 JanusVLN通过双隐式记忆解耦语义与空间性,提升视觉-语言导航的性能和效率。
Comments Accepted to ICLR 2026. Project page: https://miv-xjtu.github.io/JanusVLN.github.io/
通过移动增强现实实现超声体积重建的扩展
机构 * National University Health System, Singapore(新加坡国家大学医疗系统) ; College of Design and Engineering, National University of Singapore, Singapore(新加坡国立大学设计与工程学院)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 MARVUS通过移动增强现实技术提升超声体积重建的准确性和可重复性,减少用户间差异,提高临床应用的可行性和成本效益。
Comments Submitted to MICCAI 2026
CapNav:基于能力条件的室内导航基准测试
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 CapNav基准测试评估VLMs在不同移动约束下室内导航能力,发现其性能随约束增加而下降,且先进模型仍难以处理空间推理任务。
RA-Nav:基于语义分割的面向不确定环境的面向风险的导航系统
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 RA-Nav通过语义分割实时识别障碍物并分类,构建风险地图以实现安全高效的路径规划,验证了在突发障碍物场景下的优越性能。
终用户验证BRIGHT的定制开发图形用户界面应用于宫颈癌近距离治疗
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 BRIGHT结合定制GUI在宫颈癌近距离治疗中表现出色,优于临床实践五例,用户友好且高效。
机器人可穿戴对话切换用于导航
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文提出通过对话切换实现多设备室内导航,发现可穿戴设备更受用户青睐,强调了具身AI在人机交互中的作用。
Comments To appear in Proceedings of Augmented Humans International Conference (AHs 2026)
基于意图的扩散路径:物联网密集WSN中的移动数据收集器路径规划
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出ID2P2框架,通过意图驱动的扩散路径规划,提升物联网密集WSN中移动数据收集器的能效、数据新鲜度和网络公平性。
时间采样的高效自适应状态格子用于部分观测环境中的自主地面机器人导航
机构 * University of Rochester(罗切斯特大学) ; DEVCOM Army Research Lab(陆军研究实验室) ; Parsons Corporation(帕尔逊公司)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出TSEASL,一种用于部分观测环境的自主地面机器人导航方法,通过自适应状态格子提升规划稳定性,减少手动干预需求。
Comments 12 pages, 8 figures
PA-MPPI:感知-aware的模型预测路径积分控制用于未知环境中的四旋翼导航
机构 * University of Zurich(苏黎世大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 PA-MPPI通过结合感知信息,提升了四旋翼在未知环境中的导航能力,能够有效探索未知区域并规划替代路径。
Journal ref IEEE Robotics and Automation Letters (RA-L), 2026
LAMP:机器人导航的隐式语言地图
机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人学系,全北国立大学) ; NAVER LABS ; Department of Robotics and Mechatronics Engineering, DGIST(机器人与机电工程系,韩国科学技术院)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 LAMP通过隐式语言地图实现高效机器人导航,结合隐式神经场与稀疏图进行粗到细路径优化,提升大环境下的内存效率和目标精度。
Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L). Project page: https://lab-of-ai-and-robotics.github.io/LAMP/
Journal ref IEEE Robotics and Automation Letters (RA-L), 2025
ReSPEC:动态环境中在线多光谱传感器重新配置框架
机构 * Department of Electrical Engineering, Columbia University(电气工程系,哥伦比亚大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 ReSPEC框架通过强化学习实现动态多光谱传感器重新配置,提升机器人在复杂环境下的感知效率与资源利用率。
Comments 8 pages, 4 figures. This work has been submitted to the IEEE for possible publication
一种无碰撞的摇摆阻尼模型预测控制器用于安全且反应性的林业起重机导航
机构 * Automation & Control Institute (ACIN), TU Wien(自动化与控制研究所(ACIN),维也纳技术大学) ; Center for Vision, Automation & Control, AIT Austrian Institute of Technology GmbH(视觉、自动化与控制中心,奥地利技术研究所)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出了一种无碰撞的摇摆阻尼模型预测控制器,用于林业起重机的安全导航和实时环境适应。
Comments Accepted at ICRA 2026