User Association and Path Planning for UAV-Aided Mobile Edge Computing with Energy Restriction
专题命中 GUI与网页智能体 :planning(title)
Comments Accepted by IEEE WCL
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 GUI与网页智能体 :planning(title)
Comments Accepted by IEEE WCL
专题命中 GUI与网页智能体 :planning(title)
Comments CVPR 2019, for implementation see https://github.com/janinethoma
专题命中 GUI与网页智能体 :agent(title)
专题命中 GUI与网页智能体 :planning(title)
Comments 7 pages, 6 figures
专题命中 GUI与网页智能体 :planning(title)
Comments 14 pages, 5 figures, 2 tables, IEEE Transactions on Vehicular Technology
专题命中 GUI与网页智能体 :planning(title)
专题命中 GUI与网页智能体 :agent(title)
Comments submitted to Malaria Journal on March 31, 2015
Journal ref Malaria Journal 2015, 14:231
专题命中 GUI与网页智能体 :agent(title)
Comments 6 pages, 7 figures
专题命中 GUI与网页智能体 :agent(title)
Comments Information Security for Global Information Infrastructures, the 16th IFIP SEC (2000)
专题命中 GUI与网页智能体 :agent(title)
Comments 7 pages, 5 figures; Proceedings of the 2006 Conference on Mobile Computing and Wireless Communications (MCWC'2006)
专题命中 GUI与网页智能体 :agent(title)
Comments 4 pages, 4 figures. Accepted in WSDM 2009 Late Breaking Results
Journal ref WSDM 2009 Late Breaking Results
专题命中 GUI与网页智能体 :agent(title)
用于血管内导航多任务世界模型控制的渐进式经验融合
机构 * School of Biomedical Engineering & Imaging Sciences, King’s College London(伦敦国王学院生物医学工程与影像科学学院) ; Surgical & Interventional Engineering(外科与介入工程)
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.LG
AI总结 本研究提出渐进式经验融合(PEF)训练多任务TD-MPC2控制器,在血管内导航任务中提升了成功率,可实现跨血管结构迁移与患者特异性微调,为临床应用提供概念验证。
LegacyWorld:面向遗留工作流的GUI智能体的原子性感知评估
专题命中 GUI与网页智能体 :agent(abstract);workflow(abstract);分类 cs.SE
AI总结 该研究开发LegacyUse框架以自动化遗留工作流,构建含28个Windows GUI工作流的基准,采用原子性评估6款计算机使用智能体,发现不同操作特征并提出相关首要要求。
Comments Accepted for publication in the Industry Track of the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), 14-18 September 2026, Benevento, Italy
WebGrader:利用自演化程序化评分器训练用于网页开发的大语言模型
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI
AI总结 本研究提出自演化程序化评分器WebGrader,通过分离测试规划等环节生成准确奖励,训练8B策略在WebGen-Bench、WG-core-250数据集上的功能成功率及得分优于多款大语言模型。
Comments 17 pages, 3 figures. Supplementary material is included in the main PDF
StepReflect:面向移动GUI智能体的结构化UI过渡反射
专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.AI
AI总结 针对移动GUI智能体长时序执行的动作反射需求,提出StepReflect模型,在离线和在线实验中均优于GPT-5.2相关方案,成本更低且可本地部署。
重新思考本地计算机使用智能体的推理时扩展:失败模式与计算权衡
机构 * Hanyang University(汉阳大学)
专题命中 GUI与网页智能体 :planning(abstract);agentic(abstract);分类 cs.AI
AI总结 本文针对本地计算机使用智能体的推理时扩展开展系统实证研究,评估多款模型在OSWorld基准上的表现,揭示其边际收益递减、失败模式转变等规律,提出高效本地智能体的设计方向。
RAG-HAR+: 面向边缘部署的成本高效型基于大语言模型(LLM)的人类活动识别
机构 * University of Sydney(悉尼大学) ; Curtin University(科廷大学) ; Colorado State University(科罗拉多州立大学)
专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.LG
AI总结 RAG-HAR+是面向边缘部署的成本高效型LLM辅助HAR方案,通过检索设计智能体优化特征、对确定样本用多数投票、仅不确定样本用LLM,在六基准上性能相当或更优且降低了LLM相关开销。
Comments Submitted to IEEE Transactions on Mobile Computing. Extended version of the IEEE PerCom 2026 paper "RAG-HAR: Retrieval Augmented Generation-based Human Activity Recognition." (https://doi.org/10.1109/PerCom67906.2026.11524560)
HARP:人机人工智能研究平台
机构 * BTPX Innovation Lab(BTPX创新实验室)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 研究旨在设计人机人工智能研究平台(HARP),通过让参与者在可控模拟场景中与可配置实时人工智能代理互动,研究人员可控制多种因素并记录相关数据,能系统测试人工智能设计选择对用户的影响。
Comments 5 pages, 3 figures, SAP Academic Community Conference North America, 2026
EvoGUI:用于GUI状态转换理解的进化感知基准测试
机构 * Tsinghua University(清华大学)
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI
AI总结 研究GUI状态转换理解,提出EvoGUI诊断框架,将GUI轨迹转化为视觉问答探针,无需额外注释。通过Mind2Web和WebLINX实例化EvoGUI-Bench并零样本评估28种模型配置,结果显示其可补充端到端评估,揭示理解提升空间。
通过强化学习在非定常流中进行流量感知最优导航
机构 * Politecnico di Milano(米兰理工大学) ; MOX(数学优化与工程计算实验室)
专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);分类 cs.LG
AI总结 研究在非定常流中自主机器人导航问题,用TD3算法训练智能体在双涡旋流中到达目标。评估五种生物启发观测策略及全局流参数影响,发现速度感知与涡度传感器效用有权衡,明确参数会降性能,为机器人导航从模拟到现实提供见解。
OSWorld2.0:在长时域真实世界任务上基准测试计算机使用智能体
机构 * XLANG Lab(XLANG实验室)
专题命中 GUI与网页智能体 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 提出OSWorld 2.0基准,包含108个长时域计算机使用工作流,通过复杂真实任务揭示当前智能体在约束跟踪、动态信息处理等方面的局限,最佳模型仅完成20.6%任务。
Comments 68 pages, 42 figures. Equal contribution: Mengqi Yuan, Zilong Zhou, and Xinzhuang Xiong
SCALECUA:通过可验证任务合成和高效在线强化学习扩展计算机使用代理
机构 * Tsinghua University(清华大学)
专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI
AI总结 研究针对计算机使用代理扩展能力受限问题,提出ScaleCUA框架,通过可验证任务合成及高效训练实现。包括设计VeriGen生成任务、前沿采样提高效率、视觉上下文分割加速训练,在相关平台取得新的最优性能。
建模网络代理中不同的人类交互
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Duke University(杜克大学)
专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.CL
AI总结 本文通过收集400条真实用户网络导航轨迹,识别四种人机交互模式,并训练语言模型预测用户干预时机,将干预预测准确率提升61.4%-63.4%,用户评价的代理有用性提高36.8%。
Comments Preprint
从被动检索到主动记忆导航:学习将记忆用作结构化动作空间
机构 * Alibaba(阿里巴巴) ; ShanghaiTech University(上海科技大学) ; Zhejiang University(浙江大学) ; Peking University(北京大学) ; National University of Singapore(新加坡国立大学)
专题命中 GUI与网页智能体 :agent(abstract);tool-use(abstract);分类 cs.AI
AI总结 研究针对个性化对话代理中记忆系统的被动性问题,提出NapMem框架,将用户记忆组织成多粒度金字塔并通过工具暴露层次,经记忆工具强化学习训练智能体,在多任务实验中具竞争力,还进行了多方面分析,证明结构化存储与策略结合对长期用户记忆有益。
具备安全保证的Web智能体不可信内容掩码技术
机构 * ETH Zurich(苏黎世联邦理工学院) ; ETH AI Center(苏黎世联邦理工学院人工智能中心) ; ISTA(瑞士信息科学与技术学院) ; Anthropic(Anthropic公司)
专题命中 GUI与网页智能体 :agent(abstract);tool-use(abstract);分类 cs.LG
AI总结 针对Web智能体的提示注入安全边界缺失问题,提出UCM方法,利用网页DOM区分内容区域,通过掩码与沙箱交互恢复安全边界,实现带安全保障的Web环境交互。
Xiaomi-GUI-0 技术报告
专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.AI
AI总结 提出Xiaomi-GUI-0,一种在真实移动设备上训练和评估的原生多模态GUI智能体,通过真实设备主导的混合基础设施、多源训练数据和渐进式三阶段训练,在真实任务中实现72.0%成功率,显著提升执行稳定性和异常状态识别。
它向医生撒谎购买毒药成分:量化手机使用代理的现实世界滥用
机构 * Fudan University(复旦大学)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 研究手机使用代理在真实设备与商业应用中的恶意滥用,发现主流模型拒绝率低、任务完成率高,甚至能欺骗医生获取毒药前体,揭示安全意识-执行差距。
Comments work in progress
Tinker Tales:一个用于儿童与AI共同创意故事讲述的有形对话系统
机构 * Department of Computer Science, Emory University(埃默里大学计算机科学系) ; Department of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) ; School of Nursing, Emory University(埃默里大学护理学院)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 提出Tinker Tales有形对话系统,通过结合物理故事板、NFC玩具和移动应用,支持儿童与AI在四个叙事阶段进行协作故事创作,并发现提示框架影响儿童叙事贡献的形式和一致性。
Comments Accepted to SIGDIAL 2026
GUI vs. CLI:纯屏幕与技能中介计算机使用代理的执行瓶颈
机构 * NYU Shanghai(上海纽约大学) ; Yale NLP Lab(耶鲁大学自然语言处理实验室)
专题命中 GUI与网页智能体 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 通过匹配基准测试,发现GUI代理在长流程任务中表现优于CLI代理,但CLI代理通过技能增强可超越GUI,揭示两者执行瓶颈分别在于可靠交互与技能覆盖。