Agentic Quantum Deep Reinforcement Learning for RAN Slicing
面向RAN切片的智能量子深度强化学习
专题命中 GUI与网页智能体 :agentic(title,summary_cn)
AI总结 针对RAN切片的可靠性-吞吐量权衡问题,提出Agentic-QDRL两时间尺度框架,结合PMAR控制器与VQC调度器,经仿真验证可提升eMBB性能并维持URLLC可靠性。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
面向RAN切片的智能量子深度强化学习
专题命中 GUI与网页智能体 :agentic(title,summary_cn)
AI总结 针对RAN切片的可靠性-吞吐量权衡问题,提出Agentic-QDRL两时间尺度框架,结合PMAR控制器与VQC调度器,经仿真验证可提升eMBB性能并维持URLLC可靠性。
面向视角的对话编译器用于代理轨迹分析
机构 * Stanford University(斯坦福大学)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI
AI总结 本文提出VCC编译器,将原始代理JSONL日志转换为结构化视角,提升轨迹分析质量,减少token消耗并提升模型性能。
Comments Code: this https URL (https://github.com/lllyasviel/VCC)
MobileDreamer: 用于GUI代理的生成式草图世界模型
机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; Meituan(美团)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI
AI总结 MobileDreamer通过生成式草图世界模型和rollout想象策略,提升GUI代理在长周期任务中的决策能力,任务成功率提升5.25%。
GUI-PRA:面向GUI任务的过程奖励智能体
机构 * Zhejiang University(浙江大学) ; MiLM Plus, Xiaomi Inc.(小米公司)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI
AI总结 针对长程GUI自动化的错误累积与视觉歧义问题,本文提出GUI-PRA,通过主动调查式评估实现性能提升,在AndroidWorld等数据集上较标准PRM取得显著进步。
WebXSkill:自主网页代理的技能学习
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Microsoft(微软)
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.CL
AI总结 WebXSkill通过可执行技能框架解决自主网页代理在长周期任务中的执行与适应问题,提升任务成功率。
Comments Accepted to Findings of EMNLP2026
GeoAgent:通过具身导航评估视觉语言模型的地理定位能力
机构 * KIIT Bhubaneswar(布巴内斯瓦尔KIIT大学) ; IIT Bhubaneswar(布巴内斯瓦尔印度理工学院)
专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.CL
AI总结 本研究提出基于街景导航的GeoAgent基准,发现VLMs在地理定位中难区分区域模式,智能体导航可提升准确率,但模型存在地区偏差且自我改进能力差,明确了具身地理定位的挑战
Comments Accepted to EMNLP 2026 Findings
为大型语言模型网页智能体学习简单的测试时环境
机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) ; Dept. of Comp. Sci. & Tech., Tsinghua University(清华大学计算机科学与技术系) ; School of Electronic and Information Engineering, Beijing Jiaotong University(北京交通大学电子信息工程学院) ; Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) ; Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本研究针对LLM网页智能体在复杂真实环境中性能下降问题,提出测试时环境分解(TTED)方法,通过将复杂环境分解为子模块并利用子环境经验提升组合泛化能力,验证了其在合成与真实基准上的有效性。
Comments Code and data are released at this https URL (https://github.com/THUNLP-MT/TTED)
超越像素:探索面向基于大语言模型的智能体的DOM下采样
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL
AI总结 本文提出D2Snap算法对DOM下采样,解决原始DOM令牌占用过大的问题,经评估其在GPT-4o智能体上的成功率达73%,接近基于GUI快照的基线性能。
Comments 21 pages, LaTeX, print version; updated figures (2, 4)
SIR:面向计算使用智能体的自改进红队测试
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI
AI总结 本文提出SIR,一种针对操作系统层面计算使用智能体的黑盒间接提示注入攻击,通过迭代反馈循环提炼策略,使攻击成功率显著提升且可跨模型迁移。
在线技能与记忆模块是否总是值得其令牌消耗?Web代理的预算约束研究
机构 * ServiceNow AI Research(ServiceNow AI 研究院) ; ÉTS Montreal(蒙特利尔高等技术学院) ; University of British Columbia(不列颠哥伦比亚大学) ; McGill University(麦吉尔大学)
专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.CL
AI总结 在固定推理预算下,对比三种在线增强模块与令牌匹配的基线,发现基线在总成功率上匹配或超越所有增强方法,且常使用更少令牌。
Comments Accepted to EMNLP 2026
由5G与移动边缘计算赋能的半自主假肢控制
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 该研究开发了基于5G和MEC的半自主假手原型,通过边缘服务器处理视觉任务,其性能优于手动控制和设备端处理,为假肢控制提供了可行方案。
CanonNav:跨平台视觉导航中解耦导航行为与相机几何
机构 * Seoul National University(首尔大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 CanonNav框架解耦导航行为与相机几何,引入相机几何规范化并结合规划监督,仅用RGB推理便在多场景视觉导航中优于相关基线与RGB-D方法。
ActReal:系统级移动智能体对移动自动化检测提出挑战
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 该研究提出ActReal框架,可生成时间对齐的触摸与六轴IMU信号,规避现有移动自动化检测,事件级平均攻击成功率达77.5%,联合检测时仍达71.1%,对移动自动化检测构成挑战。
Comments 15 pages, 5 figures
自我感知主动学习实现自动驾驶的持续改进
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Adelaide University(阿德莱德大学) ; University College London(伦敦大学学院)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 该研究提出自我感知主动学习框架SAGE,通过生成恐惧与好奇心信号调节风险,在多场景中提升自动驾驶系统鲁棒性、减少安全违规并维持任务性能,实现训练后持续改进。