arXivDaily arXiv每日学术速递 周一至周五更新
爬虫太凶残了,网站这两天有点不稳定,紧急升级ing

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-09-01 至 2026-09-01 共收录 481 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 37 篇

2608.28433 2026-09-01 cs.AI cs.LO cs.MA 版本更新 70%

Prove2Me: An Open Collaborative Platform for Scaling Math Formalization

Prove2Me:用于规模化数学形式化的开源协作平台

Shuze Chen, Kunal Marwaha, Xiaoyang Lu, Henry Yuen, Tianyi Peng

机构 * Columbia University(哥伦比亚大学) University of Chicago(芝加哥大学) Purdue University(普渡大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 Prove2Me是支持人类与AI智能体协作的开源数学形式化平台,可降低大规模数学形式化的门槛,实现众包式规模化形式化验证。

Comments https://prove2.me

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15932 2026-09-01 cs.CL 版本更新 70%

Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence

超越NL2Code:多模态代码智能的结构化综述

Xuanle Zhao, Qiushi Sun, Jingyu Xiao, Xuexin Liu, Haoyue Yang, Qiaosheng Chen, Xianzhen Luo, Jing Huang, Yufeng Zhong, Lei Chen, Shuai Fu, Zhenlin Wei, Jinhe Bi, Lei Jiang, Haibo Qiu, Siqi Yang, Peng Shi, Jian Hu, Zhixiong Zeng

机构 * Meituan(美团) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学) Australian Institute for Machine Learning, Adelaide University(阿德莱德大学澳大利亚机器学习研究所) Ludwig Maximilian University of Munich(慕尼黑大学) University of Science and Technology of China(中国科学技术大学) Queen Mary University of London(伦敦玛丽女王大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本文系统综述多模态代码智能,将任务按代码角色分类,覆盖GUI、科学可视化、结构化图形及前沿任务,并提出四个基于验证的未来方向。

Comments Accepted by TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13856 2026-09-01 eess.IV cs.CV stat.AP 版本更新 67%

From crown candidates to neighborhood screening: integrating optical GeoAI and spatial modeling for urban-canopy assessment in Davis, California

从树冠候选到邻域筛选:整合光学地理人工智能与空间建模用于加利福尼亚州戴维斯市的城市树冠评估

Mohammadreza Narimani, Shreyan Mitra, Parastoo Farajpoor

机构 * University of California, Davis(加利福尼亚大学戴维斯分校) California High School(加利福尼亚高中)

专题命中 软件智能体 :planning(abstract);workflow(abstract)

AI总结 本研究整合光学GeoAI与空间建模,利用2022年影像在戴维斯市生成树冠筛选层,绘制了该市9.37%的树冠,验证了其与热环境的关联,为城市规划提供支持。

Comments 17 pages, 10 figures + 5 supplementary figures, 7 tables. Revised preprint (expanded canopy infill; IoU 0.719). Preprint submitted to Taylor & Francis. Code: https://github.com/MohammadrezaNarimaniUCDavis/Davis_Urban_Canopy_GeoAI Data: https://doi.org/10.5281/zenodo.21925526

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13681 2026-09-01 cs.SE cs.AI cs.ET cs.LG 交叉投稿 67%

Fine-Tuning Qwen3-27B for C-to-Rust Code Translation: A Three-Stage Curriculum of Pretraining, Debugging-Aware SFT, and Task-Specific SFT

微调Qwen3-27B实现C到Rust代码翻译:预训练、调试感知监督微调与任务特定监督微调的三阶段课程

Pu Zhao, Changdi Yang, Yixiao Chen, Yi Gao, Yifan Cao, Haochen Zeng, Yanzhi Wang

机构 * Northeastern University(东北大学) EmbodyX Inc(EmbodyX公司) Aibao LLC(Aibao有限责任公司)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本研究针对C到Rust代码翻译任务,对Qwen3-27B采用三阶段微调课程,结合SACTOR框架评估后,其性能优于基线模型及其他LLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28795 2026-09-01 cs.SE cs.AI 新提交 62%

The reach of a verification tool decides its value: A controlled study of verification surface, artifact quality, and cost in AI coding agents

验证工具的覆盖范围决定其价值:AI编码智能体中验证面、产物质量与成本的对照研究

Achint Mehta

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 该研究通过构建仅工具列表为受控变量的极简编码智能体,开展对照实验,发现验证工具的覆盖范围需匹配应用实际故障方式才能提升产物质量,且不同验证工具的成本效益存在差异。

Comments 27 pages, 13 figures, 10 tables. Submitted to IEEE Access. Data and code: https://doi.org/10.5281/zenodo.21961590

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16956 2026-09-01 cs.SE cs.LG 版本更新 62%

SpIDER: Spatially Informed Dense Embedding Retrieval for Software Issue Localization

SpIDER:面向软件问题定位的时空感知密集嵌入检索

Shravan Chaudhari, Rahul Thomas Jacob, Jiajun Cao, Shihab Rashid, Mononito Goswami, Christian Bock

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) AWS(亚马逊公司) AWS AI Labs(亚马逊人工智能实验室)

专题命中 软件智能体 :agentic(abstract);分类 cs.LG、cs.SE

AI总结 SpIDER通过结合LLM推理和图结构探索信息,提升代码库中相关代码单元的密集检索性能,实验显示在多个编程语言和基准测试中性能提升达13%。

Comments EMNLP 2026 camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31009 2026-09-01 cs.LG 新提交 57%

Language-Informed Flow Matching for Trend-Guided Structure-Based 3D Molecular Generation

用于趋势引导的基于结构的3D分子生成的语言知情流匹配

Tianyu Gao, Zhikai Su, Jiashu Li, Wenjun Gao, Zichuan Ying, Zhe Zhao, Fei Zhang, Ye Wei

机构 * City University of Hong Kong(香港城市大学) The University of Hong Kong(香港大学) Stanford University(斯坦福大学)

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 该研究提出基于流匹配的语言知情跨模态框架LiFT,通过“感知-演化-组装”智能体和自条件解耦路由器实现趋势引导的3D分子生成,在Cross-Docked2020数据集上验证了其分布匹配、药物化学指标及结构有效性的优势。

Comments Accepted at Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30300 2026-09-01 cs.SE 新提交 57%

Update from Hell: Can Coding Agents Survive Hidden Breakage in Dependency Upgrades?

来自地狱的更新:编码智能体能否在依赖升级的隐藏损坏中存活?

Zijian Luo, Runzhi He, Pengfei Gao, Yu Kang, Zeqi Lin, Minghua Ma, Qingwei Lin, Saravan Rajmohan, Yongqiang Tian

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文推出含203项真实依赖升级任务的DEPBENCH基准,评估主流编码智能体后发现其仅解决51.2%任务,凸显当前智能体能力与软件维护需求的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28814 2026-09-01 cs.CV cs.AI 新提交 57%

FigMirror: Ground It, Code It, Plot It

FigMirror:定位它、编码它、绘制它

Xiaohan Zhao, Jiacheng Liu, Yaxin Luo, Zhiqiang Shen

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 本文提出FigMirror智能体框架,通过定位测量结合PlotTwin-Bench基准,实现科学图表风格迁移至新数据,性能优于现有方法,论文图表多由其生成。

Comments Code and data available at https://github.com/VILA-Lab/FigMirror

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28646 2026-09-01 cs.AI 新提交 57%

BiasMix-Finance: Post-Generation KYC Guardrails for LLM Portfolio Advice

BiasMix-Finance:面向LLM投资组合建议的生成后KYC护栏

Gaurav Kukreja, Parul Kukreja, Mohammed Abraar, Raj Dandekar, Rajat Dandekar, Sreedath Panat

机构 * Vizuara(维祖拉公司)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 本文提出BiasMix-Finance生成后KYC护栏流水线,含JSON模式约束、数值上限验证及凸二次规划投影,可将LLM投资组合建议违规率降至0%,并发布相关基准与代码。

Comments 18 pages, 9 figures, 8 tables. Accepted to the ICLR 2026 Financial AI (FinAI) Workshop. Code and data: https://github.com/gauravkukreja06/biasmix-finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09156 2026-09-01 cs.LG 版本更新 57%

Activation Steering Transfer to Agents: One Gain Ratio Does Not Identify Potency and Efficacy

存在但重新缩放:加法激活引导的聊天到智能体的转移

Lucas Pinto

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 研究加法激活引导从聊天到智能体的转移,通过匹配信息设计进行研究,发现转移真实但重新缩放,确定了加法特定机制,定位了重新缩放位置,指出智能体部署对引导拒绝绕过影响不可预测。

Comments v3 qualifies the two-sided sign claim to the primary dose grid: the sole positive cell loses CI-exclusion under the registered alpha*-trim. Also discloses the comparison set behind the overlapping-gain pair. 42 pages, 7 figures, 9 tables. Includes an errata section correcting v1's public record. Code: github.com/digdoug/steering-dose-reparametrization

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19319 2026-09-01 cs.MA cs.AI cs.DB 版本更新 57%

Data Intelligence Agents: Interpreting, Modeling, and Querying Enterprise Data via Autonomous Coding Agents

数据智能代理:通过自主编码代理解释、建模和查询企业数据

Anoushka Vyas, Aarushi Dhanuka, Sina Khoshfetrat Pakazad, Henrik Ohlsson

机构 * C3 AI

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

AI总结 提出Data Intelligence Agents (DIA)系统,由三个自主编码代理组成,通过执行、验证和修复工件来压缩数据集成工作流,在七个SQL基准测试中达到或超越最佳结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02875 2026-09-01 cs.AI 版本更新 57%

Handoff Debt: The Rediscovery Cost When Coding Agents Take Over Interrupted Tasks

交接债务:当编码代理接管被中断任务时的重新发现成本

Dipesh KC, Anjila Budathoki

机构 * Independent Researcher(独立研究者) Georgia State University(佐治亚州立大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文通过引入“交接债务”概念,研究编码代理在任务中断后从部分状态恢复时的重新发现成本,并提出一种接管协议来量化不同交接视图对后继代理效率的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02263 2026-09-01 cs.CV cs.AI 版本更新 57%

Social-JEPA: Emergent Geometric Isomorphism

Social-JEPA:涌现的几何同构

Haoran Zhang, Youjin Wang, Yi Duan, Rong Fu, Dianyu Zhao, Sicheng Fan, Shuaishuai Cao, Wentao Guo, Xiao Zhou

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 Social-JEPA通过让不同视角的独立代理学习环境模型,发现其潜在空间近似线性同构,从而实现跨代理的透明转换与高效迁移学习。

Comments Due to an unresolved dispute among the authors regarding the correctness of the experimental results and the validity of the conclusions, the team has decided to withdraw this paper until these issues can be fully resolved

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29944 2026-09-01 cs.CV 新提交 50%

On the Role of MRI Sequences in Cross-Dataset Generalization for Brain Tumor Segmentation

MRI序列在脑肿瘤分割跨数据集泛化中的作用

Henrique Zan Grande, João G. Pitol, Lucas B. Schuck, Rafael V. Serenato, Rayson Laroca, Andre Gustavo Hochuli

机构 * Pontifical Catholic University of Paraná(巴拉那州天主教大学)

专题命中 软件智能体 :planning(abstract)

AI总结 本研究评估MRI序列对脑肿瘤分割跨数据集泛化的影响,采用ResUNet框架,发现T2f/FLAIR序列跨数据集性能最优,多序列训练可进一步提升效果,有限目标域适应能减少标注需求。

Comments Accepted for presentation at the 2026 Conference on Graphics, Patterns and Images (SIBGRAPI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31160 2026-09-01 astro-ph.IM astro-ph.CO astro-ph.HE 新提交 50%

Ad Astra White Paper: A Pitch for the Next 25 Years of NASA's Physics of the Cosmos Program

阿斯特拉白皮书:为NASA宇宙物理学计划未来25年发声

Eric Burns, Ivan Agullo, Igor Andreoni, Catherine M. Deibel, Christopher L. Fryer, Natasha Latouf, M. Coleman Miller, Jillian C. Rastinejad, Breann N. Sitarski, Zorawar Wadiasingh

专题命中 软件智能体 :planning(abstract)

AI总结 该报告梳理了美国宇宙物理学领域25年的研究进展,明确了支撑未来研究的关键天基设施,为NASA筹备2030年天文十年调查提供了指导。

Comments First version submitted ahead of the Ad Astra September workshop. Feedback welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23763 2026-09-01 cs.NI 版本更新 50%

AgenticNet: Utilizing AI Coding Agents To Create Hybrid Network Experiments

AgenticNet:利用AI编码代理创建混合网络实验

Majd Latah, Kubra Kalkan

专题命中 软件智能体 :AI agent(abstract)

AI总结 AgenticNet通过AI编码代理提供混合网络实验工具,支持纯模拟、纯仿真和混合模式,提升实验灵活性和开发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03824 2026-09-01 cs.GT cs.MA 50%

Level-2 Inverse Games for Inferring Agents' Estimates of Others' Objectives

智能体彼此想要什么?用于推断智能体对他人目标估计的二级逆向游戏

Hamzah I. Khan, Jingqi Li, David Fridovich-Keil

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出二级逆向游戏框架,用于推断智能体对他人目标的估计,解决了传统一级推断在现实场景中的局限性。

Comments 6 pages + appendix with supplements

详情

展开后加载摘要…

URL PDF HTML 收藏

2. GUI与网页智能体 15 篇

2608.30206 2026-09-01 eess.SP 新提交 87%

Agentic Quantum Deep Reinforcement Learning for RAN Slicing

面向RAN切片的智能量子深度强化学习

Tingnan Bao, Medhat Elsayed, Pedro Enrique Iturria-Rivera, Yigit Ozcan, Majid Bavand, Melike Erol-Kantarci

专题命中 GUI与网页智能体 :agentic(title,summary_cn)

AI总结 针对RAN切片的可靠性-吞吐量权衡问题,提出Agentic-QDRL两时间尺度框架,结合PMAR控制器与VQC调度器,经仿真验证可提升eMBB性能并维持URLLC可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29678 2026-09-01 cs.AI 版本更新 79%

View-oriented Conversation Compiler for Agent Trace Analysis

面向视角的对话编译器用于代理轨迹分析

Lvmin Zhang, Maneesh Agrawala

机构 * Stanford University(斯坦福大学)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 本文提出VCC编译器,将原始代理JSONL日志转换为结构化视角,提升轨迹分析质量,减少token消耗并提升模型性能。

Comments Code: https://github.com/lllyasviel/VCC

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04035 2026-09-01 cs.AI 版本更新 79%

MobileDreamer: Generative Sketch World Model for GUI Agent

MobileDreamer: 用于GUI代理的生成式草图世界模型

Yilin Cao, Yufeng Zhong, Zhixiong Zeng, Siran Dai, Liming Zheng, Jing Huang, Haibo Qiu, Peng Shi, Wenji Mao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Meituan(美团)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 MobileDreamer通过生成式草图世界模型和rollout想象策略,提升GUI代理在长周期任务中的决策能力,任务成功率提升5.25%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23263 2026-09-01 cs.AI 版本更新 79%

GUI-PRA: Process Reward Agent for GUI Tasks

GUI-PRA:面向GUI任务的过程奖励智能体

Tao Xiong, Xavier Hu, Yurun Chen, Yuhang Liu, Changqiao Wu, Pengzhi Gao, Wei Liu, Jian Luan, Shengyu Zhang

机构 * Zhejiang University(浙江大学) MiLM Plus, Xiaomi Inc.(小米公司)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 针对长程GUI自动化的错误累积与视觉歧义问题,本文提出GUI-PRA,通过主动调查式评估实现性能提升,在AndroidWorld等数据集上较标准PRM取得显著进步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13318 2026-09-01 cs.AI cs.CL 版本更新 79%

WebXSkill: Skill Learning for Autonomous Web Agents

WebXSkill:自主网页代理的技能学习

Zhaoyang Wang, Qianhui Wu, Xuchao Zhang, Chaoyun Zhang, Wenlin Yao, Fazle Elahi Faisal, Baolin Peng, Si Qin, Suman Nath, Qingwei Lin, Chetan Bansal, Dongmei Zhang, Saravan Rajmohan, Jianfeng Gao, Huaxiu Yao

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft(微软)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 WebXSkill通过可执行技能框架解决自主网页代理在长周期任务中的执行与适应问题,提升任务成功率。

Comments Accepted to Findings of EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29483 2026-09-01 cs.CV cs.CL 新提交 70%

GeoAgent: Evaluating VLM Geolocalization Through Embodied Navigation

GeoAgent:通过具身导航评估视觉语言模型的地理定位能力

Arka Mukherjee, Soham Roy, Kartikeya Trivedi, Shreya Ghosh

机构 * KIIT Bhubaneswar(布巴内斯瓦尔KIIT大学) IIT Bhubaneswar(布巴内斯瓦尔印度理工学院)

专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究提出基于街景导航的GeoAgent基准,发现VLMs在地理定位中难区分区域模式,智能体导航可提升准确率,但模型存在地区偏差且自我改进能力差,明确了具身地理定位的挑战

Comments Accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29305 2026-09-01 cs.CL cs.AI cs.LG 新提交 67%

Learning Simple Test-Time Environments for LLM Web Agents

为大型语言模型网页智能体学习简单的测试时环境

Junxuan Li, Zijun Liu, Ziyi Huang, Peng Li, Yuzhou Liu, Ming Yan, Yang Liu

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Dept. of Comp. Sci. & Tech., Tsinghua University(清华大学计算机科学与技术系) School of Electronic and Information Engineering, Beijing Jiaotong University(北京交通大学电子信息工程学院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究针对LLM网页智能体在复杂真实环境中性能下降问题,提出测试时环境分解(TTED)方法,通过将复杂环境分解为子模块并利用子环境经验提升组合泛化能力,验证了其在合成与真实基准上的有效性。

Comments Code and data are released at https://github.com/THUNLP-MT/TTED

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04412 2026-09-01 cs.AI cs.CL cs.HC 版本更新 62%

Beyond Pixels: Exploring DOM Downsampling for LLM-Based Web Agents

超越像素:探索面向基于大语言模型的智能体的DOM下采样

Thassilo M. Schiepanski, Nicholas Piël

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出D2Snap算法对DOM下采样,解决原始DOM令牌占用过大的问题,经评估其在GPT-4o智能体上的成功率达73%,接近基于GUI快照的基线性能。

Comments 21 pages, LaTeX, print version; updated figures (2, 4)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07086 2026-09-01 cs.AI cs.LG cs.SY eess.SY 62%

To Train or Not to Train: Balancing Efficiency and Training Cost in Deep Reinforcement Learning for Mobile Edge Computing

Maddalena Boscaro, Federico Mason, Federico Chiariotti, Andrea Zanella

机构 * University of Padova(帕多瓦大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.LG

Journal ref IEEE International Conference on Communications, Montreal, QC, Canada, 2025, pp. 2352-2357

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30207 2026-09-01 cs.CR cs.AI 新提交 57%

SIR: Self-improving Red-teaming for Compute Use Agents

SIR:面向计算使用智能体的自改进红队测试

Chen Xiong, Zhiyuan He, Pin-Yu Chen, Stjepan Picek, Tsung-Yi Ho

机构 * The Chinese University of Hong Kong(香港中文大学) IBM Research(IBM研究院) University of Zagreb(萨格勒布大学) Radboud University(拉德堡德大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出SIR,一种针对操作系统层面计算使用智能体的黑盒间接提示注入攻击,通过迭代反馈循环提炼策略,使攻击成功率显著提升且可跨模型迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15017 2026-09-01 cs.CL 版本更新 57%

Are Online Skill and Memory Modules Always Worth Their Tokens? A Budget-Constrained Study of Web Agents

在线技能与记忆模块是否总是值得其令牌消耗?Web代理的预算约束研究

Sina Hajimiri, Masih Aminbeidokhti, Jose Dolz, Ismail Ben Ayed, Issam H. Laradji, Spandana Gella, Nicolas Gontier

机构 * ServiceNow AI Research(ServiceNow AI 研究院) ÉTS Montreal(蒙特利尔高等技术学院) University of British Columbia(不列颠哥伦比亚大学) McGill University(麦吉尔大学)

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.CL

AI总结 在固定推理预算下,对比三种在线增强模块与令牌匹配的基线,发现基线在总成功率上匹配或超越所有增强方法,且常使用更少令牌。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31021 2026-09-01 eess.SY cs.SY 新提交 50%

Semi-Autonomous Prosthesis Control Empowered by 5G and Mobile Edge Computing

由5G与移动边缘计算赋能的半自主假肢控制

Ozan Karaali, Hossam Farag, Strahinja Dosen, Cedomir Stefanovic

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 该研究开发了基于5G和MEC的半自主假手原型,通过边缘服务器处理视觉任务,其性能优于手动控制和设备端处理,为假肢控制提供了可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏