arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-01 至 2025-12-01 共收录 124 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 44 篇

2504.19408 2025-12-01 cs.LG cs.CV eess.SP 57%

Axial-UNet: A Neural Weather Model for Precipitation Nowcasting

Axial-UNet:一种用于降水nowcasting的神经天气模型

Sumit Mamtani, Maitreya Sonawane

机构 * New York University(纽约大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 Axial-UNet通过轴向注意力块和混合架构实现高效的降水nowcasting,优于现有方法并在像素保真度上取得显著成绩。

Comments 16 pages, 3 figures. Accepted at the International Conference on Distributed Computing and Intelligent Technology (ICDCIT 2026), to appear in Springer LNCS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22325 2025-12-01 cs.AI 57%

Tracing Footsteps of Similar Cities: Modeling Urban Economic Vitality with Dynamic Inter-City Graph Embeddings

追踪相似城市的足迹:通过动态跨城市图嵌入建模城市经济活力

Xiaofeng Li, Xiangyi Xiao, Xiaocong Du, Ying Zhang, Haipeng Zhang

机构 * ShanghaiTech University(上海科技大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ECO-GROW通过动态跨城市图嵌入建模城市经济活力,整合产业联系、POI相似性等多维度数据,提升对城市经济活力的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21758 2025-12-01 cs.CR cs.AI cs.CY 57%

A Longitudinal Measurement of Privacy Policy Evolution for Large Language Models

大型语言模型隐私政策演变的纵向测量

Zhen Tao, Shidong Pan, Zhenchang Xing, Emily Black, Talia Gillis, Chunyang Chen

机构 * Technical University of Munich(慕尼黑技术大学) Columbia University(哥伦比亚大学) New York University(纽约大学) CSIRO’s Data61(CSIRO的数据61)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文首次对全球主流LLM提供者的隐私政策进行了纵向研究,揭示了隐私政策的演变趋势、内容特征及地区差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21631 2025-12-01 cs.CV cs.AI 57%

Qwen3-VL Technical Report

Qwen3-VL 技术报告

Shuai Bai, Yuxuan Cai, Ruizhe Chen, Keqin Chen, Xionghui Chen, Zesen Cheng, Lianghao Deng, Wei Ding, Chang Gao, Chunjiang Ge, Wenbin Ge, Zhifang Guo, Qidong Huang, Jie Huang, Fei Huang, Binyuan Hui, Shutong Jiang, Zhaohai Li, Mingsheng Li, Mei Li, Kaixin Li, Zicheng Lin, Junyang Lin, Xuejing Liu, Jiawei Liu, Chenglong Liu, Yang Liu, Dayiheng Liu, Shixuan Liu, Dunjie Lu, Ruilin Luo, Chenxu Lv, Rui Men, Lingchen Meng, Xuancheng Ren, Xingzhang Ren, Sibo Song, Yuchong Sun, Jun Tang, Jianhong Tu, Jianqiang Wan, Peng Wang, Pengfei Wang, Qiuyue Wang, Yuxuan Wang, Tianbao Xie, Yiheng Xu, Haiyang Xu, Jin Xu, Zhibo Yang, Mingkun Yang, Jianxin Yang, An Yang, Bowen Yu, Fei Zhang, Hang Zhang, Xi Zhang, Bo Zheng, Humen Zhong, Jingren Zhou, Fan Zhou, Jing Zhou, Yuanzhi Zhu, Ke Zhu

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 Qwen3-VL 是一款强大的多模态模型,具备强大的纯文本理解、长上下文处理和多模态推理能力,适用于图像推理、代理决策和多模态代码智能。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20591 2025-12-01 cs.LG 57%

Attention Trajectories as a Diagnostic Axis for Deep Reinforcement Learning

注意力轨迹作为深度强化学习的诊断轴

Charlotte Beylier, Hannah Selder, Arthur Fleig, Simon M. Hofmann, Nico Scherf

机构 * Max Planck Institute for Human Cognitive and Brain Sciences(马克斯·普朗克人类认知与脑科学研究所) Center for Scalable Data Analytics and Artificial Intelligence (ScaDS.AI)(可扩展数据与人工智能研究中心) Leipzig University(莱比锡大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出通过注意力轨迹分析深度强化学习代理的内部决策过程,揭示其特征依赖、策略偏差和过度拟合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00096 2025-12-01 q-bio.GN cs.AI 57%

PathGene: Benchmarking Driver Gene Mutations and Exon Prediction Using Multicenter Lung Cancer Histopathology Image Dataset

PathGene:利用多中心肺癌组织病理学图像数据集进行驱动基因突变和外显子预测的基准测试

Liangrui Pan, Qingchun Liang, Shen Zhao, Songqing Fan, Shaoliang Peng

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 PathGene通过多中心肺癌病理图像数据集,利用多实例学习方法提升驱动基因突变和外显子预测的准确性,助力精准肿瘤学发展。

Comments Withdrawn due to issues related to data permissions/ethics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23454 2025-12-01 cs.GT 50%

Designing Rules for Choosing a Winner in a Debate

辩论中选择胜者的规则设计

Alexander Heckett, Vincent Conitzer

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了委托人如何设计规则以选择辩论中更好的行动,通过正式框架分析了代理人策略和规则设计的优化问题。

Comments 22 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23109 2025-12-01 cs.LO 50%

Neuro-Symbolic Constrained Optimization for Cloud Application Deployment via Graph Neural Networks and Satisfiability Modulo Theory

基于图神经网络和可满足性模理论的神经符号受限优化用于云应用部署

Madalina Erascu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于图神经网络和可满足性模理论的神经符号框架,用于优化云应用部署,通过结合约束推理与机器学习提升求解器的可扩展性和成本最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22873 2025-12-01 cs.CV cs.IR 50%

CNN-Based Framework for Pedestrian Age and Gender Classification Using Far-View Surveillance in Mixed-Traffic Intersections

基于CNN的远视监控中混合交通交叉口行人年龄和性别分类框架

Shisir Shahriar Arif, Md. Muhtashim Shahrier, Nazmul Haque, Md Asif Raihan, Md. Hadiuzzaman

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出基于CNN的远视监控框架,用于混合交通交叉口行人年龄和性别分类,无需面部识别或高分辨率图像,提供高效、低成本的行人人口统计数据监测解决方案。

Comments Accepted for poster presentation at the 105th Annual Meeting of the Transportation Research Board

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06224 2025-12-01 cs.CV 50%

TEFormer: Texture-Aware and Edge-Guided Transformer for Semantic Segmentation of Urban Remote Sensing Images

TEFormer:面向城市遥感图像语义分割的纹理感知与边缘引导变换器

Guoyu Zhou, Jing Zhang, Yi Yan, Hui Zhang, Li Zhuo

专题命中 规划决策 :planning(abstract)

AI总结 TEFormer通过纹理感知和边缘引导的变换器提升城市遥感图像语义分割的精度与鲁棒性。

Comments Accepted by IEEE GRSL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15958 2025-12-01 eess.SY cs.SY 50%

Impact Analysis of Utility-Scale Energy Storage on the ERCOT Grid in Reducing Renewable Generation Curtailments and Emissions

电力规模储能对 ERCOT 网格减少可再生能源弃消和排放的影响分析

Cody Buehner, Sharaf K. Magableh, Oraib Dawaghreh, Caisheng Wang

专题命中 规划决策 :planning(abstract)

AI总结 本文研究电力规模储能如何减少 ERCOT 网格中可再生能源弃消和二氧化碳排放,通过分析未来能源格局和不同负荷场景下的排放情况,提出战略性储能方案以优化可再生能源利用。

Comments This paper is accepted for publication in IEEE PES GM 2025

Journal ref 2025 IEEE Power & Energy Society General Meeting (PESGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22606 2025-12-01 eess.IV cs.CV 50%

Hard Spatial Gating for Precision-Driven Brain Metastasis Segmentation: Addressing the Over-Segmentation Paradox in Deep Attention Networks

精准驱动的脑转移瘤分割中的硬空间门控:解决深度注意力网络中的过分割悖论

Rowzatul Zannath Prerona

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出SG-Net,通过硬空间门控机制解决深度注意力网络中的过分割问题,提升分割精度和边界检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22415 2025-12-01 cs.CR 50%

Exposing Vulnerabilities in RL: A Novel Stealthy Backdoor Attack through Reward Poisoning

揭示强化学习中的漏洞:通过奖励污染的新型隐秘后门攻击

Bokang Zhang, Chaojun Lu, Jianhui Li, Junfeng Wu

专题命中 规划决策 :agent(abstract)

AI总结 本文提出通过奖励污染对强化学习代理进行隐秘后门攻击,展示了在不同环境中攻击的有效性和隐蔽性。

Comments Workshop on Safe and Robust Robot Learning for Operation in the Real World at CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22338 2025-12-01 cs.RO cs.SY eess.SY 50%

Nonholonomic Narrow Dead-End Escape with Deep Reinforcement Learning

非完整约束狭窄死胡同逃脱与深度强化学习

Denghan Xiong, Yanzhe Zhao, Yutong Chen, Zichun Wang

机构 * ZJUI Institute, International Campus\ University Haining China Tianjin University Tianjin China Beijing Jiaotong University Beijing China University of Nottingham Ningbo China Ningbo China ZJUI Institute, International Campus\ University Tianjin University Beijing Jiaotong University University of Nottingham Ningbo China

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出了一种基于深度强化学习的方法,用于解决Ackermann车辆在狭窄死胡同中的非完整约束逃脱问题,通过生成多阶段轨迹并训练策略以提高效率。

Comments 14 pages, 5 figures, 1 table, submitted to arXiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22218 2025-12-01 math.OC 50%

A Two-Stage Stochastic Optimization Framework for Environmentally Sensitive Oil Spill Response Resource Allocation in the Arctic

一种用于北极环境敏感石油泄漏应急响应资源分配的两阶段随机优化框架

Md Ashiqur Rahman, Mustofa Tanbir Kuhel, Clara Novoa

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种两阶段随机优化框架,用于北极环境敏感石油泄漏应急响应中资源分配问题,通过考虑不确定性、环境敏感性和现实约束,提升响应效果。

Comments 18 pages, 11 figures, 5 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22217 2025-12-01 cs.NI 50%

Optimizing NetGPT via Routing-Based Synergy and Reinforcement Learning

通过基于路由的协同与强化学习优化NetGPT

Yuxuan Chen, Rongpeng Li, Xianfu Chen, Celimuge Wu, Chenghui Peng, Zhifeng Zhao, Honggang Zhang

专题命中 规划决策 :agent(abstract)

AI总结 NetGPT通过云边协同与强化学习优化,实现动态路由与边缘自改进,提升复杂请求处理效率与成本控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13914 2025-12-01 physics.med-ph 50%

Development of a defacing algorithm to protect the privacy of head and neck cancer patients in publicly-accessible radiotherapy datasets

头颈癌患者在公共放射治疗数据集中的隐私保护去脸算法开发

Kayla O'Sullivan-Steben, Luc Galarneau, John Kildea

专题命中 规划决策 :planning(abstract)

AI总结 本研究开发了一种新的自动去脸算法,用于在保护头颈癌患者隐私的同时保留关键结构,使公共放射治疗数据集能够用于大数据和人工智能研究。

Comments 22 pages, 6 figures, submitted to Medical Physics

Journal ref Med Phys. 2025; 52:e70160

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00369 2025-12-01 cs.CV 50%

Automated segmentation of pediatric neuroblastoma on multi-modal MRI: Results of the SPPIN challenge at MICCAI 2023

多模态MRI上儿科神经母细胞瘤自动分割:2023年MICCAI SPPIN挑战赛结果

M. A. D. Buser, D. C. Simons, M. Fitski, M. H. W. A. Wijnen, A. S. Littooij, A. H. ter Brugge, I. N. Vos, M. H. A. Janse, M. de Boer, R. ter Maat, J. Sato, S. Kido, S. Kondo, S. Kasai, M. Wodzinski, H. Muller, J. Ye, J. He, Y. Kirchhoff, M. R. Rokkus, G. Haokai, S. Zitong, M. Fernández Patón, D. Veiga-Canuto, D. G. Ellis, M. R. Aizenberg, B. H. M. van der Velden, H. Kuijf, A. De Luca, A. F. W. van der Steeg

专题命中 规划决策 :planning(abstract)

AI总结 SPPIN挑战赛通过多模态MRI自动分割神经母细胞瘤,展示了预训练网络在小数据集中的有效性,但小肿瘤分割仍需改进。

Comments 23 pages, 6 figures

Journal ref Bioengineering, 12(11), 1157 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 22 篇

2511.22737 2025-12-01 cs.AI cs.HC 92%

Agentic AI Framework for Individuals with Disabilities and Neurodivergence: A Multi-Agent System for Healthy Eating, Daily Routines, and Inclusive Well-Being

具有残疾和神经多样性个体的代理AI框架:一个用于健康饮食、日常习惯和包容性福祉的多代理系统

Salman Jan, Toqeer Ali Syed, Gohar Ali, Ali Akarma, Mohammad Riyaz Belgaum, Ahmad Ali

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出一种多代理系统,通过个性化营养、适应性调度、食品指导和生理监测等代理,为残疾和神经多样性个体提供健康饮食、日常习惯和包容性福祉的AI框架。

Comments Presented at International Conference on Business and Digital Technology, Bahrain, Springer Nature, 27 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00081 2025-12-01 cs.MA cs.AI 89%

From homeostasis to resource sharing: Biologically and economically aligned multi-objective multi-agent gridworld-based AI safety benchmarks

从稳态到资源共享:生物和经济对齐的多目标多智能体网格世界基于AI安全基准

Roland Pihlakas

机构 * Independent researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出生物和经济对齐的多目标多智能体网格世界基准,用于评估AI安全中的稳态、 diminishing returns、可持续性和资源共享等关键问题。

Comments 21 pages, 13 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23148 2025-12-01 cs.AI 89%

Peer-to-Peer Energy Trading in Dairy Farms using Multi-Agent Reinforcement Learning

基于多智能体强化学习的奶牛场点对点能源交易

Mian Ibad Ali Shah, Marcos Eduardo Cruz Victorio, Maeve Duffy, Enda Barrett, Karl Mason

机构 * School of Computer Science, College of Science and Engineering, University of Galway(Galway大学计算机科学学院) School of Engineering, College of Science and Engineering, University of Galway(Galway大学工程学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本研究利用多智能体强化学习和点对点能源交易,降低奶牛场电力成本和高峰负荷需求,提升能源管理效率。

Comments 51 pages, 7 figures, 11 tables, Preprint of the article published in Applied Energy: Shah, M.I.A., Victorio, M.E.C., Duffy, M., Barrett, E. and Mason, K. (2026). Peer-to-peer energy trading in dairy farms using multi-agent reinforcement learning. Applied Energy, 402, 127041. doi:10.1016/j.apenergy.2025.127041

Journal ref Applied Energy (2026), 402, 127041

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23315 2025-12-01 cs.LG 88%

Emergent Coordination and Phase Structure in Independent Multi-Agent Reinforcement Learning

独立多智能体强化学习中的涌现协调与相结构

Azusa Yamaguchi

机构 * School of Physics and Astronomy University of Edinburgh(物理与天文学学院 英格兰爱丁堡大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 该研究通过分析独立多智能体强化学习中的协调与相结构,揭示了规模、密度和内核漂移之间的相互作用对多智能体学习系统动态的影响。

Comments 22 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04195 2025-12-01 cs.CR 88%

AutoPatch: Multi-Agent Framework for Patching Real-World CVE Vulnerabilities

AutoPatch:多智能体框架用于修补现实世界中的CVE漏洞

Minjae Seo, Wonwoo Choi, Myoungsung You, Seungwon Shin

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 AutoPatch通过多智能体框架高效修补LLM生成代码中的CVE漏洞,实现高准确率和低成本的漏洞修复

Comments 19 pages, double column, 9 figures. Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19676 2025-12-01 cs.CR 88%

A Survey of LLM-Driven AI Agent Communication: Protocols, Security Risks, and Defense Countermeasures

面向大语言模型驱动的AI代理通信的综述:协议、安全风险及防御措施

Dezhang Kong, Shi Lin, Zhenhua Xu, Zhebo Wang, Minghao Li, Yufeng Li, Yilun Zhang, Hujin Peng, Xiang Chen, Zeyang Sha, Yuyuan Li, Changting Lin, Xun Wang, Xuan Liu, Ningyu Zhang, Chaochao Chen, Chunming Wu, Muhammad Khurram Khan, Meng Han

专题命中 多智能体 :agent(title,abstract);AI agent(title,abstract)

AI总结 本文综述了由大语言模型驱动的AI代理通信的安全问题,提出定义、分类框架及防御措施,通过实验揭示通信漏洞并探讨未来研究方向。

Comments 48 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22767 2025-12-01 cs.AI cs.MA 87%

Agentic AI Framework for Cloudburst Prediction and Coordinated Response

云暴预测与协调响应的代理AI框架

Toqeer Ali Syed, Sohail Khan, Salman Jan, Gohar Ali, Muhammad Nauman, Ali Akarma, Ahmad Ali

机构 * Islamic University of Madinah(麦地那伊斯兰大学) Effat College of Engineering(Effat工程学院) Effat University(Effat大学) Faculty of Computer Studies(计算机研究学院) Arab Open University-Bahrain(巴林阿拉伯开放大学) kingdom university(王国大学)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 本文提出一种代理AI框架,用于预测云暴并协调响应,通过多代理系统提升预测可靠性与预警提前量,实现可扩展的气候韧性。

Comments Presented at International Conference on Business and Digital Technology, Bahrain, Springer Nature, 27 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22572 2025-12-01 cs.LO cs.MA 86%

Formal Verification of Probabilistic Multi-Agent Systems for Ballistic Rocket Flight Using Probabilistic Alternating-Time Temporal Logic

基于概率交替时间时序逻辑的球形火箭飞行概率多智能体系统形式化验证

Damian Kurpiewski, Jędrzej Michalczyk, Wojciech Jamroga, Jerzy Julian Michalski, Teofil Sidoruk

专题命中 多智能体 :agent(title,abstract);multi-agent(title)

AI总结 本研究提出基于概率交替时间时序逻辑的验证方法,用于验证弹道火箭飞行轨迹的安全性,通过整合真实飞行数据和环境随机性分析,确保任务安全并维持科学目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23366 2025-12-01 cs.AI cs.MA 85%

Agentic AI Framework for Smart Inventory Replenishment

智能库存补货的代理AI框架

Toqeer Ali Syed, Salman Jan, Gohar Ali, Ali Akarma, Ahmad Ali, Qurat-ul-Ain Mastoi

机构 * Faculty of Computer and Information System(计算机与信息系统学院) Islamic University of Madinah(麦地那伊斯兰大学) School of Computer Science and Creative Technologies(计算机科学与创意技术学院) University of the West of England(英格兰西部大学) Faculty of Computer Studies(计算机研究学院) Arab Open University(阿拉伯开放大学)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本研究提出一种代理AI框架,用于智能库存补货,通过需求预测、供应商优化和多代理谈判,减少缺货和库存成本,提升产品周转效率。

Comments Presented at International Conference on Business and Digital Technology, Bahrain, Springer Nature, 27 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21729 2025-12-01 cs.CL cs.AI 85%

Beyond Component Strength: Synergistic Integration and Adaptive Calibration in Multi-Agent RAG Systems

超越组件强度:多智能体RAG系统中的协同整合与自适应校准

Jithin Krishnan

机构 * National University of Singapore(新加坡国立大学)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI、cs.CL

AI总结 该研究探讨了多智能体RAG系统中组件协同整合的重要性,发现通过混合检索、集合验证和自适应阈值等技术的协同作用,可显著降低退避率并减少幻觉,强调了标准化度量和自适应校准的必要性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22536 2025-12-01 cs.AI cs.GT cs.MA 84%

A Computable Game-Theoretic Framework for Multi-Agent Theory of Mind

一个可计算的游戏理论框架用于多智能体理论 of mind

Fengming Zhu, Yuxin Pan, Xiaomeng Zhu, Fangzhen Lin

机构 * Fengming Zhu, Yuxin Pan, Xiaomeng Zhu, Fangzhen Lin(作者)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI

AI总结 本文提出了一种基于游戏理论的可计算框架,用于多智能体的理论 of mind,结合有限理性决策与统计技术实现计算可行性。

Comments Ongoing work. A preliminary version has been accepted by the AAAI 2026 Theory of Mind for AI (ToM4AI) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22105 2025-12-01 cs.LG 83%

Energy Efficient Sleep Mode Optimization in 5G mmWave Networks via Multi Agent Deep Reinforcement Learning

通过多智能体深度强化学习优化5G毫米波网络的节能睡眠模式

Saad Masrur, Ismail Guvenc, David Lopez Perez

机构 * Department of Electrical and Computer Engineering, North Carolina State University, Raleigh, NC(北卡罗来纳州立大学电气与计算机工程系) Universitat Politècnica de València, Valencia, Spain(瓦伦西亚理工大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出基于多智能体深度强化学习的MARL-DDQN方法,用于优化5G毫米波网络的节能睡眠模式,实现更高的能效和吞吐量公平性。

Comments This is an updated version of my preprint available on TechRxiv. Don't flag it as plagiarism. I wanna post my paper on arxiv

详情

展开后加载摘要…

URL PDF HTML 收藏