arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-14 至 2026-01-14 共收录 96 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 9 篇

2601.08726 2026-01-14 cs.LG 57%

Model-Agnostic Solutions for Deep Reinforcement Learning in Non-Ergodic Contexts

深度强化学习在非平衡环境中模型无关的解决方案

Bert Verbruggen, Arne Vanhoyweghen, Vincent Ginis

机构 * Data Analytics Lab, Vrije Universiteit Brussel(自由大学布鲁塞尔数据分析实验室) Mobilise, Vrije Universiteit Brussel(Mobilise,自由大学布鲁塞尔) School of Engineering and Applied Sciences, Harvard University(工程与应用科学学院,哈佛大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本文提出在非平衡环境中通过引入时间依赖性改进深度强化学习策略,以获得更优的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08318 2026-01-14 q-bio.QM cs.LG 57%

Disentangling History and Propagation Dependencies in Cross-Subject Knee Contact Stress Prediction Using a Shared MeshGraphNet Backbone

解构跨受体膝关节接触应力预测中的历史与传播依赖性使用共享MeshGraphNet主干

Zhengye Pan, Jianwei Zuo, Jiajia Luo

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出了一种共享MeshGraphNet主干模型,通过分离时间历史依赖性和空间传播依赖性,提升了跨受体膝关节接触应力预测的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23130 2026-01-14 cs.CV cs.AI 57%

PathoSyn: Imaging-Pathology MRI Synthesis via Disentangled Deviation Diffusion

PathoSyn: 通过解耦偏差扩散实现影像-病理MRI合成

Jian Wang, Sixing Rong, Jiarui Xing, Yuling Xu, Weide Liu

机构 * Department of Radiology, Boston Children’s Hospital, Harvard Medical School(放射科,波士顿儿童医院,哈佛医学院) College of Science, Northeastern University(科学学院,东北大学) School of Medicine, Yale University(医学院,耶鲁大学) Department of Cardiac Surgery, The Second Affiliated Hospital of Jiangxi Medical College, Nanchang University(心脏外科科,江西医学院第二附属医院,南昌大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI

AI总结 PathoSyn通过解耦偏差扩散模型生成高保真MRI合成数据,提升低数据环境下诊断算法的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27591 2026-01-14 astro-ph.SR astro-ph.IM 50%

Multi-band infrared imaging reveals dusty spiral arcs around the binary B[e] star 3 Puppis

多波段红外成像揭示双星B[e]星3 Puppis周围的尘埃螺旋弧

M. Abello, J. Drevon, A. Meilland, A. Domiciano de Souza, F. Millour, R. Flor, J. H. Leftley, C. Paladini, Ph. Stee, A. Matter, S. Lagarde, B. Lopez, P. Ábrahám, J. -C. Augereau, P. Cruzalèbes, W. Danchi, T. Henning, T. Juhász, F. Kerschbaum, F. Lykou, P. Priolet, S. Robbe-Dubois, J. Varga, L. B. F. M. Waters, G. Weigelt, S. Wolf, MATISSE collaboration

专题命中 工作流自动化 :workflow(abstract)

AI总结 多波段红外成像揭示3 Puppis双星周围尘埃螺旋结构的复杂形态与动力学机制

Comments 19 pages, 11 figures, 11 tables

Journal ref A&A 704, A175 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08720 2026-01-14 physics.soc-ph cs.SI 50%

Bipartite structure and dynamics of political corruption networks

政治腐败网络的二元结构与动态

Monica V. Prates, Arthur A. B. Pessa, Sebastian Goncalves, Matjaz Perc, Haroldo V. Ribeiro

专题命中 工作流自动化 :agent(abstract)

AI总结 本文通过二元网络分析揭示了政治腐败网络中代理人与案件的不 assortative 度混合,发现低再犯率和高协调成本,以及犯罪轨迹的网络嵌入度逐步上升。

Comments 12 pages, 6 figures, accepted for publication in Physica A

Journal ref Physica A 683, 131216 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2601.08829 2026-01-14 cs.CL cs.AI 81%

Modeling LLM Agent Reviewer Dynamics in Elo-Ranked Review System

在Elo排名评审系统中建模LLM代理评审动态

Hsiang-Wei Huang, Junbin Lu, Kuang-Ming Chen, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究了在Elo排名评审系统中,通过整合Elo评分和评审者记忆提升领域主席决策准确性的LLM代理评审动态。

Comments In submission. The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09252 2026-01-14 cs.LG cs.SY eess.SY 79%

Large-scale Regional Traffic Signal Control Based on Single-Agent Reinforcement Learning

基于单智能体强化学习的大规模区域交通信号控制

Qiang Li, Jin Niu, Qin Luo, Lina Yu

专题命中 软件智能体 :agent(title,abstract);分类 cs.LG

AI总结 本文提出基于单智能体强化学习的大规模区域交通信号控制模型,通过优化交通信号协调以缓解拥堵和减少行驶时间。

Comments A critical error in the methodology. The reported congestion control effects were not caused by the proposed signal timing optimization, but by an incorrect traffic volume scaling factor during evaluation. The traffic demand was not properly amplified, resulting in misleading performance gains. Due to the substantial nature of the error, completion of revisions is not feasible in the short term

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11665 2026-01-14 cs.PL cs.MA 75%

StackPilot: Autonomous Function Agents for Scalable and Environment-Free Code Execution

StackPilot: 用于可扩展和无环境代码执行的自主函数代理

Xinkui Zhao, Yifan Zhang, Zhengyi Zhou, Yueshen Xu

专题命中 软件智能体 :agent(abstract);autonomous agent(abstract);multi-agent(abstract)

AI总结 StackPilot通过自主函数代理和栈式调度策略,实现语言无关的代码验证与执行,提升LLM生成代码的可靠性与可执行性。

Comments This method needs to be reconsidered and there is something wrong with experiment

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06789 2026-01-14 cs.SE cs.AI 73%

MemGovern: Enhancing Code Agents through Learning from Governed Human Experiences

MemGovern:通过学习受控的人类经验增强代码代理

Qihao Wang, Ziming Cheng, Shuo Zhang, Fan Liu, Rui Xu, Heng Lian, Kunyi Wang, Xiaoming Yu, Jianghao Yin, Sen Hu, Yue Hu, Shaolei Zhang, Yanbing Liu, Ronghao Chen, Huacan Wang

机构 * UCAS(中国科学院大学) NUS(新加坡国立大学) ECNU(华东师范大学) FDU(福建师范大学) XDU(西安电子科技大学) UBC(不列颠哥伦比亚大学) HKUST(GZ)(香港科技大学) PKU(北京大学) RUC(中国人民大学) QuantaAlpha(量子阿尔法)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 MemGovern通过学习受控的人类经验,提升代码代理的修复效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 1 篇

2601.02371 2026-01-14 cs.CY cs.AI cs.MA cs.NI 61%

Permission Manifests for Web Agents

基于Web代理的权限声明

Samuele Marro, Alan Chan, Xinxing Ren, Lewis Hammond, Jesse Wright, Gurjyot Wanga, Tiziano Piccardi, Nuno Campos, Tobin South, Jialin Yu, Sunando Sengupta, Eric Sommerlade, Alex Pentland, Philip Torr, Jiaxin Pei

机构 * University of Oxford(牛津大学) Institute for Decentralized AI(去中心化人工智能研究所) Centre for the Governance of AI(人工智能治理中心) Coral Protocol(珊瑚协议) Cooperative AI Foundation(协作人工智能基金会) Webair Johns Hopkins University(约翰霍普金斯大学) Witan Labs(Witan实验室) Stanford University(斯坦福大学) Microsoft(微软) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 GUI与网页智能体 :agent(abstract,comments);分类 cs.AI

AI总结 本文提出 agent-permissions.json,一种轻量级声明,用于规范 Web 代理的交互权限,以提升自动化应用与网站所有者的协调性。

Comments Authored by the Lightweight Agent Standards Working Group https://las-wg.org/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 3 篇

2512.13564 2026-01-14 cs.CL cs.AI 86%

Memory in the Age of AI Agents

人工智能代理时代的记忆

Yuyang Hu, Shichun Liu, Yanwei Yue, Guibin Zhang, Boyang Liu, Fangyi Zhu, Jiahang Lin, Honglin Guo, Shihan Dou, Zhiheng Xi, Senjie Jin, Jiejun Tan, Yanbin Yin, Jiongnan Liu, Zeyu Zhang, Zhongxiang Sun, Yutao Zhu, Hao Sun, Boci Peng, Zhenrong Cheng, Xuanbo Fan, Jiaxin Guo, Xinlei Yu, Zhenhong Zhou, Zewen Hu, Jiahao Huo, Junhao Wang, Yuwei Niu, Yu Wang, Zhenfei Yin, Xiaobin Hu, Yue Liao, Qiankun Li, Kun Wang, Wangchunshu Zhou, Yixin Liu, Dawei Cheng, Qi Zhang, Tao Gui, Shirui Pan, Yan Zhang, Philip Torr, Zhicheng Dou, Ji-Rong Wen, Xuanjing Huang, Yu-Gang Jiang, Shuicheng Yan

机构 * Core Supervisors. 0.5em Affiliations: National University of Singapore, Renmin University of China, Fudan University, Peking University, Nanyang Technological University, Tongji University, University of California San Diego, Hong Kong University of Science Technology (Guangzhou), Griffith University, Georgia Institute of Technology, OPPO, Oxford University

专题命中 记忆与上下文管理 :AI agent(title);agent(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文系统梳理了人工智能代理记忆的现状与分类,提出了记忆的三种形式、功能分类及动态分析,为未来智能设计提供理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.03684 2026-01-14 cs.LG cs.AI cs.RO stat.ML 62%

Cross-Domain Imitation Learning via Optimal Transport

跨领域模仿学习 via 最优传输

Arnaud Fickinger, Samuel Cohen, Stuart Russell, Brandon Amos

机构 * Berkeley AI Research(伯克利人工智能研究)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 GWIL通过Gromov-Wasserstein距离实现跨领域模仿学习,有效对齐不同空间的状态,适用于连续控制领域。

Comments ICLR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00365 2026-01-14 cs.LG 57%

ROSS: RObust decentralized Stochastic learning based on Shapley values

ROSS:基于Shapley值的鲁棒去中心化随机学习

Lina Wang, Yunsheng Yuan, Feng Li, Lingjie Duan

机构 * School of Computer Science and Technology, Shandong University(计算机科学与技术学院,山东大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出基于Shapley值的ROSS算法,通过加权导数提升去中心化学习的鲁棒性和收敛效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 22 篇

2601.06093 2026-01-14 cs.CY cs.AI 88%

GenAITEd Ghana: A First-of-Its-Kind Context-Aware and Curriculum-Aligned Conversational AI Agent for Teacher Education

GenAITEd Ghana:首个基于情境感知和课程对齐的对话式人工智能代理用于教师教育

Matthew Nyaaba, Patrick Kyeremeh, Macharious Nabang, Bismark Nyaaba Akanzire, Sakina Acquah, Cyril Ababio Titty, Kotor Asare, Jerry Etornam Kudaya

专题命中 Agent评测 :agent(title,abstract);AI agent(title);multi-agent(abstract);分类 cs.AI

AI总结 GenAITEd Ghana是一款基于情境感知和课程对齐的对话式AI代理,旨在支持加纳教师教育,通过多代理系统和伦理约束确保负责任的AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08333 2026-01-14 cs.AI 86%

Semantic Laundering in AI Agent Architectures: Why Tool Boundaries Do Not Confer Epistemic Warrant

人工智能代理架构中的语义清洗:为什么工具边界不赋予认知证成

Oleg Romanchuk, Roman Bondar

专题命中 Agent评测 :agent(title,abstract);AI agent(title);分类 cs.AI

AI总结 本文指出基于LLM的代理架构中存在语义清洗问题,即缺乏证成的命题通过架构信任接口被接受,导致认知证成无法消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07880 2026-01-14 cs.CR cs.AI 86%

Sola-Visibility-ISPM: Benchmarking Agentic AI for Identity Security Posture Management Visibility

Sola-Visibility-ISPM:用于身份安全态势管理可见性的代理AI基准测试

Gal Engelberg, Konstantin Koutsyi, Leon Goldberg, Reuven Elezra, Idan Pinto, Tal Moalem, Shmuel Cohen, Yoni Weintrob

机构 * Sola Security(Sola安全)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 Sola-Visibility-ISPM基准测试通过代理AI系统评估身份安全态势管理的可见性任务,展示了其在AWS、Okta和Google Workspace等环境中的高准确率和实用性。

Comments 20 pages, 3 figures. Benchmark and evaluation framework for agentic AI in identity security posture management, including expert evaluation and LLM-as-judge analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18882 2026-01-14 cs.CY 86%

Personalized Safety in LLMs: A Benchmark and A Planning-Based Agent Approach

大语言模型中的个性化安全:一个基准和基于规划的代理方法

Yuchen Wu, Edward Sun, Kaijie Zhu, Jianxun Lian, Jose Hernandez-Orallo, Aylin Caliskan, Jindong Wang

专题命中 Agent评测 :agent(title,abstract);planning(title)

AI总结 本文提出个性化安全框架PENGUIN和RAISE,通过获取用户背景信息提升LLM的安全性,实验显示安全评分提升达31.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06663 2026-01-14 cs.AI 83%

SafePro: Evaluating the Safety of Professional-Level AI Agents

SafePro:评估专业级AI代理的安全性

Kaiwen Zhou, Shreedhar Jangam, Ashwin Nagarajan, Tejas Polu, Suhas Oruganti, Chengzhi Liu, Ching-Chen Kuo, Yuting Zheng, Sravana Narayanaraju, Xin Eric Wang

机构 * UCSC(加州大学圣塔 Cruz 分校) UCSB(加州大学圣塔 Barbara 分校) eBay(eBay 公司)

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 SafePro通过高复杂度专业任务数据集评估专业级AI代理的安全性,揭示了现有模型在安全判断和对齐方面的不足,并提出了改进安全性的策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08105 2026-01-14 cs.CL 77%

Query Suggestion for Retrieval-Augmented Generation via Dynamic In-Context Learning

通过动态上下文学习实现检索增强生成的查询建议

Fabian Spaeh, Tianyi Chen, Chen-Hao Chiang, Bin Shen

专题命中 Agent评测 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出通过动态上下文学习实现检索增强生成的查询建议,以提升用户交互的安全性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22462 2026-01-14 cs.AI 77%

Learning "Partner-Aware" Collaborators in Multi-Party Collaboration

在多方协作中学习“伙伴感知”的协作者

Abhijnan Nath, Nikhil Krishnaswamy

专题命中 Agent评测 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出ICR算法,通过学习伙伴感知的协作者,提升多任务协作中的共同基础一致性与解决方案多样性。

Comments Fixed typographic errors in the previous manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08003 2026-01-14 cs.CL cs.AI cs.MA 73%

LLM Review: Enhancing Creative Writing via Blind Peer Review Feedback

LLM Review: 通过盲审同行反馈增强创造性写作

Weiyue Li, Mingxiao Song, Zhenda Shen, Dachuan Zhao, Yunfan Long, Yi Li, Yongce Li, Ruyi Yang, Mengyu Wang

机构 * Harvard University(哈佛大学) Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学)

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 LLM Review通过盲审同行反馈机制提升创造性写作,实验显示其优于多智能体基线,并使小模型超越大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02369 2026-01-14 cs.CL cs.AI 73%

AutoContext: Instance-Level Context Learning for LLM Agents

AutoContext:LLM代理的实例级上下文学习

Kuntai Cai, Juncheng Liu, Xianglin Yang, Zhaojie Niu, Xiaokui Xiao, Xing Chen

专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 AutoContext通过解耦探索与任务解决,为LLM代理构建结构化的实例上下文,显著提升了任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09583 2026-01-14 cs.LG stat.ML 70%

YRC-Bench: A Benchmark for Learning to Coordinate with Experts

YRC-Bench:一种学习与专家协调的基准

Mohamad H. Danesh, Nguyen X. Khanh, Tu Trinh, Benjamin Plaut

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.LG

AI总结 YRC-Bench通过提供开放源代码基准,支持在无监督环境下学习与专家协调的方法研究。

Comments Accepted at TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08682 2026-01-14 cs.CL cs.AI 62%

Lessons from the Field: An Adaptable Lifecycle Approach to Applied Dialogue Summarization

领域经验:一种适用于应用对话摘要的可适应生命周期方法

Kushal Chawla, Chenyang Zhu, Pengshan Cai, Sangwoo Cho, Scott Novotney, Ayushman Singh, Jonah Lewis, Keasha Safewright, Alfy Samuel, Erin Babinsky, Shi-Xiong Zhang, Sambit Sahu

机构 * Capital One

专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种适用于应用对话摘要的可适应生命周期方法,通过行业案例研究探讨了在动态需求下构建可靠摘要系统的挑战与解决方案。

Comments EACL 2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08477 2026-01-14 cs.CL cs.HC cs.SE 62%

Do You Understand How I Feel?: Towards Verified Empathy in Therapy Chatbots

你了解我感受吗?:朝向疗法聊天机器人中的验证共情

Francesco Dettori, Matteo Forasassi, Lorenzo Veronese, Livia Lestingi, Vincenzo Scotti, Matteo Giovanni Rossi

机构 * Université Paris-Saclay, Centre National de la Recherche Scientifique(巴黎萨克雷大学,法国国家科学研究中心) TU Wien(维也纳技术大学) Politecnico di Milano(米兰理工学院) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.SE

AI总结 本文提出通过自然语言处理与形式验证结合的方法,开发具有共情能力的疗法聊天机器人,通过统计模型检查验证共情属性并指导行为策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03333 2026-01-14 cs.LG cs.AI 62%

A Differential Perspective on Distributional Reinforcement Learning

分布强化学习的微分视角

Juan Sebastian Rojas, Chi-Guhn Lee

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文从微分视角扩展分布强化学习至平均奖励设置,提出首个能有效学习长期每步奖励分布和微分回报分布的算法,并展示其在性能和信息捕捉方面的优势。

Comments In AAAI Conference on Artificial Intelligence 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08748 2026-01-14 cs.CV cs.AI 57%

UR-Bench: A Benchmark for Multi-Hop Reasoning over Ultra-High-Resolution Images

UR-Bench:面向超高清图像的多跳推理基准

Siqi Li, Xinyu Cai, Jianbiao Mei, Nianchen Deng, Pinlong Cai, Licheng Wen, Yufan Shen, Xuemeng Yang, Botian Shi, Yong Liu

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 UR-Bench是一个针对超高清图像多跳推理的基准,通过引入代理框架和语义工具,评估大语言模型在极端视觉信息下的推理能力。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08690 2026-01-14 cs.AI 57%

All Required, In Order: Phase-Level Evaluation for AI-Human Dialogue in Healthcare and Beyond

全部必要,按顺序:面向AI-人类对话在医疗保健及其他领域的相级评估

Shubham Kulkarni, Alexander Lyzhov, Shiva Chaitanya, Preetam Joshi

专题命中 Agent评测 :workflow(abstract);分类 cs.AI

AI总结 OIP-SCE是一种用于评估AI-人类对话在医疗及其他领域中合规性的方法,通过相级证据确保临床义务按顺序满足,提升AI与临床流程的对齐度。

Comments Accepted at the AI for Medicine and Healthcare (AIMedHealth) Bridge Program, AAAI-26, Singapore. Full-length paper; to appear in Proceedings of Machine Learning Research (PMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08406 2026-01-14 cs.AI cs.CR 57%

WebTrap Park: An Automated Platform for Systematic Security Evaluation of Web Agents

WebTrap Park: 一个用于系统评估Web代理安全性的自动化平台

Xinyi Wu, Jiagui Chen, Geng Hong, Jiayi Dong, Xudong Pan, Jiarun Dai, Min Yang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 WebTrap Park通过自动化平台系统评估Web代理的安全性,揭示不同框架间的安全差异,强调架构重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08254 2026-01-14 cs.AI cs.SY eess.SY 57%

Large Artificial Intelligence Model Guided Deep Reinforcement Learning for Resource Allocation in Non Terrestrial Networks

大人工智能模型引导的深度强化学习用于非地面网络资源分配

Abdikarim Mohamed Ibrahim, Rosdiadee Nordin

机构 * Faculty of Engineering, Sunway University, Petaling Jaya, Malaysia(工程学院,Sunway大学,Petaling Jaya,马来西亚) Future Cities Research Institute, Sunway University, Petaling Jaya, Malaysia(未来城市研究 institute,Sunway大学,Petaling Jaya,马来西亚)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型引导深度强化学习,以提升非地面网络资源分配的性能,在极端天气下表现优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏