arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2604.01630 2026-04-03 cs.CL 57%

Grounding AI-in-Education Development in Teachers' Voices: Findings from a National Survey in Indonesia

将教育中的AI发展扎根于教师的声音:来自印度尼西亚全国调查的结果

Nurul Aisyah, Muhammad Dehan Al Kautsar, Arif Hidayat, Fajri Koto

机构 * Quantic School of Business and Technology(昆蒂克商业与技术学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Indonesia University of Education(印度尼西亚教育大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 研究通过全国性调查揭示印尼教师对AI在教育中的应用现状,发现AI在教学、内容开发和教学媒体中日益普及,但应用不均,教师更倾向于利用AI减轻教学准备负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01535 2026-04-03 cs.CL 57%

Read More, Think More: Revisiting Observation Reduction for Web Agents

多读多想:重新审视网络代理中的观察缩减

Masafumi Enomoto, Ryoma Obara, Haochen Zhang, Masafumi Oyamada

机构 * NEC Corporation(日本电气股份有限公司)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 本文研究网络代理中观察缩减的优化问题,发现模型能力和思考token预算影响观察表示选择,高能力模型适合详细HTML观察,低能力模型适合紧凑的访问树观察,同时引入diff-based表示提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01221 2026-04-02 cs.AI cs.CV 57%

HippoCamp: Benchmarking Contextual Agents on Personal Computers

HippoCamp:在个人电脑上对上下文代理进行基准测试

Zhe Yang, Shulin Tian, Kairui Hu, Shuai Liu, Hoang-Nhat Nguyen, Yichi Zhang, Zujin Guo, Mengying Yu, Zinan Zhang, Jingkang Yang, Chen Change Loy, Ziwei Liu

机构 * S-Lab, Nanyang Technological University, Singapore(新加坡南洋理工大学S-Lab)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 HippoCamp是一个新的基准,用于评估代理在多模态文件管理中的能力,通过用户为中心的环境建模个体用户档案并搜索大规模个人文件进行上下文感知推理,揭示了当前代理在真实环境中的局限性。

Comments Project Page: https://hippocamp-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28183 2026-04-02 cs.AI 57%

PReD: An LLM-based Foundation Multimodal Model for Electromagnetic Perception, Recognition, and Decision

PReD:基于大语言模型的电磁感知、识别与决策基础多模态模型

Zehua Han, Jing Xiao, Yiqi Duan, Mengyu Xiang, Yuheng Ji, Xiaolong Zheng, Chenghanyu Zhang, Zhendong She, Junyu Shen, Dingwei Tan, Shichu Sun, Zhou Cong, Mingxuan Liu, Fengxiang Wang, Jinping Sun, Yangang Sun

机构 * Tsinghua University(清华大学) National University of Defense Technology(国防科技大学) Beihang University(北京航空航天大学) Tianjin University(天津大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Institute of Microelectronics, Chinese Academy of Sciences(中国科学院微电子研究所) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) The Hong Kong University of Science and Technology(香港科技大学) Civil Aviation University of China(中国民航大学) Beijing Institute of Technology(北京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出PReD,首个电磁领域基础模型,涵盖感知、识别与决策闭环,构建高质量多任务电磁数据集和评估基准,通过多阶段训练策略提升电磁领域能力,实验显示在PReD-Bench上达到最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19846 2026-04-02 cs.AI 57%

HiMA-Ecom: Enabling Joint Training of Hierarchical Multi-Agent E-commerce Assistants

HiMA-Ecom:面向电商场景的分层多智能体助手联合训练

Junxing Hu, Ai Han, Haolan Zhan, Pu Wei, Zhiqian Zhang, Yuhang Guo, Jiawei Lu, Zhen Chen, Haoran Li, Zicheng Zhang

机构 * JD Retail, JD.com, Inc.(京东零售,京东集团) Faculty of Engineering and Information Technology, The University of Melbourne(墨尔本大学工程与信息技术学院) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出HiMA-Ecom电商多智能体基准,通过VR-GRPO算法实现多智能体联合训练,基于3B/7B开源模型在电商场景中取得优于DeepSeek-V3的性能。

Comments 39 pages, 10 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00281 2026-04-02 cs.AI 57%

Human-in-the-Loop Control of Objective Drift in LLM-Assisted Computer Science Education

人机协同控制LLM辅助计算机科学教育中的目标漂移

Mark Dranias, Adam Whitley

机构 * Asheville Institute for Memory and Longevity(阿什维尔记忆与长寿研究所) University of North Carolina Asheville(北卡罗来纳大学阿什维尔分校)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种人机协同的教学方法,通过分离规划与执行,训练学生在代码生成前指定接受标准和架构约束,以稳定AI辅助学习过程。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00074 2026-04-02 cs.LG cs.CY 57%

PASM: Population Adaptive Symbolic Mixture-of-Experts Model for Cross-location Hurricane Evacuation Decision Prediction

PASM:用于跨地点飓风疏散决策预测的群体自适应符号混合专家模型

Xiao Qian, Shangjia Dong

机构 * University of Delaware(特拉华大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出PASM模型,通过符号回归与混合专家架构,解决跨地点疏散决策预测中的泛化问题,实现高准确率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29993 2026-04-01 cs.AI 57%

Extending MONA in Camera Dropbox: Reproduction, Learned Approval, and Design Implications for Reward-Hacking Mitigation

在Camera Dropbox中扩展MONA:再现、学习批准与奖励黑客缓解的设计影响

Nathan Heath

机构 * Independent Researcher(独立研究者)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 该研究通过扩展MONA方法,验证了学习批准在缓解奖励黑客中的有效性,并探讨了其设计影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18615 2026-04-01 cs.AI 57%

Improving Execution Concurrency in Partial-Order Plans via Block-Substitution

通过块替换改进部分序计划的执行并发性

Sabah Binte Noor, Fazlul Hasan Siddiqui

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出通过块替换优化部分序计划的并发性,通过引入非并发约束条件和资源优化算法,提升计划执行效率。

Comments arXiv admin note: text overlap with arXiv:2406.03091

Journal ref Autonomous Agents and Multi-Agent Systems, vol. 39, April 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03091 2026-04-01 cs.AI 57%

Improving Plan Execution Flexibility using Block-Substitution

通过块替换提高计划执行灵活性

Sabah Binte Noor, Fazlul Hasan Siddiqui

机构 * Dhaka University of Engineering \& Technology Gazipur Bangladesh Dhaka University of Engineering \& Technology

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文通过块替换方法提升计划灵活性,利用块分解部分顺序计划(BDPO)结构,结合MaxSAT重新排序策略,在国际规划竞赛基准问题中显著提升执行灵活性。

Journal ref . Improving Plan Execution Flexibility using Block-Substitution. Journal of Artificial Intelligence Research 85, Article 35 (March 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27991 2026-03-31 cs.HC cs.AI 57%

ViviDoc: Generating Interactive Documents through Human-Agent Collaboration

ViviDoc:通过人机协作生成交互式文档

Yinghao Tang, Yupeng Xie, Yingchaojie Feng, Tingfeng Lan, Jiale Lao, Yue Cheng, Wei Chen

机构 * National University of Singapore(新加坡国立大学) University of Virginia(弗吉尼亚大学) Cornell University(康奈尔大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 ViviDoc通过多智能体流程和三级人类控制,系统性解决交互式文档生成问题,构建了ViviBench基准并实现高内容丰富度和交互质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11524 2026-03-31 cs.AI 57%

Inspire or Predict? Exploring New Paradigms in Assisting Classical Planners with Large Language Models

激励还是预测?探索利用大语言模型辅助经典规划器的新范式

Wenkai Yu, Jianhang Tang, Yang Zhang, Yixiong Feng, Celimuge Wu, Kebing Jin, Hankz Hankui Zhuo

机构 * State Key Laboratory of Public Big Data, Guizhou University(贵州大学公共大数据国家重点实验室) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院) School of Mechanical Engineering, Guizhou University(贵州大学机械工程学院) Meta-Networking Research Center, The University of Electro-Communications(电气通信大学元网络研究中心) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种集成问题分解的新型LLM辅助规划器,通过LLM4Inspire和LLM4Predict两种范式,结合通用知识和领域知识,有效解决大规模规划问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27738 2026-03-31 cs.AI 57%

TianJi:An autonomous AI meteorologist for discovering physical mechanisms in atmospheric science

TianJi:一种自主AI气象学家,用于发现大气科学中的物理机制

Kaikai Zhang, Xiang Wang, Haoluo Zhao, Nan Chen, Mengyang Yu Jing-Jia Luo, Tao Song, Fan Meng

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) State Key Laboratory of Climate System Prediction and Risk Management (CPRM), Nanjing University of Information Science and Technology(南京信息工程大学气候系统预测与风险管理国家重点实验室) College of Computer Science and Technology, China University of Petroleum(中国石油大学计算机科学与技术学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 TianJi通过自主驱动复杂数值模型验证物理机制,实现零人工干预的高效大气科学研究,压缩研究周期至数小时。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27593 2026-03-31 cs.CV cs.AI 57%

STRIDE: When to Speak Meets Sequence Denoising for Streaming Video Understanding

STRIDE:当语音识别与序列去噪相结合用于流媒体视频理解

Junho Kim, Hosu Lee, James M. Rehg, Minsu Kim, Yong Man Ro

机构 * UIUC(伊利诺伊大学厄巴纳-香槟分校) KAIST(韩国科学技术院) Google DeepMind(谷歌DeepMind)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出STRIDE方法,通过结构化序列建模解决流媒体视频中的主动激活问题,提升在线流媒体场景下的'何时说话'决策质量。

Comments Project page: https://interlive-team.github.io/STRIDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27563 2026-03-31 cs.HC cs.AI 57%

InnerPond: Fostering Inter-Self Dialogue with a Multi-Agent Approach for Introspection

InnerPond:通过多智能体方法促进跨自我对话的内省研究

Hayeon Jeon, Dakyeom Ahn, Sunyu Pang, Yunseo Choi, Suhwoo Yoon, Joonhwan Lee, Eun-mee Kim, Hajin Lim

机构 * hci+d lab.(hci+d 实验室) Seoul National University(首尔国立大学) Department of Communication(传播学系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 InnerPond通过多智能体系统探索自我多重性,用户通过与AI共同创作内在声音和对话,揭示了支持内省的AI工具设计方法。

Comments 25 pages, 10 figures, Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27104 2026-03-31 q-bio.QM cs.AI cs.IR 57%

Autonomous Agent-Orchestrated Digital Twins (AADT): Leveraging the OpenClaw Framework for State Synchronization in Rare Genetic Disorders

自主代理协调数字孪生(AADT):利用OpenClaw框架实现罕见遗传病中的状态同步

Hongzhuo Chen, Zhanliang Wang, Quan M. Nguyen, Gongbo Zhang, Chunhua Weng, Kai Wang

机构 * Raymond G. Perelman Center for Cellular and Molecular Therapeutics, Children's Hospital of Philadelphia(费城儿童医院雷蒙德·G·佩雷尔曼细胞与分子治疗中心) Applied Mathematics and Computational Science Graduate Program, University of Pennsylvania(宾夕法尼亚大学应用数学与计算科学研究生项目) Bioengineering Graduate Program, University of Pennsylvania(宾夕法尼亚大学生物工程研究生项目) Department of Biomedical Informatics, Columbia University Irving Medical Center(哥伦比亚大学欧文医学中心生物医学信息学系) Department of Pathology and Laboratory Medicine, Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院病理学与实验医学系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出基于OpenClaw框架的自主代理协调数字孪生框架,通过持续监控数据流和自动化工作流,实现医疗数字孪生状态与纵向表型更新和进化基因组知识的同步,提升罕见病诊断和疾病进展建模的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21045 2026-03-31 cs.AI cs.DB cs.IR 57%

From Questions to Queries: An AI-powered Multi-Agent Framework for Spatial Text-to-SQL

从问题到查询:一种基于AI的多智能体框架用于空间文本到SQL

Ali Khosravi Kazazi, Zhenlong Li, M. Naser Lessani, Guido Cervone

机构 * Geoinformation and Big Data Research Laboratory, Department of Geography, The Pennsylvania State University(宾夕法尼亚州立大学地理系地理信息与大数据研究实验室) Institute for Computational and Data Sciences and Department of Geography, The Pennsylvania State University(宾夕法尼亚州立大学计算与数据科学研究所及地理系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种基于AI的多智能体框架,解决空间文本到SQL中的复杂问题,通过分阶段解释、模式绑定、逻辑规划和执行审查提升空间查询的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19372 2026-03-31 stat.ML cs.LG 57%

On the Hardness of Reinforcement Learning with Transition Look-Ahead

强化学习中过渡前瞻的难度

Corentin Pla, Hugo Richard, Marc Abeille, Nadav Merlis, Vianney Perchet

机构 * CREST, ENSAE(CREST,ENSAE) Criteo AI Lab(Criteo AI实验室) FairPlay Joint Team(FairPlay联合团队) Technion(以色列理工学院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 研究了强化学习中利用过渡前瞻的信息对性能的影响,证明了一步前瞻可在线性规划中解决,而两步及以上前瞻则为NP难问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26831 2026-03-31 cs.CV cs.AI 57%

Envisioning global urban development with satellite imagery and generative AI

用卫星影像和生成式AI展望全球城市发展

Kailai Sun, Yuebing Liang, Mingyi He, Yunhan Zheng, Alok Prakash, Shenhao Wang, Jinhua Zhao, Alex "Sandy'' Pentland

机构 * Singapore–MIT Alliance for Research and Technology Centre (SMART)(新加坡-麻省理工学院研究与技术联盟中心) Department of Urban Planning, Tsinghua University(清华大学城市规划系) Department of Urban Studies and Planning, Massachusetts Institute of Technology(麻省理工学院城市研究与规划系) College of Urban and Environmental Sciences, Peking University(北京大学城市与环境学院) Department of Urban and Regional Planning, University of Florida(佛罗里达大学城市与区域规划系) Stanford Institute for Human-Centered Artificial Intelligence, Stanford University(斯坦福大学以人为本人工智能研究所)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种多模态生成式AI框架,通过整合提示和地理空间控制,生成全球500个最大都会区的高保真城市卫星影像,支持可持续城市发展和场景规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23610 2026-03-30 cs.AI 57%

Environment Maps: Structured Environmental Representations for Long-Horizon Agents

环境地图:面向长周期智能体的结构化环境表示

Yenchia Feng, Chirag Sharma, Karime Maamari

机构 * Distyl AI

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出环境地图,通过整合异构证据构建结构化图表示,提升长周期任务的鲁棒性。在WebArena基准上,环境地图使智能体成功率提升至28.2%,优于基线方法。

Comments 9 pages, 5 figures, accepted to ICLR 2026 the 2nd Workshop on World Models; updated formatting issue

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06105 2026-03-30 physics.space-ph cs.LG 57%

Forecasting Thermospheric Density with Transformers for Multi-Satellite Orbit Management

利用变压器进行多卫星轨道管理的热层密度预测

Cedric Bös, Alessandro Bortotto, Mohamed Khalil Ben-Larbi

机构 * Julius-Maximilians-Universität Würzburg(维尔茨堡大学) Chair of Space Computer Science and Satellite Systems(空间计算机科学与卫星系统教席)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出基于变压器的模型,用于预测热层密度以提升多卫星轨道管理,该模型在保持效率的同时提升了预测精度。

Comments 6 pages, 3 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24617 2026-03-27 cs.DS cs.LG math.OC 57%

Multi-LLM Query Optimization

多LLM查询优化

Arlen Dean, Zijin Zhang, Stefanus Jasin, Yuqing Liu

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文研究如何在异构模型间优化查询分配,通过建立鲁棒的离线查询规划问题,结合联合界限分解与Chernoff型集中界,提出闭式表达式并设计近似方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22577 2026-03-25 cs.CR cs.AI cs.MA 57%

STRIATUM-CTF: A Protocol-Driven Agentic Framework for General-Purpose CTF Solving

STRIATUM-CTF: 一种基于协议的代理框架用于通用CTF求解

James Hugglestone, Samuel Jacob Chacko, Dawson Stoller, Ryan Schmidt, Xiuwen Liu

机构 * Department of Computer Science, Florida State University, Tallahassee, USA(计算机科学系,佛罗里达州立大学,塔拉萨斯,美国)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出STRIATUM-CTF框架,通过Model Context Protocol标准化工具接口,提升CTF求解的自主性和适应性,在真实竞赛中取得第一名。

Comments 8 pages, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21597 2026-03-25 cs.AI cs.CV 57%

Cerebra: A Multidisciplinary AI Board for Multimodal Dementia Characterization and Risk Assessment

Cerebra:一个多学科AI平台用于多模态痴呆症特征化和风险评估

Sheng Liu, Long Chen, Zeyun Zhao, Qinglin Gou, Qingyue Wei, Arjun Masurkar, Kevin M. Spiegler, Philip Kuball, Stefania C. Bray, Megan Bernath, Deanna R. Willis, Jiang Bian, Lei Xing, Eric Topol, Kyunghyun Cho, Yu Huang, Ruogu Fang, Narges Razavian, James Zou

机构 * Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系) Department of Radiation Oncology, Stanford University(斯坦福大学放射肿瘤科) Center for Data Science, New York University(纽约大学数据科学中心) J. Crayton Pruitt Family Department of Biomedical Engineering, University of Florida(佛罗里达大学杰·克雷顿·普瑞特家庭生物医学工程系) Department of Biomedical Engineering and Informatics, Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校生物医学工程与信息学系) Department of Neurology, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科) Department of Neuroscience, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科学系) UF Health Family Medicine – Haile Plantation(佛罗里达大学健康家庭医学-海莱种植园) Department of Family Medicine, Indiana University School of Medicine(印第安纳大学医学院家庭医学系) Department of Biostatistics and Health Data Science, Indiana University School of Medicine(印第安纳大学医学院生物统计学与健康数据科学系) Scripps Research Translational Institute(斯克里普斯研究转化研究所) Courant Institute, New York University(纽约大学柯朗研究所) Center for Biomedical Informatics, Regenstrief Institute(再生斯蒂夫研究所生物医学信息中心) Center for Cognitive Aging and Memory, McKnight Brain Institute, University of Florida(佛罗里达大学麦金托神经研究所认知衰老与记忆中心) Population Health Department, NYU Langone Health(纽约大学兰戈恩健康人口健康部) Radiology Department, NYU Langone Health(纽约大学兰戈恩健康放射科)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 Cerebra通过多智能体协调处理电子病历、临床笔记和医学影像,提供可视化分析和对话界面,提升临床决策支持的可解释性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22060 2026-03-25 cs.CV cs.AI 57%

Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models

Vision-DeepResearch: 促进多模态大语言模型中的深度研究能力

Wenxuan Huang, Yu Zeng, Qiuchen Wang, Zhen Fang, Shaosheng Cao, Zheng Chu, Qingyu Yin, Shuang Chen, Zhenfei Yin, Lin Chen, Zehui Chen, Xu Tang, Yao Hu, Shaohui Lin, Philip Torr, Feng Zhao, Wanli Ouyang

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Vision-DeepResearch,通过多轮、多实体和多尺度的视觉与文本搜索,提升多模态大语言模型在噪声环境下的深度研究能力,实现更高效的多模态深度研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22083 2026-03-24 cs.AI 57%

A Context Engineering Framework for Improving Enterprise AI Agents based on Digital-Twin MDP

基于数字孪生MDP的上下文工程框架:提升企业AI代理的框架

Xi Yang, Aurelie Lozano, Naoki Abe, Bhavya, Saurabh Jha, Noah Zheutlin, Rohan R. Arora, Yu Deng, Daby M. Sow

机构 * IBM Software Innovation Lab(IBM软件创新实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于数字孪生MDP的上下文工程框架,通过离线强化学习提升企业AI代理性能,解决数据质量、现实推理需求和反馈信号不足等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21925 2026-03-24 cs.AI 57%

Guideline-grounded retrieval-augmented generation for ophthalmic clinical decision support

基于指南的检索增强生成用于眼科临床决策支持

Shuying Chen, Sen Cui, Zhong Cao

机构 * University of International Business and Economics(国际商务经济大学) Tsinghua University(清华大学) Heidelberg Institute of Global Health(海德堡全球健康研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Oph-Guid-RAG系统,通过多模态视觉RAG方法提升眼科临床问答与决策支持,通过可控检索框架和多模态推理提升证据基础和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21594 2026-03-24 cs.IT cs.AI cs.SY eess.SY math.IT 57%

Spatio-Temporal Attention Enhanced Multi-Agent DRL for UAV-Assisted Wireless Networks with Limited Communications

时空注意力增强的多智能体深度强化学习用于受限制通信的无人机辅助无线网络

Che Chen, Lanhua Li, Shimin Gong, Yu Zhao, Yuming Fang, Dusit Niyato

机构 * School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University(中山大学智能系统工程学院深圳校区) Southern Marine Science and Engineering Guangdong Laboratory (Zhuhai)(广东海洋工程科学实验室(珠海)) Department of Equipment Management and Unmanned Aerial Vehicle Engineering, Air Force Engineering University(空军工程大学装备管理与无人机工程系) School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算机与人工智能学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种延迟容忍的多智能体深度强化学习算法,结合延迟惩罚奖励促进无人机间信息共享,并优化轨迹规划、网络形成和传输控制策略,同时采用时空注意力预测方法恢复丢失信息,提升网络容量和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21520 2026-03-24 cs.CL 57%

Generalizable Self-Evolving Memory for Automatic Prompt Optimization

通用可推广的自我进化记忆用于自动提示优化

Guanbao Liang, Yuanchen Bei, Sheng Zhou, Yuheng Qin, Huan Zhou, Bingxin Jia, Bin Li, Jiajun Bu

机构 * Zhejiang University(浙江大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Alibaba Group(阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出MemAPO框架,通过双记忆机制积累可推广的提示经验,提升提示优化的泛化能力和持续改进能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19735 2026-03-24 cs.LG 57%

Improving Fairness of Large Language Model-Based ICU Mortality Prediction via Case-Based Prompting

通过基于案例的提示提升基于大语言模型的ICU死亡预测公平性

Gangxiong Zhang, Yongchao Long, Yuxi Zhou, Yong Zhang, Shenda Hong

机构 * School of Computer Science and Engineering, Tianjin University of Technology, Tianjin, China(天津理工大学计算机科学与工程学院) Institute for Artificial Intelligence, Peking University, Beijing, China(北京大学人工智能研究院) DCST, BNRist, RIIT, Institute of Internet Industry, Tsinghua University, Beijing, China(清华大学信息产业研究院) National Institute of Health Data Science, Peking University, Beijing, China(北京大学健康数据科学国家研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种临床适应性提示框架,通过整合去偏策略和历史误判案例,提升ICU死亡预测的公平性和性能,实验显示AUROC和AUPRC显著提升,预测差异大幅减少。

详情

展开后加载摘要…

URL PDF HTML 收藏