arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35686 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35686 篇

2603.20299 2026-03-24 cs.SE cs.AI 79%

HCAG: Hierarchical Abstraction and Retrieval-Augmented Generation on Theoretical Repositories with LLMs

HCAG:基于LLM的理论仓库中层次抽象与检索增强生成

Yusen Wu, Xiaotie Deng

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 HCAG通过层次化抽象与检索增强生成方法,解决复杂理论代码库中高层架构模式和跨文件依赖的捕捉问题,提升代码质量和架构一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19306 2026-03-23 cs.IR cs.AI cs.LG 79%

VERDICT: Verifiable Evolving Reasoning with Directive-Informed Collegial Teams for Legal Judgment Prediction

VERDICT: 可验证的演进推理与指令驱动的协作团队用于法律判断预测

Hui Liao, Chuan Qin, Yongwen Ren, Hao Li, Zhenya Huang, Yanyong Zhang, Chao Wang

机构 * University of Science and Technology of China(中国科学技术大学) Chinese Academy of Sciences(中国科学院) iFLYTEK AI Research(iFLYTEK人工智能研究院)

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 VERDICT通过模拟虚拟合议庭,提出自反思协作多智能体框架,结合混合法理记忆实现法律推理的可验证性和适应性,提升法律预测的准确性和解释性。

Comments 15 pages,3 figures,4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15563 2026-03-18 cs.LG cs.AI 79%

The PokeAgent Challenge: Competitive and Long-Context Learning at Scale

PokeAgent挑战:在大规模中实现竞争性和长上下文学习

Seth Karten, Jake Grigsby, Tersoo Upaa, Junik Bae, Seonghun Hong, Hyunyoung Jeong, Jaeyoon Jung, Kun Kerdthaisong, Gyungbo Kim, Hyeokgi Kim, Yujin Kim, Eunju Kwon, Dongyu Liu, Patrick Mariglia, Sangyeon Park, Benedikt Schink, Xianwei Shi, Anthony Sistilli, Joseph Twin, Arian Urdu, Matin Urdu, Qiao Wang, Ling Wu, Wenli Zhang, Kunsheng Zhou, Stephanie Milani, Kiran Vodrahalli, Amy Zhang, Fei Fang, Yuke Zhu, Chi Jin

机构 * Princeton(普林斯顿大学) UT-Austin(得克萨斯大学奥斯汀分校) CMU(卡内基梅隆大学) NYU(纽约大学) Google DeepMind(谷歌DeepMind) Team Heatz(团队Heatz) Team PA-Agent(团队PA-Agent) Team FoulPlay(团队FoulPlay) Team 4thLesson(团队4thLesson) Team Q(团队Q) Team Anthonys(团队Anthonys) Team Hamburg(团队Hamburg) Team Porygon2AI(团队Porygon2AI) Team Deepest(团队Deepest) Team August(团队August)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 PokeAgent挑战通过两个互补赛道,解决部分可观测性、博弈推理和长周期规划问题,提供大规模基准测试和首个RPG速run评估框架,揭示通用(LLM)、专业(RL)和精英人类表现间的差距。

Comments 41 pages, 26 figures, 5 tables. NeurIPS 2025 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09184 2026-03-11 cs.LG cs.AI 79%

Latent-DARM: Bridging Discrete Diffusion And Autoregressive Models For Reasoning

Latent-DARM: 联结离散扩散与自回归模型以实现推理

Lina Berrayana, Ahmed Heakl, Abdullah Sohail, Thomas Hofmann, Salman Khan, Wei Chen

机构 * EPFL(苏黎世联邦理工学院) MBZUAI(马克斯·普朗克人工智能研究所) ETH Zürich(苏黎世联邦理工学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 Latent-DARM通过结合离散扩散模型与自回归模型,提升多智能体系统在推理任务中的表现和协作效率。

Comments Published at LIT Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06412 2026-03-04 astro-ph.IM cs.AI cs.CL 79%

StarWhisper Telescope: An AI framework for automating end-to-end astronomical observations

StarWhisper望远镜:一种用于自动化端到端天文观测的AI框架

Cunshi Wang, Yu Zhang, Yuyang Li, Xinjie Hu, Yiming Mao, Xunhao Chen, Pengliang Du, Rui Wang, Ying Wu, Hang Yang, Yansong Li, Beichuan Wang, Haiyang Mu, Zheng Wang, Jianfeng Tian, Liang Ge, Yongna Mao, Shengming Li, Xiaomeng Lu, Jinhang Zou, Yang Huang, Ningchen Sun, Jie Zheng, Min He, Yu Bai, Junjie Jin, Hong Wu, Jifeng Liu

机构 * University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Optical Astronomy National Astronomical Observatories Chinese Academy of Sciences(中国科学院国家天文台光学天文重点实验室) School of Computing Science Simon Fraser University(西蒙弗雷泽大学计算机科学学院) College of Science Tibet University(西藏大学理学院) Institute for Frontiers in Astronomy and Astrophysics Beijing Normal University(北京师范大学前沿天文与天体物理研究院) Liii Network Co(Liii网络公司)

专题命中 规划决策 :agent(abstract);AI agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 StarWhisper望远镜是一种结合大语言模型与模块化工作流的AI框架,用于自动化天文观测,提升观测效率并促进业余与专业天文学家的协作。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21515 2026-03-02 cs.LG cs.AI cs.MA 79%

Training Generalizable Collaborative Agents via Strategic Risk Aversion

通过战略风险规避训练通用的协作智能体

Chengrui Qu, Yizhou Zhang, Nicolas Lanzetti, Eric Mazumdar

机构 * Caltech Department of Computing and Mathematical Sciences, California Institute of Technology, Pasadena, CA, USA(加州理工学院计算机与数学科学系) Caltech(加州理工学院)

专题命中 规划决策 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于战略风险规避的多智能体强化学习算法,通过增强协作鲁棒性,实现与未见过的合作伙伴的可靠协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18060 2026-02-26 cs.LG cs.AI cs.RO 79%

SPACeR: Self-Play Anchoring with Centralized Reference Models

SPACeR:基于集中参考模型的自我对战锚定

Wei-Jer Chang, Akshay Rangesh, Kevin Joseph, Matthew Strong, Masayoshi Tomizuka, Yihan Hu, Wei Zhan

机构 * Applied Intuition University of California, Berkeley(加州大学伯克利分校) New York University(纽约大学) Stanford University(斯坦福大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 SPACeR通过集中参考模型指导自我对战,实现高效、可扩展的自动驾驶策略生成。

Comments Accepted at ICLR 2026. Project page: https://spacer-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10604 2026-02-24 cs.CL cs.AI 79%

Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

步骤3.5 Flash:通过11B活跃参数实现前沿级智能

Ailin Huang, Ang Li, Aobo Kong, Bin Wang, Binxing Jiao, Bo Dong, Bojun Wang, Boyu Chen, Brian Li, Buyun Ma, Chang Su, Changxin Miao, Changyi Wan, Chao Lou, Chen Hu, Chen Xu, Chenfeng Yu, Chengting Feng, Chengyuan Yao, Chunrui Han, Dan Ma, Dapeng Shi, Daxin Jiang, Dehua Ma, Deshan Sun, Di Qi, Enle Liu, Fajie Zhang, Fanqi Wan, Guanzhe Huang, Gulin Yan, Guoliang Cao, Guopeng Li, Han Cheng, Hangyu Guo, Hanshan Zhang, Hao Nie, Haonan Jia, Haoran Lv, Hebin Zhou, Hekun Lv, Heng Wang, Heung-Yeung Shum, Hongbo Huang, Hongbo Peng, Hongyu Zhou, Hongyuan Wang, Houyong Chen, Huangxi Zhu, Huimin Wu, Huiyong Guo, Jia Wang, Jian Zhou, Jianjian Sun, Jiaoren Wu, Jiaran Zhang, Jiashu Lv, Jiashuo Liu, Jiayi Fu, Jiayu Liu, Jie Cheng, Jie Luo, Jie Yang, Jie Zhou, Jieyi Hou, Jing Bai, Jingcheng Hu, Jingjing Xie, Jingwei Wu, Jingyang Zhang, Jishi Zhou, Junfeng Liu, Junzhe Lin, Ka Man Lo, Kai Liang, Kaibo Liu, Kaijun Tan, Kaiwen Yan, Kaixiang Li, Kang An, Kangheng Lin, Lei Yang, Liang Lv, Liang Zhao, Liangyu Chen, Lieyu Shi, Liguo Tan, Lin Lin, Lina Chen, Luck Ma, Mengqiang Ren, Michael Li, Ming Li, Mingliang Li, Mingming Zhang, Mingrui Chen, Mitt Huang, Na Wang, Peng Liu, Qi Han, Qian Zhao, Qinglin He, Qinxin Du, Qiuping Wu, Quan Sun, Rongqiu Yang, Ruihang Miao, Ruixin Han, Ruosi Wan, Ruyan Guo, Shan Wang, Shaoliang Pang, Shaowen Yang, Shengjie Fan, Shijie Shang, Shiliang Yang, Shiwei Li, Shuangshuang Tian, Siqi Liu, Siye Wu, Siyu Chen, Song Yuan, Tiancheng Cao, Tianchi Yue, Tianhao Cheng, Tianning Li, Tingdan Luo, Wang You, Wei Ji, Wei Yuan, Wei Zhang, Weibo Wu, Weihao Xie, Wen Sun, Wenjin Deng, Wenzhen Zheng, Wuxun Xie, Xiangfeng Wang, Xiangwen Kong, Xiangyu Liu, Xiangyu Zhang, Xiaobo Yang, Xiaojia Liu, Xiaolan Yuan, Xiaoran Jiao, Xiaoxiao Ren, Xiaoyun Zhang, Xin Li, Xin Liu, Xin Wu, Xing Chen, Xingping Yang, Xinran Wang, Xu Zhao, Xuan He, Xuanti Feng, Xuedan Cai, Xuqiang Zhou, Yanbo Yu, Yang Li, Yang Xu, Yanlin Lai, Yanming Xu, Yaoyu Wang, Yeqing Shen, Yibo Zhu, Yichen Lv, Yicheng Cao, Yifeng Gong, Yijing Yang, Yikun Yang, Yin Zhao, Yingxiu Zhao, Yinmin Zhang, Yitong Zhang, Yixuan Zhang, Yiyang Chen, Yongchi Zhao, Yongshen Long, Yongyao Wang, Yousong Guan, Yu Zhou, Yuang Peng, Yuanhao Ding, Yuantao Fan, Yuanwei Lu, Yuanzhen Yang, Yuchu Luo, Yudi Zhao, Yue Peng, Yueqiang Lin, Yufan Lu, Yuling Zhao, Yunzhou Ju, Yurong Zhang, Yusheng Li, Yuxiang Yang, Yuyang Chen, Yuzhu Cai, Zejia Weng, Zetao Hong, Zexi Li, Zhe Xie, Zheng Ge, Zheng Gong, Zheng Zeng, Zhenyi Lu, Zhewei Huang, Zhichao Chang, Zhiguo Huang, Zhiheng Hu, Zidong Yang, Zili Wang, Ziqi Ren, Zixin Zhang, Zixuan Wang

机构 * StepFun Team(StepFun团队)

专题命中 规划决策 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 Step 3.5 Flash通过11B活跃参数实现前沿级智能,结合高效推理与多任务表现,提升代理在数学、代码等领域的性能。

Comments Technical report for Step 3.5 Flash

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00403 2026-02-24 cs.LG cs.AI cs.CV 79%

SelfAI: A self-directed framework for long-horizon scientific discovery

SelfAI: 一种用于长周期科学发现的自导向框架

Xiao Wu, Ting-Zhu Huang, Liang-Jian Deng, Xiaobing Yu, Yu Zhong, Shangqi Deng, Ufaq Khan, Jianghao Wu, Xiaofeng Liu, Imran Razzak, Xiaojun Chang, Yutong Xie

机构 * University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Xian Jiaotong University(西安交通大学) Yale University(耶鲁大学) Washington University in St. Louis(圣路易斯华盛顿大学) Monash University(莫纳什大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 SelfAI是一种自导向的多智能体系统,通过自动化科学探索的策略性轨迹决策,实现高效、可重复的长周期科学发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25232 2026-02-24 cs.AI cs.CL 79%

From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity

从医疗记录到诊断对话:一种基于临床的途径和数据集用于精神疾病共病

Tianxi Wan, Jiaming Luo, Siyuan Chen, Kunyao Lan, Jianhua Chen, Haiyang Geng, Mengyue Wu

机构 * X - LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai Mental Health Center, SJTU School of Medicine, China(上海精神卫生中心,上海交通大学医学院) Chen Frontier Lab for AI and Mental Health, Tianqiao and Chrissy Chen Institute, Shanghai, China(陈前沿人工智能与心理健康实验室,田青和克里斯蒂娜·陈研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种基于临床的途径和数据集,用于生成支持精神疾病共病的多轮诊断对话,通过合成患者电子医疗记录和多智能体对话生成技术,构建了首个大规模对话数据集PsyCoTalk,提升了诊断准确性和治疗计划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17734 2026-02-23 cs.SE cs.AI 79%

Five Fatal Assumptions: Why T-Shirt Sizing Systematically Fails for AI Projects

五项致命假设:为何T恤 sizing 系统性地失败于AI项目

Raja Soundaramourty, Ozkan Kilic, Ramu Chenchaiah

机构 * Cisco Systems, Inc.(思科系统公司)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本文指出T恤 sizing在AI项目中失效的五项致命假设,并提出Checkpoint Sizing作为更人性化的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14229 2026-02-17 cs.AI cs.ET cs.LG 79%

CORPGEN: Simulating Corporate Environments with Autonomous Digital Employees in Multi-Horizon Task Environments

CORPGEN:在多时间尺度任务环境中通过自主数字员工模拟企业环境

Abubakarr Jaye, Nigel Boachie Kumankumah, Chidera Biringa, Anjel Shaileshbhai Patel, Sulaiman Vesal, Dayquan Julienne, Charlotte Siska, Manuel Raúl Meléndez Luján, Anthony Twum-Barimah, Mauricio Velazco, Tianwei Chen

机构 * Microsoft Corporation(微软公司)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 CorpGen通过分层规划、子代理隔离和分层内存等机制,在多时间尺度任务环境中实现自主数字员工的高效模拟,提升企业环境模拟的完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18217 2026-01-27 cs.AI cs.LG 79%

Paying Less Generalization Tax: A Cross-Domain Generalization Study of RL Training for LLM Agents

支付更少的泛化税:RL训练对LLM代理跨域泛化能力的研究

Zhihan Liu, Lin Guan, Yixin Nie, Kai Zhang, Zhuoqun Hao, Lin Chen, Asli Celikyilmaz, Zhaoran Wang, Na Zhang

机构 * Meta Superintelligence Labs(Meta超智能实验室) FAIR at Meta(Meta的FAIR) Northwestern University(西北大学) The Ohio State University(俄亥俄州立大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究探讨了RL训练对LLM代理跨域泛化能力的影响,发现增加状态信息丰富度可提升泛化性能,同时指出建模选择对泛化能力的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23631 2026-01-05 cs.LG cs.AI 79%

BOAD: Discovering Hierarchical Software Engineering Agents via Bandit Optimization

通过Bandit优化发现层次化软件工程代理:BOAD

Iris Xu, Guangtao Zeng, Zexue He, Charles Jin, Aldo Pareja, Dan Gutfreund, Chuang Gan, Zhang-Wei Hong

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT-IBM Watson AI Lab(MIT-IBM Watson AI实验室) Stanford(斯坦福大学) UMass Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 BOAD通过多臂老虎机问题自动发现层次化多代理结构,提升软件工程任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11862 2025-12-16 cs.LG cs.AI 79%

Hierarchical Task Offloading and Trajectory Optimization in Low-Altitude Intelligent Networks Via Auction and Diffusion-based MARL

低空智能网络中的分层任务卸载与轨迹优化:通过拍卖和基于扩散的MARL

Jiahao You, Ziye Jia, Can Cui, Chao Dong, Qihui Wu, Zhu Han

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于拍卖和扩散的MARL方法,用于低空智能网络中的分层任务卸载与轨迹优化,以提升能耗效率和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01155 2025-12-03 cs.SE cs.AI 79%

Beyond Greenfield: The D3 Framework for AI-Driven Productivity in Brownfield Engineering

超越Greenfield:面向Brownfield工程的D3框架:AI驱动的生产力框架

Krishna Kumaar Sharma

专题命中 规划决策 :agent(abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出D3框架,通过双代理提示架构提升Brownfield工程中LLM的应用效果,实验证明在遗留系统探索、文档重建等任务中,AI辅助显著提升生产力和减少认知负荷。

Comments 53 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17442 2025-12-02 cs.CL cs.AI 79%

Confident RAG: Enhancing the Performance of LLMs for Mathematics Question Answering through Multi-Embedding and Confidence Scoring

Confident RAG: 通过多嵌入和置信度评分提升LLM在数学问题回答中的性能

Shiting Chen, Zijian Zhao, Jinsong Chen

机构 * Faculty of Education, The University of Hong Kong(香港大学教育学院) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学土木与环境工程系)

专题命中 规划决策 :planning(abstract);workflow(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 Confident RAG通过多嵌入和置信度评分提升LLM在数学问题回答中的性能,实验表明其在准确率上比普通LLMs和RAG分别提升10%和5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17854 2025-11-25 cs.CL cs.AI cs.CY cs.HC cs.MA 79%

A superpersuasive autonomous policy debating system

一种超级有说服力的自主辩论系统

Allen Roush, Devin Gonier, John Hines, Judah Goldfeder, Philippe Martin Wyder, Sanjay Basu, Ravid Shwartz Ziv

专题命中 规划决策 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 DeepDebater是一种能够自主参与并赢得完整政策辩论的AI系统,通过多智能体协作生成高质量论证并战胜人类对手。

Comments Accepted to CLIP workshop at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11519 2025-11-17 cs.AI cs.LG 79%

Experience-Guided Adaptation of Inference-Time Reasoning Strategies

Adam Stein, Matthew Trager, Benjamin Bowman, Michael Kleinman, Aditya Chattopadhyay, Wei Xia, Stefano Soatto

机构 * University of Pennsylvania(宾夕法尼亚大学) AWS AI(亚马逊AI)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI、cs.LG

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04720 2025-11-10 cs.CL cs.AI 79%

Learning to reason about rare diseases through retrieval-augmented agents

Ha Young Kim, Jun Li, Ana Beatriz Solana, Carolin M. Pirkl, Benedikt Wiestler, Julia A. Schnabel, Cosmin I. Bercea

机构 * Technical University of Munich(慕尼黑技术大学) GE HealthCare(GE医疗) Munich Center for Machine Learning(慕尼黑机器学习中心) Klinikum Rechts der Isar(莱布尼茨医院) Helmholtz Munich(亥姆霍兹慕尼黑研究中心) King's College London(伦敦国王学院)

专题命中 规划决策 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

Comments Submitted on behalf of the PREDICTOM consortium

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06733 2025-11-06 cs.AI cs.CL cs.IR 79%

Reinforcement Learning Foundations for Deep Research Systems: A Survey

Wenjun Li, Zhi Chen, Jingru Lin, Hannan Cao, Wei Han, Sheng Liang, Zhi Zhang, Kuicai Dong, Dexun Li, Chen Zhang, Yong Liu

专题命中 规划决策 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

Comments 39 pages, second version

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00079 2025-11-06 cs.CL cs.AI 79%

PhysicsEval: Inference-Time Techniques to Improve the Reasoning Proficiency of Large Language Models on Physics Problems

Oshayer Siddique, J. M Areeb Uzair Alam, Md Jobayer Rahman Rafy, Syed Rifat Raiyan, Hasan Mahmud, Md Kamrul Hasan

机构 * Systems and Software Lab (SSL) Department of Computer Science and Engineering(系统与软件实验室(SSL)计算机科学与工程系)

专题命中 规划决策 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments Accepted in Findings of the Association for Computational Linguistics: IJCNLP-AACL 2025, 23 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20685 2025-11-04 cs.CV cs.AI cs.LG 79%

Flip Learning: Weakly Supervised Erase to Segment Nodules in Breast Ultrasound

Yuhao Huang, Ao Chang, Haoran Dou, Xing Tao, Xinrui Zhou, Yan Cao, Ruobing Huang, Alejandro F Frangi, Lingyun Bao, Xin Yang, Dong Ni

机构 * National-Regional Key Technology Engineering Laboratory for Medical Ultrasound, School of Biomedical Engineering, Shenzhen University Medical School, Shenzhen University, Shenzhen, China(国家区域医疗超声关键技术工程实验室、生物医学工程学院、深圳大学医学院、深圳大学、深圳,中国) Medical UltraSound Image Computing (MUSIC) Lab, Shenzhen University, Shenzhen, China(医学超声图像计算(MUSIC)实验室、深圳大学、深圳,中国) Marshall Laboratory of Biomedical Engineering, Shenzhen University, Shenzhen, China(马歇尔生物医学工程实验室、深圳大学、深圳,中国) School of Computing, University of Leeds, Leeds, UK(计算学院、利兹大学、利兹,英国) Shenzhen RayShape Medical Technology Co., Ltd, Shenzhen, China(深圳RayShape医疗科技有限公司、深圳,中国) Data Science, School of Health Sciences, University of Manchester, Manchester, UK(数据科学、健康科学学院、曼彻斯特大学、曼彻斯特,英国) Department of Computer Science, School of Engineering, University of Manchester, Manchester, UK(计算机科学系、工程学院、曼彻斯特大学、曼彻斯特,英国) Medical Imaging Research Center (MIRC), Department of Electrical Engineering, Department of Cardiovascular Sciences, KU Leuven, Belgium(医学影像研究中心(MIRC)、电气工程系、心血管科学系、库勒文大学,比利时) Alan Turing Institute, London, UK(艾伦·图灵研究所、伦敦,英国) NIHR Manchester Biomedical Research Centre, Manchester Academic Health Science Centre, Manchester, UK(NIHR曼彻斯特生物医学研究中心、曼彻斯特学术健康科学中心、曼彻斯特,英国) Department of Ultrasound, Affiliated Hangzhou First People's Hospital, School of Medicine, Westlake University(超声科、附属杭州第一人民医院、医学院、西湖大学) School of Biomedical Engineering and Informatics, Nanjing Medical University, Nanjing, China(生物医学工程与信息学院、南京医科大学、南京,中国)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by Medical Image Analysis. 24 pages, 13 figures, 20 tabels

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12253 2025-10-15 cs.LG cs.AI 79%

Diffusion Models for Reinforcement Learning: Foundations, Taxonomy, and Development

Changfu Xu, Jianxiong Guo, Yuzhu Liang, Haiyang Huang, Haodong Zou, Xi Zheng, Shui Yu, Xiaowen Chu, Jiannong Cao, Tian Wang

机构 * Jiangxi University of Finance and Economics(江西财经大学) Beijing Normal University(北京师范大学) Anhui University(安徽大学) Macquarie University(麦考瑞大学) University of Technology Sydney(悉尼大学) The University of Science and Technology (Guangzhou)(广州大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11004 2025-10-14 cs.MA cs.AI cs.CE cs.CL 79%

Automating Structural Engineering Workflows with Large Language Model Agents

Haoran Liang, Yufa Zhou, Mohammad Talebi Kalaleh, Qipei Mei

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments Code: https://github.com/DelosLiang/masse

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03514 2025-10-07 cs.CY cs.AI cs.CL 79%

Red Lines and Grey Zones in the Fog of War: Benchmarking Legal Risk, Moral Harm, and Regional Bias in Large Language Model Military Decision-Making

Toby Drinkall

机构 * Oxford Internet Institute, University of Oxford(牛津互联网研究所、牛津大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments 54 pages; 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23436 2025-09-25 cs.AI cs.LG 79%

Emergent Risk Awareness in Rational Agents under Resource Constraints

Daniel Jarne Ornia, Nicholas Bishop, Joel Dyer, Wei-Chen Lee, Ani Calinescu, Doyne Farmer, Michael Wooldridge

机构 * University of Oxford(牛津大学)

专题命中 规划决策 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05311 2025-08-08 cs.AI cs.CL 79%

A Novel Architecture for Symbolic Reasoning with Decision Trees and LLM Agents

Andrew Kiruluta

机构 * Andrew Kiruluta(独立研究者)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22844 2025-07-31 cs.LG cs.AI 79%

RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents

Zijing Zhang, Ziyang Chen, Mingxiao Li, Zhaopeng Tu, Xiaolong Li

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23276 2025-07-25 cs.AI cs.CL 79%

Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games

David Guzman Piedrahita, Yongjin Yang, Mrinmaya Sachan, Giorgia Ramponi, Bernhard Schölkopf, Zhijing Jin

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments Published at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏