arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 7434 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 2137 篇

2607.07139 2026-07-09 cs.RO 新提交 71%

Disturbance-aware Motion Planning for Over-actuated Underwater Vehicles Exploiting Actuation Redundancy for High-fidelity 3D Reconstruction

利用驱动冗余进行高保真 3D 重建的过驱动水下航行器的干扰感知运动规划

Yuer Gao, Tongqing Xu, Qingyang Liu, Yi Cai

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :planning(title)

AI总结 研究水下机器人驱动对感知的影响,利用过驱动平台冗余,通过搜索零空间最小化目标区域干扰,采用基于致动盘理论的尾流代理及冗余解决分配器,降低粒子速度,提高 3D 重建精度,支持自主扫描与辅助检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06724 2026-07-09 cs.RO 新提交 71%

EvoPlan: Evolutionary Neuro-Symbolic Robot Planning with Spatio-Temporal Guarantees

EvoPlan:具有时空保证的进化神经符号机器人规划

Bhavya Sai Nukapotula, Samin Moosavi, Haoze Wang, Luke Duncan, Diya Shakkottai, Varun Murali, Srinivas Shakkottai

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 规划决策 :planning(title)

AI总结 研究针对基于LLM的机器人规划器不足及经典PDDL规划器问题,提出含离线STL约束挖掘、进化PDDL规划器和受约束执行循环的神经符号框架,能保证计划属性,在基准测试中表现良好且可在无云环境下部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 71%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 规划决策 :planning(title)

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31425 2026-07-01 math.OC 新提交 71%

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

客货一体化模块化车辆的联合规划与调度

Wanru Chen, Jiaming Wu, Balázs Kulcsár

专题命中 规划决策 :planning(title)

AI总结 针对双向公交走廊,提出模块化车辆系统,通过联合优化服务路线、时刻表、车辆组成等,最小化成本并处理乘客需求不确定性,使用Benders分解算法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14064 2026-06-15 eess.SY cs.CE cs.SY 新提交 71%

HPC-Enabled Generator Importance Assessment for RTO-Scale Resource Adequacy Planning

基于高性能计算的RTO规模资源充裕度规划中的发电机重要性评估

Eve Tsybina, Nicholson Koukpaizan, Joshua Hambrick, Samim Konjicija, Slaven Peles

专题命中 规划决策 :planning(title)

AI总结 提出高性能计算框架,快速评估发电机重要性并排序,使分钟级完成传统计算密集型评估成为可能,支持更广泛的发电组合场景分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13232 2026-06-12 cs.RO 新提交 71%

WT-UMI: Tactile-based Whole-Body Manipulation via Force-Supervised Contact-Aware Planning

WT-UMI: 基于触觉的全身操控通过力监督的接触感知规划

Jaehwi Jang, Zhaoyuan Gu, Alfred Cueva, Zimeng Chai, Junjie Sheng, Thong Nguyen, Himank Galundia, Yifan Wu, Huishu Xue, Isaac Legene, Ojas Mediratta, Davin Doan, Andrew Collins, Sarah Sadegh, KyoungMok Kim, Rishita Dhalbisoi, Zun Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机械研究所,佐治亚理工学院)

专题命中 规划决策 :planning(title)

AI总结 提出WT-UMI系统,结合人体演示与遥操作数据,通过力监督规划器预测末端执行器位姿和接触力轨迹,并利用触觉导纳控制器提升全身操控性能。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12306 2026-06-11 cs.RO 新提交 71%

UGV-Conditioned Multi-UAV Informative Planning on a Shared Exposure Belief

基于共享暴露信念的UGV条件多无人机信息规划

Lars Oerlemans, Moji Shi, Marija Popovic

机构 * MAVLab, Faculty of Aerospace Engineering, TU Delft(马文实验室,航空航天工程学院,代尔夫特理工大学)

专题命中 规划决策 :planning(title)

AI总结 提出一种协调无人机编队降低地面车辆在未知威胁区导航风险的方法,通过共享暴露信念引导感知并减少冗余覆盖,仿真显示累积暴露降低38%,冗余覆盖从38.8%降至3.7%。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09550 2026-06-09 cs.DB 新提交 71%

InquiTree: Evaluating AI Agents in the Scientific Inquiry Loop with Paper-Derived Research Trees

InquiTree: 在论文衍生研究树中评估科学探究循环中的AI智能体

Shaoyang Cui

专题命中 规划决策 :AI agent(title)

AI总结 提出InquiTree诊断环境,将科学探究形式化为交互式研究树,揭示AI智能体在长周期交互中关键判断退化(认知隧道)及对训练数据外论文性能下降的局限性。

Comments 17 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09014 2026-06-09 cs.IT math.IT 新提交 71%

Deterministic versus Stochastic Optimization for Joint Path Planning and Dynamic Time Splitting in Multiple-UAV-Cached IoT Networks

多无人机缓存物联网网络中联合路径规划与动态时间分割的确定性优化与随机优化

Trinh Van Chien, Dinh Thanh Tung, Waqas Khalid, Ngo Cong Dung, Banh Thi Quynh Mai, Symeon Chatzinotas

专题命中 规划决策 :planning(title)

AI总结 针对多无人机缓存物联网网络,提出基于块坐标下降和遗传算法的联合优化方法,实现动态时间分割、轨迹和传输功率的协同优化,吞吐量提升至少31%。

Comments 15 pages, 6 figures, and 7 tables. Accepted by the IEEE IoT Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26867 2026-08-28 cs.AI 新提交 70%

BekchiAI: Measuring, Observing, and Controlling LLM Agents in One Click

BekchiAI:一键式测量、观测与控制大语言模型智能体

Mesut Toruk

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI

AI总结 BekchiAI是一款兼具智能体技能测量基准与实时观测控制平台的工具,含2057个测试任务的基准及配套平台,已公开发布并完成多模型对比。

Comments 8 pages, 1 Figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26116 2026-08-28 cs.AI 新提交 70%

The Artificial Experimentalist: Discovery and Control of Self-Organizing Phenomena with Autotelic Reinforcement Learning

人工实验者:利用自目的强化学习发现与控制自组织现象

Marko Cvjetko, Benedikt Hartl, Michael Levin, Clément Moulin-Frier, Pierre-Yves Oudeyer

机构 * Inria Centre at the University of Bordeaux(波尔多大学Inria中心) Allen Discovery Center at Tufts University(塔夫茨大学艾伦发现中心) Wyss Institute for Biologically Inspired Engineering at Harvard University(哈佛大学Wyss生物启发工程研究所) Inria(法国国家信息与自动化研究所) INSA Lyon(里昂国立应用科学学院) CITI(CITI研究所) UR3720(UR3720实验室)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究提出基于自目的强化学习的闭环框架CARL,以Lenia为对象,实现了高效发现、控制自组织孤子及实时引导其穿越迷宫的能力,策略可零样本泛化至分布外条件。

Comments 8 pages, 8 figures. Accepted at ALIFE 2026. Companion website: https://developmentalsystems.org/carl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25771 2026-08-27 cs.HC cs.LG 新提交 70%

Large Language Model Few-Shot Prompting with Dilemma Training Outperforms Human Surrogates in Predicting Patient Preferences

采用困境训练的大语言模型少样本提示在预测患者偏好方面优于人类替代者

Natasha Ureyang, Sebastian Porsdam Mann, Yuxin Liu, Zuriel Hassirim, Melanie Almonte, Wenhao Chen, Joyce Ng, Thant Nay Lin, Aung Thiha, Gerald CH Koh, Brian David Earp, Pin Sym Foong

机构 * National University of Singapore(新加坡国立大学) University of Copenhagen(哥本哈根大学) Imperial College London(伦敦帝国学院)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.LG

AI总结 该研究提出采用困境训练的P4-DT智能体,通过12组患者-替代者配对实验,其预测患者治疗选择的准确率达81.7%,优于人类替代者及相关方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25622 2026-08-27 cs.CV cs.CL 新提交 70%

Plans You Can Check: Verifier-Grounded Learning of an Open-Weight Planner for Executable Video-Editing

可核查的方案:基于验证器的可执行视频编辑开放权重规划器学习

Haoyu Wang, Cheng Feng, Liuyang Bian, Ruiyang Huang, Lei Wei, Yafei Wen, Xiaoxin Chen, Xiaoying Tang

机构 * School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院) vivo AI Lab(vivo AI实验室) University of the Chinese Academy of Sciences(中国科学院大学) Southeast University(东南大学) Peking University(北京大学) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来智能网络研究院) Guangdong Provincial Key Laboratory of Future Networks of Intelligence, CUHK-Shenzhen(香港中文大学(深圳)广东省未来智能网络重点实验室)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.CL

AI总结 针对可执行视频编辑规划问题,提出基于验证器的RefineCut及RefineCut-Evo方法,训练8B开放权重规划器,在基准上取得优于前沿模型的效果,代码与基准已公开。

Comments Accepted to the Main Conference of EMNLP '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25215 2026-08-27 cs.AI cs.MA q-bio.QM 新提交 70%

Federation Is Nearly Free, Reasoning Is Not: Tradeoffs for AI Co-Scientists in Protein Characterization Workflows

联合近乎免费,推理并非如此:AI 联合科学家在蛋白质表征工作流中的权衡

Maia Kapur, Timothy Boe, Abby Jerger, Paul Rigor

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究在生产级科学智能体平台上,对比联合拓扑、PPO策略及不同LLM等,发现LLM选择对蛋白质表征预测质量影响最大,PPO策略成本低且一致性好,联合对性能影响可忽略,为科学工作流智能体部署提供了指导。

Comments 24 Pages, 4 main figures, 5 main tables, 2 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24369 2026-08-26 cs.AI 新提交 70%

Do Recipes Have Personas? Characterizing and Generating Creator Style in Attributed Procedural Graphs

食谱是否具有人设?在带属性的过程图中刻画与生成创作者风格

Lei Jiang

机构 * Microsoft(微软公司)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 该研究针对大语言模型生成同质化逻辑的问题,构建了映射特定创作者的烹饪执行图数据集,提出结构化两阶段模型,可精准刻画与生成创作者的过程风格,集成方法能融合语义推理与拓扑控制优势。

Comments Accepted at the 29th International Conference on Discovery Science (DS 2026). 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23629 2026-08-26 cs.RO cs.AI 新提交 70%

Macro-Operator Generation and Predicate Selection for TAMP Operator Learning

TAMP算子学习的宏算子生成与谓词选择

Can Emir Bora, Emre Ugur

机构 * Bogazici University(博加齐奇大学)

专题命中 规划决策 :planning(abstract,abstract_cn);分类 cs.AI

AI总结 本文针对TAMP算子学习的效率问题,提出自动生成宏算子并剪枝未被引用谓词的系统,在四个TAMP领域实现最高4.6倍规划加速,还解决了基线无法处理的长序列任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23030 2026-08-25 cs.AI 新提交 70%

Artificial Empathy: Towards a Framework for Unsupervised Agency Detection and Policy Reconstruction

人工共情:迈向无监督智能体检测与策略重构的框架

Peter Kuhn, Chris Pang, Sonakshi Chauhan

机构 * Human Inductive Bias Project(人类归纳偏差项目)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究提出一种基于强化学习智能体先验的无监督框架,用于从观察中检测环境中的智能体并重构其策略,解决了仅通过观察建模环境智能体的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22971 2026-08-25 cs.AI cs.CV 新提交 70%

ParallelWorld: Test-Time Scaling for Embodied Reasoning

ParallelWorld:具身推理的测试时缩放方法

Min Chen, Shengjun Zhang, Yuxin Li, Zhang Zhang, Xin Fei, Chong Xia, Yueqi Duan

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文针对具身推理现有方法缺乏长程规划的局限,提出ParallelWorld多步测试时缩放框架,通过验证器引导的树搜索实现并行多步轨迹模拟,在ESI-Bench上显著提升了主动感知与推理性能。

Comments Project Page: https://chen-min-22.github.io/ParallelWorld-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20026 2026-08-21 cs.CV cs.LG 新提交 70%

From Street View Imagery to Street Quality Indicators: Vision Language Inference for the Suburban 15-minute City

从街景图像到街道质量指标:面向郊区15分钟城市的视觉语言推理

Joan Perez, Giovanni Fusco

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文以法国尼斯东北部郊区为研究对象,采用开源的SAGAI工作流,利用视觉语言模型从街景图像评估街景质量,发现理想街景仅存在于部分郊区区域,证明了VLM可支持郊区城市诊断,助力循证规划。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18852 2026-08-20 cs.AI 新提交 70%

SkillGate: Training In-Policy Skill Selection in Long-Horizon Agents

SkillGate:训练长视距智能体中的策略内技能选择

Qingyao Li, Wenxiang Jiao, Shuai Shao, Kangning Zhang, Yuan Lu, Yi Guo, Weiwen Liu, Weinan Zhang, Yong Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Xiaohongshu Inc.(小红书科技有限公司)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 SkillGate 针对长视距智能体策略内技能选择的选择器信用匮乏问题,通过划分信用通道提升了 9B 策略的试验成功率,减少了误导性候选接触并降低技能读取次数。

Comments 17 pages, 6 figures, 6 tables. Code: https://github.com/DeepExperience/SkillGate. Models: https://huggingface.co/simonlqy/SkillGate-9B

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17184 2026-08-19 cs.CL 新提交 70%

AISA: AI Safety Assistant Framework for Continuous Improvement of Highway Construction

AISA:用于公路施工持续改进的AI安全助手框架

Mason Smetana, Trevor Neece, Lev Khazanovich

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究提出AISA框架,基于LLM和文本嵌入模型实现公路施工事故分类、质量评分及相关数据检索,为未来智能体应用提供基础,在OIICS分类和事故检索等任务上取得优于随机水平的效果。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17164 2026-08-19 cs.LG 新提交 70%

SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting--Extended Version

SCENARIODIFF:面向多模态时间序列预测的场景级引导框架——扩展版

Tuan-Binh Tran, Dat Nguyen Cong, Duc-Trong Le, Thanh Trung Huynh, Tung Kieu

机构 * VinUniversity FPT Software AI Center, FPT Corporation(FPT软件AI中心,FPT集团) VNU University of Engineering and Technology(VNU工程技术大学) Aalborg University(奥尔堡大学)

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对现有多模态时间序列预测方法上下文影响难解释控制的问题,提出SCENARIODIFF分层框架,通过三类智能体生成结构化信号引导多模态扩散Transformer,锚点混合采样优化轨迹,在Time-MMD基准的事件驱动领域表现优异。

Comments 10 pages. An extended version of "SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting" accepted at ICDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16033 2026-08-18 cs.CL 新提交 70%

$R^3$-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets

$R^3$-Bench:大语言模型在共享预算下的资源理性推理能力存在不足

Peisong Wang, Zhiwei Ma, Bowen Liu, Feixue Liu, Aochuan Chen, Chenyi Zi, Hongchuan Zeng, Yuhan Li, Jia Li

机构 * The University of Hong Kong(香港大学) Hunyuan Team, Tencent(腾讯混元团队)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 $R^3$-Bench测试发现,大语言模型在共享预算下的资源理性推理存在不足,其表现出的单问题能力与共享预算下的实际表现存在差距。

Comments Code is available at https://github.com/NineAbyss/R-3-Bench . The dataset is available at https://huggingface.co/datasets/R-3-Bench/R-3-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15703 2026-08-18 cs.AI 新提交 70%

HyMem: Hierarchical Context Management for Long-Horizon Agents via Information Isolation

HyMem:基于信息隔离的长程智能体分层上下文管理

XinQi Wang, Jinwei Xiao, Sijia Cui, Hongming Zhang, Yanna Wang, Qingyang Zhang, Bo Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Nanjing Artificial Intelligence Research of IA(IA南京人工智能研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 针对LLM智能体长程任务上下文杂乱导致推理性能下降的问题,提出分层上下文管理框架HyMem,通过功能分层隔离推理与规划,在GAIA、Browsecomp-plus数据集上取得优于基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14522 2026-08-17 cs.AI 新提交 70%

Participatory Moral AI Is Not Neutral: The Invisible Hand of Developers

参与式道德人工智能并非中立:开发者的隐形之手

Taenyun Kim, Edyta Bogucka, Daniele Quercia

专题命中 规划决策 :AI agent(abstract,abstract_cn);分类 cs.AI

AI总结 该研究发现,道德AI偏好征集流程中的特征范围、投票者构成、问题措辞三项关键选择会显著影响AI决策,仅靠投票汇总无法实现公平透明的AI,需对流程各阶段审计披露。

Comments 35 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09574 2026-08-11 cs.AI 新提交 70%

The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games

政客、骗子与顺从的工人:层级博弈中大语言模型智能体的涌现行为

Fatemeh Seyedin, Adrian Weller, Jinhyuk Yun, Mahmoudreza Babaei

机构 * Soongsil University(崇实大学) GISMA University(GISMA大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究通过层级博弈实验测试6种大语言模型智能体,发现其在不同制度下会涌现出撒谎、私下交易等类似人类的治理失效行为,且模型家族会影响领导层更迭。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09443 2026-08-11 cs.AI 新提交 70%

Coupled Graph--Policy Distillation for Personalized Medication Safety in Older Adults with Multimorbidity

面向多病老年患者个性化用药安全的耦合图-策略蒸馏方法

Zihan Wang, Anglin Liu, Rongyi Wang, Dantong Li, Yi Lu, Siqing Yuan, Hongxia Xu, Zhongtian Long, Jintai Chen

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出ATLAS框架与GeriMedBench基准,通过耦合图-策略蒸馏实现多病老年患者的个性化用药安全,在多基准测试中表现优于对比系统,获临床医生更高评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09380 2026-08-11 cs.AI 新提交 70%

OpenLoopEvolve: A Verifiable Self-Evolution Framework for Loop Policies in Long-Horizon Complex Tasks

OpenLoopEvolve:面向长周期复杂任务中循环策略的可验证自进化框架

Siqi Wang, Xinlin Li, Zhenglin Li, Li Li

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 OpenLoopEvolve是面向长周期复杂任务的可验证自进化框架,通过在线与离线两种进化模式优化循环策略,在YC-Bench基准上提升了任务性能、成功率与风险指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09119 2026-08-11 cs.AI 新提交 70%

Motif 3: Technical Report

Motif 3:技术报告

Junghwan Lim, Joon Son Chung, Sungmin Lee, Wai Ting Cheung, Gihun Cho, Minsu Ha, Sangho Kang, Beomgyu Kim, Dongseok Kim, Jangwoong Kim, Taehyun Kim, Taewhan Kim, Jeesoo Lee, Jeongdoo Lee, Junhyeok Lee, Dongpin Oh, Hyeyeon Cho, Dahye Choi, Jaeheui Her, Hanbin Jung, Changjin Kang, Minjae Kim, Youngrok Kim, Hyukjin Kweon, Hongjoo Lee, Yeongjae Park, Bokki Ryu

机构 * Motif Technologies(Motif科技公司)

专题命中 规划决策 :tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 本研究推出仅解码器的MoE语言模型Motif 3,采用GDLA等技术,经万亿token预训练及多阶段后训练,在长上下文、推理等任务上性能与领先开源模型相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08804 2026-08-11 eess.SY cs.LG cs.SY 新提交 70%

ML-Based Hierarchical Prediction for Practical Energy Scheduling in Dynamic NTN-WPT Systems

面向动态非地面网络-无线功率传输(NTN-WPT)系统的实用能量调度的机器学习分层预测方法

Zhanyu Ju, Wenchi Cheng

机构 * School of Telecommunications Engineering, Xidian University(西安电子科技大学电信工程学院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 针对动态NTN-WPT系统的调度挑战,本文提出含三层预测框架的ML方法,采用MORL与MAPPO模型优化能量调度,仿真显示其权衡性能更优且鲁棒性良好。

Comments 21 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏