arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-25 至 2026-08-25 共收录 381 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 110 篇

2607.25875 2026-08-25 cs.LG cs.AI 版本更新 62%

A2TTA: Anchored-and-Agile Test-Time Adaptation for Evolving Traffic Sensor Networks

A2TTA:用于不断发展的交通传感器网络的锚定与敏捷测试时自适应

Du Yin, Xiachong Lin, Yue Tan, Jinliang Deng, Estrid He, Hao Xue, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) Griffith University(格里菲斯大学) Beihang University(北京航空航天大学) RMIT University(皇家墨尔本理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究针对交通传感器网络动态变化致传统预测模型性能下降问题,提出A2TTA框架,将拓扑诱导误差转化为输出校准问题,区分时间自适应,联合应对拓扑演变和多尺度时间偏移,实验证明该框架能有效提升预测性能。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20507 2026-08-25 cs.AI cs.LG 版本更新 62%

CacheSpec: Finding the Sweet Spot for Small Models in Large Language Models

MiniCache:用于高效大语言模型推理的具有小模型接口的可重复使用程序缓存

Jingquan Chen, Jie Feng, Jinghua Piao, Shaogang Hu, Yong Li

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型推理成本高的问题,提出MiniCache框架,将PoT程序转换为参数化缓存对象,通过重用小模型进行语义变量提取和推测性起草,减少目标大语言模型调用,实验证明其能提升推理性能,平衡延迟、缓存重用和准确性。

Comments Accepted by EMNLP 2026, codes via https://github.com/chenjqQAQ/CacheSpec

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17174 2026-08-25 cs.LG cs.AI cs.SY eess.SY 版本更新 62%

Continual Uncertainty Learning for Robust Control of Nonlinear Systems with Multiple Heterogeneous Uncertainties

持续不确定性学习

Heisei Yonezawa, Ansei Yonezawa, Itsuro Kajiwara

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出基于课程的学习框架,用于鲁棒控制问题中的多重不确定性处理,通过分解复杂问题为持续学习任务,提升学习效率和控制器鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17527 2026-08-25 cs.AI cs.CY cs.LG 版本更新 62%

Benchmarking Retrieval-Augmented Generation Strategies for Large Language Model-Based Travel Mode Choice Prediction

面向基于大语言模型的出行方式选择预测的检索增强生成策略基准测试

Yiming Xu, Junfeng Jiao

机构 * School of Architecture, The University of Texas at Austin(德克萨斯大学建筑学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究开发将RAG集成到LLM出行方式选择预测的模块化框架,测试四种检索策略在三款LLM上的表现,发现结合均衡检索与交叉编码器重排序的GPT-4o准确率达80.8%,优于传统基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24255 2026-08-25 cs.CL cs.AI cs.HC 版本更新 62%

Effects of Theory of Mind and Prosocial Beliefs on Steering Human-Aligned Behaviors of LLMs in Ultimatum Games

心理理论与亲社会信念对最后通牒博弈中大型语言模型的人类对齐行为的影响

Neemesh Yadav, Yihuai Lan, Shan Dong, Mai Hieu Hien, Palakorn Achananuparp, Jing Jiang, Ee-Peng Lim

机构 * Singapore Management University(新加坡管理大学) Australian National University(澳大利亚国立大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本研究以最后通牒博弈为任务,赋予LLM不同亲社会信念与推理方法,开展2700次模拟,发现ToM推理可增强LLM行为对齐度等,且不同游戏角色适配不同ToM顺序,Llama 3.3 70B的推理与行动信念最一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23493 2026-08-25 cs.AI 新提交 57%

SRPO: Self-Reflective Policy Optimization for Long-Horizon Reasoning

SRPO:用于长程推理的自反思策略优化

Jialong Liu, Yuling Shi, Ning Yang, Xiaodong Gu, Zuchao Li

机构 * School of artificial intelligence, Wuhan University(武汉大学人工智能学院) School of computer science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) Institute of automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本研究提出 SRPO 框架,将人类的自反思能力内化到 LLMs 中,无需额外模型即可将稀疏监督转化为密集训练信号,在数学推理等基准上以高数据效率取得了最先进性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23329 2026-08-25 cs.CV cs.AI 新提交 57%

Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents

超越视频:统一视频推理与深度研究的开放世界视频智能体

Wenqi Liu, Shijie Ma, Yunxiao Wang, Meng Liu, Qile Su, Han Liu, Bohan Hou, Xuanyu Zheng, Changyi Liu, Tianke Zhang, Haonan Fan, Kaiyu Jiang, Yingxin Li, Jiankang Chen, Xu Wang, Bin Wen, Tingting Gao, Han Li, Jianhua Yin, Yinwei Wei, Xuemeng Song

机构 * Shandong University(山东大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) City University of Hong Kong(香港城市大学) Nanyang Technological University(南洋理工大学) Kuaishou Technology(快手科技) Southern University of Science and Technology(南方科技大学)

专题命中 规划决策 :tool use(abstract);分类 cs.AI

AI总结 本研究提出统一视频推理与深度研究的VideoRover框架,构建相关数据集与基准,其8B-RL模型在无工具直接回答场景性能接近专有模型,优于同工具套件的更大开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22764 2026-08-25 cs.LG 新提交 57%

LpWM: A Case for Sparse Representations in World Models

LpWM:世界模型中稀疏表示的一个应用案例

Yilun Kuang, Yash Dagade, Quentin Le Lidec, Lucas Maes, Randall Balestriero, Yann LeCun

机构 * NYU(纽约大学) Duke University(杜克大学) Mila(米拉) Brown University(布朗大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出LpWM模型,以稀疏表示替代密集表示建模动作条件潜在动力学,在PushT任务上规划成功率优于密集模型,且能揭示可解释的动力学结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22516 2026-08-25 cs.CV cs.CL 新提交 57%

TRACE: Temporal Retrieval with Anchored and Convergent Evidence for Long-Horizon Video Understanding

TRACE:用于长视频理解的基于锚定收敛证据的时序检索

Pengyiang Liu, Junbo Niu, Xiaoyang Hu, Zhongyue Shi, Zitian Wang, Linjiang Huang, Si Liu

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 针对长视频理解中证据核查不足的问题,提出VES-Bench基准和无需训练的TRACE智能体,在帧成本更低的情况下实现了高正确率,在多个基准上表现出色。

Comments Accepted to EMNLP 2026 Main Conference. 19 pages, 5 figures, 6 tables. Project page: https://buaa-colalab.github.io/TRACE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22151 2026-08-25 cs.SE cs.ET 新提交 57%

Towards Actionable Visualization: Ten Years Later, What Generative AI Changes and What It Cannot

面向可操作的可视化:十年之后,生成式AI带来了什么改变,又有什么是它做不到的

Leonel Merino, Mohammad Ghafari, Oscar Nierstrasz

专题命中 规划决策 :AI agent(abstract);分类 cs.SE

AI总结 该研究回顾了十年前软件可视化领域的研究现状,探讨生成式AI对该领域的改变与局限,提出未来应聚焦于帮助人类理解复杂软件系统及AI生成内容,并指出可操作可视化已成为该领域可达成的标准。

Comments 2026 IEEE Working Conference on Software Visualization (VISSOFT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22055 2026-08-25 cs.AI 新提交 57%

GenCoord: Skill-Path Commitments under Private Information

Peng He, Junning Zhu, Haohan Yuan, Jianpeng Liang

机构 * Tsinghua University(清华大学) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) University of California San Diego(加利福尼亚大学圣迭戈分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

Comments 25 pages, 10 figures, and 23 tables, including supplementary material. Peng He and Junning Zhu contributed equally. Paper source and compact evidence: https://github.com/JulianZJN/GenCoord

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21993 2026-08-25 cs.LG 新提交 57%

Gated Decoupled Compositional Bandits: A Unified Theory of Contextual Bandits with Supervised-Calibrated Action Scaling and Pre-Execution Gating

门控解耦组合多臂老虎机:带监督校准动作缩放与预执行门控的上下文多臂老虎机统一理论

Oleg Miroshnichenko

专题命中 规划决策 :tool-use(abstract);分类 cs.LG

AI总结 该研究提出门控解耦组合多臂老虎机(GDCB),证明其可统一多个工业系统,核心定理可将非平稳问题转化为近似平稳问题,还推广了相关结果,配套论文已验证短期租赁动态定价实例。

Comments 30 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21414 2026-08-25 cs.RO cs.LG 新提交 57%

RiskWorld: Object-Centric Latent World Modeling for Autonomous Driving Risk Identification

RiskWorld:面向自动驾驶风险识别的以对象为中心的潜在世界建模

Jingzheng Li, Yufei Ge, Qianren Mao, Zhijun Chen, Bing Li, Xingyu Peng, Baochang Zhang, Xianglong Liu

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出 RiskWorld 模型,以对象为中心的潜在世界建模,结合预训练视频表示与自车-对象历史,在 RiskBench 上实现 63.0% F1 和 2.1% 误报率,可有效识别自动驾驶风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21399 2026-08-25 cs.LG 新提交 57%

Federated Ensemble Forecasting Under Supply-Chain Market Volatility

供应链市场波动下的联邦集成预测

Shunmukha Sagar Puppala

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究针对供应链市场波动下的预测需求,提出FEF NCL分布式方法,在合成数据集上实现了预测误差降低、延迟风险宏观F1提升及高波动误差减少的效果,为供应链预测提供了可行方案。

Comments 8 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21380 2026-08-25 cs.RO cs.AI cs.CV cs.IT math.IT 新提交 57%

RoboShape: Information-Theoretic Point Cloud Representations for Privacy-Aware Robot Perception

RoboShape:面向隐私感知机器人感知的信息论点云表示

Oguzhan Baser, Mirac Sozen, Kaan Kale, Sandeep Chinchali, Sriram Vishwanath

机构 * The University of Texas at Austin(得克萨斯大学奥斯汀分校) Bogazici University(博加齐大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 RoboShape 是一种信息论引导的点云压缩工具,可在保留物体分类效用的同时降低敏感属性泄露,缩小嵌入体积,发布代码库供机器人社区使用。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21998 2026-08-25 cs.LG cs.NA math.NA physics.ao-ph 新提交 57%

DySCo: Dynamically consistent data-driven downscaling of extremes in climate projections

DySCo:气候预测中极端事件的动态一致数据驱动降尺度方法

S. Stamatelopoulos, M. Wang, I. Lopez-Gomez, L. Zepeda-Nunez, Z. Y. Wan, R. Carver, F. Sha, T. P. Sapsis

机构 * Massachusetts Institute of Technology(麻省理工学院) City University of Hong Kong(香港城市大学) Google Research(谷歌研究院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对气候降尺度中动态一致性缺失的挑战,提出DySCo框架,通过数据驱动的张弛法重构训练动态配对轨迹,训练两阶段算子,在保持统计性能的同时提升动态一致性,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16447 2026-08-25 cs.AI cs.RO 版本更新 57%

HaReCAP: Habitual-action Grounding for Recursive Large Language Model Agents

HaReCAP:面向递归大语言模型智能体的习惯性动作 grounding 方法

Shen Liu, Zhenguo Xu, Shaopu Wang, Yike Gao, Chunlei Wang

机构 * North China Institute of Computer System Engineering(华北计算机系统工程研究所) University of Science and Technology of China(中国科学技术大学) China Information Security Research Institute Co., Ltd.(中国信息安全研究院有限公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 HaReCAP 是针对 ReCAP 的低侵入性扩展,通过编译叶子反射规则减少长视距具身任务中 LLM 的重复调用,在 Robotouille 和 ALFWorld 上显著降低了 token 消耗。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17642 2026-08-25 cs.AI 版本更新 57%

FinAcumen: Financial Multimodal Reasoning via Self-Evolving Experience Memory Harness

FinAcumen: 通过自演化经验记忆实现的金融多模态推理

Pianran Guo, Pengcheng Zhou, Yucheng Jian, Shuhua Chen, Zhongliang Yang, Linna Zhou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Queen Mary University of London(伦敦玛丽女王大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出FinAcumen框架,通过选择性经验记忆机制增强工具增强型多模态推理,在四个金融基准上持续提升冻结的8B视觉语言模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01063 2026-08-25 cs.AI 版本更新 57%

MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention

MindClaw: 用于精确干预的闭环具身心理状态推理

Ruoxuan Zhang, Qiaoqiao Wan, Zhengguang Wang, Chenghao Yu, Hongxia Xie, Wen-Huang Cheng, Jianlong Fu

机构 * Jilin University(吉林大学) Microsoft Asia(微软亚洲) National Taiwan University(国立台湾大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出MindClaw框架,通过闭环具身心理状态推理实现精确干预,结合多源输入、信念记忆、认知触发技能和动作生成,在动态环境中优化干预时机。

Comments Extended version of the CVPR 2026 paper *MindPower: Enabling Theory-of-Mind Reasoning in VLM-based Embodied Agents*. This work is in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30538 2026-08-25 cs.LG 57%

DisasterLex: An Expert Concept-to-Schema Knowledge Graph for Geospatial Reasoning in Disaster Analytics

DisasterLex:面向灾害分析中地理空间推理的专家概念到模式知识图谱

Yiming Xiao, Ankit Basu, Kai Yin, Sahil Vartak, Christian Swords, Ali Mostafavi

机构 * Texas A&M University(德克萨斯大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出DisasterLex框架,通过插入专家知识图谱(EKG)将用户查询与数据库模式桥接,在灾害分析场景中实现文本到SQL的准确转换,性能优于现有方法1.4-2.75倍。

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19093 2026-08-25 cs.CV cs.CY cs.LG 57%

Seeing SDG 6 from space: local-scale monitoring of piped water and sewage systems across Africa using satellite imagery and self-supervised learning

从太空看SDG 6:利用卫星图像和自监督学习对非洲管道水和污水系统接入进行局部尺度监测

Othmane Echchabi, Aya Lahlou, Nizar Talty, Josh Malcolm Manto, Tongshu Zheng, Ka Leung Lam

机构 * Mila – Quebec AI Institute(魁北克人工智能研究所) School of Computer Science, McGill University(麦吉尔大学计算机科学学院) Department of Earth and Environmental Engineering, Columbia University(哥伦比亚大学地球与环境工程系) Center for Learning the Earth with Artificial Intelligence and Physics (LEAP)(人工智能与物理学习地球中心(LEAP)) Division of Natural and Applied Sciences, Duke Kunshan University(杜克-昆山大学自然科学与应用科学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究利用Sentinel-2图像、Afrobarometer调查数据、30米人口数据和DINO自监督视觉Transformer特征,开发了一个可扩展的遥感框架,以约2.56公里分辨率估计管道水和污水系统接入情况,最佳模型AUROC分别达到91.54%和93.24%,与WHO/UNICEF JMP统计数据高度一致,并在尼日利亚案例中揭示了细粒度环境不平等。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03795 2026-08-25 cs.RO cs.AI 版本更新 57%

MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving

MPCFormer: 一种融合物理信息的数据驱动方法用于可解释的社交感知自主驾驶

Jia Hu, Zhexi Lian, Xuerun Yan, Ruiang Bi, Dou Shen, Yu Ruan, Chunlong Xia, Haoran Wang

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 MPCFormer通过融合物理信息和数据驱动的方法,提升自主驾驶在复杂交通场景中的社交交互能力,实现更安全的人类行为模拟,实验显示其在轨迹预测和碰撞率控制方面表现优异。

Comments 17 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06769 2026-08-25 cs.CL 版本更新 57%

Training Large Language Models to Reason in a Continuous Latent Space

训练大型语言模型在连续潜在空间中进行推理

Shibo Hao, Sainbayar Sukhbaatar, DiJia Su, Xian Li, Zhiting Hu, Jason Weston, Yuandong Tian

机构 * FAIR at Meta(Meta 的 FAIR)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 本文提出名为Coconut的连续思维链新范式,将LLM推理状态表示为连续潜在空间中的隐藏状态,支持广度优先搜索,在需大量搜索的逻辑推理任务上优于CoT,实现更优的准确率效率权衡。

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12811 2026-08-25 cs.CL 版本更新 57%

ConvergeWriter: Data-Driven Bottom-Up Article Construction

ConvergeWriter:数据驱动的自下而上文章构建

Binquan Ji, Jiaqi Wang, Ruiting Li, Xingchen Han, Yiyang Qi, Shichao Wang, Yifei Lu, Yuantao Han, Feiliang Ren

机构 * Binquan Ji, Jiaqi Wang, Ruiting Li, Xingchen Han, Yiyang Qi, Shichao Wang, Yifei Lu, Yuantao Han, Feiliang Ren(作者)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 针对现有LLM生成长篇文档的问题,提出自下而上的ConvergeWriter框架,通过检索聚类构建知识基础,减少幻觉,在14B、32B模型上性能优于或比肩基准,适用于高保真知识场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17448 2026-08-25 cs.CE cs.AI physics.chem-ph 版本更新 57%

RetroDFM-R: Reasoning-Driven Retrosynthesis Prediction with Large Language Models via Reinforcement Learning

RetroDFM-R:基于强化学习的大语言模型驱动的推理型逆合成预测

Situo Zhang, Hanqi Li, Lu Chen, Zihan Zhao, Xuanze Lin, Zichen Zhu, Danyu Luo, Bo Chen, Xin Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science MoE Key Lab of Artificial Intelligence SJTU AI Institute(X-LANCE实验室,计算机科学学院,人工智能关键实验室,SJTU人工智能研究所) Suzhou Laboratory(苏州实验室) Jiangsu Key Lab of Language Computing(江苏语言计算重点实验室) School of Chemistry and Chemical Engineering(化学与化工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出RetroDFM-R模型,结合强化学习与大语言模型实现推理型逆合成预测,在USPTO-50K基准上准确率优于现有方法,可重构复杂合成路线,提升了预测的可解释性与实用性。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23432 2026-08-25 cs.CV 新提交 50%

Image-Conditioned Diffusion Models for Quality Assurance of Organ-at-Risk Segmentations in Radiotherapy

用于放疗中危及器官分割质量保证的图像条件扩散模型

Clea Dronne, Catharine H Clark, Xavier Loizeau, Elizabeth Miles, Peter Hoskin, Jamie R McClelland

机构 * UCL Hawkes Institute(UCL霍克斯研究所) University College London(伦敦大学学院) National Physical Laboratory(英国国家物理实验室) University College London Hospital(伦敦大学学院医院) National Radiotherapy Trials Quality Assurance Group(国家放射治疗试验质量保证组) Mount Vernon Hospital(芒特弗农医院) University of Manchester(曼彻斯特大学)

专题命中 规划决策 :planning(abstract)

AI总结 该研究针对放疗中危及器官分割审阅耗时主观的问题,对比VAE框架与图像条件分割扩散模型,发现后者能更一致地定位细微边界错误,为分割质量保证提供了有前景的框架。

Comments Submitted to the MICCAI 2026 UNSURE Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23082 2026-08-25 cs.CG 新提交 50%

A fast improved quasi-physical dynamic algorithm for efficient wireless coverage in convex polygonal regions

用于凸多边形区域高效无线覆盖的快速改进类物理动态算法

Zeping Yi, Yongjun Wanga, Baoshan Wang, Jian Zhang, Songyi Liu

专题命中 规划决策 :planning(abstract)

AI总结 针对凸多边形无线节点部署问题,提出改进类物理动态算法IQPD,通过保结构初始化、精细化虚拟力模型与边界环绕策略,实现更高的覆盖率与节点利用率,性能优于多种元启发式算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23060 2026-08-25 cs.SI 新提交 50%

Atomic Common-Day Invoice Clearing under Causal Daily Scheduling: Path-Enabled and Bounded-Cycle Policies

因果每日调度下的原子日常发票清算:路径启用与有界周期策略

Peplluis Esteva de la Rosa, Sai Srikanth Madugula

专题命中 规划决策 :agent(abstract)

AI总结 该研究针对企业作为债权债务人的迟付款压力,开发原子记录时间发票图的路径启用清算方法,经749952张发票实证,其应付账款减少幅度优于长度8的周期净额结算,为异步代理间清算提供策略依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22629 2026-08-25 cs.RO cs.SY eess.SY 新提交 50%

Enhancing Sim2Real Transfer for Torque-Controlled Robots through Real2Sim Dynamics Estimation and Reinforcement Learning

通过Real2Sim动力学估计与强化学习增强力矩控制机器人的Sim2Real迁移

Davide Bargellini, Alex Pasquali, Andrea Govoni, Riccardo Zanella, Gianluca Palli

机构 * University of Bologna(博洛尼亚大学) University of Twente(特文特大学)

专题命中 规划决策 :agent(abstract)

AI总结 本研究提出Real2Sim2Real流水线,结合轨迹匹配等方法校准7自由度Franka Emika Panda机器人动力学,训练TQC智能体,实现力矩控制机器人Sim2Real迁移,提升了跟踪精度与鲁棒性。

Comments 6 pages, 8 figures. Presented at the 2026 IEEE/ASME International Conference on Advanced Intelligent Mechatronics (AIM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22569 2026-08-25 eess.SY cs.SY 新提交 50%

Integrating Prognostics, Maintenance, and Tail Assignment under Remaining Useful Life Uncertainty: A Stochastic Optimisation Approach for Airline Reliability

在剩余使用寿命不确定性下整合 prognostics、维护与尾部分配:一种面向航空公司可靠性的随机优化方法

Benno Käslin, Marta Ribeiro, Dimitrios Zarouchas, Manuel Arias Chao

专题命中 规划决策 :planning(abstract)

AI总结 该研究针对航空公司运营中 RUL 不确定性下 TA 与 MS 单独优化的问题,提出联合整合 TA、MS 与 PdM 的随机优化框架,经真实数据验证可降低运营风险。

详情

展开后加载摘要…

URL PDF HTML 收藏