arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 7433 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 2137 篇

2608.10483 2026-08-12 cs.AI cond-mat.mtrl-sci 新提交 57%

Predicting Space Groups of Double Perovskites by LLM with Dynamic Few-Shot Learning

基于动态少样本学习的大语言模型预测双钙钛矿的空间群

Jongwon Park, Inhyo Lee, Junhyeong Lee, Seunghwa Ryu

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究提出基于LLM智能体的DyRIS框架,通过动态少样本检索与规则引导推理,在不平衡双钙钛矿数据集上提升了空间群预测的整体及少数类性能,验证了领域知识与LLM结合的有效性。

Comments 46 pages, 6 figures, Supplementary Information included(24 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09848 2026-08-11 cs.AI 新提交 57%

CEAA: A Cognitive Embodied Agents Architecture for Interactive Computing Systems

CEAA:面向交互式计算系统的认知具身智能体架构

Aimilios Hadjiliasi, Louis Nisiotis

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究针对具身IVAs在实时交互式虚拟环境中实现认知能力的挑战,提出基于Sense-Think-Act等框架的模块化认知架构,弥合高级推理与实时执行的差距,用于部署可扩展的具身IVAs。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09628 2026-08-11 cs.LG cs.RO 新提交 57%

Satellite Trajectory Optimization via Proximal Policy Optimization for Space Debris Avoidance

基于近端策略优化(PPO)的卫星轨道优化用于空间碎片规避

Logan Luna, Juan Ortiz Couder, Raul Alejandro Vargas-Acosta

机构 * Georgia Institute of Technology(佐治亚理工学院) Embry-Riddle Aeronautical University(安柏瑞德航空大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本研究针对轨道拥堵下卫星碰撞规避难题,提出基于PPO的强化学习策略,经高保真模拟器训练,在GEO任务中碰撞规避成功率达97.5%,优于传统方法,构建了公开可用框架

Comments 18 pages, 16 figures. Published in IEEE Access, vol. 14, pp. 18138-18154, 2026

Journal ref L. Luna, J. Ortiz Couder, and R. A. Vargas-Acosta, "Satellite Trajectory Optimization via Proximal Policy Optimization for Space Debris Avoidance," IEEE Access, vol. 14, pp. 18138-18154, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09564 2026-08-11 cs.CV cs.AI 新提交 57%

From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UAV Vision-Language Navigation

从语义接地到决策优化:面向长 horizon 无人机视觉语言导航的统一框架

Zeyuan Ma, Jiaxin Chen, Di Huang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文针对无人机视觉语言导航的现有问题,提出统一语义到决策框架,经实验在AerialVLN和OpenFly基准上达到SOTA性能。

Comments 10 pages, 5 figures. Accepted at ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09166 2026-08-11 cs.RO cs.LG stat.ME 新提交 57%

Particle-Based Conformal Prediction for Contact-Aware Uncertainty Calibration in Stratified Configuration Spaces

分层构型空间中接触感知不确定性校准的基于粒子的保形预测

Luís Marques, Kristian Popov, Dmitry Berenson

机构 * University of Michigan(密歇根大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对机器人接触障碍物时运动模型不准确、未来构型分布异常的问题,提出CaPTURe算法,实现了接触与非接触场景下的指定覆盖率要求,任务成功率较最佳基线提升30%。

Comments 31 pages, 10 figures, 5 tables. Accepted at COPA 2026 (Conformal and Probabilistic Prediction with Applications). Project page: https://um-arm-lab.github.io/capture/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08561 2026-08-11 cs.AI 新提交 57%

Deep probabilistic logic programming for diagnostic reasoning from incomplete information: A case study in stroke detection

面向不完整信息诊断推理的深度概率逻辑编程:以脑卒中检测为例

Felix Weitkämper, Monchito Avila, Elizabeth Nanjala, Siska, Grace Zawadi

机构 * German University of Digital Science(德国数字科学大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本研究以脑卒中检测为案例,提出结合最大熵技术与DeepProbLog的诊断系统构建方法,分析了不完整数据模型的性能及ProbFOIL 2压缩模型的潜力,拓展了神经符号方法在医疗诊断中的应用。

Comments Accepted for presentation at IJCLR 2026. This is the accepted version, _not_ the camera-ready version for the post-proceedings of the conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08389 2026-08-11 cs.AI cs.IR cs.MA 新提交 57%

Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents

不值得再增加一个Token:面向高效深度研究智能体的边际价值估计

Harshitha Kolukuluru, Reshma Ashok, Kirat Arora, Evan William Ciccarelli, Nischal Ashok Kumar, Lunyiu Nie, Franck Dernoncourt, Samyadeep Basu, Ryan A. Rossi, Nedim Lipka

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Adobe Research(奥多比研究院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 该研究针对长周期研究智能体的上下文冗余问题,系统比较不同阶段的剪枝策略,发现早期剪枝可大幅降本,轻量级启发式方法能减73%Token用量且质量损失小,为高效智能体设计提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08146 2026-08-11 cs.AI 新提交 57%

Long SKILL Compliance as Logical Reasoning: Closure-Grounded Detection with Scaling-Guided On-Policy Distillation

长SKILL合规性检测作为逻辑推理:基于闭包的检测与尺度引导的在线策略蒸馏

Shuaitao Zhao, Feng Ni, Lichao Ma, Jiaye Lin, Fei Han, Yang Wei, Lu Pan

机构 * Meituan(美团)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 针对长SKILL合规性检测的成本与精度矛盾,提出SkillCDG框架,结合两级检索与依赖闭包实现检测,在多数据集上优于基线,还发现尺度趋势以优化小模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08061 2026-08-11 cs.AI 新提交 57%

CORDA: A Benchmark for Hierarchical Harm-Centric Moral Reasoning in Large Language Models

CORDA:面向大语言模型的以伤害为核心的分层道德推理基准

Siddarth Singh, Victoria Williams, Simon Rosen, Ebenezer Gelo, Helen Sarah Robertson, Ibrahim Suder, Benjamin Rosman, Geraud Nangue Tasse, Steven James

机构 * University of the Witwatersrand(威特沃特斯兰德大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究提出CORDA基准,评估大语言模型的以伤害为核心的分层道德推理,发现多数模型优先避免直接个人伤害,部分模型无法遵循指定优先级,该基准填补了LLM道德评估的核心空白。

Comments 8 pages, 6 figures. Accepted at the Fourth International Workshop on Value Engineering in AI (VALE 2026), affiliated with IJCAI-ECAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08025 2026-08-11 cs.RO cs.AI 新提交 57%

DA-NBV: A Direction-Aware Next-Best-View Planner for Efficient 3D Reconstruction of Ships at Sea

DA-NBV:一种用于海上船舶高效3D重建的方向感知最优下一个视点规划器

Jiaming Chen, Juntao Yang, Zhentao Zou, Qi Ming, Yi Yu, Zhihang Zhong, Xue Yang, Xue Jiang, Yue Zhou

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对海上船舶3D重建中现有NBV策略忽略方向观测历史的问题,本文提出DA-NBV策略,结合PAF等方法,在SeaShip-3D数据集与仿真环境下实现了更高效的船舶3D重建性能。

Comments 16pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07954 2026-08-11 cs.AI 新提交 57%

KGCache: Amortized Subgraph Retrieval for KG Reasoning with LLMs

KGCache:基于大型语言模型的知识图谱推理的摊销子图检索

Uros Stanic, Changcheng Yuan, Sabuj Laskar, Ariful Azad

机构 * Texas A&M University(得克萨斯农工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本研究针对KGQA中重复检索知识图谱邻域的问题,提出兼容ToG与RoG范式的KGCache,经在WebQSP和CWQ上评估,可显著加速知识图谱检索。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07809 2026-08-11 cs.AI 新提交 57%

CausalNav: Reliability-Certified Causal World Models for Control under Physical-Parameter Shift

CausalNav:用于物理参数偏移下控制的可靠性可验证因果世界模型

Yiyao Zhang, Diksha Goel, Hussain Ahmad, Shixun Huang, Jun Shen

机构 * University of Wollongong(卧龙岗大学) CSIRO’s Data61(联邦科学与工业研究组织Data61) Adelaide University(阿德莱德大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出CausalNav控制器,其结合因果转移图与多门控可靠性验证机制,在物理参数偏移的CartPole-v1和Pendulum-v1任务上,较9种基准取得最佳平均排名,关键在于经认证的弃权(不执行)提升了部署安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07725 2026-08-11 cs.LG 新提交 57%

Finite Constant Frontiers and Auditable Regret Certificates for Average-Reward Reinforcement Learning

平均奖励强化学习的有限常数前沿与可审计后悔证书

Ibne Farabi Shihab, Abu Sa-Adat Mohamed Moon-Im Al Ahsan, Md Najmus Swaqeeb

机构 * Iowa State University(爱荷华州立大学) BRAC University(BRAC大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文针对平均奖励强化学习,提出感知常数的比较协议,推导通信MDP的有限下界证书,改进已发表系数,给出跨度约束乐观学习者的可审计组合规则,完成相关形式化与诊断测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07148 2026-08-10 cs.AI 新提交 57%

A MARL Centered Reference Architecture for Large Language Model Augmentation in Smart Manufacturing

面向智能制造中大型语言模型增强的多智能体强化学习(MARL)中心参考架构

Fouad Bahrpeyma, Dirk Reichelt

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文针对智能制造自适应控制的耦合需求,提出以MARL为中心的三层参考架构,探讨LLM在MARL中的附着点,明确传统MARL与LLM组件的适配场景,为相关研究提供结构化框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06994 2026-08-10 cs.RO cs.AI 新提交 57%

Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models

将意图与轨迹解耦:面向世界动作模型的表示演绎框架

Xiangkai Ma, Yue Ma, Junjie Wang, Sheng Xu, Mingyang Li, Han Zhang, Yuzheng Zhuang, Wenzhong Li, Zhihao Yuan

机构 * NJU(南京大学) HKUST(香港科技大学) CUHK-SZ(香港中文大学(深圳)) THU(清华大学) Joy Future Academy, JD(京东探索研究院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对现有世界动作模型的表示纠缠问题,提出PILOT的表示演绎框架,解耦运动语义与轨迹细节,提升复杂机器人操纵任务的性能与可解释性,兼具少样本微调及架构迁移的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06948 2026-08-10 cs.AI 新提交 57%

LMM Modality Transfer: A Pre-requisite for Autonomous GIS Agents

多模态大模型模态迁移:自主地理信息系统智能体的先决条件

Ivan Majic, Zexian Huang, Franziska Hübl, Krzysztof Janowicz, Meilin Shi, Mina Karimi, Zilong Liu, Alexandra Fortacz-Lazan

机构 * Graz University of Technology(格拉茨工业大学) University of Vienna(维也纳大学) University of Liverpool(利物浦大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文针对自主GIS智能体的先决条件,提出LMM模态迁移任务,发现现有LMM在图像与文本模态间传递空间信息的能力不足,需加强多模态对齐以实现地理空间理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06917 2026-08-10 cs.AI 新提交 57%

ReGraph: Learning to Generate Recipe Graphs from Food Images

ReGraph:从食物图像生成食谱图的学习方法

Guoshan Liu, Bin Zhu, Pengkun Jiao, Jingjing Chen, Chong-Wah Ngo, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信体智能研究院) Singapore Management University(新加坡管理大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本研究针对现有食谱生成方法的过程结构捕捉不足问题,构建了ReGraph食谱图数据集并提出RGL两阶段框架,可让LMM从食物图像生成结构化食谱图,提升了烹饪实体与过程关系的生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06745 2026-08-10 cs.AI 新提交 57%

MemPrism: Task-Conditioned Relational Memory Views for Long-Horizon Agents

MemPrism:面向长程智能体的任务条件关系记忆视图

Zhisheng Chen, Bingfan Zeng, Bangde Cao, Zhengwei Xie, Yuxuan Li, Jinhan Li, Zheng Lu, Xiangchen Guan, Zikai Xiao, Rui Qian, Jingwei Song

机构 * Nanyang Technological University(南洋理工大学) South China University of Technology(华南理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Zhejiang University(浙江大学) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究针对长程智能体记忆系统的表示不匹配问题,提出MemPrism任务条件关系记忆框架,经实验验证可提升长程任务性能、减少记忆消耗且视图策略可跨VLM迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06695 2026-08-10 cs.LG 新提交 57%

A Transferable Autologistic Model for Predicting Rare Failures in Heterogeneous Equipment

一种可迁移的自 logistic 模型,用于预测异构设备中的罕见故障

Islam Benamirouche, Djemel Ziou, Feriel Fass

机构 * Université de Sherbrooke(谢布鲁克大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文针对异构设备罕见故障预测难题,提出可迁移自 logistic 模型,在含27台模拟冰箱的合成数据集上验证了模型的故障概率估计能力,为预测性维护提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06503 2026-08-10 cs.LG 新提交 57%

Toward Reliable Context Compression for Long-Horizon Agents: An Empirical Study of Execution Instability

面向长 horizon 智能体的可靠上下文压缩:执行不稳定性的实证研究

Guanghui Min, Liang Wu, Mayank Darbari, Chen Chen, Liangjie Hong

机构 * University of Virginia(弗吉尼亚大学) Nokia(诺基亚公司)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 该研究针对长 horizon 智能体上下文压缩的执行不稳定性问题,提出了验证器引导框架 TRACE,在 AppWorld 上的实验显示其在任务性能等指标上优于现有基线,为可靠上下文压缩提供了新方向。

Comments 31 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06434 2026-08-10 cs.RO cs.LG 新提交 57%

Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection

快速且精准:一种通过环境感知模型选择的自适应VLA推理框架

Yuewei Sun, Lang Qin, Zechuan Tian, Jingwen Li, Guiqin Wang, Shengzeng Huo, Wenxin Ren, Tao Fang, Xiaochen Zhang, Guanqing Deng, Xiang Wang, Xiaowen Dong, Qinghai Guo, Yuxin Ma

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出环境感知模型选择(EMS)自适应VLA推理框架,通过解耦双系统与强化学习切换策略,在LIBERO基准及真实双臂任务中平衡了VLA的推理速度与任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07228 2026-08-10 cs.LG math.OC 新提交 57%

Learning Suffers More Than the Policy Class Under Partial Observability: A Closed-Form Analysis

部分可观测性下学习的表现比策略类更差:闭式分析

Idil Gözel

机构 * University College London(伦敦大学学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 该研究通过闭式分析发现,部分可观测强化学习中学习偏差是性能差的主因,调整演员-评论家的前瞻步数可解决问题,提供了理论依据且经实验验证。

Comments 26 pages, 4 figures. Code and data: https://github.com/idilgozel/belief-critic-restoration

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05447 2026-08-07 cs.CL 新提交 57%

Example-Guided Prompting for Document-Level Text Simplification

示例引导提示用于文档级文本简化

Marina Litvak, Ariel Perstin, Ilan Shtilman, Michael Färber

机构 * SCE(SCE(以色列SCE学院)) ScaDS.AI, TUD Dresden(ScaDS.AI,德累斯顿工业大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 该研究针对文档级文本简化中提示指导不足的问题,提出示例引导提示方法,经OneStopEnglish语料库实验,可提升大语言模型的简化质量,性能优于或媲美相关基准系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05371 2026-08-07 cs.LG 新提交 57%

Quantum-Structured World Models (QSWMs) for Predictive Latent Dynamics

用于预测潜在动力学的量子结构化世界模型(QSWMs)

Hailong Jiang, Emran Hossain, Feng Yu, Jianfeng Zhu, Guilin Zhang, Wulan Guo

机构 * Youngstown State University(扬斯敦州立大学) Kent State University(肯特州立大学) George Washington University(乔治·华盛顿大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出量子结构化世界模型(QSWMs),研究量子启发结构对世界建模的作用,在基本元胞自动机上评估其变体,发现复值QSWM局部预测潜力良好但类密度矩阵变体存在长时序预测局限。

Comments 19 pages, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05256 2026-08-07 cs.AI 新提交 57%

Posture and Sustainment Optimization Under Adversarial Uncertainty

对抗不确定性下的态势与维持优化

Amelie Norris, Alyssa Lee, Natan Vidra, Spurthi Setty

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对态势与维持分配(PSA)问题,提出CEV优化器及RobustCEV扩展,在印太基地环境实验中验证其相比贪心基线、朴素优化器可显著提升对抗不确定性下的态势效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05212 2026-08-07 cs.AI 新提交 57%

SearchAuditor: Auditing and Attributing Failures in Long-Horizon Search Agents

SearchAuditor:长程搜索智能体失败的审计与归因

Zhixiang Liang, Yifei Liu, Yidan Huang, Haozhe Zhao, Beichen Huang, Jiaqi Wang, Nan Duan, Qiong Cao

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究针对长程搜索智能体的失败诊断难题,构建SearchAuditBench基准,提出多视角审计框架SearchAuditor,其端到端通过率达32.3%,优于基线模型,可助力智能体从错误中恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05171 2026-08-07 cs.CY cs.AI 新提交 57%

Beyond Information Retrieval: Generative AI as an Epistemic Arbiter to Enhance Collaborative Problem-Solving

超越信息检索:生成式AI作为认知仲裁者以增强协作问题解决

Jiaxin Zou, Xiaoming Zhai, Chunlei Gao

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本研究通过201名五年级学生的六周准实验,探究生成式AI对协作问题解决的影响,发现其会改变学生行为模式,可作为认知仲裁者促进建设性分歧解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05148 2026-08-06 cs.CL 新提交 57%

Reasoning Core: Designing Broad Procedural Data for Completion-Supervised Reasoning Training

推理核心:为完成监督式推理训练设计广谱过程化数据

Damien Sileo, Valentin Lacombe, Dimitri Kachler

机构 * Univ. Lille(里尔大学) Inria(法国国家信息与自动化研究所) CNRS(法国国家科学研究中心) Centrale Lille(里尔中央理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 本研究推出含50类任务生成器的Reasoning Core集合,经对比实验,其在3B规模模型的三个推理基准上得分最优,相关资源已公开。

Comments 20 pages, 3 figures. Code: https://github.com/sileod/reasoning-core Data: https://hf.co/collections/reasoning-core/datasets

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04719 2026-08-06 cs.AI 新提交 57%

Diagnosing Tool-Selection Reasoning in LLM Agents with Canary Tools

用金丝雀工具诊断大语言模型智能体的工具选择推理

Atul Anand, Sourav Chattaraj

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究引入金丝雀工具诊断LLM智能体的工具选择推理,通过多维度分类法评估8个模型,发现模型能力提升会降低易感性,分类法具能力分层性,且发布了相关框架与数据。

Comments 10 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04575 2026-08-06 cs.CV cs.AI 新提交 57%

PhysMind: From Video to Executable Worlds for Training-Free Physical Reasoning

PhysMind:从视频到可执行世界的无训练物理推理框架

Chen Yang, Shenxiang Zeng, Haoyang Zhao, Zhouyuan Xu, Youquan He, Haoyu Li, Mingyi Deng, Jiansheng Fan, Chen Wang

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 PhysMind是无训练的智能体框架,为每个视频构建可执行世界,在CLEVRER、Physion++数据集及反事实问题上的物理推理准确率显著优于现有视觉语言模型。

Comments 27 pages, 18 figures. Project page: https://physmind.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏