arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-14 至 2026-08-14 共收录 64 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14 篇

2608.12835 2026-08-14 cs.RO 新提交 57%

AirForesight: Current-to-Future Spatial Map Imagination with Cross-Space Planning Consistency for UAV-VLN

AirForesight:面向无人机视觉语言导航(UAV-VLN)的跨空间规划一致性当前-未来空间地图想象

Yutong Liu, Xiaojie Li, Mingzhu Xu, Jianlong Wu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shandong University(山东大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对现有UAV-VLN方法空间推理不足的问题,提出AirForesight框架,通过联合监督学习当前地图表示并引入跨空间规划一致性损失,在公开数据集上取得良好性能。

Comments Accepted by ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09700 2026-08-14 eess.SP 版本更新 50%

Track-Consistency-Based GNSS RFI Monitoring Using Crowdsourced ADS-B Sensor Networks

基于轨迹一致性的GNSS射频干扰监测:利用众包式自动相关监视广播(ADS-B)传感器网络

Sanghyeon Park, Halim Lee, Pyo-Woong Son

专题命中 具身导航 :navigation(abstract)

AI总结 针对GNSS射频干扰监测问题,提出基于轨迹一致性的三阶段框架,利用众包式ADS-B网络筛选位置跳跃候选者、验证轨迹一致性并分组异常事件,通过东北亚地区数据验证,该框架能有效识别事件集群,为监测提供补充标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11055 2026-08-14 cs.CR eess.SP 版本更新 50%

AIS-Based Maritime GNSS RFI Monitoring With Multi-Vessel Coherence and Communication-Integrity Artifact Mitigation

基于AIS衍生时空完整性的广域GNSS欺骗与干扰检测

Sanghyeon Park, DeukJae Cho, Pyo-Woong Son

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出基于AIS的三阶段框架,通过预过滤和时空分析实现广域GNSS欺骗与干扰检测,有效降低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08484 2026-08-14 physics.atom-ph 版本更新 50%

The SWaP plot: Visualising the performance of portable atomic clocks as a function of their size, weight and power

SWaP图:可视化便携式原子钟的性能随其尺寸、重量和功率的变化

Benjamin White, Rachel Offer, Ashby Hilton, Andre Luiten

专题命中 具身导航 :navigation(abstract)

AI总结 本研究开发了一个网络资源及交互式SWaP图,用于跟踪从研究转向应用的新一代光原子钟的性能,为精密计时领域提供持续更新的参考。

Comments 5 pages, 2 figures. For more information see https://a1120960.github.io/PAC-SWaP/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 10 篇

2608.13438 2026-08-14 cs.RO cs.AI cs.CV 新提交 85%

ContactGuard: Pre-Contact Execution Monitoring with Action-Conditioned Latent World Models

ContactGuard:基于动作条件潜世界模型的接触前执行监控器

Gehan Zheng, Matthew Johnson-Roberson, Weiming Zhi

机构 * College of Connected Computing, Vanderbilt University(范德堡大学连接计算学院) School of Computer Science, The University of Sydney(悉尼大学计算机学院) Australian Centre for Robotics, The University of Sydney(悉尼大学澳大利亚机器人中心)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 ContactGuard是基于动作条件潜世界模型的接触前执行监控器,通过预测接触前动作的潜态后果判断是否失败,能准确预测接触型操纵任务失败,可迁移至真实机器人且无需修改底层策略。

Comments 14 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13456 2026-08-14 cs.AI cs.CV 新提交 84%

A Unifying Perspective on Causal World Models: From Observations to Representations to Structure

因果世界模型的统一视角:从观测到表征再到结构

Avinash Kori, Fabrizio Russo

机构 * Imperial College London(帝国理工学院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 本文从因果视角研究不同抽象层级的世界模型,提出因果世界模型的形式定义,关联相关领域工作并阐明其组件可从数据恢复的条件,为世界模型奠定支持因果推理与决策的基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13518 2026-08-14 cs.LG cs.CV 新提交 82%

Intervention-Aware Clinical World Model for Post-Op Outcome Forecasting in Cardiology

面向心脏病术后结局预测的干预感知临床世界模型

Yunsung Chung, Yingshuo Liu, Abboud F. Hassan, Han Feng, Mary M. Maleckar, Nassir Marrouche, Jihun Hamm

机构 * Tulane University(杜兰大学) Simula Research Laboratory(Simula研究实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV、cs.LG

AI总结 本研究针对心脏病术后结局预测的不规则轨迹问题,提出干预感知临床世界模型,在DECAAF-II数据集上实现心房颤动消融后复发预测及疤痕范围估计的良好性能。

Comments Medical World Models (MWM) Workshop at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12959 2026-08-14 cs.LG cs.AI 新提交 81%

The Objective Is the Bottleneck: Latent World Models Encode What Their Planners Cannot Use

目标是瓶颈:潜在世界模型编码了其规划器无法使用的内容

Joyjeet Singh

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究发现潜在世界模型的规划瓶颈在于规划器目标而非预测器,通过替换目标无需额外训练即可大幅提升长视野规划性能,揭示模型编码了规划器未利用的可达性信息。

Comments Follow-up to arXiv:2608.10145. All experiments run on a laptop CPU; no model was trained or fine-tuned. Code, checkpoints and every measurement: github.com/joyjeet-singh/tinylab

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12939 2026-08-14 cs.LG 新提交 79%

Diagnosing JEPA World Models with Action-Conditioned Predictive Consistency

用动作条件预测一致性诊断JEPA世界模型

Guo An, Zijing Wu, Honghua Dong, Yuhao Yan, Zixuan Gui, Haochong Chen, Shanzhao Ruan, Xiang Wang, Yurong Ling, Qi Tian

机构 * Huawei(华为) University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本研究针对JEPAs世界模型易受视觉扰动影响的问题,提出动作条件预测一致性(ACPC)诊断方法,定义IR与SR指标,经四视觉控制任务实验验证其可预测扰动带来的预测及代价变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12564 2026-08-14 cs.LG 新提交 79%

Scaling Automatic Research Agents via World Models

通过世界模型扩展自动研究智能体

Xiyuan Yang, Sheikh Sarwar, Jingru Cheng, Zhan Shi, Duanshun Li, Huiyuan Chen, Haiyang Zhang, Chenlei Guo, Jingrui He, Zhenyu Liao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊公司)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 针对自动研究智能体扩展时的训练瓶颈,提出WMRL方法,结合两种缓解措施提升收敛性,训练加速3-4倍且性能优于更大规模智能体,还可迁移至多类任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09696 2026-08-14 cs.AI 版本更新 79%

Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models

模型发现智能体:用于数据高效发现机制世界模型的大语言模型辅助贝叶斯实验设计

Kevin Murphy

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 该研究提出模型发现智能体(MDA),结合LLM与贝叶斯机制,在少量干预下发现机制世界模型,在三类基准上实现数据高效模型学习与可靠干预预测的SOTA性能。

Comments v3: further improve app A (algorithm pseudocode), add new app G (further related work) - (main text unchanged)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13492 2026-08-14 cs.AI 新提交 74%

AlayaWorld: Interactive Long-Horizon World Modeling - Full Technical Report (v1.1)

AlayaWorld:交互式长时世界建模——完整技术报告(v1.1)

AlayaWorld Team, Kaipeng Zhang, Chuanhao Li, Yifan Zhan, Yongtao Ge, Yuanyang Yin, Jiaming Tan, Kang He, Liaoyuan Fan, Mingliang Zhai, Ruicong Liu, Xiaojie Xu, Xuangeng Chu, Zhen Li, Zhengyuan Lin, Zhixiang Wang, Zian Meng, Zihui Gao

机构 * Alaya Lab(Alaya实验室)

专题命中 具身推理 :world model(title);分类 cs.AI

AI总结 本报告改进AlayaWorld,通过调整条件信号设计等六项修改优化交互式长时世界建模,保留原有架构等核心部分。

Comments Authors are listed alphabetically by the first name and their role. See the contribution section for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13095 2026-08-14 cs.RO cs.CV 新提交 62%

Semantic Radiance Fields as Simulators for Spatial Reasoning in Real-World Scenes

语义辐射场作为真实场景空间推理的模拟器

Nico Heider, Michał Jan Włodarczyk, Katarzyna Wasielewska-Michniewska, Przemysław Hołda, Martin Schieck, Marcin Paprzycki, Maria Ganzha, Bogdan Franczyk

机构 * Leipzig University(莱比锡大学) Systems Research Institute Polish Academy of Sciences(波兰科学院系统研究所) Wrocław University of Economics(弗罗茨瓦夫经济大学)

专题命中 具身推理 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出用语义辐射场(SRF)构建兼具几何真实性与语义可查询性的真实场景模拟器,用于训练评估具身智能体的空间推理能力,还将其应用于果园苹果采摘任务。

Comments Accepted at the IJCAI 2026 Workshop on Spatio-Temporal Reasoning and Learning (STRL), oral presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12683 2026-08-14 cs.RO cs.CV 新提交 62%

FUSE: Active Functional Affordance Grounding through Adaptive Semantic-Geometric Evidence Acquisition

FUSE:通过自适应语义-几何证据获取实现主动功能可供性接地

Zhou Chen, Sathyanarayanan N. Aakur

专题命中 具身推理 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出主动功能可供性接地任务,构建FUSE框架结合不确定性驱动探索与摊销规划器,基于Habitat基准验证其在非神示接地中性能最优且计算量降低1.33倍。

Comments Under review. 15 Pages. 9 tables, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 3 篇

2608.13453 2026-08-14 cs.CV cs.AI 新提交 79%

UniTexture: Cross-Task Universal Adversarial Textures for Vision-Language-Action Models

UniTexture:面向视觉-语言-动作模型的跨任务通用对抗纹理

Yukun Dai, Mingzhe Dai, Tianshi Wang, Fengling Li, Jingjing Li, Lei Zhu

专题命中 机器人基础模型 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 该研究提出UniTexture跨任务通用对抗纹理攻击,通过单个带纹理3D物体诱导VLA动作预测偏差,在OpenVLA等模型上可显著降低任务成功率,且具备跨套件与跨模型迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29699 2026-08-14 cs.CV cs.AI cs.RO 版本更新 67%

Early Warning Signals for OpenVLA Failure under Visual Distribution Shift

视觉分布偏移下OpenVLA故障的早期预警信号

Dipesh Tharu Mahato, Rachel Ren

机构 * New York University(纽约大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究在视觉分布偏移下,OpenVLA内部激活是否包含可线性解码的近期任务失败信息,通过LIBERO操作实验发现第16层逻辑探针在遮挡条件下预测失败AUROC达0.972。

Comments 16 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13474 2026-08-14 cs.RO 新提交 57%

Decoding Task Progress from VLA Representations

从视觉-语言-动作模型(VLA)表征中解码任务进度

Atiksh Bhardwaj, Edward Weiyi Duan, Prithwish Dan, Wei-Chiu Ma, Preston Culbertson

机构 * Cornell University(康奈尔大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 该研究利用机制可解释性探究VLA的π₀.₅残差流,发现任务进度可从激活值线性读取,基于此构建的探测器可作为无标签OOD检测器,性能接近最先进方法,为监控部署的视觉运动策略提供轻量可解释路径。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 6 篇

2608.12917 2026-08-14 cs.LG cs.RO 新提交 81%

Towards Socially Compliant Navigation in Deep Reinforcement Learning via Proxemics-Based Reward Modeling

基于近体学奖励建模的深度强化学习中符合社会规范的导航研究

Takieddine Soualhi, Jacques Saraydaryan, Laetitia Matignon

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 该研究针对DRL社会导航中社会合规目标不足的问题,提出基于近体学的奖励建模方法,经模拟验证可提升社会指标且保持导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12743 2026-08-14 cs.AI 新提交 70%

Spatial Memory Agent: Experience-Grounded Procedure Memory for Spatial Intelligence

空间记忆智能体:用于空间智能的基于经验的过程记忆

Haokai Zhang, Yuhang Ding, Yunshu Zhou, Xinze Du, Shengtao Zhang, Zhiyue Zhao, Yuling Xi, Hao Chen

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 模仿学习与强化学习 :embodied agent(abstract);robotic(abstract);分类 cs.AI

AI总结 该研究提出SMA框架,让冻结VLM智能体无需外部空间工具,通过无参数更新自进化提升空间推理,在多基准和模型上表现最优,提供了空间自进化的实用路径。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01568 2026-08-14 cs.LG cs.RO 版本更新 62%

Trajectory First: A Curriculum for Discovering Diverse Policies

轨迹优先:发现多样化策略的课程

Cornelius V. Braun, Sayantan Auddy, Marc Toussaint

机构 * TU Berlin(柏林技术大学) Robotics Institute(机器人研究所)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出一种两阶段课程,通过轨迹先验生成多样化高奖励行为,再蒸馏为反应式策略,提升任务性能与行为多样性。

Comments Best paper at the Inductive Biases in Reinforcement Learning Workshop at RLC 2025

Journal ref Reinforcement Learning Journal 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12995 2026-08-14 cs.AI cs.MA 新提交 57%

OGR-MARL: Option-Guided Residual Multi-Agent Reinforcement Learning for Heterogeneous USV Cooperative Pursuit in Constrained Port Waterways

OGR-MARL:面向受限港口水道中异构无人水面艇协同追踪的选项引导式残差多智能体强化学习

Jiayang Mao, Lanfeng Wang, Zhao-Han Peng

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

AI总结 本文提出OGR-MARL框架,将其实例化为多款连续控制MARL算法,经厦门港水道实验验证,OGR-MASAC捕获率达75.0%,规则依从性与异构协同表现最优,且具备良好泛化潜力。

Comments 6 pages,5 figures, accepted by ICUS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06161 2026-08-14 cs.AI 版本更新 57%

iARCS: Iterative Agentic RL for Controllable 3D Scene Generation

iARCS:用于可控3D场景生成的迭代智能体强化学习

Saugat Adhikari, Ashok Prasad Neupane, Pramish Paudel, Ajad Chhatkuli, Danda Pani Paudel

机构 * Tribhuvan University(特里布文大学) Pulchowk Campus, IOE, Tribhuvan University(特里布文大学工程学院普尔乔克校区) NAAMII(尼泊尔先进数学与信息学研究所) INSAIT, Sofia University “St. Kliment Ohridski”(索菲亚大学圣克莱门特奥赫里德斯基分校INSAIT)

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI

AI总结 研究针对现有3D场景生成器无法满足任务约束的问题,提出iARCS迭代智能体强化学习框架,通过两阶段策略优化约束保真度,生成的数据可改进基础生成器,具实用价值。

Comments 15 pages, 9 figures, 4 tables. Includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01891 2026-08-14 cs.LG 版本更新 57%

SEAR: Sample Efficient Action Chunking Reinforcement Learning

SEAR:样本高效的动作分块强化学习

C. F. Maximilian Nagy, Onur Celik, Emiliyan Gospodinov, Florian Seligmann, Weiran Liao, Aryan Kaushik, Gerhard Neumann

机构 * Autonomous Learning Robots, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院自主学习机器人实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

AI总结 SEAR 是一种样本高效的在线强化学习算法,通过利用动作分块的时间结构和滚动时间 horizon,有效结合小和大分块大小的优势,在 Metaworld 上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2608.13284 2026-08-14 cs.RO 新提交 79%

Predictive Relative-Velocity Steering for Safe Robotic Manipulator Teleoperation in Dynamic Environments

动态环境下安全机器人操纵器遥操作的预测相对速度转向方法

Changhao Hu, Zeyi Liu, Songqiao Hu, Shuang Liu, Zihan Meng, Xiao He

机构 * Zhejiang University(浙江大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) Institute for Embodied Intelligence and Robotics, Tsinghua University(清华大学具身智能与机器人研究所) TetraBOT

专题命中 人机交互与遥操作 :robotic(title,abstract);分类 cs.RO

AI总结 针对动态环境下机器人遥操作的安全问题,提出轻量级模块化预测相对速度转向框架,可提升末端执行器避障率并缓解死锁,仿真与物理实验验证了其有效性。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 8 篇

2608.13233 2026-08-14 cs.RO 新提交 79%

Manufacturing Complex Airtight Soft Pneumatic Actuators for Soft Robotics: Process Evaluation and Optimization

面向软机器人的复杂气密性软气动执行器制造:工艺评估与优化

Mohammed Abboodi

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 本研究评估多种复杂软气动执行器制造工艺,发现熔融沉积建模(FDM)适应性最强,确立了以执行器架构与制造约束兼容性为核心的面向制造设计方法,为相关执行器开发提供实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12904 2026-08-14 cs.CV 新提交 79%

HounsWorld: A Multimodal World Model for Hidden Patient-State Readout, Reconstruction, and Simulation

HounsWorld:用于隐藏患者状态读取、重建与模拟的多模态世界模型

Yunhao Bai, Zhongwei Qiu, Guangyu Guo, Yiming Huang, Tony C. W. Mok, Qinji Yu, Ling Zhang, Yan Wang

机构 * East China Normal University(华东师范大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Hupan Laboratory(湖畔实验室) Zhejiang University(浙江大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.CV

AI总结 该研究提出3B参数多模态世界模型HounsWorld,结合CT扫描与临床语言,通过共享潜在患者状态实现读取、重建、模拟三类任务,在HounsBench基准上表现优异,提升了CT理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12849 2026-08-14 eess.SP 新提交 78%

Energy Efficiency Maximization for FAS-Assisted Downlink Communication in Mobile Embodied AI Networks (MEAN) over Interference Channels

干扰信道中移动具身人工智能网络(MEAN)里流体天线系统(FAS)辅助的下行通信的能效最大化

Ruopeng Xu, Zhaohui Yang, Jiaxiang Wang, Chenliang Wu, Zhaoyang Zhang

专题命中 机器人数据与评测 :embodied AI(title,abstract)

AI总结 针对干扰信道中FAS辅助的下行MEAN,该研究联合优化智能体位置、FAS端口选择与发射功率以最大化能效,提出的迭代算法在噪声严重时性能优于基准方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05498 2026-08-14 cs.RO 版本更新 70%

JailWAM: Jailbreaking World Action Models in Robot Control

JailWAM: 在机器人控制中对World Action Models进行劫持

Hanqing Liu, Songping Wang, Jiahuan Long, Jiacheng Hou, Jialiang Sun, Chao Li, Yang Yang, Wei Peng, Xu Liu, Tingsong Jiang, Yao Mu, Wen Yao

机构 * MoE key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部重点实验室) PR Lab, Nanjing University(南京大学PR实验室) Defense Innovation Institute, Chinese Academy of Military Science(军事科学院国防创新研究院)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出JailWAM框架,通过三级安全分类体系和三个核心组件,系统评估WAM的安全性,实验表明其能有效暴露物理漏洞,攻击成功率高达84.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13028 2026-08-14 cs.CV cs.RO 新提交 62%

RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction

用于改进人机物体交接预测的RGB-D视频生成

Tianyu Sun, Zhoujie Fu, Zihui Gao, Bang Zhang, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) College of Computing and Data Science(计算与数据科学学院) Zhejiang University(浙江大学) College of Computer Science and Technology(计算机科学与技术学院) Alibaba Group(阿里巴巴集团)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对人机物体交接数据集稀缺及现实-模拟差距问题,提出Hand2Bot数据集与PassGen生成流水线,实现高意图识别准确率与低误触发率,支持机器人稳健零样本迁移与早期意图预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13420 2026-08-14 cs.AI 新提交 57%

Enhancing Virtual Agents through SLMs and Edge-Computing: An Exploratory Evaluation of Think and Memory Processes

通过小型语言模型(SLMs)与边缘计算增强虚拟智能体:对思考与记忆过程的探索性评估

Aimilios Hadjiliasi, Louis Nisiotis

机构 * University of Central Lancashire(中央兰开夏大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 本文探索利用SLMs与边缘计算支持CEAA的“思考”“记忆”组件,在NVIDIA Jetson Orin NX上用Qwen2.5模型开发边缘虚拟智能体网关,经模拟实验验证其可高效运行部分CEAA过程,助力沉浸式虚拟世界具身智能体开发。

详情

展开后加载摘要…

URL PDF HTML 收藏