arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8673 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8673 篇

2602.12112 2026-02-13 cs.LG 57%

Few-Shot Design Optimization by Exploiting Auxiliary Information

通过利用辅助信息进行少样本设计优化

Arjun Mani, Carl Vondrick, Richard Zemel

机构 * Department of Computer Science, Columbia University, New York, New York, USA(计算机科学系,哥伦比亚大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.LG

AI总结 本文提出了一种利用辅助信息进行少样本设计优化的方法,通过神经模型预测未见过的设计,提升了设计任务的优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11940 2026-02-13 cs.LG 57%

Temporally Unified Adversarial Perturbations for Time Series Forecasting

时间统一对抗扰动用于时间序列预测

Ruixian Su, Yukun Bao, Xinze Zhang

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出时间统一对抗扰动方法,通过时间一致性约束和梯度累积方法提升时间序列预测模型的对抗攻击效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18382 2026-02-13 cs.RO 57%

One Demo Is All It Takes: Planning Domain Derivation with LLMs from A Single Demonstration

一个演示就足够:从单个演示中利用LLM进行规划域推导

Jinbang Huang, Yixin Xiao, Zhanguang Zhang, Mark Coates, Jianye Hao, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) McGill University(麦吉尔大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 PDDLLM通过结合LLM推理与物理模拟,从单个演示中自动推导规划域,提升长时间跨度任务规划的自动化与可靠性。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11648 2026-02-13 cs.RO cs.HC 57%

Human-Like Gaze Behavior in Social Robots: A Deep Learning Approach Integrating Human and Non-Human Stimuli

社交机器人中类人目光行为:一种整合人类和非人类刺激的深度学习方法

Faezeh Vahedi, Morteza Memari, Ramtin Tabatabaei, Alireza Taheri

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本研究通过深度学习方法,使社交机器人在各种社交情境中更准确地模仿人类目光行为,提升与人类的互动效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11049 2026-02-12 cs.RO 57%

SQ-CBF: Signed Distance Functions for Numerically Stable Superquadric-Based Safety Filtering

SQ-CBF:基于超二次曲面的安全过滤中的符号距离函数

Haocheng Zhao, Lukas Brunke, Oliver Lagerquist, Siqi Zhou, Angela P. Schoellig

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 SQ-CBF通过符号距离函数改进安全过滤,解决隐式函数梯度病态问题,提升机器人在复杂环境中的安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11005 2026-02-12 cs.CV 57%

Interpretable Vision Transformers in Monocular Depth Estimation via SVDA

通过SVDA实现单目深度估计中的可解释性视觉变换器

Vasileios Arampatzakis, George Pavlidis, Nikolaos Mitianoudis, Nikos Papamarkos

机构 * Dept. Electrical and Computer Engineering(电子与计算机工程系) Democritus University of Thrace(德米特里乌斯大学) Athena Research Center(雅典研究中心) University Campus at Kimmeria(基米里亚大学校园)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 SVDA通过引入谱结构化的注意力机制,提升了单目深度估计的可解释性,同时保持了预测精度并降低了计算开销。

Comments 8 pages, 2 figures, submitted to CVPR Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10980 2026-02-12 cs.RO 57%

RADAR: Benchmarking Vision-Language-Action Generalization via Real-World Dynamics, Spatial-Physical Intelligence, and Autonomous Evaluation

RADAR:通过现实动态、空间-物理智能和自主评估进行视觉-语言-动作泛化基准测试

Yuhao Chen, Zhihao Zhan, Xiaoxin Lin, Zijian Song, Hao Liu, Qinhan Lyu, Yubo Zu, Xiao Chen, Zhiyuan Liu, Tao Pu, Tianshui Chen, Keze Wang, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室) Guangdong University of Technology(广东工业大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 RADAR通过现实动态、空间-物理智能和自主评估,系统评估VLA模型在现实环境中的泛化能力,揭示其在物理动态和空间推理上的脆弱性。

Comments 12 pages, 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10814 2026-02-12 cs.AI 57%

See, Plan, Snap: Evaluating Multimodal GUI Agents in Scratch

见、计划、快照:评估Scratch中的多模态GUI代理

Xingyi Zhang, Yulei Ye, Kaifeng Huang, Wenhao Li, Xiangfeng Wang

机构 * Tongji University(同济大学) East China Normal University(华东师范大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出ScratchWorld基准,用于评估多模态GUI代理在Scratch中的程序构建能力,揭示了推理与执行之间的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10559 2026-02-12 cs.RO 57%

Towards Safe Path Tracking Using the Simplex Architecture

基于简单形架构的安全路径跟踪

Georg Jäger, Nils-Jonathan Friedrich, Hauke Petersen, Benjamin Noack

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出基于简单形架构的路径跟踪控制器,结合强化学习和高保证控制器,以实现安全性和高性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07593 2026-02-12 stat.ML cs.LG stat.ME 57%

Diffusion posterior sampling for simulation-based inference in tall data settings

扩散后验采样用于高数据设置下的基于模拟的推断

Julia Linhart, Gabriel Victorino Cardoso, Alexandre Gramfort, Sylvain Le Corff, Pedro L. C. Rodrigues

机构 * Université Paris-Saclay(巴黎-萨克雷大学) Inria(法国国家信息与自动化技术研究院) CEA(法国原子能委员会) CMAP, École Polytechnique(高等理工学院CMAP部门) Institut Polytechnique de Paris(巴黎理工 institute) CNRS(法国国家科学研究中心) Grenoble INP(格勒诺布尔INP) LJK(格勒诺布尔联合实验室)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.LG

AI总结 本文提出了一种无需兰格-动态步骤的扩散后验采样方法,提高了高数据设置下基于模拟的推断效率和稳定性。

Comments 49 pages, 24 figures, 3 tables, 2 algorithms, 12 appendices, TMLR acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21872 2026-02-11 eess.IV cs.LG 57%

Targeted Unlearning Using Perturbed Sign Gradient Methods With Applications On Medical Images

利用扰动符号梯度方法的目标遗忘与医疗图像应用

George R. Nahass, Zhu Wang, Homa Rashidisabet, Won Hwa Kim, Sasha Hubschman, Jeffrey C. Peterson, Chad A. Purnell, Pete Setabutr, Ann Q. Tran, Darvin Yi, Sathya N. Ravi

机构 * Department of Biomedical Engineering(生物医学工程系) Department of Ophthalmology(眼科学系) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Department of Computer Science(计算机科学系) Computer Science and Engineering(计算机科学与工程) Pohang University of Science and Technology, South Korea(韩国釜山科学技术大学) Department of Plastic and Reconstructive Surgery(整形外科与重建外科系)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.LG

AI总结 本文提出了一种基于扰动符号梯度的方法,用于医疗图像中的目标遗忘,通过可调损失设计和模型组合策略,在遗忘与保留之间取得平衡,优于现有基线方法。

Comments 39 pages, 12 figures, 11 tables, 3 algorithms

Journal ref Transactions on Machine Learning Research 2025, https://openreview.net/forum?id=XE0bJg6sQN

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09765 2026-02-11 cs.RO 57%

NavDreamer: Video Models as Zero-Shot 3D Navigators

NavDreamer: 视频模型作为零样本三维导航器

Xijie Huang, Weiqi Gai, Tianyue Wu, Congyu Wang, Zhiyang Liu, Xin Zhou, Yuze Wu, Fei Gao

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 NavDreamer利用视频模型实现零样本三维导航,通过生成视频模型作为语言指令与导航轨迹的接口,结合时空信息和物理动态,实现强大泛化能力。

Comments Work in the progress. 22 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06747 2026-02-11 cs.CV 57%

Wandering around: A bioinspired approach to visual attention through object motion sensitivity

游走探索:一种受生物启发的通过物体运动敏感性实现视觉注意的方法

Giulia D'Angelo, Victoria Clerico, Chiara Bartolozzi, Matej Hoffmann, P. Michael Furlong, Alexander Hadjiivanov

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(捷克技术大学普拉茨分校电子工程系) IBM Research Europe, Zurich, Switzerland(IBM欧洲研究院,瑞士苏黎世) Italian Institute of Technology, Genoa, Italy(意大利理工学院,热那亚) National Research Council of Canada & Systems Design Engineering, University of Waterloo, Canada(加拿大国家研究理事会与系统设计工程,滑铁卢大学) European Space Agency, Noordwijk, The Netherlands(欧洲航天局,荷兰诺德维克) Adapsent, Leiden, The Netherlands(Adapsent,荷兰莱顿)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出了一种受生物启发的视觉注意系统,通过物体运动敏感性实现选择性注意,利用动态视觉传感器和神经形态算法,实现高效低延迟的实时目标检测与分割。

Journal ref Neuromorphic Computing and Engineering 5.2 (2025): 024019

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07801 2026-02-11 cs.CV 57%

Deep Learning-Based Object Pose Estimation: A Comprehensive Survey

基于深度学习的对象位姿估计:全面综述

Jian Liu, Wei Sun, Hui Yang, Zhiwen Zeng, Chongpei Liu, Jin Zheng, Xingyu Liu, Hossein Rahmani, Nicu Sebe, Ajmal Mian

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文综述了基于深度学习的对象位姿估计的最新进展,涵盖实例级、类别级和未见过对象的位姿估计,分析了当前方法的挑战与未来方向。

Comments Accepted by IJCV 2026, 45 pages, 13 figures

Journal ref International Journal of Computer Vision, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08168 2026-02-10 cs.CV 57%

DAS-SK: An Adaptive Model Integrating Dual Atrous Separable and Selective Kernel CNN for Agriculture Semantic Segmentation

DAS-SK:一种集成双空洞分离和选择性核的自适应模型用于农业语义分割

Mei Ling Chee, Thangarajah Akilan, Aparna Ravindra Phalke, Kanchan Keisham

机构 * Electrical & Computer Engineering Department of Lakehead University(拉夫莱德大学电气与计算机工程系) Faculty of Software Engineering of Lakehead University(拉夫莱德大学软件工程系) Faculty of Applied Science of the University of Alabama(阿拉巴马大学应用科学系) School of Computer Science Engineering and Information Systems, Vellore Institute of Technology(维洛雷理工学院计算机科学工程与信息系统学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 DAS-SK通过集成双空洞分离和选择性核卷积,实现高效农业语义分割,优于现有模型。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24554 2026-02-10 cs.RO 57%

An Adaptive Inspection Planning Approach Towards Routine Monitoring in Uncertain Environments

一种面向不确定环境常规监测的自适应检查规划方法

Vignesh Kottayam Viswanathan, Yifan Bai, Scott Fredriksson, Sumeet Satpute, Christoforos Kanellakis, George Nikolakopoulos

机构 * Robotics and AI, Luleå University of Technology(机器人与人工智能,卢勒奥技术大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种分层框架,用于在不确定环境中通过自适应检查规划实现常规监测。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05538 2026-02-09 cs.CV 57%

A Comparative Study of 3D Person Detection: Sensor Modalities and Robustness in Diverse Indoor and Outdoor Environments

三维人物检测的比较研究:传感器模态与在多样室内和室外环境中的鲁棒性

Malaz Tamim, Andrea Matic-Flierl, Karsten Roscher

机构 * Fraunhofer Institute for Cognitive Systems IKS(弗劳恩霍夫认知系统研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文比较了三种三维人物检测方法,发现融合模型在复杂场景中表现最佳,但对传感器错位仍敏感。

Comments Accepted for VISAPP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00169 2026-02-09 cond-mat.mtrl-sci cs.AI 57%

Towards Agentic Intelligence for Materials Science

迈向材料科学的代理智能

Huan Zhang, Yizhan Li, Wenhao Huang, Ziyu Hou, Yu Song, Xuye Liu, Farshid Effaty, Jinya Jiang, Sifan Wu, Qianggang Ding, Izumi Takahara, Leonard R. MacGillivray, Teruyasu Mizoguchi, Tianshu Yu, Lizi Liao, Yuyu Luo, Yu Rong, Jia Li, Ying Diao, Heng Ji, Bang Liu

机构 * DIRO & Institut Courtois, Université de Montréal(蒙特利尔大学DIRO与Courtois研究所) Mila – Quebec AI Institute(魁北克AI研究所) University of Waterloo(滑铁卢大学) Université de Sherbrooke(Sherbrooke大学) University of California, San Diego(加州大学圣地亚哥分校) The University of Tokyo, Institute of Industrial Science(东京大学工业科学研究所) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Singapore Management University(新加坡管理学院) The Hong Kong University of Science and Technology, Guangzhou(香港科学与技术大学(广州)) Alibaba DAMO Academy(阿里巴巴达摩院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) CIFAR AI Chair(CIFAR人工智能主席)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI

AI总结 本文提出以流程为中心的代理系统框架,通过整合人工智能与材料科学,推动材料发现的自主化与智能化。

Comments 81 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08414 2026-02-09 cs.CV 57%

SPARK: Scalable Real-Time Point Cloud Aggregation with Multi-View Self-Calibration

SPARK:可扩展的实时点云聚合与多视角自校准

Chentian Sun

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 SPARK通过自校准实时多摄像机点云重建框架,实现稳定且高效的点云融合与外参估计,适用于大规模3D重建场景。

Comments 10 pages, 1 figure, submitted to IEEE Transactions on Image Processing (TIP). Version 3: Minor revision; several experimental results have been removed and supplemented after further verification

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15953 2026-02-09 cs.RO 57%

Right-Side-Out: Learning Zero-Shot Sim-to-Real Garment Reversal

右面朝外:学习零样本仿真到现实的服装翻转

Chang Yu, Siyu Ma, Wenxin Du, Zeshun Zong, Han Xue, Wendi Chen, Cewu Lu, Yin Yang, Xuchen Han, Joseph Masterjohn, Alejandro Castro, Chenfanfu Jiang

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 Right-Side-Out通过任务分解和高保真度仿真,实现零样本仿真到现实的服装翻转任务,无需人工标注即可在现实硬件上达到81.3%的成功率。

Comments More details and supplementary material are on the website: https://right-side-out.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05577 2026-02-06 cs.CV 57%

LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization

LocateEdit-Bench:基于指令的编辑本地化基准测试

Shiyu Wu, Shuyan Li, Jing Li, Jing Liu, Yequan Wang

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of EEECS, Queen's University Belfast, Northern Ireland, UK(女王大学 Belfast 电子工程与计算机科学学院) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peking University, Beijing, China(北京大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 LocateEdit-Bench是一个针对基于指令的编辑本地化问题设计的大规模数据集,整合了四种先进编辑模型,用于评估和推动伪造本地化方法的发展。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04880 2026-02-05 cs.RO 57%

Capturing Visual Environment Structure Correlates with Control Performance

捕捉视觉环境结构与控制性能相关

Jiahua Dong, Yunze Man, Pavel Tokmakov, Yu-Xiong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Toyota Research Institute(丰田研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 通过分析视觉编码器对环境状态解码能力,发现其与下游控制性能强相关,为高效选择通用机器人策略提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04799 2026-02-05 cs.SE cs.RO 57%

Beyond the Control Equations: An Artifact Study of Implementation Quality in Robot Control Software

超越控制方程:机器人控制软件实施质量的艺术品研究

Nils Chur, Thorsten Berger, Einar Broch Johnsen, Andrzej Wąsowski

机构 * Ruhr University Bochum(博尔次大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究探讨了机器人控制软件实施质量的问题,发现实际实现中存在离散化处理不规范、测试不充分等缺陷,需改进指南与验证技术以提升可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16793 2026-02-05 cs.RO 57%

PhysBrain: Human Egocentric Data as a Bridge from Vision Language Models to Physical Intelligence

PhysBrain: 人眼视角数据作为视觉语言模型到物理智能的桥梁

Xiaopeng Lin, Shijie Lian, Bin Yu, Ruoqi Yang, Zhaolong Shen, Changti Wu, Yuzhuo Miao, Yurun Jin, Yukun Shi, Jiyan He, Cong Huang, Bojun Cheng, Kai Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) Harbin Institute of Technology(哈尔滨工业大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 PhysBrain通过将人类眼动视频转化为多级具身监督,提升机器人在眼动感知和长期规划中的能力,实现从人类视角到机器人控制的有效迁移。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04214 2026-02-05 cs.RO 57%

ALORE: Autonomous Large-Object Rearrangement with a Legged Manipulator

ALORE:具有腿部机械臂的自主大物体重排

Zhihai Bi, Yushan Zhang, Kai Chen, Guoyang Zhao, Yulin Li, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统方向,香港科技大学(广州))

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 ALORE通过分层强化学习和任务规划框架,实现了腿部机械臂在复杂环境中的多物体自主重排,展示了高效稳定的操作性能和广泛的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04068 2026-02-05 cs.LG cs.DB 57%

An Empirical Survey and Benchmark of Learned Distance Indexes for Road Networks

道路网络中学习距离索引的实证调查与基准测试

Gautam Choudhary, Libin Zhou, Yeasir Rayhan, Walid G. Aref

机构 * Purdue University(普渡大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.LG

AI总结 本文首次实证评估了道路网络中基于机器学习的距离索引,从训练时间、查询延迟、存储和准确性四个维度进行基准测试,并发布开源代码支持后续研究。

Comments Preprint (Under Review). 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04056 2026-02-05 eess.SY cs.RO cs.SY 57%

Modular Safety Guardrails Are Necessary for Foundation-Model-Enabled Robots in the Real World

模块化安全护栏是现实世界中由基础模型赋能的机器人所必需的

Joonkyung Kim, Wenxi Chen, Davood Soleymanzadeh, Yi Ding, Xiangbo Gao, Zhengzhong Tu, Ruqi Zhang, Fan Fei, Sushant Veer, Yiwei Lyu, Minghui Zheng, Yan Gu

机构 * Purdue University(普渡大学) Amazon(亚马逊公司) NVIDIA(英伟达公司)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出模块化安全护栏以解决现实世界中由基础模型赋能的机器人在开放、长尾和随时间适应的环境中的安全挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04012 2026-02-05 cs.RO cs.MA 57%

FDA Flocking: Future Direction-Aware Flocking via Velocity Prediction

FDA 集群:面向未来的集群行为

Hossein B. Jond, Martin Saska

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出FDA集群方法,通过预测邻居未来速度增强反应性集群的协调性和鲁棒性,实验表明其在对齐速度和抗干扰能力上优于传统反应性模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03742 2026-02-04 cs.CV 57%

Edge-Optimized Vision-Language Models for Underground Infrastructure Assessment

边缘优化的视觉-语言模型用于地下基础设施评估

Johny J. Lopez, Md Meftahul Ferdaus, Mahdi Abdelguerfi

机构 * Canizaro Livingston Gulf States Center for Environmental Informatics(卡尼扎罗利文斯顿海湾州环境信息中心) University of New Orleans(新奥尔良大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出边缘优化的视觉-语言模型,用于高效生成地下基础设施缺陷的摘要,结合轻量级分割模型与微调VLM,实现资源受限设备上的实时检测与总结。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00060 2026-02-04 cs.RO 57%

Correspondence-Free, Function-Based Sim-to-Real Learning for Deformable Surface Control

无需对应的功能基仿真到现实学习用于变形表面控制

Yingjun Tian, Guoxin Fang, Renbo Su, Aoran Lyu, Neelotpal Dutta, Weiming Wang, Simeon Gill, Andrew Weightman, Charlie C. L. Wang

机构 * Department of Mechanical and Aerospace Engineering, The University of Manchester, United Kingdom(机械与航空航天工程系,曼彻斯特大学,英国) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong, Shatin, Hong Kong(机械与自动化工程系,香港中文大学(深圳),香港) Department of Materials, The University of Manchester, United Kingdom(材料系,曼彻斯特大学,英国)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种无需对应的功能基仿真到现实学习方法,用于控制可变形自由形式表面,通过神经网络参数化变形函数空间和置信度图,实现无需对应关系的仿真到现实转移。

Comments arXiv admin note: text overlap with arXiv:2405.08935

详情

展开后加载摘要…

URL PDF HTML 收藏