arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 6089 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 其他机器人 6089 篇

1805.00124 2018-10-29 cs.RO 65%

Force Generation by Parallel Combinations of Fiber-Reinforced Fluid-Driven Actuators

Daniel Bruder, Audrey Sedal, Ram Vasudevan, C. David Remy

专题命中 其他机器人 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO

Comments Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters ( Volume: 3 , Issue: 4 , Oct. 2018 )

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.02758 2018-08-29 cs.RO 65%

Autonomous Visual Rendering using Physical Motion

Ahalya Prabhakar, Anastasia Mavrommati, Jarvis Schultz, Todd Murphey

专题命中 其他机器人 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO

Comments 16 pages, to appear in Proceedings of the Workshop on the Algorithmic Foundations of Robotics (WAFR), 2016

Journal ref Proceedings of the Workshop on the Algorithmic Foundations of Robotics (WAFR), 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1611.04552 2017-11-13 cs.RO 65%

A Model-Predictive Motion Planner for the IARA Autonomous Car

Vinicius Cardoso, Josias Oliveira, Thomas Teixeira, Claudine Badue, Filipe Mutz, Thiago Oliveira-Santos, Lucas Veronese, Alberto F. De Souza

专题命中 其他机器人 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO

Comments This is a preprint. Accepted by 2017 IEEE International Conference on Robotics and Automation (ICRA)

Journal ref IEEE International Conference on Robotics and Automation (ICRA 2017), 2017, pp. 225-230

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18930 2026-08-24 cs.CV cs.AI 版本更新 62%

WeedNet: A Foundation Model-Based Global-to-Local AI Approach for Real-Time Weed Species Identification and Classification

WeedNet:一种基于基础模型的全局到局部AI方法,用于实时杂草种类识别与分类

Yanben Shen, Timilehin T. Ayanlade, Venkata Naresh Boddepalli, Mojdeh Saadati, Ashlyn Rairdin, Zi K. Deng, Muhammad Arbab Arshad, Aditya Balu, Daren Mueller, Asheesh K Singh, Wesley Everman, Nirav Merchant, Baskar Ganapathysubramanian, Meaghan Anderson, Soumik Sarkar, Arti Singh

机构 * Department of Agronomy, Iowa State University, Iowa, USA(农业学系,爱荷华州立大学) Department of Computer Science, Iowa State University, Iowa, USA(计算机科学系,爱荷华州立大学) Data Science Institute, University of Arizona, Arizona, USA(数据科学研究所,亚利桑那大学) Department of Mechanical Engineering, Iowa State University, Iowa, USA(机械工程系,爱荷华州立大学) Department of Plant Pathology, Entomology and Microbiology, Iowa State University, Iowa, USA(植物病理学、昆虫学和微生物学系,爱荷华州立大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 本研究提出基于基础模型的WeedNet全局到局部AI方法,通过自监督学习等技术实现1593种杂草91.02%的识别准确率,可适配区域杂草识别,具备集成至农业机器人及对话式AI咨询工具的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07104 2026-08-21 cs.CV cs.AI 版本更新 62%

Extended to Reality: Prompt Injection in 3D Environments

扩展到现实:3D环境中的提示注入

Zhuoheng Li, Ying Chen

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 研究提出PI3D攻击,通过在3D环境中放置带文本的物理物体来注入提示,挑战多模态大语言模型的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09520 2026-08-19 cs.CV cs.AI 版本更新 62%

Seeing is Free, Speaking is Not: Uncovering the True Energy Bottleneck in Edge VLM Inference

眼见无需耗能,言语却要代价:揭示边缘视觉语言模型推理中的真正能量瓶颈

Junfei Zhan, Haoxun Shen, Mingang Guo, Zixuan Huang, Tengjiao He

机构 * University of Pennsylvania(宾夕法尼亚大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Jinan University(暨南大学)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 研究边缘VLM推理的能量瓶颈,通过系统能量分析发现平均推理功率恒定,输出令牌耗时多是关键,图像复杂度因输出长度影响能量,揭示视觉令牌修剪局限,控制输出长度能大幅节能。

Comments Accepted to ACM MM 2026. This version includes the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09857 2026-08-11 cs.RO cs.AI 新提交 62%

Agentic Harnesses: LLM-Driven Verification Layers for Robot Autonomy

智能体 harness:面向机器人自主的大语言模型驱动验证层

Rohan Bhagra, Mahantesh Halapannavar, Uddhav Bhattarai

机构 * Carnegie Mellon University(卡内基梅隆大学) Pacific Northwest National Laboratory(太平洋西北国家实验室)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 针对机器人规划模型的安全与伦理风险,提出LLM驱动的验证层作为中间件管控计划,实现近85%的类别准确率、97%的对抗性攻击遏制率,为机器人自主提供可靠保障。

Comments 7 pages. Not yet finalized for conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07924 2026-08-11 cs.LG cs.AI cs.NA math.NA 新提交 62%

Second Order Drifting Models

二阶漂移模型

Drake Brown, Yuhao Huang, Shih-Hsin Wang, Bao Wang

机构 * University of Utah(犹他大学) Scientific Computing and Imaging (SCI) Institute(科学计算与成像研究所)

专题命中 其他机器人 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出二阶漂移模型,通过引入人工速度变量将漂移动力学拓展至相空间,结合 Nesterov 加速缓解一阶漂移的频谱刚性,在合成分布匹配等任务上实现了更优的收敛与性能。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06919 2026-08-10 cs.CV cs.RO 新提交 62%

Vernata: Self-Supervised Learning of LiDAR Point Representations

Vernata:激光雷达点表示的自监督学习

Oliver Lemke, Alexander Liniger, Abel Gawel, Marco Hutter

机构 * Robotics and AI Institute(机器人与人工智能研究院) ETH Zurich(苏黎世联邦理工学院)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出基于Sonata架构的Vernata自监督学习框架,通过三项扩展优化激光雷达点云表示,在多数据集上相比基线取得显著性能提升,模态减少场景下仍保持竞争力

Comments IROS 2026. Implementation: https://github.com/rai-opensource/vernata

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06650 2026-08-10 cs.RO cs.AI 新提交 62%

SoRoMoX: Fast, Differentiable, and Parallelizable Soft Robot Models

SoRoMoX:快速、可微分且可并行化的软体机器人模型

Maximilian Stölzle, Solange Gribonval, Daniel Feliu-Talegon, Vito Daniele Perfetta, Michele Martini, Chuhan Zhang, Kiwan Wong, Mohammed Tarnini, Anup Teejo Mathew, Federico Renda, Daniela Rus, Cosimo Della Santina

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出首个直接在GPU运行且端到端可微分的软体机器人建模框架SoRoMoX,其CPU顺序rollout提速18.1倍、GPU并行吞吐量提升234.6倍,可实现高精度系统辨识、控制优化及强化学习等先进工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04379 2026-08-06 cs.CV cs.AI 新提交 62%

Image Classification Using CNN-QNN Hybrid Model with Optimized Correlated Features

基于优化相关特征的CNN-QNN混合模型的图像分类

Minseo Seong, Youngwook Kim

机构 * Sogang University(西江大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出优化CNN特征相关性的CNN-QNN混合模型,在CIFAR-10等三项分类任务中,使特征平均相关性达0.5可提升分类准确率与稳定性,凸显QNN的性能潜力。

Comments Accepted by CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03109 2026-08-05 cs.CV cs.RO 新提交 62%

Multimodal Plant Root Phenotyping with Integration of 3D Skeleton Extraction and Language Analysis

结合三维骨架提取与语言分析的多模态植物根表型分析

Jiakai Lin, Zijun Li, Guoyu Lu

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出多模态机器人AI框架,结合W-LBC无监督三维骨架提取与证据优先语言建模,微调GPT实现12种植物根表型的可解释分析,建立了定量与语义结合的根表型统一分析范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19135 2026-08-03 cs.AI cs.HC cs.RO 版本更新 62%

Combining Large Language Models and Symbolic Reasoning for Multi-Robot Temporal Planning through Explainable Knowledge Bases

结合大语言模型与符号推理,通过可解释知识库实现多机器人时序规划

Enrico Saccon, Matteo Saveriano, Edoardo Lamon, Luigi Palopoli, Marco Roveri

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出PLANTOR框架,结合LLM与符号推理,通过可解释知识库实现多机器人时序规划,在基准场景及多臂装配场景验证,可减少手动建模但需人工修正,主张混合工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28451 2026-07-31 cs.RO cs.AI 新提交 62%

Machines that know they are aging: a framework for hardware-aware autonomous intelligence

感知自身老化的机器:面向硬件感知自主智能的框架

Cheng Siong Chin, Jianhua Zhang, Mohan Venkateshkumar

机构 * Newcastle University Singapore(新加坡纽卡斯尔大学) Qingdao University of Technology(青岛理工大学) Amrita Vishwa Vidyapeetham(阿姆里塔维什瓦维迪亚皮塔姆大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 针对自主系统硬件老化引发的任务失败问题,提出将硬件健康融入决策的 AAAI 框架,通过三大支柱实现系统自适应,提升弹性并延长寿命,适用于太空、医疗等关键环境。

Comments 1 figure, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06150 2026-07-30 cs.CV cs.LG 版本更新 62%

Enhanced Seam Segmentation for Automated Welding Robot in Construction Through Transfer Learning: Addressing Limitations of Bilateral Segmentation Network

通过迁移学习增强建筑自动化焊接机器人的焊缝分割:解决双边分割网络的局限性

Keonvin Park, Yong Ann Voeurn, Hyeokjun Kweon, Doyun Lee

机构 * Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔国立大学人工智能跨学科项目) Department of Civil Engineering and Construction, Georgia Southern University(佐治亚南方大学土木工程与建筑系) The Graduate School of Advanced Imaging Science, Multimedia & Film, Chung-Ang University(中央大学先进影像科学、多媒体与电影研究生院)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV、cs.LG

AI总结 研究针对建筑自动化焊接中焊缝分割难题,提出通过迁移学习和混合损失增强BiSeNetV2的框架,提升反射鲁棒性。实验表明其联合交并比等指标优异,能恢复多数失败案例,对轻量级实时分割架构有效,为机器人焊接提供实用感知方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16247 2026-07-21 cs.LG cs.CV 新提交 62%

Self-Evolving Just-In-Time Memory for Proactive Embodied Safety

用于主动具身安全的自进化即时记忆

Bingrui Sima, Lizhong Wang, Xiaoya Lu, Kun He, Xiao Yang

机构 * Huazhong University of Science and Technology(华中科技大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.CV、cs.LG

AI总结 研究视觉语言模型在闭环交互中应对动态危险的问题,提出自进化即时记忆框架,含RSG、事实记忆和经验记忆,并通过自动测试-验证-写入循环完善元技能,实验证明该框架大幅提升安全成功率且不阻碍任务进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11275 2026-07-21 cs.LG cs.AI 版本更新 62%

RoVE: Rotary Value Embeddings Attention for Relative Position-dependent Value Pathways

RoVE: 旋转值嵌入注意力实现相对位置相关的值路径

Alejandro García-Castellanos, Maurice Weiler, Erik J Bekkers

机构 * AMLab University of Amsterdam(阿姆斯特丹大学AMLab) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 提出RoVE方法,通过同时旋转键和值使值对位置敏感,将RoPE注意力转化为注意力卷积,在少样本学习、分布外困惑度和长上下文检索上优于RoPE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15524 2026-07-20 cs.LG cs.AI 新提交 62%

Recursive Harness Self-Improvement

递归工具自我改进

Hyunin Lee, Jinglue Xu, Jeffrey Seely, Donghyun Lee, Matei Zaharia, Yujin Tang

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 研究在模型-工具协同进化中,通过递归工具自我改进(RHI)优化用户构建工具,以提高执行轨迹质量和智能体性能。RHI将工具表示为提示级规范,经成对反馈迭代改进,在多任务中提升了低推理能力智能体性能,降低推理成本。

Comments This work addresses the first half of the model-harness coevolution loop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00182 2026-07-20 cs.RO cs.AI 版本更新 62%

A Systematic Study of Large Language Models for Task and Motion Planning With PDDLStream

基于PDDLStream的任务与运动规划大语言模型的系统研究

Jorge Mendez-Mendez

机构 * Stony Brook University(石溪大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 研究大语言模型在机器人任务与运动规划中的应用,开发16种用LLMs替代关键TAMP组件的算法,通过实验发现基于LLM的规划器成功率低、规划时间长,提供几何细节会增加任务规划错误,多数情况下直接LLM变体表现更好。

Comments 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS). 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13061 2026-07-17 cs.LG cs.AI stat.ML 版本更新 62%

Native Extrapolation Awareness in Flow-Based Conditional Generation

发散流:在条件生成中检测外推

Constantinos Tsakonas, Serena Ivaldi, Jean-Baptiste Mouret

机构 * Inria(法国国家信息与自动化技术研究院) Université de Lorraine(洛林大学) CNRS(法国国家科学研究中心) Loria(洛林信息与自动化技术研究院)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 发散流通过结构强制实现对非流形输入的低效传输,实现条件生成与外推检测的统一,提升流模型在安全关键领域的可靠性。

Comments 30 pages, 10 figures, 2 algorithms, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08098 2026-07-10 cs.CV cs.RO 新提交 62%

EVIS: A Physics-Grounded Event Camera Plugin for NVIDIA Isaac Sim

EVIS:用于NVIDIA Isaac Sim的基于物理的事件相机插件

Linli Shi, Ruijun Zhang, Ziyun Wang

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 研究针对事件相机数据收集难题,提出基于物理的EVIS插件用于NVIDIA Isaac Sim,能在模拟器内生成带标签事件流,通过特定模型和可配置设置实现实时单GPU生成,其流可供预训练网络用于下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04203 2026-07-10 cs.LG cs.CV 版本更新 62%

Computation, Condensation, and the Incompleteness Between Them: A Coupled Foundation of Intelligence

计算、凝聚及其之间的不完备性:智能的耦合基础

Xin Li

机构 * Department of Computer Science, University at Albany, SUNY(计算机科学系,阿尔巴尼大学,SUNY)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.CV、cs.LG

AI总结 该研究探讨计算理论与智能所回答问题的差异,指出智能需计算与记忆两个算子耦合,证明单独算子不完备,确定耦合代价是关键操作不可判定且有误差下限,认为耦合是普遍法则并给出其可证伪核心与范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00514 2026-07-02 cs.CV cs.AI 新提交 62%

Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning

Cross4D-JEPA: 用于4D点云表示学习的密集跨模态对应蒸馏

Trung Thanh Nguyen, Hai Nguyen-Truong, Tu Vo, Hoang M. Truong, Tuan-Anh Vu

机构 * Nagoya University(名古屋大学) Northeastern University(东北大学) KC Machine Learning Lab(KC机器学习实验室) University of Science, Vietnam National University Ho Chi Minh City(胡志明市越南国立大学理科大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 提出Cross4D-JEPA,通过教师-学生框架将冻结的2D基础模型(如DINOv2或V-JEPA 2)的密集补丁特征蒸馏到4D点编码器,实现每点对应和潜在空间匹配,在四个基准上优于模态内和全局跨模态基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28649 2026-06-30 cs.CR cs.AI cs.RO 62%

RIPA: Sensory-Vector Prompt Injection Attacks on LLM-Controlled ROS 2 Robots

RIPA: 针对LLM控制的ROS 2机器人的感官向量提示注入攻击

Nima Dorzhiev

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出RIPA,首个通过感官管道对ROS 2机器人进行多通道提示注入攻击的系统研究,发现模型脆弱性不随规模单调变化,并提出混合语义防火墙。

Comments 12 pages, 4 figures, 10 tables, 3 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07069 2026-06-30 cs.GR cs.AR cs.CV cs.LG 62%

Efficient 3D Gaussian Splatting with Axis-Shared Rasterization and Order-independent Transmittance

高效3D高斯散射与轴共享光栅化及顺序无关透射率

Zhican Wang, Guanghui He, Lingjun Gao, Dantong Liu, Shell Xu Hu, Chen Zhang, Zhuoran Song, Nicholas Lane, Hongxiang Fan

机构 * Shanghai Jiao Tong University(上海交通大学) University of Cambridge(剑桥大学) Imperial College London(伦敦帝国学院) Samsung AI(三星人工智能)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV、cs.LG

AI总结 本文提出轴共享光栅化和顺序无关透射率方法,提升3D高斯散射在资源受限平台的实时性能,实现1.33至1.88倍的加速。

Comments ISCA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25646 2026-06-25 cs.RO cs.CV 新提交 62%

Calousel: Extrinsic Calibration of Non-overlapping Multi-camera Systems from Pure Rotation

Calousel: 基于纯旋转的非重叠多相机系统外参标定

Gwanhyeong Song, Chaehyeon Song, Ayoung Kim

机构 * Seoul National University(首尔国立大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 提出一种利用纯旋转运动和非重叠视场多相机系统外参标定方法,仅需单个静态标定板,通过全局优化框架中的潜转台帧和SE(3)三维误差实现高精度标定。

Comments Accepted to IROS 2026. 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23256 2026-06-23 cs.CV cs.AI 新提交 62%

P-JEPA: Procedural Video Representation Learning via Joint Embedding Predictive Architecture

P-JEPA: 通过联合嵌入预测架构进行程序性视频表示学习

Felix Tristram, Stefano Gasperini, Benjamin Killeen, Marcel Walch, Christian Benz, Nassir Navab, Ghazal Ghazaei

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Carl Zeiss AG(卡尔蔡司股份公司)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 提出P-JEPA,一种与骨干网络无关的方法,通过将长视频映射到密集帧对齐动作空间并预测池化掩码潜在向量,实现对超过30分钟程序性视频的长时理解,在EgoExo4D等数据集上达到细粒度动作分类SOTA,参数比基于LLM的方法少一个数量级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21093 2026-06-23 cs.RO cs.CV 新提交 62%

How Should a Robot Configure Its Laser Scanner for Inspection?

机器人应如何配置其激光扫描仪以进行检测?

Zhiling Chen, David Gorsich, Matthew P. Castanier, Yang Zhang, Jiong Tang, Farhad Imani

机构 * University of Connecticut(康涅狄格大学) US Army DEVCOM Ground Vehicle Systems Center (GVSC)(美国陆军DEVCOM地面车辆系统中心(GVSC))

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出SenseHD系统,将扫描仪配置建模为指令条件感知决策,通过超维联想记忆选择稳定感知参数,提升检测可靠性。

Comments 8 pages, 9 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21018 2026-06-23 cs.SD cs.AI cs.LG 新提交 62%

LK Jam: System Architecture and Implementation of a Real-Time Human-AI Interactive Music Generation System using Role-Aware GRU

LK Jam:使用角色感知GRU的实时人机交互音乐生成系统的系统架构与实现

Yakun Liu, Zhiyu Jin, Dong Liu, Hai Luan

机构 * Shenyang Conservatory of Music(沈阳音乐学院)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.AI、cs.LG

AI总结 提出LK_Jam系统,基于轻量级GRU和高性能音频主机架构,通过多维稀疏事件流和角色感知编码实现低延迟双向人机交互音乐生成,采用三阶段渐进训练策略提升交互质量。

Comments 7 pages, 10 figures, 3 tables. This is an original technical report on real-time human-AI interactive symbolic music generation VST3 plugin based on GRU and JUCE. The source code is open-source on GitHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19947 2026-06-15 cs.CV cs.AI 版本更新 62%

Vanishing Depth: Training Generalized Depth Adapters with Sinusoidal Depth Preprocessing for Pretrained RGB Encoders

消失深度:基于正弦深度预处理的预训练RGB编码器通用深度适配器训练

Paul Koch, Jörg Krüger

机构 * Fraunhofer IPK(弗劳恩霍夫研究所) TU-Berlin(技术大学柏林)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 提出自监督训练方法,为预训练RGB编码器添加深度适配器,结合正弦深度编码实现通用鲁棒的深度特征提取,在分割、姿态估计和深度补全等下游任务中提升基线性能,SUN-RGBD分割达56.05 mIoU。

Comments Accepted to IntelliSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏