arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, San Diego(加州大学圣迭戈分校)

2026-08-25 至 2026-08-25 共收录 6
2608.22072 2026-08-25 cs.CV eess.SP 新提交

Spiking Neural Networks for Energy-Efficient Object Detection in Forward-Looking Sonar Imagery

用于前视声呐图像中节能目标检测的脉冲神经网络

Gwenevere Frank, Gert Cauwenberghs

机构 * University of California San Diego(加利福尼亚大学圣地亚哥分校)

AI总结 本研究针对前视声呐图像目标检测,提出全脉冲网络SpikeYOLO,在三类FLS数据集上对比基准模型,实现更低能耗、相当或更优精度及抗噪性,适配AUV节能需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22055 2026-08-25 cs.AI 新提交

GenCoord: Skill-Path Commitments under Private Information

Peng He, Junning Zhu, Haohan Yuan, Jianpeng Liang

机构 * Tsinghua University(清华大学) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) University of California San Diego(加利福尼亚大学圣迭戈分校)

Comments 25 pages, 10 figures, and 23 tables, including supplementary material. Peng He and Junning Zhu contributed equally. Paper source and compact evidence: this https URL (https://github.com/JulianZJN/GenCoord)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21678 2026-08-25 cs.SD cs.LG eess.AS 新提交

MusPyExpress: Extending MusPy with Enhanced Expression Text Support

MusPyExpress:为MusPy扩展增强的表情文本支持功能

Phillip Long, Hao-Wen Dong, Julian McAuley, Zachary Novack

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

AI总结 该研究提出MusPyExpress扩展MusPy库,支持提取表情文本,解析PDMX数据集展示相关数据丰富性,并开展三类利用该信息的生成任务以推动符号音乐建模。

Comments Accepted at NeurIPS 2025 Workshop on AI for Music: Where Creativity Meets Computation; 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21596 2026-08-25 cs.CV 版本更新

$ϕ$-Scene: Physically Grounded Image-to-3D Scene Reconstruction

$\phi$-Scene: 物理驱动的图像到3D场景重建

Haodong Li, Lulu Shao, Haolin Lu, Yu Fu, Yen-Ru Chen, Seemandhar Jain, Manmohan Chandraker

机构 * University of California San Diego(加州大学圣地亚哥分校)

AI总结 提出$\phi$-Scene方法,将单图像3D场景重建视为拓扑驱动的物理组装过程,通过SDF优化和刚体仿真解决穿透与不稳定接触问题,在3D-Front数据集上取得最优性能。

Comments Project page: this https URL (https://phi-scene.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17445 2026-08-25 cs.CV 版本更新

LangDriveCTRL: Natural Language Controllable Driving Scene Editing with Multi-modal Agents

LangDriveCTRL: 通过多模态代理实现自然语言可控的驾驶场景编辑

Yun He, Francesco Pittaluga, Ziyu Jiang, Matthias Zwicker, Manmohan Chandraker, Zaid Tasneem

机构 * University of Maryland, College Park(马里兰大学帕克分校) NEC Labs America(NEC美国实验室) UC San Diego(加州大学圣迭戈分校)

AI总结 LangDriveCTRL通过多模态代理实现驾驶视频的自然语言可控编辑,生成多样化的交通场景,提升真实感和交通场景的真实性。

Comments Accepted by ECCV 2026. Project Page: this https URL (https://yunhe24.github.io/langdrivectrl/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18845 2026-08-25 cs.RO eess.SY 版本更新

MADR: MPC-guided Adversarial DeepReach

MADR:MPC引导的对抗性深度可达性分析

Ryan Teoh, Sander Tonkens, William Sharpless, Aijia Yang, Zeyuan Feng, Somil Bansal, Sylvia Herbert

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of California, San Diego(加州大学圣地亚哥分校) Stanford University(斯坦福大学)

AI总结 本研究提出MADR框架,用于鲁棒近似两人零和微分博弈值函数,通过结合MPC引导与对抗性深度可达性分析,在高维机器人仿真及硬件测试中优于现有基线方法。

Comments 8 pages, IEEE International Conference on Robotics and Automation (ICRA), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏