arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

NIO(蔚来)

共收录 22
2608.21796 2026-08-25 cs.CV cs.AI 新提交

SAFE-G: Structure-aware Faithful Evidence-guided Generation for Knowledge-based Visual Question Answering

SAFE-G:面向基于知识的视觉问答的结构感知忠实证据引导生成

Long Shu, Shuochen Liu, Wei Chen, Junda Lin, Zhi Zheng, Huijun Hou, Tong Xu

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) NIO(蔚来)

AI总结 针对KB-VQA现有方法难以捕捉结构关联、推理不忠实的问题,提出SAFE-G框架,通过混合搜索、图检索与证据对齐RL策略,在两个基准上准确率优于现有方法8.9%、3.5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18105 2026-06-19 eess.AS cs.CL cs.SD 版本更新

NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR

NIM4-ASR:迈向高效、鲁棒且可定制的实时基于LLM的语音识别

Yuan Xie, Jiaqi Song, Guang Qiu, Xianliang Wang, Kai Qiao, Junfeng Yuan, Shengqing Liu, Yi Zhang, Bowen Chen, Ming Lei, Jie Gao, Jie Wu

机构 * Advanced Intelligent Systems Group, NIO(蔚来智能系统集团)

AI总结 提出NIM4-ASR框架,通过重新设计多阶段训练范式(包括预训练架构优化、迭代异步SFT和ASR专用强化学习)以及生产优化(噪声鲁棒性、流式推理和RAG热词定制),在2.3B参数下实现SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.07119 2026-06-04 eess.SY cs.LG cs.SY

"Parallel Training Considered Harmful?": Comparing series-parallel and parallel feedforward network training

并行训练是否有害?:比较系列-并行与并行前馈网络训练

Antônio H. Ribeiro, Luis A. Aguirre

机构 * Department of Electronic Engineering at Universidade Federal de Minas Gerais (UFMG) - Av. Ant\ o nio Carlos 6627, 31270-901, Belo Horizonte, MG, Brazil

AI总结 本文比较了系列-并行和并行前馈网络训练方法,探讨了其在鲁棒性、计算成本和收敛性方面的表现,发现并行训练在更现实的场景中表现更优。

Journal ref Neurocomputing 316:222--231, (2018)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03909 2026-06-03 cs.CV

SparseStreet: Sparse Gaussian Splatting for Real-Time Street Scene Simulation

SparseStreet: 用于实时街景模拟的稀疏高斯泼溅

Qingpo Wuwu, Xiaobao Wei, Peng Chen, Nan Huang, Zhongyu Zhao, Hao Wang, Ming Lu, Ningning Ma, Shanghang Zhang

机构 * Peking University(北京大学) Chinese Academy of Sciences(中国科学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Autonomous Driving Development, NIO(蔚来自动驾驶开发)

AI总结 针对街景重建中高斯原语冗余问题,提出节点可学习剪枝与背景压缩框架,实现高达80%压缩比且质量损失极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01818 2026-06-02 cs.CV

Unsupervised Collaborative Domain Adaptation for Driving Scene Parsing

无监督协作域自适应用于驾驶场景解析

Jiahe Fan, Shaolong Shu, Mingjian Sun, Tiehua Zhang, Bohong Xiao, Hanli Wang, Rui Fan

机构 * College of Electronic and Information Engineering, Tongji University(同济大学电子与信息学院) Department of Control Science and Engineering, Harbin Institute of Technology(控制科学与工程系,哈尔滨工业大学) Department of Vehicle Control System and Software Development, NIO(车辆控制系统与软件开发部,蔚来汽车) School of Computer Science and Technology, Tongji University(计算机科学与技术学院,同济大学) Key Laboratory of Embedded System and Service Computing (Ministry of Education), Tongji University(嵌入式系统与服务计算重点实验室(教育部),同济大学)

AI总结 提出无监督协作域自适应框架UCDA,通过多源模型协作优化和知识蒸馏,在无源数据条件下提升目标域驾驶场景解析的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29221 2026-05-29 cs.CV

An Approach for Thyroid Nodule Analysis Using Thermographic Images

使用热成像图像进行甲状腺结节分析的方法

J. R. González, É. O. Rodrigues, C. P. Damião, C. A. P. Fontes, A. C. Silva, A. C. Paiva, H. Li, C. Du, A. Conci

机构 * Computer Science Department, Universidade Federal Fluminense(联邦弗里蒙特大学计算机科学系) Radiology Department, Hospital Universitário Antônio Pedro (HUAP)(安东尼奥佩德罗大学医院放射科) Applied Computation Group NCA-UFMA, Universidade Federal do Maranhão(马兰舍大学应用计算组NCA-UFMA)

AI总结 本文综述了热成像在甲状腺分析中的应用,提出图像采集协议和自主配准方法,并通过特征提取、图像处理和分类方法区分健康与患病患者。

Journal ref Application of Infrared to Biomedical Sciences 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13588 2026-02-17 cs.CV cs.AI

Two-Stream Interactive Joint Learning of Scene Parsing and Geometric Vision Tasks

双流交互式场景解析与几何视觉任务联合学习

Guanfeng Tang, Hongbo Zhao, Ziwei Long, Jiayao Li, Bohong Xiao, Wei Ye, Hanli Wang, Rui Fan

机构 * College of Electronic and Information Engineering, Tongji University(同济大学电子信息学院) Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学智能自主系统研究所) College of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Department of Vehicle Control System and Software Development, NIO(蔚来汽车车辆控制系统与软件开发部门) Department of Automotive Engineering, Jilin University(吉林大学汽车工程学院) Key Laboratory of Embedded System and Service Computing (Ministry of Education), Tongji University(同济大学嵌入式系统与服务计算重点实验室) College of Electronic and Information Engineering, Shanghai Institute of Intelligent Science and Technology(上海智能科学与技术研究院电子信息学院) Shanghai Key Laboratory of Intelligent Autonomous Systems(上海智能自主系统重点实验室)

AI总结 TwInS通过双流交互式联合学习框架,实现场景解析与几何视觉任务的同步优化,采用跨任务适配器提升性能并减少对人工标注的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00810 2026-02-03 cs.CV cs.RO

VVLoc: Prior-free 3-DoF Vehicle Visual Localization

VVLoc: 无需先验信息的3自由度车辆视觉定位

Ze Huang, Zhongyang Xiao, Mingliang Song, Longan Yang, Hongyuan Yuan, Li Sun

机构 * Fudan University(复旦大学) NIO(蔚来汽车) Bosch XC(博世XC)

AI总结 VVLoc通过单一神经网络实现多摄像头下的车辆拓扑与度量定位,无需先验信息,提升定位精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21178 2025-06-27 cs.RO

UAIbot: Beginner-friendly web-based simulator for interactive robotics learning and research

Johnata Brayan, Armando Alves Neto, Pavel Petrovič, Gustavo M Freitas, Vinicius Mariano Gonçalves

机构 * Graduate Program in Electrical Engineering - Universidade Federal de Minas Gerais - Av. Antônio Carlos 6627, 31270-901, Belo Horizonte, MG, Brazil(巴西米纳斯吉拉斯联邦大学电气工程研究生项目) Comenius University, Bratislava, Slovakia(斯洛伐克布拉迪斯拉发康门纽斯大学)

Comments 12 pages, 8 figures, submitted to Springer proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15804 2025-05-20 cs.DC cs.AI

FairKV: Balancing Per-Head KV Cache for Fast Multi-GPU Inference

Bingzhe Zhao, Ke Cheng, Aomufei Yuan, Yuxuan Tian, Ruiguang Zhong, Chengchen Hu, Tong Yang, Lian Yu

机构 * Peking University(北京大学) University of Science and Technology of China(中国科学技术大学) NIO Inc(蔚来汽车)

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19314 2025-05-02 cs.CL

BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese

Peilin Zhou, Bruce Leon, Xiang Ying, Can Zhang, Yifan Shao, Qichen Ye, Dading Chong, Zhiling Jin, Chenxuan Xie, Meng Cao, Yuxin Gu, Sixin Hong, Jing Ren, Jian Chen, Chao Liu, Yining Hua

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Peking University(北京大学) Mindverse AI Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Zhejiang University of Technology(浙江工业大学) MBZUAI NIO(蔚来汽车) HSBC(汇丰银行) Harvard T.H. Chan School of Public Health(哈佛大学T.H. Chan公共卫生学院)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16464 2025-04-24 cs.RO cs.AI

ManipDreamer: Boosting Robotic Manipulation World Model with Action Tree and Visual Guidance

Ying Li, Xiaobao Wei, Xiaowei Chi, Yuming Li, Zhongyu Zhao, Hao Wang, Ningning Ma, Ming Lu, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing(多媒体信息处理国家重点实验室) School of Computer Science, Peking University(北京大学计算机学院) Hong Kong University of Science and Technology(香港科技大学) Autonomous Driving Development, NIO(蔚来自动驾驶研发)

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02361 2025-04-10 cs.LG

Pruner: A Draft-then-Verify Exploration Mechanism to Accelerate Tensor Program Tuning

Liang Qiao, Jun Shi, Xiaoyu Hao, Xi Fang, Sen Zhang, Minfan Zhao, Ziqi Zhu, Junshi Chen, Hong An, Xulong Tang, Bing Li, Honghui Yuan, Xinyang Wang

机构 * University of Science and Technology of China(中国科学技术大学) University of Pittsburgh(匹兹堡大学) NIO(蔚来)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01358 2025-04-03 cs.GR cs.CV

3D Gaussian Inverse Rendering with Approximated Global Illumination

Zirui Wu, Jianteng Chen, Laijian Li, Shaoteng Wu, Zhikai Zhu, Kang Xu, Martin R. Oswald, Jie Song

机构 * HKUST(GZ)(香港科技大学(广州)) NIO(蔚来) University of Amsterdam(阿姆斯特丹大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01709 2025-03-19 cs.CV cs.AI

MoVE-KD: Knowledge Distillation for VLMs with Mixture of Visual Encoders

Jiajun Cao, Yuan Zhang, Tao Huang, Ming Lu, Qizhe Zhang, Ruichuan An, Ningning MA, Shanghang Zhang

机构 * Peking University(北京大学) NIO(蔚来) Shanghai Jiao Tong University(上海交通大学)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00153 2025-03-12 cs.CV cs.LG

ROSE: Revolutionizing Open-Set Dense Segmentation with Patch-Wise Perceptual Large Multimodal Model

Kunyang Han, Yibo Hu, Mengxue Qu, Hailin Shi, Yao Zhao, Yunchao Wei

机构 * Beijing Jiaotong University(北京交通大学) NIO(蔚来)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07367 2025-03-11 cs.CV

LEGO-Motion: Learning-Enhanced Grids with Occupancy Instance Modeling for Class-Agnostic Motion Prediction

Kangan Qian, Jinyu Miao, Ziang Luo, Zheng Fu, and Jinchen Li, Yining Shi, Yunlong Wang, Kun Jiang, Mengmeng Yang, Diange Yang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与出行学院) AI2Robotics(AI2机器人公司) AD Division of NIO Inc.(蔚来汽车自动驾驶事业部)

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08373 2024-11-14 cs.RO

DG-SLAM: Robust Dynamic Gaussian Splatting SLAM with Hybrid Pose Optimization

Yueming Xu, Haochen Jiang, Zhongyang Xiao, Jianfeng Feng, Li Zhang

机构 * Fudan University(复旦大学) Autonomous Driving Division, NIO(蔚来汽车自动驾驶部门)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09289 2024-09-17 cs.SD cs.MM eess.AS

DSCLAP: Domain-Specific Contrastive Language-Audio Pre-Training

Shengqiang Liu, Da Liu, Anna Wang, Zhiyu Zhang, Jie Gao, Yali Li

机构 * NIO(蔚来)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09282 2024-09-17 cs.LG cs.MM

Turbo your multi-modal classification with contrastive learning

Zhiyu Zhang, Da Liu, Shengqiang Liu, Anna Wang, Jie Gao, Yali Li

机构 * NIO(蔚来)

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.13393 2024-09-06 cs.CV cs.RO eess.IV

TransKD: Transformer Knowledge Distillation for Efficient Semantic Segmentation

Ruiping Liu, Kailun Yang, Alina Roitberg, Jiaming Zhang, Kunyu Peng, Huayao Liu, Yaonan Wang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学) University of Stuttgart(斯图加特大学) ETH Zurich(苏黎世联邦理工学院) NIO(蔚来汽车)

Comments Accepted to IEEE Transactions on Intelligent Transportation Systems (T-ITS). The source code is publicly available at https://github.com/RuipingL/TransKD

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09949 2024-08-20 cs.CV cs.CL

C${^2}$RL: Content and Context Representation Learning for Gloss-free Sign Language Translation and Retrieval

Zhigang Chen, Benjia Zhou, Yiqing Huang, Jun Wan, Yibo Hu, Hailin Shi, Yanyan Liang, Zhen Lei, Du Zhang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所多模态人工智能系统国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院) Macau University of Science and Technology(澳门科技大学) NIO(蔚来汽车)

详情

展开后加载摘要…

URL PDF HTML 收藏