arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2025-12-12 至 2025-12-12 共收录 8
2512.10863 2025-12-12 cs.CV cs.AI

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10624 2025-12-12 cs.CL

AgriGPT-Omni: A Unified Speech-Vision-Text Framework for Multilingual Agricultural Intelligence

AgriGPT-Omni: 一种统一的语音-视觉-文本框架用于多语言农业智能

Bo Yang, Lanfei Feng, Yunkui Chen, Yu Zhang, Jianyu Zhang, Xiao Xu, Nueraili Aierken, Shijian Li

机构 * Zhejiang University(浙江大学)

AI总结 AgriGPT-Omni提出了一种统一的语音-视觉-文本框架,通过数据合成、多阶段训练和三模态基准,提升多语言农业智能的性能和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10540 2025-12-12 cs.RO

Mr. Virgil: Learning Multi-robot Visual-range Relative Localization

Mr. Virgil:学习多机器人视觉范围相对定位

Si Wang, Zhehan Li, Jiadong Lu, Rong Xiong, Yanjun Cao, Yue Wang

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制系统研究所) Huzhou Institute of Zhejiang University(浙江大学湖州研究院)

AI总结 Mr. Virgil通过图神经网络和可微分PGO后端实现多机器人视觉范围相对定位,提升定位精度与鲁棒性。

Comments Accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10531 2025-12-12 cs.RO

Neural Ranging Inertial Odometry

神经测距惯性里程计

Si Wang, Bingqi Shen, Fei Wang, Yanjun Cao, Rong Xiong, Yue Wang

机构 * Institute of Cyber-Systems and Control, Zhejiang University, China(浙江大学控制系统研究所) Beijing Institute of Electronic System Engineering(北京电子系统工程研究所) Huzhou Institute of Zhejiang University, Huzhou, China(浙江大学湖州研究院)

AI总结 本文提出一种基于神经融合的测距惯性里程计框架,通过图注意力网络和递归神经网络提升定位精度和鲁棒性,适用于复杂环境。

Comments Accepted by 2025 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10450 2025-12-12 cs.CV

Error-Propagation-Free Learned Video Compression With Dual-Domain Progressive Temporal Alignment

无误差传播的学得视频压缩与双域渐进时间对齐

Han Li, Shaohui Li, Wenrui Dai, Chenglin Li, Xinlong Pan, Haipeng Wang, Junni Zou, Hongkai Xiong

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系) Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Naval Aviation University(海军航空大学)

AI总结 本文提出一种无误差传播的学得视频压缩框架,通过双域渐进时间对齐和质量条件化的专家混合实现高质量的视频压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10375 2025-12-12 cs.SD cs.AI

Neural personal sound zones with flexible bright zone control

具有灵活明亮区控制的神经个人声音区

Wenye Zhu, Jun Tang, Xiaofei Li

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Westlake Institute for Advanced Study(西湖研究学院)

AI总结 本文提出了一种基于3D卷积神经网络的神经个人声音区再现方法,能够灵活控制声音区域并处理不同重建目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08169 2025-12-12 cs.LG

Bidirectional Representations Augmented Autoregressive Biological Sequence Generation

双向表示增强的自回归生物序列生成

Xiang Zhang, Jiaqi Wei, Zijie Qiu, Sheng Xu, Zhi Jin, ZhiQiang Gao, Nanqing Dong, Siqi Sun

机构 * Fudan University(复旦大学) University of British Columbia(不列颠哥伦比亚大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Zhejiang University(浙江大学)

AI总结 本文提出混合框架,通过结合非自回归机制与自回归生成,提升生物序列生成的双向依赖建模能力。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10177 2025-12-12 cs.LG cond-mat.stat-mech cs.CV stat.ML

Geometric Regularity in Deterministic Sampling Dynamics of Diffusion-based Generative Models

扩散生成模型确定性采样动态中的几何正则性

Defang Chen, Zhenyu Zhou, Can Wang, Siwei Lyu

机构 * University at Buffalo, State University of New York(纽约州立大学布法罗分校) Zhejiang University(浙江大学)

AI总结 本文揭示了扩散生成模型采样轨迹的几何正则性,提出动态规划方案提升图像生成性能。

Comments 57 pages. Accepted by Journal of Statistical Mechanics: Theory and Experiment (2025). The short version was published in ICML 2024. arXiv admin note: text overlap with arXiv:2405.11326

Journal ref J. Stat. Mech. (2025) 124002

详情

展开后加载摘要…

URL PDF HTML 收藏