arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2608.18034 2026-08-19 cs.CV 新提交

Deep Academic Survey: Stateful Agentic Closed-Loop Paradigm for Academic Survey Automation

深度学术调查:用于学术调查自动化的有状态智能体闭环范式

Zhikai Xu, Zhucun Xue, Teng Hu, Yabiao Wang, Yong Liu, Jiangning Zhang

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 该研究提出DAS框架,通过状态智能体闭环实现学术调查自动化,在DAS-Bench基准测试中,其在引用质量等四维度得分及专家评估中均优于现有系统。

Comments Project page: this https URL (https://zhikaixu24.github.io/projects/DAS/) | Code: this https URL (https://github.com/ZhikaiXu24/DAS) | Data: this https URL (https://huggingface.co/datasets/ZhikaiXu24/DAS-2M)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17988 2026-08-19 cs.CV 新提交

GS-Voxel: Fitting-Free Structured Latents for Large-Scale 3DGS Generation

GS-Voxel:用于大规模3DGS生成的免拟合结构化隐变量

Ming Qian, Zijian Wang, Minchao Sun, Jincheng Xiong, Hang Zhang, Mu Xu, Chi Wang, Baoquan Chen

机构 * Zhejiang University(浙江大学) Peking University(北京大学) Amap(高德地图) Alibaba(阿里巴巴)

AI总结 GS-Voxel是免拟合结构化隐变量框架,可将预优化3DGS重建转为稀疏活跃体素,通过GS专用VAE编码为稀疏3D隐变量,结合图像条件流模型实现大规模航空3DGS场景生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17528 2026-08-19 cs.AI cs.SE 新提交

Agent Lightning v1.0: Towards Harnessed Agentic RL

Agent Lightning v1.0:走向可控的智能体强化学习

Zhiyuan He, Siwei Zhang, Zhiwen Zhou, Yuqing Yang, Yu Kang, Yuge Zhang, Luna K. Qiu, Tin Yan Tsui, Jiahang Xu, Chong Luo

机构 * Microsoft(微软) Fudan University(复旦大学) Zhejiang University(浙江大学) University of Edinburgh(爱丁堡大学)

AI总结 研究针对可控智能体强化学习的挑战,推出轻量级框架 Agent Lightning v1.0,经评估可将 Qwen3.5-9B 在 SWE-bench Verified 上的性能提升14.6个百分点,发布完整流程脚本以推进相关可复现研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17447 2026-08-19 cs.CV 新提交

NGS-Marker: Robust Native Watermarking for 3D Gaussian Splatting

NGS-Marker:面向3D高斯溅射(3DGS)的鲁棒原生水印

Hao Qin, Yukai Sun, Luyuan Chen, Mengxu Lu, Feng Zhang, Ming Kong, Zhenhong Du, Qiang Zhu

机构 * Zhejiang University(浙江大学) Zhejiang Key Laboratory of Geographic Information Science(浙江省地理信息科学重点实验室)

AI总结 该研究针对现有3D高斯溅射水印技术无法抵御部分侵权的问题,提出NGS-Marker原生水印框架,通过联合训练的注入器与解码器及梯度渐进注入策略实现全场景覆盖,可抵御部分侵权并支持混合与多模态水印,具备实际部署灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17421 2026-08-19 cs.CV 新提交

TEAMS: Text-prompted spatiotEmporal dual-heAd Mamba Snake

TEAMS:文本提示的时空双路头Mamba Snake

Ruicheng Zhang, Jianhui Lei, Kaiwen Shen, Haowei Guo, Jun Zhou, Bin Chen, Mengtang Li, Shen Zhao, Shuo Li

机构 * School of intelligent systems engineering, Sun Yat-sen University(中山大学智能系统工程学院) Affiliated Hangzhou First People’s Hospital, Zhejiang University School of Medicine(浙江大学医学院附属杭州市第一人民医院) School of Engineering, Case Western Reserve University(凯斯西储大学工程学院)

AI总结 该研究提出视觉-语言Mamba框架TEAMS,通过三项创新改进深度蛇方法,在五个医学图像数据集上较现有方法取得显著性能提升,可作为多种医学图像分割场景的可靠工具。

Comments Medical Image Analysis (MedIA), 2026, In Press, Online Early Access Available

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17420 2026-08-19 cs.CV 新提交

SPVC: Structured and Panoptic Video Fixing for Cross-Dataset Driving Scene Rendering

SPVC:面向跨数据集驾驶场景渲染的结构化全景视频修复

Gen Li, Shu Han, Yun Xi Qiao, Hua Chen, Xuyang Dai, Bohan Li, Hao Zhao, Chaojian Li

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Zhejiang University(浙江大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Great Wall Motor Company Limited(长城汽车股份有限公司) Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出SPVC框架,通过结构化、全景、视频及跨数据集修复原则,训练两阶段可控视频扩散模型,解决驾驶场景渲染的伪影问题,实现跨数据集的高效修复。

Comments Project page: this https URL (https://li00147.github.io/SPVC-Project-Page/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16485 2026-08-19 cs.CV 版本更新

HiFi-BRep: High-Fidelity Latent Representation for Robust B-Rep Generation

HiFi-BRep:用于鲁棒边界表示(B-Rep)生成的高保真隐式表示

Junhao Hou, Chenqi Luo, Pufan Wang, Jiaying Lu, Yusheng Liu, Feiwei Qin, Meie Fang, Kun Zhou

机构 * Zhejiang University(浙江大学) Hangzhou Dianzi University(杭州电子科技大学) Guangzhou University(广州大学)

AI总结 HiFi-BRep是一种新型框架,通过拓扑感知编码器与单阶段解码器解决B-Rep生成的脆弱性问题,在结构有效性和几何保真度上优于现有最优方法,提供了鲁棒的B-Rep合成方案。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07725 2026-08-19 cs.CL cs.AI 版本更新

SOD: Step-wise On-policy Distillation for Small Language Model Agents

SOD:分步式在线蒸馏用于小型语言模型代理

Qiyong Zhong, Mao Zheng, Mingyang Song, Xin Lin, Jie Sun, Houcheng Jiang, Xiang Wang, Junfeng Fang

机构 * Zhejiang University(浙江大学) Large Language Model Department, Tencent(腾讯大语言模型部门) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 针对小型语言模型中工具集成推理的稳定性问题,提出SOD分步式在线蒸馏框架,通过动态调整蒸馏强度缓解教师信号误导,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19513 2026-08-19 cs.LG 版本更新

Row-Stochastic Matrices Can Provably Outperform Doubly Stochastic Matrices in Decentralized Learning

行随机矩阵在去中心化学习中可证明优于双随机矩阵

Bing Liu, Boao Kong, Limin Lu, Kun Yuan, Chengcheng Zhao

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Center for Data Science, Peking University(北京大学数据科学中心) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心)

AI总结 本文通过加权希尔伯特空间框架,严格证明了行随机矩阵相比双随机矩阵在去中心化学习中具有更快的收敛速度,并给出了拓扑条件指导设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16745 2026-08-18 cs.CV 新提交

VicEdit: Learning to Edit Videos from Visual In-Context Examples

VicEdit:从视觉上下文示例学习编辑视频

Yuji Wang, Teng Hu, Yuheng Chen, Ran Yi, Han Feng, Weijian Cao, Chengjie Wang, Lizhuang Ma, Jiangning Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室) Zhejiang University(浙江大学)

AI总结 针对文本指令视频编辑难以传达细粒度视觉信息的问题,提出视觉上下文编辑新范式,构建VicEdit-400K数据集,开发VicEdit框架,在VicEditBench上实现SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16717 2026-08-18 cs.CV 新提交

PersonaShot: Benchmarking Person-Centric Narrative Continuity in Multi-Shot Video Generation

PersonaShot:多镜头视频生成中以人为中心的叙事连续性基准

Yuji Wang, Yuheng Chen, Teng Hu, Ran Yi, Yijia Hong, Han Feng, Weijian Cao, Chengjie Wang, Lizhuang Ma, Jiangning Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室) Zhejiang University(浙江大学)

AI总结 该研究针对多镜头视频生成中角色叙事连续性评估的不足,推出PersonaShot基准,设计三类特定评估器,发现先进模型感知质量与跨镜头连续性存在差距,评估器与人类专家判断一致性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16647 2026-08-18 cs.CL 新提交

Every Coin Has Two Sides: On the Dual Nature of Generalization in On-Policy Distillation of Large Language Models

硬币皆有两面:关于大型语言模型的策略内蒸馏中泛化的双重性质

Zhaoyi Li, Deyang Kong, Yuan Wei, Evan Yang, Ranran Shen, Mahardika Krisna Ihsani, Ming Yang, Wei Zhang, Chuan Hao, Jian Yang, Ran Tao, Bryan Dai, Shikun Zhang, Wei Ye, Ying Wei, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) IQuest Research(IQuest研究院) MBZUAI(穆罕默德·本·扎耶德人工智能大学) Zhejiang University(浙江大学)

AI总结 本研究探究大型语言模型策略内蒸馏(OPD)的泛化特性,发现其迁移教师推理行为而非答案,同源配对泛化性强,异源配对适配性有限,多教师组合存在能力跷跷板效应,为诊断多教师OPD提供了视角。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16640 2026-08-18 cs.RO 新提交

DPNet: Efficient Dead-End Prediction and Avoidance for Vision-Based UAV Navigation

DPNet:面向基于视觉的无人机导航的高效死胡同预测与规避

Ruibin Zhang, Lun Pan, Zelong Xia, Jialiang Hou, Fei Gao

机构 * Huzhou Institute of Zhejiang University(浙江大学湖州研究院) University of Electronic Science and Technology of China(电子科技大学) Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院 cyber系统与控制研究所) Differential Robotics Technology Company(差分机器人技术公司)

AI总结 该研究针对基于视觉的无人机导航死胡同问题,提出轻量级神经网络DPNet,利用RGB-D输入预测死胡同并修剪轨迹库,实现50Hz高频重规划,跨场景无需标注微调,仿真与真实实验验证其优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16554 2026-08-18 cs.CL 新提交

Ask, Condition or Abstain: Reinforcement Learning for Missing-Premise Reasoning

询问、条件化或弃权:针对缺失前提推理的强化学习

Yongqi Tong, Zhenyu Zhang, Zimi Liu, Kewei Fu, Mingli Song, Haofei Zhang, Junshao Zhang, Hong Zhu, Jiang-Ming Yang, Xin Zhang, Jianshe Li

机构 * Ant International(蚂蚁国际) Zhejiang University(浙江大学) Dingtalk, Alibaba Group(阿里巴巴集团钉钉) Ant Group(蚂蚁集团)

AI总结 本研究提出ACA-RL框架,结合MPB基准,训练模型应对缺失前提的推理任务,可询问、条件化或弃权,提升欠定问题处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16513 2026-08-18 cs.CV cs.AI 新提交

MLLM-Guided Semantic Correction for Text-to-Video Generation

基于多模态大语言模型(MLLM)的文本到视频生成语义修正

Junhao Chen, Zheqi Lv, Keting Yin, Shengyu Zhang, Zhou Zhao, Feiyang Chen, Xinyu Duan, Baoxing Huai, Fei Wu

机构 * Zhejiang University(浙江大学) Huawei Cloud Computing Technology Co., Ltd.(华为云计算技术有限公司)

AI总结 该研究提出一种无需训练的MLLM引导文本到视频生成语义修正框架,通过两个关键模块在生成中修正语义偏差,提升了生成内容的语义对齐度等性能,经多基准实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16465 2026-08-18 cs.AI 新提交

JailbreakSkill: Scaling Automated Red-Teaming with Reusable and Ever-Evolving Skills

JailbreakSkill:通过可复用且不断演进的技能扩展自动化红队测试

Xiaoyu Wen, Jiajia Li, Zhida He, Peng Yu, Chenxu Wang, Han Qi, Ziyuan Zhou, Cheng Jin, Ying Wen, Xingcheng Xu, Shuyue Hu, Tianhang Zheng, Chaochao Lu, Qiaosheng Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 本研究提出以技能为核心的JailbreakSkill框架,将攻击策略打包为可复用技能,通过攻击与学习的闭环演进技能,大幅提升攻击成功率,且技能可泛化至未见过的提示词与目标模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16417 2026-08-18 cs.CL 新提交

D2-ScaleAgent: Dual-Dimensional Scaling for Long Document Understanding

D2-ScaleAgent:面向长文档理解的双维度缩放方法

Hao Zhang, Longrong Yang, Lunhao Duan, Ziyang Wang, Qing-Guo Chen, Shanshan Zhao

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) University of Science and Technology of China(中国科学技术大学)

AI总结 针对现有多模态RAG长文档理解方法缺乏动态计算缩放能力的问题,提出D2-ScaleAgent双维度缩放智能体框架,在相关基准上取得良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16111 2026-08-18 cs.LG cs.AI 新提交

RetroMPA: A Molecular Property-Aware Auxiliary Framework for Enhancing Retrosynthesis Prediction

RetroMPA:一种用于增强逆合成预测的分子属性感知辅助框架

Mianzhi Liu, Fan Xiao, Zhiliang Yu, Huayang Huang, Yuke Li, Yi Yang, Wenbo Liu, Yu Wu

机构 * School of Cyber Science and Engineering, Wuhan University(武汉大学网络安全学院) School of Computer Science, Wuhan University(武汉大学计算机学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) College of Chemistry and Molecular Sciences, Wuhan University(武汉大学化学与分子科学学院)

AI总结 RetroMPA是一种与模型无关的即插即用化学过滤器,通过注入化学知识增强逆合成预测,在USPTO-50K和USPTO-Full数据集上提升了多种模型的准确率,湿实验验证了其实际效用。

Comments Accepted for publication in Journal of Chemical Information and Modeling

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15924 2026-08-18 cs.RO 新提交

RAPAC-DP: Response-Aligned Pending-Action Compensation for Diffusion Policies under Delayed Execution

RAPAC-DP:延迟执行场景下扩散策略的响应对齐待执行动作补偿

Tao Wang, Wei Wang, Jianhui Wang, Qi Wang, Weidi Huang, Bing Xu

机构 * Zhejiang University(浙江大学) Midea Group(美的集团)

AI总结 本文针对云端部署模仿学习策略的延迟问题,提出RAPAC-DP框架,通过编码待执行动作补偿延迟,在Kinetix和RoboMimic任务中取得良好性能,验证了该方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15817 2026-08-18 cs.AI 新提交

RLCascadeRouter: Quality-Estimator-Free Cascade Routing via Reinforcement Learning

RLCascadeRouter:基于强化学习的无质量估计器级联路由

Shihong Huang, Shengjie Wang, Hong Ma, Zhou Xu

机构 * Polytechnic Institute, Zhejiang University(浙江大学理工学院) The Hong Kong Polytechnic University(香港理工大学)

AI总结 该研究针对LLM路由的灵活性问题,提出RLCascadeRouter框架,将级联路由建模为马尔可夫决策过程,无需质量估计器,在LLMRouterBench基准上实现了更优的性能-成本权衡,且可纳入未见模型无需重训。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15788 2026-08-18 cs.CV 新提交

ChainSpace: A Chained-Reasoning Paradigm for Spatial Intelligence

ChainSpace:面向空间智能的链式推理范式

Xiaohan Zhang, Feng Gu, Xudong Rao, Xuhao Pan, Tao Wei, Zhou Pan, Kun Zhan

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Li Auto Inc.(理想汽车有限公司)

AI总结 针对现有空间推理方法的缺陷,提出ChainSpace链式推理范式,构建对应基准与训练框架,相关模型在基准上表现最优且可迁移至多类外部基准,为空间智能评估与学习提供有效方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15580 2026-08-18 cs.AI cs.CV 新提交

From Generalist to Specialist: A Context-Fusion Framework for Endoscopic Polyp Reporting with a Frozen VLM

从通用到专用:基于冻结视觉语言模型(VLM)的内窥镜息肉报告上下文融合框架

Ruijie Yang, Yan Zhu, Peiyao Fu, Siyuan Li, Te Luo, Zhihua Wang, Quanlin Li, Pinghong Zhou, Xian Yang, Shuo Wang

机构 * Zhejiang University(浙江大学) Shanghai Institute for Advanced Study, Zhejiang University(浙江大学上海高等研究院) Shanghai Key Laboratory of MICCAI(上海市MICCAI重点实验室) Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医学研究中心) Endoscopy Center and Endoscopy Research Institute, Zhongshan Hospital, Fudan University(复旦大学附属中山医院内镜中心及内镜研究所) Shanghai Collaborative Innovation Center of Endoscopy(上海市内镜协同创新中心) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟曼彻斯特商学院)

AI总结 本研究针对内窥镜息肉报告需求,提出一种不修改预训练权重的上下文融合框架,通过隐式指令与显式转换上下文对冻结通用VLM专用化,在2056张标注图像实验中实现最优性能且参数量仅为冻结VLM的0.006%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14730 2026-08-18 cs.CV cs.CR cs.LG 新提交

IP Protection in the Era of Visual Generative AI: A Survey

视觉生成AI时代的知识产权保护:一项综述

Zhuan Shi, Shunchang Liu, Alireza Dehghanpour Farashah, Qian Yang, Han Yu, Cao Yang, Chaochao Chen, Yuping Yan, Yaochu Jin, Golnoosh Farnadi, Lingjuan Lyu

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) McGill University(麦吉尔大学) EPFL(洛桑联邦理工学院) Université de Montréal(蒙特利尔大学) Nanyang Technological University(南洋理工大学) Science Tokyo(东京理科大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Sony Research(索尼研究院)

AI总结 本综述针对视觉生成AI带来的知识产权风险,提出二维分类体系梳理相关防御方法,对齐评估协议并探讨挑战,为该领域研究者提供系统概述。

Comments 35 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12951 2026-08-18 cs.SD 版本更新

VoxAudio: Vocalized Audio Synthesis via Multi-Reward Autoregressive Flow Matching

VoxAudio:基于多奖励自回归流匹配的发声音频合成

Wenxiang Guo, Changhao Pan, Ziyue Jiang, Zhou Zhao, Fei Wu

机构 * Zhejiang University(浙江大学)

AI总结 VoxAudio是一种多奖励自回归流匹配模型,通过架构、偏好、数据层面的优化,解决现有T2A系统发声控制不足的问题,在多基准上验证了有效性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11801 2026-08-18 cs.LG 版本更新

JAPE: Joint Anomaly Prediction and Intrinsic Explanation in Multivariate Time Series

JAPE:多变量时间序列中的联合异常预测与内在解释

Yian Wei, Yuanyuan Yao, Lu Chen, Xiangmin Zhou, Tianyi Li

机构 * Zhejiang University(浙江大学) Aalborg University(奥尔堡大学) School of Computing Technologies, RMIT University(皇家墨尔本理工大学计算技术学院)

AI总结 JAPE是首个联合异常预测与解释的多变量时间序列框架,通过解耦时空建模等技术提升预测性能与可解释性,在五个真实基准上实现F1、AUC-PR及MRR的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11079 2026-08-18 cs.AI 版本更新

SkillZip: Evaluation-Free Skill Compression for Self-Evolving Agents by Discovering Reusable Structure

SkillZip:通过发现可重用结构实现自进化智能体的免评估技能压缩

Xiaofan Bai, Hongqiang Lin, Chao Liu, Yantao Zhang, Xuan Jin, Xipeng Cao, Yuhong Li

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Duke University(杜克大学)

AI总结 SkillZip 是一种免评估的自进化智能体技能压缩方法,通过提炼重复规则与动作序列实现高效压缩,在性能、泛化性及成本上优于评估引导压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10433 2026-08-18 cs.LG 版本更新

From Recoverability to Functional Use: Auditing Temporal Reports in Time-Series Forecasting

时间序列预测器是否使用了正确的历史信息:时间延迟的可恢复性、恢复及功能使用

Qipeng Qian, Yuntao Qian

机构 * Supcon Technology(中控技术) College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院)

AI总结 该研究针对时间序列模型,分析了延迟可恢复性、报告与功能使用的问题,发现多数模型存在延迟报告正确但实际未使用对应历史的情况,提出的路由方法可实现预测与报告的对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11439 2026-08-18 cs.LG cs.AI 版本更新

Retrofit: Continual Learning with Controlled Forgetting for Binary Security Detection and Analysis

Retrofit: 二进制安全检测与分析中的受控遗忘持续学习

Yiling He, Junchi Lei, Hongyu She, Shuo Shao, Xinran Zheng, Yiping Liu, Zhan Qin, Lorenzo Cavallaro

机构 * University College London(伦敦大学学院) Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

AI总结 Retrofit通过受控遗忘机制在持续学习中平衡知识保留与适应性,无需历史数据,在恶意软件检测和二进制摘要任务中提升了性能和泛化能力。

Comments Accepted by USENIX Security 2026. The artifact received all three badges

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02583 2026-08-18 cs.CV 版本更新

FusionBERT: Multi-View Image--3D Retrieval via Cross-Attention Visual Fusion and Normal-Aware 3D Encoder

FusionBERT: 多视角图像-3D检索 via 跨注意力视觉融合与正常感知3D编码器

Wei Li, Yufan Ren, Hanqing Jiang, Jianhui Ding, Zhen Peng, Leman Feng, Yichun Shentu, Guoqiang Xu, Baigui Sun

机构 * IROOTECH TECHNOLOGY Wolf 1069 b Lab, Sany Group(三一集团Wolf 1069 b实验室) Zhejiang University(浙江大学) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) BPIT, Sany Group(三一集团BPIT)

AI总结 FusionBERT通过跨注意力视觉融合和正常感知3D编码器,实现多视角图像-3D多模态检索,提升跨模态检索性能。

Comments 9 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23286 2026-08-18 cs.RO

Precise Time Delay Measurement and Compensation for Tightly Coupled Underwater SINS/piUSBL Navigation

紧密耦合水下SINS/piUSBL导航中的精确时间延迟测量与补偿

Jin Huang, Yingqiang Wang, Haoda Li, Zichen Liu, Zhikun Wang, Ying Chen

机构 * State Key Laboratory of Ocean Sensing, Ocean College of Zhejiang University(浙江大学海洋学院海洋传感国家重点实验室) School of Oceanography, Shanghai Jiao Tong University(上海交通大学海洋学院) Donghai Laboratory(东海实验室)

AI总结 本文提出一种紧密耦合导航框架,通过精确时间同步整合被动倒置超短基线(piUSBL)声学定位系统、捷联惯性导航系统(SINS)和深度计,有效解决水下多传感器系统中的时间同步问题,提升定位精度。

Comments Published in IEEE Transactions on Instrumentation and Measurement. This is the author's accepted manuscript

Journal ref IEEE Trans. Instrum. Meas., vol. 75, 2026, Art. no. 3676179

详情

展开后加载摘要…

URL PDF HTML 收藏