arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Zhejiang University(浙江大学)

2026-02-25 至 2026-02-25 共收录 18
2602.21154 2026-02-25 cs.AI

CG-DMER: Hybrid Contrastive-Generative Framework for Disentangled Multimodal ECG Representation Learning

CG-DMER:一种用于解耦多模态ECG表示学习的对比-生成框架

Ziwei Niu, Hao Sun, Shujun Bian, Xihong Yang, Lanfen Lin, Yuxin Liu, Yueming Jin

机构 * Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系) Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) College of information science and engineering, Ritsumeikan university(立命馆大学信息科学与工程学院)

AI总结 CG-DMER通过对比-生成框架解耦多模态ECG表示,提升ECG信号在心血管疾病诊断中的建模能力。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20973 2026-02-25 cs.CL

Linear Reasoning vs. Proof by Cases: Obstacles for Large Language Models in FOL Problem Solving

线性推理与证明中的反证法:大型语言模型在一阶逻辑问题解决中的障碍

Yuliang Ji, Fuchen Shen, Jian Wu, Qiujie Xie, Yue Zhang

机构 * Nanjing University of Science and Technology(南京理工大学) Westlake University(西湖大学) Zhejiang University(浙江大学)

AI总结 本文提出PC-FOL数据集,通过对比线性推理与基于情况的推理,揭示大型语言模型在FOL问题解决中的核心挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20901 2026-02-25 cs.CV cs.LG

SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models

SpatiaLQA: 一个评估视觉-语言模型空间逻辑推理能力的基准

Yuechen Xie, Xiaoyan Zhang, Yicheng Shan, Hao Zhu, Rui Tang, Rong Wei, Mingli Song, Yuanyu Wan, Jie Song

机构 * Zhejiang University(浙江大学) The University of Sydney(悉尼大学) ManyCore State Key Laboratory of Blockchain and Security, Zhejiang University(浙江大学区块链与安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

AI总结 SpatiaLQA提出了一种评估视觉-语言模型空间逻辑推理能力的基准,通过递归场景图辅助推理方法提升模型在复杂场景中的推理能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19365 2026-02-25 cs.CV

Pareto-Guided Optimization for Uncertainty-Aware Medical Image Segmentation

基于帕累托优化的不确定性感知医学图像分割

Jinming Zhang, Youpeng Yang, Xi Yang, Haosen Shi, Yuyao Yan, Qiufeng Wang, Guangliang Cheng, Kaizhu Huang

机构 * Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学) Duke Kunshan University(杜克大学昆山分校)

AI总结 本文提出基于帕累托优化的医学图像分割方法,通过区域级课程策略和帕累托一致损失,解决边界区域的不确定性问题,提升分割精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01874 2026-02-25 cs.CV cs.AI

CogFlow: Bridging Perception and Reasoning through Knowledge Internalization for Visual Mathematical Problem Solving

CogFlow:通过知识内化连接感知与推理以解决视觉数学问题

Shuhang Chen, Yunqiu Xu, Junjie Xie, Aojun Lu, Tao Feng, Zeying Huang, Ning Zhang, Yi Sun, Yi Yang, Hangjie Yuan

机构 * Zhejiang University(浙江大学) Intelligent Learning(智能学习) Sichuan University(四川大学) Tsinghua University(清华大学)

AI总结 CogFlow通过知识内化连接感知与推理,提升视觉数学问题解决能力。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18632 2026-02-25 cs.CV

Decouple, Reorganize, and Fuse: A Multimodal Framework for Cancer Survival Prediction

解耦、重组与融合:一种多模态框架用于癌症生存预测

Huayi Wang, Haochao Ying, Yuyang Xu, Qibo Qiu, Cheng Zhang, Danny Z. Chen, Ying Sun, Jian Wu

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) State Key Laboratory of Transvascular Implantation Devices of the Second Affiliated Hospital, Zhejiang University School of Medicine(浙江大学医学院第二附属医院血管植入设备国家重点实验室) Transvascular Implantation Devices Research Institute(血管植入设备研究院) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室) China Mobile (Zhejiang) Research & Innovation Institute(中国移动(浙江)研究院)

AI总结 本文提出DeReF框架,通过解耦-重组-融合策略提升多模态癌症生存预测的准确性与泛化能力。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20715 2026-02-25 cs.RO

IG-RFT: An Interaction-Guided RL Framework for VLA Models in Long-Horizon Robotic Manipulation

IG-RFT: 一种基于交互引导的强化学习框架用于长时域机器人操作中的VLA模型

Zhian Su, Weijie Kong, Haonan Dong, Huixu Dong

机构 * Grasp Laboratory, Mechanical Engineering Department, Zhejiang University(浙江大学机械工程学院抓取实验室) Torch Kernel Co., Ltd.(火炬核科技有限公司)

AI总结 IG-RFT通过交互引导强化学习框架提升VLA模型在长时域机器人任务中的性能,实现85%的成功率,优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20653 2026-02-25 cs.CV

SD4R: Sparse-to-Dense Learning for 3D Object Detection with 4D Radar

SD4R:基于4D雷达的稀疏到密集学习用于3D物体检测

Xiaokai Bai, Jiahao Cheng, Songkai Wang, Yixuan Luo, Lianqing Zheng, Xiaohan Zhang, Si-Yuan Cao, Hui-Liang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Ningbo Global Innovation Center, Zhejiang University(浙江大学宁波全球创新中心) School of Automotive Studies, Tongji University(同济大学汽车学院)

AI总结 SD4R通过前景点生成器和对数几率查询编码器提升4D雷达点云的密集化能力,实现更鲁棒的3D物体检测性能。

Comments 7 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20648 2026-02-25 cs.CL

CARE: An Explainable Computational Framework for Assessing Client-Perceived Therapeutic Alliance Using Large Language Models

CARE:基于大语言模型的可解释计算框架,用于评估客户端感知的治疗联盟

Anqi Li, Chenxiao Wang, Yu Lu, Renjun Xu, Lizhi Ma, Zhenzhong Lan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Department of Psychology, Jing Hengyi School of Education, Hangzhou Normal University(心理系,金恒毅教育学院,杭州师范大学)

AI总结 CARE基于大语言模型,通过生成可解释的推理原因,提升对咨询中治疗联盟感知的评估准确性与实用性。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20632 2026-02-25 cs.CV

Boosting Instance Awareness via Cross-View Correlation with 4D Radar and Camera for 3D Object Detection

通过4D雷达和相机的跨视图相关性提升实例意识

Xiaokai Bai, Lianqing Zheng, Si-Yuan Cao, Xiaohan Zhang, Zhe Wu, Beinan Yu, Fang Wang, Jie Bai, Hui-Liang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Automotive Studies, Tongji University(同济大学汽车学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Jinhua Institute of Zhejiang University(浙江大学金华研究院) School of Information and Electrical Engineering, Hangzhou City University(杭州城市学院信息与电气工程学院) Hangzhou City University Binjiang Innovation Center(杭州城市学院滨江创新中心)

AI总结 SIFormer通过结合4D雷达和相机的跨视图相关性,提升3D目标检测中的实例意识,结合两种融合范式的优点,提高检测精度。

Comments 14 pages, 10 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20566 2026-02-25 cs.RO cs.CV

BFA++: Hierarchical Best-Feature-Aware Token Prune for Multi-View Vision Language Action Model

BFA++: 多视角视觉语言动作模型的分层最佳特征感知令牌剪枝

Haosheng Li, Weixin Mao, Zihan Lan, Hongwei Xiong, Hongan Wang, Chenyang Si, Ziwei Liu, Xiaoming Deng, Hua Chen

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) LimX Dynamic(LimX动态) Nanjing University(南京大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

AI总结 BFA++通过分层最佳特征感知令牌剪枝提升多视角视觉语言动作模型的效率和成功率

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20500 2026-02-25 cs.RO cs.CV

Strategy-Supervised Autonomous Laparoscopic Camera Control via Event-Driven Graph Mining

基于事件驱动图挖掘的策略监督自主腹腔镜摄像机控制

Keyu Zhou, Peisen Xu, Yahao Wu, Jiming Chen, Gaofeng Li, Shunlei Li

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhejiang University(浙江大学)

AI总结 本研究提出基于事件驱动图挖掘的策略监督自主腹腔镜摄像机控制方法,通过结合视觉-语言推理与闭环控制,提升手术视野稳定性与可解释性,实验表明其在减少视野偏移和图像抖动方面表现优异。

Comments Submitted to IEEE Transactions on Robotics (T-RO). 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20479 2026-02-25 cs.CV

Path-Decoupled Hyperbolic Flow Matching for Few-Shot Adaptation

路径解耦双曲流匹配用于少样本适应

Lin Li, Ziqi Jiang, Gefan Ye, Zhenqi He, Jiahui Li, Jun Xiao, Kwang-Ting Cheng, Long Chen

机构 * The Hong Kong University of Science(香港科学与技术大学) Zhejiang University(浙江大学)

AI总结 本文提出路径解耦双曲流匹配方法,通过双曲几何解决少样本适应中的路径缠绕问题,实现更高效的特征传输与对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20162 2026-02-25 cs.CL cs.AI

Talking to Yourself: Defying Forgetting in Large Language Models

与自己对话:在大型语言模型中克服遗忘

Yutao Sun, Mingshuai Chen, Tiancheng Zhao, Phillip Miao, Zilun Zhang, Haozhan Shen, Ruizhe Zhu, Jianwei Yin

机构 * Zhejiang University(浙江大学) Binjiang Institute of Zhejiang University(浙江大学滨江学院) Om AI Research(奥姆人工智能研究) Stanford University(斯坦福大学) ETH Zürich(苏黎世联邦理工学院)

AI总结 本文提出SA-SFT方法,通过让LLM生成自我对话来缓解微调过程中的灾难性遗忘,提升领域性能并优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12815 2026-02-25 cs.CL cs.AI cs.CY cs.MA

Multimodal Multi-Agent Empowered Legal Judgment Prediction

多模态多智能体赋能的法律判决预测

Zhaolu Kang, Junhao Gong, Qingxi Chen, Hao Zhang, Jiaxin Liu, Rong Fu, Zhiyuan Feng, Yuan Wang, Simon Fong, Kaiyue Zhou

机构 * Peking University(北京大学) Chengdu Minto Tech(成都Minto科技) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Macau(澳门大学) Tsinghua university(清华大学) Zhejiang University(浙江大学)

AI总结 本文提出JurisMMA框架,通过多模态多智能体技术提升法律判决预测的准确性,并构建了包含大量司法记录的JurisMM数据集,验证了其在法律领域应用的广泛有效性。

Comments Accepted to the IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16030 2026-02-25 cs.CV

CuriGS: Curriculum-Guided Gaussian Splatting for Sparse View Synthesis

CuriGS:基于课程指导的高斯点云法用于稀疏视角合成

Zijian Wu, Mingfeng Jiang, Zidian Lin, Ying Song, Hanjie Ma, Qun Wu, Dongping Zhang, Guiyang Pu

机构 * Zhejiang Sci-Tech University(浙江科技学院) China Jiliang University(中国嘉兴大学) Zhejiang University(浙江大学)

AI总结 CuriGS通过课程指导方法提升稀疏视角下3DGS的重建效果,实现更稳定的视角增强和更高的渲染保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19975 2026-02-25 cs.LG

From Samples to Scenarios: A New Paradigm for Probabilistic Forecasting

从样本到场景:概率预测的新范式

Xilin Dai, Zhijian Xu, Wanxu Cai, Qiang Xu

机构 * ZJU-UIUC Institute, Zhejiang University(浙江大学ZJU-UIUC研究院) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) School of Software, Tsinghua University(清华大学软件学院)

AI总结 本文提出概率场景范式,通过直接生成场景与概率对,改进概率预测模型,实现更高效和准确的预测效果。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03043 2026-02-25 cs.CL cs.AI cs.SD eess.AS

K-Function: Joint Pronunciation Transcription and Feedback for Evaluating Kids Language Function

K-Function:儿童语言功能的联合发音转录与评估反馈

Shuhe Li, Chenxu Guo, Jiachen Lian, Cheol Jun Cho, Wenshuo Zhao, Xiner Xu, Ruiyu Jin, Xiaoyu Shi, Xuanru Zhou, Dingkun Zhou, Sam Wang, Grace Wang, Jingze Yang, Jingyi Xu, Ruohan Bao, Xingrui Chen, Elise Brenner, Brandon In, Francesca Pei, Maria Luisa Gorno-Tempini, Gopala Anumanchipalli

机构 * Zhejiang University(浙江大学) UC Berkeley(加州大学伯克利分校) Duke University(达特茅斯大学) SCUT(上海交通大学) TVT UCSF(加州大学旧金山分校)

AI总结 K-Function通过结合子词转录与LLM评分,提升儿童语音识别精度,实现高效的语言功能评估。

Comments Accepted to 2026 ICASSP

详情

展开后加载摘要…

URL PDF HTML 收藏