arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-03-30 至 2026-03-30 共收录 7
2603.26192 2026-03-30 cs.CV

HAD: Heterogeneity-Aware Distillation for Lifelong Heterogeneous Learning

HAD:面向终身异质学习的异质性感知知识蒸馏

Xuerui Zhang, Xuehao Wang, Zhan Zhuang, Linglan Zhao, Ziyue Li, Xinmin Zhang, Zhihuan Song, Yu Zhang

机构 * Southern University of Science and Technology(南方科技大学) Zhejiang University(浙江大学) Technical University of Munich(慕尼黑工业大学) City University of Hong Kong(香港城市大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出HAD方法,用于解决终身异质学习中异质知识保留问题,通过两种互补损失函数提升预测分布平衡性和信息边缘像素学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26164 2026-03-30 cs.LG cs.CL

DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models

DataFlex: 一种统一的以数据为中心的大型语言模型动态训练框架

Hao Liang, Zhengyang Zhao, Meiyi Qiang, Mingrui Chen, Lu Ma, Rongyi Yu, Hengyi Feng, Shixuan Sun, Zimo Meng, Xiaochen Ma, Xuanlin Yang, Qifeng Cai, Ruichuan An, Bohan Zeng, Zhen Hao Wong, Chengyu Shen, Runming He, Zhaoyang Han, Yaowei Zheng, Fangcheng Fu, Conghui He, Bin Cui, Zhiyu Li, Weinan E, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) OriginHub Technology LLaMA-Factory Team(LLaMA-Factory团队) Zhongguancun Academy(中关村学院) OpenDataLab, Shanghai Artificial Intelligence Laboratory(上海人工智能实验室OpenDataLab) Shanghai Jiao Tong University(上海交通大学)

AI总结 DataFlex 提供了一种统一的以数据为中心的动态训练框架,支持样本选择、领域混合调整和样本再加权,提升了大型语言模型的训练效率和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25377 2026-03-30 cs.SD

Joint Learning Global-Local Speaker Classification to Enhance End-to-End Speaker Diarization and Recognition

联合学习全局-局部说话人分类以增强端到端说话人辨识与识别

Yuhang Dai, Haopeng Lin, Jiale Qian, Ruiqi Yan, Hao Meng, Hanke Xie, Hanlin Wen, Shunshun Yin, Ming Tao, Xie Chen, Lei Xie, Xinsheng Wang

机构 * Soul AI Lab, China(中国Soul AI实验室) X-LANCE Lab, Shanghai Jiao Tong University, China(中国上海交通大学X-LANCE实验室)

AI总结 本文提出GLSC-SDR方法,通过联合训练说话人分类与辨识识别,提升细粒度说话人区分能力,实验表明其在多个数据集上表现优异,无需依赖大规模真实对话数据。

Comments 5 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11647 2026-03-30 cs.CV

IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment

IVEBench:现代指令引导视频编辑评估基准套件

Yinan Chen, Jiangning Zhang, Teng Hu, Yuxiang Zeng, Zhucun Xue, Qingdong He, Chengjie Wang, Yong Liu, Xiaobin Hu, Shuicheng Yan

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学) University of Auckland(奥克兰大学) National University of Singapore(新加坡国立大学)

AI总结 IVEBench通过引入多样化的视频数据库和多维评估协议,解决现有视频编辑基准在评估指令引导视频编辑方面的不足,提供全面的人类对齐评估结果。

Comments Accepted by ICLR 2026. Equal contributions from first two authors. Project page: https://ryanchenyn.github.io/projects/IVEBench Code: https://github.com/RyanChenYN/IVEBench Dataset: https://huggingface.co/datasets/Coraxor/IVEBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19733 2026-03-30 cs.AI

ReMe: Scaffolding Personalized Cognitive Training via Controllable LLM-Mediated Conversations

ReMe:通过可控的LLM中介对话实现个性化认知训练

Zilong Wang, Nan Chen, Luna K. Qiu, Ling Yue, Geli Guo, Yang Ou, Shiqi Jiang, Yuqing Yang, Lili Qiu

机构 * Microsoft Research(微软研究院) Department of Geriatric Psychiatry, Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属上海市精神卫生中心老年精神科)

AI总结 ReMe通过可控的LLM对话实现个性化认知训练,解决传统认知训练内容僵化和对话可控性不足的问题,支持基于用户生活的记忆练习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12944 2026-03-30 cs.CV

AMFD: Distillation via Adaptive Multimodal Fusion for Multispectral Pedestrian Detection

AMFD:基于自适应多模态融合的多光谱行人检测知识蒸馏

Zizhao Chen, Yeqiang Qian, Xiaoxiao Yang, Chunxiang Wang, Ming Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Key Laboratory of System Control and Information Processing, Ministry of Education of China(系统控制与信息处理教育部重点实验室)

AI总结 本文提出AMFD框架,通过自适应多模态融合模块有效利用教师网络的原始模态特征,提升学生网络性能,实验表明其在减少漏检率和提升平均精度方面优于现有方法。

Comments Accepted by IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25791 2026-03-30 cs.CV

ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions

ArtHOI:通过基础模型驯化实现单目4D手-物体交互重建

Zikai Wang, Zhilu Zhang, Yiqing Wang, Hui Li, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出ArtHOI框架,通过整合多基础模型先验知识,解决单目视频中手-物体交互的4D重建问题,引入自适应采样细化和多模态大语言模型引导对齐方法,构建两个新数据集并验证方法有效性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏