arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-02-27 至 2026-02-27 共收录 11
2602.23333 2026-02-27 cs.SD

SemanticVocoder: Bridging Audio Generation and Audio Understanding via Semantic Latents

SemanticVocoder: 通过语义潜在空间弥合音频生成与音频理解

Zeyu Xie, Chenxing Li, Qiao Jin, Xuenan Xu, Guanrou Yang, Wenfu Wang, Mengyue Wu, Dong Yu, Yuexian Zou

机构 * Peking University(北京大学) Tencent AI Lab(腾讯AI实验室) Shanghai AI Lab(上海AI实验室) SJTU(上海交通大学)

AI总结 SemanticVocoder通过引入语义潜在空间,实现了音频生成与理解的统一,提升了生成性能并推动了共享语义空间的研究。

Comments Demo: https://zeyuxie29.github.io/SemanticVocoder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23167 2026-02-27 cs.CR cs.LG

SettleFL: Trustless and Scalable Reward Settlement Protocol for Federated Learning on Permissionless Blockchains (Extended version)

SettleFL:去中心化和可扩展的联邦学习奖励结算协议(扩展版)

Shuang Liang, Yang Hua, Linshan Jiang, Peishen Yan, Tao Song, Bin Yao, Haibing Guan

机构 * Shanghai Jiao Tong University(上海交通大学) Queen's University Belfast(女王大学 Belfast分校) National University of Singapore(新加坡国立大学)

AI总结 SettleFL是一种去中心化且可扩展的奖励结算协议,通过优化链上成本和提供即时最终性,解决联邦学习中高频率训练与区块链成本的冲突问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23117 2026-02-27 cs.CV cs.AI

Devling into Adversarial Transferability on Image Classification: Review, Benchmark, and Evaluation

深入探讨图像分类中的对抗迁移性:综述、基准测试与评估

Xiaosen Wang, Zhijin Ge, Bohan Liu, Zheng Fang, Fengfan Zhou, Ruixuan Zhang, Shaokang Wang, Yuyang Luo

机构 * HUST(华中科技大学) Xidian University(西安电子科技大学) Wuhan University(武汉大学) HFUT(合肥工业大学) SJTU(上海交通大学)

AI总结 本文通过综述和基准测试,探讨图像分类中对抗迁移性的问题,提出评估框架并分析提升迁移性的策略及潜在问题。

Comments Code is available at https://github.com/Trustworthy-AI-Group/TransferAttack

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22868 2026-02-27 cs.CL

Rejection Mixing: Fast Semantic Propagation of Mask Tokens for Efficient DLLM Inference

拒绝混合:用于高效DLLM推理的快速语义传播掩码标记

Yushi Ye, Feng Hong, Huangjie Zheng, Xu Chen, Zhiyong Chen, Yanfeng Wang, Jiangchao Yao

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学联合中位网创新中心,上海交通大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 ReMix通过在离散扩散解码过程中引入连续混合状态,实现高效DLLM推理,提升速度同时保持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22716 2026-02-27 cs.CV cs.AI

SoPE: Spherical Coordinate-Based Positional Embedding for Enhancing Spatial Perception of 3D LVLMs

SoPE: 基于球坐标的位置嵌入:增强3D大视觉-语言模型的空间感知

Guanting Ye, Qiyan Zhao, Wenhao Yu, Liangyu Yuan, Mingkai Li, Xiaofeng Zhang, Jianmin Ji, Yanyong Zhang, Qing Jiang, Ka-Veng Yuen

机构 * University of Macau(澳门大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiaotong University(上海交通大学) Hefei University of Technology(合肥工业大学) National University of Singapore(新加坡国立大学)

AI总结 SoPE通过基于球坐标的位置嵌入提升3D LVLMs的空间感知能力,结合多尺度频率混合策略,增强几何表示的一致性和表达性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01749 2026-02-27 cs.AI cs.LG

Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives

通过马尔可夫链视角控制GFlowNets中的探索-利用

Lin Chen, Samuel Drapeau, Fanghao Shao, Xuekai Zhu, Bo Xue, Yunchong Song, Mathieu Laurière, Zhouhan Lin

机构 * LUMIA Lab, School of Artificial Intelligence, SJTU(LUMIA实验室,人工智能学院,上海交通大学) School of Mathematical Sciences, SJTU(数学科学学院,上海交通大学) Shanghai Advanced Institute of Finance, SJTU(上海先进金融研究院,上海交通大学) School of Computer Science, SJTU(计算机科学学院,上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Shanghai Center for Data Science, NYU Shanghai(上海数据科学中心,纽约大学上海学院) NYU-ECNU Institute of Mathematical Sciences, NYU Shanghai(纽约大学-华东师范大学数学科学研究院,纽约大学上海学院)

AI总结 通过引入可调参数$α$,$α$-GFNs改进了GFlowNets的探索-利用平衡,提升了模式发现能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00564 2026-02-27 cs.AI cs.CL

Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs

揭示推理过程:一种评估大语言模型结构性数学推理的过程感知基准

Xiang Zheng, Weiqi Zhai, Wei Wang, Boyu Yang, Wenbo Li, Ruixiang Luo, Haoxiang Sun, Yucheng Wang, Zhengze Li, Meng Wang, Yuetian Du, Guojie Lin, Yaxuan Wang, Xiaoxiao Xu, Yanhu Mo, Xuan Ren, Hu Wei, Bing Zhao

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出ReasoningMath-Plus基准,通过过程感知评估方法揭示大语言模型在结构性数学推理中的不足,引入HCRS评分函数和过程奖励模型,发现仅答案指标可能高估推理能力。

Comments 8 pages, and 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04228 2026-02-27 cs.CV cs.AI cs.LG cs.MM

LayerT2V: A Unified Multi-Layer Video Generation Framework

LayerT2V: 一个统一的多层视频生成框架

Guangzhao Li, Kangrui Cen, Baixuan Zhao, Yi Xin, Siqi Luo, Guangtao Zhai, Lei Zhang, Xiaohong Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院) Nanjing University(南京大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 LayerT2V通过统一的多层视频生成框架,实现了多层输出并提升了视频生成的语义一致性和时间一致性。

Comments Project Page is https://layert2v.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22538 2026-02-27 cs.LG cs.CL

RAIN-Merging: A Gradient-Free Method to Enhance Instruction Following in Large Reasoning Models with Preserved Thinking Format

RAIN-Merging: 一种无梯度方法,用于在保持推理格式的前提下提升大推理模型的指令遵循能力

Zhehao Huang, Yuhang Liu, Baijiong Lin, Yixin Lou, Zhengbao He, Hanling Tian, Tao Li, Xiaolin Huang

机构 * Institute of Image Processing and Pattern Recoginition, School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(图像处理与模式识别研究所,自动化与智能感知学院,上海交通大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MoE Key Laboratory of System Control and Information Processing (Shanghai)(系统控制与信息处理国家重点实验室(上海))

AI总结 RAIN-Merging通过无梯度方法提升大推理模型的指令遵循能力,同时保持推理格式和性能。

Comments 41 pages, ICLR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19565 2026-02-27 cs.CV cs.AI

DICArt: Advancing Category-level Articulated Object Pose Estimation in Discrete State-Spaces

DICArt: 在离散状态空间中推进类别级拟合物体姿态估计

Li Zhang, Mingyu Mei, Ailing Wang, Xianhui Meng, Yan Zhong, Xinyuan Song, Liu Liu, Rujing Wang, Zaixing He, Cewu Lu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) East China Normal University(华东师范大学) Peking University(北京大学) Emory University(埃默里大学) Hefei University of Technology(合肥工业大学) Jianghuai Advance Technology Center(江淮先进技术中心) Anhui Provincial Key Laboratory of Humanoid Robots(安徽省人形机器人重点实验室)

AI总结 DICArt通过离散扩散过程和层次化运动学耦合策略,提升复杂环境下类别级6D姿态估计的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15340 2026-02-27 cs.CV

Towards Seamless Interaction: Causal Turn-Level Modeling of Interactive 3D Conversational Head Dynamics

迈向无缝交互:交互式3D对话头部动力学的因果回合级建模

Junjie Chen, Fei Wang, Zhihao Huang, Qing Zhou, Kun Li, Dan Guo, Linfeng Zhang, Xun Yang

机构 * HFUT(合肥工业大学) IAI, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心) USTC(中国科学技术大学) SJTU(上海交通大学) TeleAI, China Telecom(TeleAI,中国电信) NWPU(西北工业大学) UAEU(阿联酋大学) AHPU(安徽大学)

AI总结 TIMAR通过因果回合级建模,实现了交互式3D对话头部动态的高效生成,提升了对话的表达性和时序一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏