arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-04-20 至 2026-04-20 共收录 10
2604.15862 2026-04-20 cs.CV

Splats in Splats++: Robust and Generalizable 3D Gaussian Splatting Steganography

Splats in Splats++: 一种鲁棒且通用的3D高斯点云隐写框架

Yijia Guo, Wenkai Huang, Tong Hu, Gaolei Li, Yang Li, Yuxin Hong, Liwen Hu, Xitong Ling, Jianhua Li, Shengbo Chen, Tiejun Huang, Lei Ma

机构 * State Key Laboratory of Multimedia Information Processing and National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(多媒体信息处理国家重点实验室和视觉技术国家工程研究中心、计算机科学学院,北京大学) Shanghai Key Laboratory of Integrated Administration Technologies for Information Security, School of Computer Science, Shanghai Jiao Tong University(信息安全集成管理技术上海市重点实验室、计算机科学学院,上海交通大学) National Biomedical Imaging Center, College of Future Technology, Peking University(生物医学成像国家中心、未来技术学院,北京大学) School of Software, Nanchang University(软件学院,南昌大学) Institute of Biopharmaceutical and Health Engineering, Tsinghua Shenzhen International Graduate School, Tsinghua University(生物制药与健康工程研究院,清华大学深圳国际研究生院)

AI总结 本文提出一种统一的隐写框架,通过在3DGS表示中直接嵌入高容量3D/4D内容,实现安全高效的隐写,同时提升鲁棒性和通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15849 2026-04-20 cs.SD

TinyMU: A Compact Audio-Language Model for Music Understanding

TinyMU:一种用于音乐理解的紧凑音频-语言模型

Xiquan Li, Aurian Quelennec, Slim Essid

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI, Télécom Paris, Institut Polytechnique de Paris) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出TinyMU,一种轻量级音乐语言模型,通过MusicSkills-3.5M数据集训练,实现与大规模LALMs相当的性能,同时保持高效紧凑,适用于边缘设备。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15741 2026-04-20 cs.CL cs.AI

Learning Uncertainty from Sequential Internal Dispersion in Large Language Models

从大型语言模型中的序列内部分散性中学习不确定性

Ponhvoan Srey, Xiaobao Wu, Cong-Duy Nguyen, Anh Tuan Luu

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) Centre for AI Research, VinUniversity(Vin大学人工智能研究中心)

AI总结 本文提出SIVR框架,通过利用隐藏状态中的token和层级特征,以更基本的假设来估计不确定性,从而提高hallucination检测的准确性和泛化能力。

Comments Accepted at ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15715 2026-04-20 cs.CL cs.AI

GTA-2: Benchmarking General Tool Agents from Atomic Tool-Use to Open-Ended Workflows

GTA-2: 从原子工具使用到开放性工作流的通用工具代理基准测试

Jize Wang, Xuanxuan Liu, Yining Li, Songyang Zhang, Yijun Wang, Zifei Shan, Xinyi Le, Cailian Chen, Xinping Guan, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Tencent(腾讯) Nanyang Technological University(南洋理工大学)

AI总结 本文提出GTA-2基准测试,涵盖原子工具使用和开放性工作流,通过递归检查点机制评估模型能力和执行框架,揭示了前沿模型在复杂任务上的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14646 2026-04-20 cs.AI

Targeted Exploration via Unified Entropy Control for Reinforcement Learning

通过统一熵控制实现定向探索的强化学习

Chen Wang, Lai Wei, Yanzhi Zhang, Chenyang Shao, Zedong Dan, Weiran Huang, Ge Lan, Yue Wang

机构 * College of Software, Nankai University(南开大学软件学院) Zhongguancun Academy(中关村学院) Shanghai Jiao Tong University(上海交通大学) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学) Sun Yat-sen Univeristy(中山大学)

AI总结 本文提出UEC-RL框架,通过定向探索机制和稳定器解决强化学习中的熵崩溃问题,提升大模型推理性能。

Comments Accepted for publication in Findings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13660 2026-04-20 cs.CV

VRAG-DFD: Verifiable Retrieval-Augmentation for MLLM-based Deepfake Detection

VRAG-DFD: 可验证检索增强的基于大语言模型的深度伪造检测

Hui Han, Shunli Wang, Yandan Zhao, Taiping Yao, Shouhong Ding

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 本文提出VRAG-DFD框架,通过结合检索增强生成和强化学习,解决深度伪造检测中专业伪造知识不足的问题,提升大语言模型的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11182 2026-04-20 cs.CL

Evaluating Memory Capability in Continuous Lifelog Scenario

在连续生活日志场景中评估记忆能力

Jianjie Zheng, Zhichen Liu, Zhanyu Shen, Jingxiang Qu, Guanhua Chen, Yile Wang, Yang Xu, Yang Liu, Sijie Cheng

机构 * Southern University of Science and Technology(南方科技大学) Tsinghua University(清华大学) Shenzhen University(深圳大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出LifeDialBench基准,包含EgoMem和LifeMem两个子集,通过在线评估协议解决传统离线设置的时序泄漏问题,发现复杂记忆系统不如简单RAG基线表现,强调高保真上下文保存的重要性。

Comments 27 pages, 7 figures. ACL 2026 Findings camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00663 2026-04-20 cs.RO

Optimal Solutions for the Moving Target Vehicle Routing Problem via Branch-and-Price with Relaxed Continuity

通过放松连续性进行分支定价求解移动目标车辆路径问题的最优解

Anoop Bhat, Geordan Gutow, Zhongqiang Ren, Sivakumar Rathinam, Howie Choset

机构 * Robotics Institute at Carnegie Mellon University(卡内基梅隆大学机器人研究所) Mechanical and Aerospace Engineering at Michigan Technological University(密歇根技术大学机械与航空航天工程系) UM-SJTU Joint Institute and Department of Automation at Shanghai Jiao Tong University(上海交通大学与UM-SJTU联合研究所及自动化系) Department of Mechanical Engineering and Department of Computer Science and Engineering at Texas A&M University(德克萨斯大学阿姆斯特朗分校机械工程系和计算机科学与工程系)

AI总结 本文提出一种新的分支定价与放松连续性算法,用于求解移动目标车辆路径问题,通过改进的标签算法有效解决定价子问题,并在25个目标实例中展示出比现有方法快数倍的求解速度。

Comments Accepted to ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04377 2026-04-20 cs.CL cs.AI cs.LG

Disco-RAG: Discourse-Aware Retrieval-Augmented Generation

Disco-RAG: 语篇意识的检索增强生成

Dongqi Liu, Hang Ding, Qiming Feng, Xurong Xie, Zhucun Xue, Chengjie Wang, Jian Li, Jiangning Zhang, Yabiao Wang

机构 * Saarland University(萨尔兰大学) Shanghai Jiaotong University(上海交通大学) Fudan University(复旦大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

AI总结 Discourse-aware RAG框架通过构建篇章内结构树和跨篇章修辞图,提升知识整合能力,在问答和长文档摘要任务中取得最佳效果。

Comments ACL 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17596 2026-04-20 cs.MM cs.AI eess.IV

Subjective and Objective Quality-of-Experience Evaluation Study for Live Video Streaming

主观与客观直播视频流质量体验评估研究

Zehao Zhu, Wei Sun, Jun Jia, Wei Wu, Sibin Deng, Kai Li, Ying Chen, Xiongkuo Min, Jia Wang, Guangtao Zhai

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(图像通信与网络工程研究所,上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 本文研究直播视频流的主观和客观质量体验评估,构建了首个直播视频流QoE数据集TaoLive QoE,并提出端到端QoE模型Tao-QoE,整合多尺度语义特征和光流运动特征以预测回顾性QoE评分。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏