arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanyang Technological University(南洋理工大学)

2026-03-05 至 2026-03-05 共收录 5
2603.04338 2026-03-05 cs.CV

ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors

ArtHOI: 通过视频先验进行4D重建的可变形人-物交互合成

Zihao Huang, Tianqi Liu, Zhaoxi Chen, Shaocong Xu, Saining Zhang, Lixing Xiao, Zhiguo Cao, Wei Li, Hao Zhao, Ziwei Liu

机构 * School of AIA, Huazhong University of Science and Technology(华中科技大学人工智能学院) the S-Lab, Nanyang Technological University (NTU)(南洋理工大学S实验室) the Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Zhejiang University (ZJU)(浙江大学) the Institute for AI Industry Research (AIR), Tsinghua University (THU)(清华大学人工智能产业研究院)

AI总结 ArtHOI通过4D重建从视频先验生成可变形人-物交互,提升接触精度和物理合理性。

Comments Project Page: https://arthoi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21782 2026-03-05 cs.AI

Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety

基于MLLM的网页理解基准测试:推理、鲁棒性与安全性

Junliang Liu, Jingyu Xiao, Wenxin Tang, Zhixian Wang, Zipeng Xie, Wenxuan Wang, Minrui Zhang, Shuanghe Yu

机构 * Dalian Maritime University(大连海事大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Xi'an Jiaotong University(西安交通大学) Renmin University of China(中国人民大学) Wuhan University(武汉大学)

AI总结 本文提出WebRRSBench基准测试,评估多模态大语言模型在网页理解中的推理、鲁棒性和安全性能力,揭示模型在复杂交互任务中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20376 2026-03-05 cs.CV cs.CR

When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems

当记忆成为漏洞:针对文本到图像生成系统的多轮劫持攻击

Shiqian Zhao, Jiayang Liu, Yiming Li, Runyi Hu, Xiaojun Jia, Wenshu Fan, Xiao Bao, Xinfeng Li, Jie Zhang, Wei Dong, Tianwei Zhang, Luu Anh Tuan

机构 * Nanyang Technological University(南洋理工大学) Institute of Science(科学研究院) University of Electronic Science and Technology of China(电子科技大学) CFAR and IHPC Agency for Science Technology and Research(CFAR和IHPC科技研究局) VinUniversity(文大学)

AI总结 本文提出Inception,首个利用文本到图像生成系统内存机制的多轮劫持攻击方法,通过分割和递归模块有效规避安全过滤,提升攻击成功率20%。

Comments This work proposes a multi-turn jailbreak attack against real-world chat-based T2I generation systems that intergrate memory mechanism. It also constructed a simulation system, with considering three industrial-grade memory mechanisms, 7 kinds of safety filters (both input and output); It is going to appear on USENIX 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03564 2026-03-05 cs.CV

Modeling Cross-vision Synergy for Unified Large Vision Model

跨视觉协同的统一大视觉模型建模

Shengqiong Wu, Lanhu Wu, Mingyang Bao, Wenhao Xu, Hanwang Zhang, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 PolyV通过统一架构和协同训练方法,实现了跨视觉模态的协同推理,显著提升了多模态视觉任务的性能。

Comments 21 pages, 9 figures, 16 tables, CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01138 2026-03-05 eess.SP cs.LG

Graph Neural Networks in EEG-based Emotion Recognition: A Survey

基于EEG的情感识别中的图神经网络:综述

Chenyu Liu, Yuqiu Deng, Yihao Wu, Ruizhi Yang, Zhongruo Wang, Liangwei Zhang, Siyun Chen, Tianyi Zhang, Yang Liu, Yi Ding, Liming Zhai, Ziyu Jia, Xinliang Zhou

机构 * Nanyang Technological University, Singapore(南洋理工大学) Xi’an Jiaotong University, Xi’an, China(西安交通大学) Imperial College London, London, UK(伦敦帝国理工学院) Amazon, Seattle, WA, USA(亚马逊) Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学) Uber Technologies, Inc., USA(Uber Technologies, Inc.) School of Computer Science, Central China Normal University, Wuhan, China(中央财经大学计算机学院) Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所)

AI总结 本文综述了基于EEG的情感识别中图神经网络的应用,分析了现有方法的共性与差异,并探讨了未来研究方向。

Comments The 30th Pacific-Asia Conference on Knowledge Discovery and Data Mining (PAKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏