arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2025-11-25 至 2025-11-25 共收录 10
2511.19426 2025-11-25 cs.CV

Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction

Ref-SAM3D: 通过文本连接SAM3D与参考3D重建

Yun Zhou, Yaoting Wang, Guangquan Jie, Jinyu Liu, Henghui Ding

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(大数据研究院,计算机科学与人工智能学院,复旦大学)

AI总结 Ref-SAM3D通过引入文本描述作为先验,实现基于单张图像的文本引导3D重建,提升零样本重建性能。

Comments Code: https://github.com/FudanCVL/Ref-SAM3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19368 2025-11-25 cs.LG cs.NI

LLM-Driven Stationarity-Aware Expert Demonstrations for Multi-Agent Reinforcement Learning in Mobile Systems

基于大语言模型的站稳意识专家示范的多智能体强化学习在移动系统中的应用

Tianyang Duan, Zongyuan Zhang, Zheng Lin, Songxiao Guo, Xiuxian Guan, Guangyu Wu, Zihan Fang, Haotian Meng, Xia Du, Ji-Zhe Zhou, Heming Cui, Jun Luo, Yue Gao

机构 * Division of Computer Science, The University of Hong Kong(计算机科学系,香港大学) Department of Electrical and Electronic Engineering, The University of Hong Kong(电气电子工程系,香港大学) Department of Computer Science and Technology, Peking University(计算机科学与技术系,北京大学) Department of Computer Science, City University of Hong Kong(计算机科学系,城市大学) China Unicom Digital Technology, China Unicom co.,Ltd(中国联合数字技术,中国联合有限公司) School of Computer and Information Engineering, Xiamen University of Technology(计算机与信息工程学院,厦门理工学院) School of Computer Science, Engineering Research Center of Machine Learning and Industry Intelligence, Sichuan University(计算机科学学院,机器学习与工业智能工程研究中心,四川大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Institute of Space Internet, Fudan University(空间互联网研究院,复旦大学) School of Computer Science, Fudan University(计算机科学学院,复旦大学)

AI总结 本文提出RELED框架,通过大语言模型驱动的专家示范与自主探索相结合,提升多智能体强化学习在移动系统中的性能和稳定性。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18934 2025-11-25 cs.CL cs.AI cs.DB

Skeletons Matter: Dynamic Data Augmentation for Text-to-Query

骨架很重要:面向文本到查询的动态数据增强

Yuchen Ji, Bo Xu, Jie Shi, Jiaqing Liang, Deqing Yang, Yu Mao, Hai Chen, Yanghua Xiao

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) School of Computer Science and Technology, Donghua University(东华大学计算机科学与技术学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Ant Group(蚂蚁集团) Shanghai Key Laboratory of Data Science(上海数据科学 key laboratory)

AI总结 本文提出一种动态数据增强框架,通过识别查询骨架作为共同优化目标,提升文本到查询任务的泛化能力和效率。

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18921 2025-11-25 cs.CV

BackdoorVLM: A Benchmark for Backdoor Attacks on Vision-Language Models

BackdoorVLM:面向视觉-语言模型的后门攻击基准

Juncheng Li, Yige Li, Hanxun Huang, Yunhao Chen, Xin Wang, Yixu Wang, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Singapore Management University(新加坡管理学院) The University of Melbourne(墨尔本大学)

AI总结 BackdoorVLM提出首个评估视觉-语言模型后门攻击的基准,揭示VLMs对文本指令的高敏感性及多模后门的有效性

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03596 2025-11-25 cs.CV

ControlThinker: Unveiling Latent Semantics for Controllable Image Generation through Visual Reasoning

ControlThinker: 通过视觉推理揭示潜在语义以实现可控图像生成

Feng Han, Yang Jiao, Shaoxiang Chen, Junhao Xu, Jingjing Chen, Yu-Gang Jiang

机构 * Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(上海智能信息处理关键实验室,复旦大学计算机学院) Shanghai Collaborative Innovation Center on Intelligent Visual Computing(上海智能视觉计算协同创新中心) MiniMax

AI总结 ControlThinker通过视觉推理挖掘潜在语义,提升可控图像生成的语义一致性和视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18450 2025-11-25 cs.AI

ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints

ORIGAMISPACE:基于数学约束的多模态大语言模型多步空间推理基准测试

Rui Xu, Dakuan Lu, Zicheng Zhao, Xiaoyu Tan, Xintao Wang, Siyu Yuan, Jiangjie Chen, Yinghui Xu

机构 * Fudan University(复旦大学) SII INF Technology(INF技术)

AI总结 ORIGAMISPACE通过折纸任务评估多模态大语言模型在多步空间推理和数学约束处理中的能力,提出四个评估任务并探索强化学习训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18367 2025-11-25 cs.CV

Alias-free 4D Gaussian Splatting

无别名的4D高斯散射

Zilong Chen, Huan-ang Gao, Delin Qu, Haohan Chi, Hao Tang, Kai Zhang, Hao Zhao

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Beijing Academy of Artificial Intelligence, BAAI(北京人工智能研究院,BAAI) Fudan University(复旦大学) Peking University(北京大学)

AI总结 本研究提出了一种无别名的4D高斯散射方法,通过引入最大采样频率公式和尺度自适应滤波器,有效减少渲染伪影并提升多视角视频重建效率。

Comments Project page: https://4d-alias-free.github.io/4D-Alias-free/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17941 2025-11-25 cs.CV

V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction

V2X-RECT: 一种通过冗余交互过滤和轨迹误差修正的高效V2X轨迹预测框架

Xiangyan Kong, Xuecheng Wu, Xiongwei Zhao, Xiaodong Li, Yunyun Shi, Gang Wang, Dingkang Yang, Yang Liu, Hong Chen, Yulong Gao

机构 * Communication Research Center, Harbin Institute of Technology(哈尔滨工业大学通信研究所) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)电子与信息工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)

AI总结 V2X-RECT通过冗余交互过滤和轨迹误差修正,提升高密度环境下的轨迹预测效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01982 2025-11-25 cs.LG cs.CV

Fine-Grained GRPO for Precise Preference Alignment in Flow Models

细粒度GRPO用于流模型中的精确偏好对齐

Yujie Zhou, Pengyang Ling, Jiazi Bu, Yibin Wang, Yuhang Zang, Jiaqi Wang, Li Niu, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出细粒度GRPO框架,通过细粒度评估和多粒度整合模块提升流模型中偏好对齐的精度与鲁棒性。

Comments Project Page: https://bujiazi.github.io/g2rpo.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19165 2025-11-25 eess.IV cs.CV

Extreme Cardiac MRI Analysis under Respiratory Motion: Results of the CMRxMotion Challenge

极端呼吸运动下的心脏MRI分析:CMRxMotion挑战结果

Kang Wang, Chen Qin, Zhang Shi, Haoran Wang, Xiwen Zhang, Chen Chen, Cheng Ouyang, Chengliang Dai, Yuanhan Mo, Chenchen Dai, Xutong Kuang, Ruizhe Li, Xin Chen, Xiuzheng Yue, Song Tian, Alejandro Mora-Rubio, Kumaradevan Punithakumar, Shizhan Gong, Qi Dou, Sina Amirrajab, Yasmina Al Khalil, Cian M. Scannell, Lexiaozi Fan, Huili Yang, Xiaowu Sun, Rob van der Geest, Tewodros Weldebirhan Arega, Fabrice Meriaudeau, Caner Özer, Amin Ranem, John Kalkhof, İlkay Öksüz, Anirban Mukhopadhyay, Abdul Qayyum, Moona Mazher, Steven A Niederer, Carles Garcia-Cabrera, Eric Arazo, Michal K. Grzeszczyk, Szymon Płotka, Wanqin Ma, Xiaomeng Li, Rongjun Ge, Yongqing Kou, Xinrong Chen, He Wang, Chengyan Wang, Wenjia Bai, Shuo Wang

机构 * Digital Medical Research Center, School of Basic Medical Sciences, Fudan University, Shanghai, Shanghai 200032, China Shanghai Key Laboratory of MICCAI, Fudan University, Shanghai, Shanghai 200032, China Department of Electrical Electronic Engineering \& I-X, Imperial College London, London, London SW7 2AZ, United Kingdom Department of Radiology, Zhongshan Hospital Affiliated to Fudan University, Shanghai, Shanghai 200032, China Department of Computing, Imperial College London, London, London SW7 2AZ, United Kingdom School of Computer Science, University of Sheffield, Sheffield, S1 4DP, United Kingdom Department of Engineering Science, University of Oxford, Oxford, OX2 0ES, United Kingdom Shanghai Pudong Hospital Human Phenome Institute, Fudan University, Shanghai, 201203, China School of Computer Science, University of Nottingham, Nottingham, NG8 1BB, United Kingdom Diagnostic Imaging, University of Alberta, Edmonton, AB T6G 1K4, Canada Department of Computer Science Engineering, The Chinese University of Hong Kong, Hong Kong, Hong Kong 000000, China The D-Lab, Department of Precision Medicine, GROW - Research Institute for Oncology Reproduction, Maastricht University, 6220 MD Maastricht, The Netherlands Department of Biomedical Engineering, Eindhoven University of Technology, Eindhoven 5612 AZ, The Netherlands Department of Radiology, Northwestern University, 737 N. Michigan Ave, Suite 1600, Chicago 60611, United States United Imaging Research, 393 Middle Huaxia Road, Pudong, Shanghai 201210, China Division of Image Processing, Department of Radiology, Leiden University Medical Center, PO Box 9600, Leiden 2300 RC, The Netherlands Université Bourgogne Europe, CNRS, ICMUB UMR 6302, 21000 Dijon, France Istanbul Technical University, Maslak, 34467, İstanbul, Türkiye Computer Science, Technical University of Darmstadt, Karolinenpl. 5, 64289 Darmstadt, Germany Lung Institute, Faculty of Medicine, Imperial College London, Guy Scadding Building, Cale Street, London, SW3 6LY,United Kingdom Hawkes Institute, Department of Computer Science, University College London, 66-72 Gower St, London, United Kingdom School of Medicine, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland CeADAR: Ireland's Centre for AI, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland Sano Centre for Computational Medicine, Czarnowiejska 36, 30-054, Krakow, Poland Faculty of Mathematics Computer Science, Jagiellonian University, S. Łojasiewicza 6, Krakow, Poland Department of Electronic Computer Engineering, The Hong Kong University of Science School of Instrument Science Engineering, Southeast University, Nanjing, Nanjing 210096, China College of Artificial Intelligence, Nanjing University of Aeronautics Academy for Engineering Technology, Fudan University, Shanghai, Shanghai 200433, China College of Biomedical Engineering, Fudan University, Shanghai, Shanghai 200433, China Institute of Science Technology for Brain-inspired Intelligence, Fudan University, Shanghai, Shanghai 200433, China Department of Brain Sciences, Imperial College London, London, London SW7 2AZ, United Kingdom Data Science Institute, Imperial College London, London, London SW7 2AZ, United Kingdom

AI总结 本文提出CMRxMotion挑战,通过公开数据集评估深度学习模型在呼吸运动干扰下的心脏MRI分析性能,并探讨运动伪影对临床生物标志物的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏