arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-02-03 至 2026-02-03 共收录 17
2602.02318 2026-02-03 cs.CV

Enhancing Indoor Occupancy Prediction via Sparse Query-Based Multi-Level Consistent Knowledge Distillation

通过稀疏查询多级一致知识蒸馏增强室内占用预测

Xiang Li, Yupeng Zheng, Pengfei Li, Yilun Chen, Ya-Qin Zhang, Wenchao Ding

机构 * College of AI, Tsinghua University(清华大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) AIR, Tsinghua University(清华大学人工智能研究院) TARS College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

AI总结 DiScene通过多级一致知识蒸馏和教师引导初始化,实现高效鲁棒的室内占用预测,优于现有方法并取得SOTA性能。

Comments Accepted by RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01826 2026-02-03 cs.LG cs.AI

Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It

超越精度:训练-推理不匹配是一个优化问题,简单的学习率调度器可以解决它

Yaxiang Zhang, Yingru Li, Jiacai Liu, Jiawei Xu, Ziniu Li, Qian Liu, Haoyuan Li

机构 * National University of Singapore(新加坡国立大学) Fudan University(复旦大学) CHUK-Shenzhen(CHUK-深圳) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出通过动态学习率调度器解决强化学习中训练-推理不匹配问题,通过减少学习率来抑制梯度噪声,从而稳定训练过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01683 2026-02-03 cs.CV cs.AI

FreshMem: Brain-Inspired Frequency-Space Hybrid Memory for Streaming Video Understanding

FreshMem: 基于大脑的频率-空间混合内存用于流视频理解

Kangcong Li, Peng Ye, Lin Zhang, Chao Wang, Huafeng Qin, Tao Chen

机构 * College of Future Information Technology, Fudan University, Shanghai, China(复旦大学未来信息科技学院) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学)

AI总结 FreshMem通过频率-空间混合内存网络,提升流视频理解的连续感知能力,实现短期保真与长期一致性的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01675 2026-02-03 cs.AI cs.LG

TRIP-Bench: A Benchmark for Long-Horizon Interactive Agents in Real-World Scenarios

TRIP-Bench:面向现实场景的长周期交互智能体基准

Yuanzhe Shen, Zisu Huang, Zhengyuan Wang, Muzhao Tian, Zhengkang Guo, Chenyang Zhang, Shuaiyu Zhou, Zengjie Hu, Dailin Li, Jingwen Xu, Kaimin Wang, Wenhao Liu, Tianlong Li, Fengpeng Yue, Feng Hong, Cao Liu, Ke Zeng

机构 * Xiaohongshu Inc.(小红书公司) School of Computer Science, Fudan University(复旦大学计算机学院) Dalian University of Technology(大连理工大学) Peking University(北京大学) Wuhan University(武汉大学)

AI总结 TRIP-Bench是一个面向现实场景的长周期交互智能体基准,通过真实旅行规划场景测试多工具推理与约束满足,提出GTPO方法提升智能体鲁棒性与性能。

Comments 40 pages, 6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01660 2026-02-03 cs.CL cs.AI

CoDiQ: Test-Time Scaling for Controllable Difficult Question Generation

CoDiQ:测试时缩放用于可控的困难问题生成

Zhongyuan Peng, Caijun Xu, Changyi Xiao, Shibo Hong, Eli Zhang, Stephen Huang, Yixin Cao

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 CoDiQ通过测试时缩放实现可控困难问题生成,提升模型推理能力。

Comments 11 pages, 5 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01233 2026-02-03 cs.LG cs.AI

Lotus: Efficient LLM Training by Randomized Low-Rank Gradient Projection with Adaptive Subspace Switching

Lotus: 通过随机低秩梯度投影与自适应子空间切换实现高效的LLM训练

Tianhao Miao, Zhongyuan Bao, Lejun Zhang

机构 * Hong Kong Baptist University, School of Science, Hong Kong, China(香港 Baptist 大学,科学学院,香港,中国) Fudan University, School of Data Science, Shanghai, China(复旦大学,数据科学学院,上海,中国) New York University, Tandon School of Engineering, New York, USA(纽约大学,Tandon 工程学院,纽约,美国)

AI总结 Lotus通过随机低秩梯度投影与自适应子空间切换,实现LLM训练的高效优化,减少30%训练时间和40%内存消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01025 2026-02-03 cs.LG cs.AI cs.CV

Toward Universal and Transferable Jailbreak Attacks on Vision-Language Models

迈向通用且可迁移的视觉-语言模型劫持攻击

Kaiyuan Cui, Yige Li, Yutao Wu, Xingjun Ma, Sarah Erfani, Christopher Leckie, Hanxun Huang

机构 * School of Computing and Information Systems, The University of Melbourne, Australia(墨尔本大学计算机与信息系) School of Computing and Information Systems, Singapore Management University, Singapore(新加坡管理大学计算机与信息系) School of Information Technology, Deakin University, Australia(德肯大学信息科技系) Institute of Trustworthy Embodied AI, Fudan University, China(复旦大学可信具身人工智能研究所)

AI总结 本文提出UltraBreak,一种通用且可迁移的视觉-语言模型劫持攻击框架,通过视觉正则化和语义引导的文本监督,有效提升攻击的泛化能力和转移性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01007 2026-02-03 cs.CL

Distilling Token-Trained Models into Byte-Level Models

将令牌训练模型蒸馏为字节级模型

Zishuo Bao, Jiaqi Leng, Junxiong Wang, Bowen Peng, Yucheng Lu

机构 * Fuzhou University(福州大学) Fudan University(复旦大学) Together AI Nous Research

AI总结 本文提出了一种将令牌训练模型高效蒸馏为字节级模型的方法,通过两阶段课程实现端到端生成,验证了在有限数据下保持模型性能的可行性。

Comments 17 pages, 3 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00948 2026-02-03 physics.soc-ph cs.AI cs.GT cs.MA

FinEvo: From Isolated Backtests to Ecological Market Games for Multi-Agent Financial Strategy Evolution

FinEvo: 从孤立回测到多智能体金融策略进化的生态市场博弈

Mingxi Zou, Jiaxiang Chen, Aotian Luo, Jingyi Dai, Chi Zhang, Dongning Sun, Zenglin Xu

机构 * Fudan University(复旦大学) Tensorpacific Peng Cheng Laboratory(鹏城实验室)

AI总结 FinEvo通过生态博弈形式化方法研究多智能体金融策略的进化动态,揭示策略在动态市场中的适应与演化机制。

Comments Preprint. Submitted to a conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00810 2026-02-03 cs.CV cs.RO

VVLoc: Prior-free 3-DoF Vehicle Visual Localization

VVLoc: 无需先验信息的3自由度车辆视觉定位

Ze Huang, Zhongyang Xiao, Mingliang Song, Longan Yang, Hongyuan Yuan, Li Sun

机构 * Fudan University(复旦大学) NIO(蔚来汽车) Bosch XC(博世XC)

AI总结 VVLoc通过单一神经网络实现多摄像头下的车辆拓扑与度量定位,无需先验信息,提升定位精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00566 2026-02-03 cs.RO

UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning

UniMotion: 一种用于仿真、预测和规划的统一运动框架

Nan Song, Junzhe Jiang, Jingyu Li, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) University of Surrey(Surrey大学)

AI总结 UniMotion提出了一种统一的运动框架,通过共享结构和定制化训练策略,同时支持运动仿真、预测和规划,实现高效的任务整合和泛化能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19199 2026-02-03 cs.AI

MAGNET: Towards Adaptive GUI Agents with Memory-Driven Knowledge Evolution

MAGNET:迈向基于记忆驱动的知识演化的自适应GUI代理

Libo Sun, Jiwen Zhang, Siyuan Wang, Zhongyu Wei

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) University of Southern California(南加州大学)

AI总结 MAGNET通过双层记忆机制和动态演化机制,提升GUI代理在界面变化中的适应性和任务执行性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19149 2026-02-03 cs.LG q-bio.QM

GPCR-Filter: a deep learning framework for efficient and precise GPCR modulator discovery

GPCR-Filter: 一种用于高效且精确发现GPCR调节剂的深度学习框架

Jingjie Ning, Xiangzhen Shen, Li Hou, Shiyi Shen, Jiahao Yang, Junrui Li, Hong Shan, Sanan Wu, Sihan Gao, H. Eric Xu, Xinheng He

机构 * The State Key Laboratory of Drug Research, Shanghai Institute of Materia Medica, Chinese Academy of Sciences, Shanghai, China(中国科学院上海药物研究所国家药物研究重点实验室) School of Computer Science, Carnegie Mellon University, Pittsburgh, PA 15213, USA(卡内基梅隆大学计算机科学学院) College of Computer Science and Electronic Engineering, Hunan University, Changsha, Hunan(湖南大学计算机科学与电子工程学院) Lingang Laboratory, Shanghai, China(上海灵冈实验室) Research Center for Medicinal Structural Biology, National Research Center for Translational Medicine at Shanghai, State Key Laboratory of Medical Genomics, Ruijin Hospital, Shanghai Jiao Tong University School of Medicine, Shanghai, China(上海 translational 医学研究中心,国家医学基因组学重点实验室,瑞金医院,上海交通大学医学院,上海,中国) School of Pharmacy, Fudan University, Shanghai 201203, China(复旦大学药学院)

AI总结 GPCR-Filter通过深度学习框架高效精准发现GPCR调节剂,结合蛋白质语言模型和图神经网络,实现对受体-配体功能关系的学习,提升药物开发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11629 2026-02-03 cs.LG cs.AI

Global Feature Enhancing and Fusion Framework for Strain Gauge Time Series Classification

基于应变计时间序列分类的全局特征增强与融合框架

Xu Zhang, Peng Wang, Chen Wang, Zhe Xu, Xiaohua Nie, Wei Wang

机构 * Shanghai Key Laboratory of Data Science, School of Computer Science Fudan University(上海数据科学关键实验室,计算机科学学院,复旦大学) National Engineering Research Center for Big Data Software Tsinghua University(大数据软件国家工程研究中心,清华大学) School of Software Tsinghua University(软件学院,清华大学) National Key Laboratory of Strength and Structural Integrity, Aircraft Strength Research Institute of China(强度与结构完整性国家重点实验室,中国航空强度研究室)

AI总结 本文提出基于超图的全局特征学习与融合框架,通过特征工程和高阶关系学习提升应变计时间序列分类的准确性。

Comments The paper is published in the ACM Web Conference 2025, WWW 2025 Industry Track. The code is available at the link https://github.com/Meteor-Stars/GFEF

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08622 2026-02-03 q-fin.ST cs.AI cs.LG

Multi-period Learning for Financial Time Series Forecasting

多周期学习用于金融时间序列预测

Xu Zhang, Zhengang Huang, Yunzhi Wu, Xun Lu, Erpeng Qi, Yunkai Chen, Zhongya Xue, Qitong Wang, Peng Wang, Wei Wang

机构 * School of Computer Science Fudan University(复旦大学计算机学院)

AI总结 本文提出多周期学习框架MLF,通过三个新模块整合多周期输入以提升金融时间序列预测的准确性和效率。

Comments The codes are available at https://github.com/Meteor-Stars/MLF. The paper is published in the ACM SIGKDD Conference on Knowledge Discovery and Data Mining, SIGKDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12706 2026-02-03 cs.CV cs.AI

NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models

NAP-Tuning: 用于对抗鲁棒视觉-语言模型的神经增强提示微调

Jiaming Zhang, Xin Wang, Xingjun Ma, Lingyu Qiu, Yu-Gang Jiang, Jitao Sang

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(复旦大学计算机学院智能信息处理重点实验室) Department of Mathematics and Applications, University of Naples Federico II(那不勒斯费德里克二世大学应用数学系) State Key Laboratory of Advanced Rail Autonomous Operation, Beijing Jiaotong University(北京交通大学先进轨道交通自主运行国家重点实验室)

AI总结 NAP-Tuning通过神经增强框架提升视觉-语言模型的对抗鲁棒性,实现多模态提示微调和特征净化,显著提升模型在对抗攻击下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00015 2026-02-03 cs.CL cs.AI

G-MemLLM: Gated Latent Memory Augmentation for Long-Context Reasoning in Large Language Models

G-MemLLM:基于门控潜在记忆增强的长上下文推理大语言模型

Xun Xu

机构 * Department of Computer Science(计算机科学系) Fudan University(复旦大学)

AI总结 G-MemLLM通过引入门控潜在记忆库,提升大语言模型在长上下文推理中的表现,显著增强多跳推理和关系精度。

详情

展开后加载摘要…

URL PDF HTML 收藏