arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-01-13 至 2026-01-13 共收录 17
2601.07641 2026-01-13 cs.AI cs.CL cs.MA

Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning

超越静态工具:科学推理中的测试时工具进化

Jiaxuan Lu, Ziyu Kong, Yemin Wang, Rong Fu, Haiyuan Wan, Cheng Yang, Wenjie Lou, Haoran Sun, Lilong Wang, Yankai Jiang, Xiaosong Wang, Xiao Sun, Dongzhan Zhou

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Xiamen University(厦门大学) University of Macau(澳门大学) Tsinghua University(清华大学) Hangzhou Dianzi University(杭州电子科技大学)

AI总结 本文提出TTE框架,通过在推理过程中动态合成和进化工具,提升科学推理任务的准确性和工具效率,同时支持跨领域适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07597 2026-01-13 cs.NE cs.AI

Pheromone-Focused Ant Colony Optimization algorithm for path planning

基于信息素聚焦的蚁群优化算法用于路径规划

Yi Liu, Hongda Zhang, Zhongxue Gan, Yuning Chen, Ziqing Zhou, Chunlei Meng, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学)

AI总结 本文提出基于信息素聚焦的蚁群优化算法,通过三种策略提升路径规划中的收敛速度和解质量。

Comments Accepted to 2025 IEEE International Conference on Systems, Man, and Cybernetics (SMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07454 2026-01-13 cs.RO

WaveMan: mmWave-Based Room-Scale Human Interaction Perception for Humanoid Robots

WaveMan: 基于毫米波的房间级人形机器人人机交互感知

Yuxuan Hu, Kuangji Zuo, Boyu Ma, Shihao Li, Zhaoyang Xia, Feng Xu, Jianfei Yang

机构 * Key Laboratory for Information Science of Electromagnetic Waves, Ministry of Education, School of Information Science and Technology, Fudan University(电磁波信息科学重点实验室、教育部、信息科学与技术学院,复旦大学) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学)

AI总结 WaveMan通过空间自适应感知系统实现房间级人形机器人人机交互的可靠隐私保护,实验显示其在不同用户位置下的交互感知准确率显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07309 2026-01-13 cs.AI cs.LG

ARM: Role-Conditioned Neuron Transplantation for Training-Free Generalist LLM Agent Merging

ARM:基于角色的神经元移植用于无训练通用大语言模型代理融合

Zhuoka Feng, Kang Chen, Sihan Zhao, Kai Xiong, Yaoning Wang, Minshen Yu, Junjie Nian, Changyi Xiao, Yixin Cao, Yugang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 ARM通过角色条件神经元移植方法提升大语言模型代理在多环境中的泛化能力,实现无训练的模型融合。

Comments 17 pages, 12 figures. Project page: https://arkazhuo.github.io/ARM-homepage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07290 2026-01-13 cs.CV

VideoLoom: A Video Large Language Model for Joint Spatial-Temporal Understanding

VideoLoom:一种用于联合空间-时间理解的视频大语言模型

Jiapeng Shi, Junke Wang, Zuyao You, Bo He, Zuxuan Wu

机构 * Fudan University(复旦大学) University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 VideoLoom是一种用于联合空间-时间理解的视频大语言模型,通过LoomData-8.7k数据集和LoomBench基准测试,在多个视频理解任务中取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07263 2026-01-13 cs.CR cs.AI

When Bots Take the Bait: Exposing and Mitigating the Emerging Social Engineering Attack in Web Automation Agent

当机器人上当:揭露和缓解网络自动化代理中新兴的社会工程攻击

Xinyi Wu, Geng Hong, Yueyue Chen, MingXuan Liu, Feier Jin, Xudong Pan, Jiarun Dai, Baojun Liu

机构 * Fudan University(复旦大学) Zhongguancun Laboratory(中关村实验室) Shanghai Innovation Institute(上海创新研究院) Tsinghua University(清华大学)

AI总结 研究提出AgentBait攻击范式,揭示网络自动化代理的社会工程威胁,并设计SUPERVISOR模块有效缓解此类攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07180 2026-01-13 cs.CL

Structured Reasoning for Large Language Models

为大型语言模型引入结构化推理

Jinyi Han, Zixiang Di, Zishang Jiang, Ying Liao, Jiaqing Liang, Yongqi Wang, Yanghua Xiao

机构 * East China Normal University(华东师范大学) Fudan University(复旦大学) Beijing Institute of Technology(北京理工大学)

AI总结 本文提出结构化推理框架SCR,通过生成-验证-修改范式提升LLM的推理效率和自我验证能力,减少输出标记长度达50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07178 2026-01-13 cs.CV cs.AI

DIVER: Dynamic Iterative Visual Evidence Reasoning for Multimodal Fake News Detection

DIVER: 动态迭代视觉证据推理用于多模态虚假新闻检测

Weilin Zhou, Zonghao Ying, Chunlei Meng, Jiahui Liu, Hengyang Zhou, Quanchen Zou, Deyue Zhang, Dongdong Yang, Xiangzheng Zhang

机构 * Xinjiang University(新疆大学) AI Security Lab(360人工智能安全实验室) Beihang University(北航) Fudan University(复旦大学) Central South University(中南大学) Nanjing University(南京大学)

AI总结 DIVER通过动态迭代视觉证据推理提升多模态虚假新闻检测性能,利用文本和视觉证据融合优化检测效果。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05640 2026-01-13 cs.CV

SGDrive: Scene-to-Goal Hierarchical World Cognition for Autonomous Driving

SGDrive: 场景到目标层次化世界认知用于自动驾驶

Jingyu Li, Junjie Wu, Dongnan Hu, Xiangkai Huang, Bin Sun, Zhihui Hao, Xianpeng Lang, Xiatian Zhu, Li Zhang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Li Auto Inc.(利汽车公司) Tongji University(同济大学) University of Surrey(Surrey大学)

AI总结 SGDrive通过构建驾驶特定的知识层次结构,改进了视觉语言模型在自动驾驶中的轨迹规划能力,实现了在导航模拟基准上的最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04770 2026-01-13 cs.AI cs.DB

SciIF: Benchmarking Scientific Instruction Following Towards Rigorous Scientific Intelligence

SciIF: 科学指令遵循基准测试以实现严谨的科学智能

Encheng Su, Jianyu Wu, Chen Tang, Lintao Wang, Pengze Li, Aoran Wang, Jinouwen Zhang, Yizhou Wang, Yuan Meng, Xinzhu Ma, Shixiang Tang, Houqiang Li

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) University of Sydney(悉尼大学) Fudan University(复旦大学) Tsinghua University(清华大学) Beihang University(北航大学)

AI总结 SciIF是一个评估模型在科学问题解决中严格遵守约束条件能力的多学科基准测试,通过显式证据验证科学有效性,提升LLM在科学逻辑框架中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22976 2026-01-13 cs.CV

From Flatland to Space: Teaching Vision-Language Models to Perceive and Reason in 3D

从二维空间到三维空间:教视觉语言模型感知和推理三维世界

Jiahui Zhang, Yurui Chen, Yanpeng Zhou, Yueming Xu, Ze Huang, Jilin Mei, Junhui Chen, Yu-Jie Yuan, Xinyue Cai, Guowei Huang, Xingyue Quan, Hang Xu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Huawei Noah’s Ark Lab(华为诺亚实验室)

AI总结 本文提出了一种基于2D空间数据生成和标注的管道,构建了SPAR-7M数据集和SPAR-Bench基准,通过训练和微调提升视觉语言模型在三维空间感知和推理中的性能。

Comments Project page: https://logosroboticsgroup.github.io/SPAR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16108 2026-01-13 cs.CV

LaneSegNet: Map Learning with Lane Segment Perception for Autonomous Driving

LaneSegNet: 用于自动驾驶的基于车道段的地图学习

Tianyu Li, Peijin Jia, Bangjun Wang, Li Chen, Kun Jiang, Junchi Yan, Hongyang Li

机构 * Fudan University(复旦大学) OpenDriveLab(OpenDrive实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 LaneSegNet通过引入车道段表示,实现了端到端的地图学习,提升车道线检测、中心线感知和车道段感知的性能,达到每秒14.7次的实时推理速度。

Comments Accepted in ICLR 2024

Journal ref ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06806 2026-01-13 cs.CV cs.AI cs.RO

SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation

SpatialNav: 利用空间场景图进行零样本视觉-语言导航

Jiwen Zhang, Zejun Li, Siyuan Wang, Xiangyu Shi, Zhongyu Wei, Qi Wu

机构 * Fudan University, Shanghai, China(复旦大学) University of Southern California, Los Angeles, USA(南加州大学) Australian Institute for Machine Learning, Adelaide University, Australia(澳大利亚机器学习研究所) Shanghai Innovation Institute, Shanghai, China(上海创新研究院)

AI总结 SpatialNav通过构建空间场景图,利用全局空间表示提升零样本视觉-语言导航的效率与性能。

Comments 11 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06801 2026-01-13 cs.AI cs.LG

Thinking with Deltas: Incentivizing Reinforcement Learning via Differential Visual Reasoning Policy

通过delta思考:通过微分视觉推理策略激励强化学习

Shujian Gao, Yuan Wang, Jiangtao Yan, Zuxuan Wu, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Wuhan University(武汉大学)

AI总结 通过微分视觉推理策略增强强化学习的视觉理解能力,提升多模态任务性能。

Comments 24 pages, 10 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06666 2026-01-13 cs.CL cs.AI

InFi-Check: Interpretable and Fine-Grained Fact-Checking of LLMs

InFi-Check: 可解释且细粒度的大型语言模型事实核查

Yuzhuo Bai, Shuzheng Si, Kangyang Luo, Qingyi Wang, Wenhao Li, Gang Chen, Fanchao Qi, Maosong Sun

机构 * Tsinghua University(清华大学) DeepLang AI Fudan University(复旦大学)

AI总结 InFi-Check通过可控数据合成和细粒度事实核查框架,提升大型语言模型事实性评估的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04566 2026-01-13 cs.AI cs.CL

BackdoorAgent: A Unified Framework for Backdoor Attacks on LLM-based Agents

BackdoorAgent: 一个统一框架用于针对基于LLM的代理的后门攻击

Yunhao Feng, Yige Li, Yutao Wu, Yingshui Tan, Yanming Guo, Yifan Ding, Kun Zhai, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Singapore Management University(新加坡管理大学) Alibaba Group(阿里巴巴集团) Deakin University(德肯大学) Hunan Institute of Advanced Technology(湖南高级技术研究所)

AI总结 BackdoorAgent提出一个统一框架,分析LLM代理中后门攻击的跨阶段传播和触发器持续性,揭示代理工作流的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03561 2026-01-13 cs.LG

Neural Operators for Biomedical Spherical Heterogeneity

神经运算符用于生物医学球形异质性

Hao Tang, Hao Chen, Hao Li, Chao Li

机构 * University of Dundee(邓迪大学) University of Cambridge(剑桥大学) Fudan University(复旦大学)

AI总结 GSNO通过融合等变、不变和各向异性格林函数运算,有效建模生物医学中的球形异质性和各向异性,提升真实世界系统的适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏