arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-08-26 至 2026-08-26 共收录 9
2608.24794 2026-08-26 cs.AI 新提交

CAFE: Self-Improving Search Agents Need Co-Evolving Feedback

CAFE:自改进搜索智能体需要协同演化的反馈

Boyang Liu, Senjie Jin, Peixin Wang, Zhangyue Yin, Yibo Wang, Yuhao Zhou, Xinbing Liang, Shizheng Zhu, Yuhui Wang, Jingqi Tong, Zhiheng Xi, Jiazheng Zhang, Clive Bai, Clarenceai, Blaze Chen, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Tencent(腾讯)

AI总结 该研究提出 CAFE 框架,通过共享参数模型耦合搜索智能体与评判者的协同演化反馈,在七个及六个域外搜索基准上均优于现有 RL 智能体,减少答案幻觉且性能持续提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24777 2026-08-26 cs.AI cs.CR 新提交

StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing

StepGuard:利用可扩展监督与安全-效用平衡学习步骤级护栏

Zhijie Zheng, Yu Li, Chen Qian, Yuqian Fu, Yanwei Fu, Lu Sheng, Jing Shao, Dongrui Liu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Fudan University(复旦大学) Renmin University of China(中国人民大学) KAUST(阿卜杜拉国王科技大学)

AI总结 该研究针对LLM智能体交互的安全风险,提出步骤级护栏模型StepGuard,通过自动数据引擎StepGen与动态平衡学习方法Balance-GRPO训练,在降低攻击成功率的同时仅小幅影响效用。

Comments Accepted by EMNLP 2026. Project page: this https URL (https://zheng977.github.io/StepGuard/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24588 2026-08-26 cs.LG 新提交

IAPO: Influence-Aware Policy Optimization for Credit Assignment in Multi-Turn Service Agents

IAPO:面向多轮服务智能体信用分配的感知影响策略优化

Bo Ren, Yirong Mao, Yi Yang, Wenhui Que

机构 * Fudan University(复旦大学) WeChat, Tencent Inc.(腾讯公司微信业务)

AI总结 本研究提出IAPO方法,将轨迹转化为影响依赖图以优化多轮服务智能体的信用分配,在三个服务智能体基准及BFCL-v4多轮任务上,性能优于多轮RL基线。

Comments 12 pages, 3 figures, 5 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24386 2026-08-26 cs.LG cs.AI 新提交

Equivariant Covariance Tensors: Guaranteed SPD Uncertainty for Tensor-Valued Geometric Learning

等变协方差张量:张量值几何学习的保证SPD不确定性

Ruihan Liu, Yu Ji, Jianbo Yu, Shifu Yan, Qingchao Jiang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) School of Microelectronics, Fudan University(复旦大学微电子学院) ByteDance(字节跳动) School of Information Science and Engineering, East China University of Science and Technology(华东理工大学信息科学与工程学院)

AI总结 针对几何深度学习中张量值预测的不确定性量化难题,提出E(3)等变UQ框架,通过分解协方差与矩阵指数法保证正定性,构建LE-ESO损失,在两类数据集上验证了方法的竞争力与不确定性估计的有效性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24111 2026-08-26 cs.RO 新提交

Trajectory-Level Continuous Action Representation for Robotic Manipulation

面向机器人操作的轨迹级连续动作表示

Tong Yang, Jingkai Jia, Yuecheng Xu, Xueyao Chen, Chi Zhang, Wenqiang Zhang

机构 * Fudan University(复旦大学) TeleAI, China Telecom(中国电信TeleAI)

AI总结 该研究提出CAT轨迹级连续动作表示框架,通过频率感知位置编码等技术解决现有视觉运动系统的动作表示冗余问题,在LIBERO等数据集上显著提升机器人操作任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24068 2026-08-26 cs.CV 新提交

Representation Learning in Diffusion and Flow-based Model: An Application Aspect

扩散模型与基于流的模型中的表示学习:应用视角

Yanchen Xu, Sida Huang, Zhenyu Gu, Ruishu Zhu, Yilan Gao, Hongyuan Zhang

机构 * Fudan University(复旦大学) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(西北工业大学光学与电子信息人工智能学院(iOPEN)) The University of Hong Kong(香港大学)

AI总结 本综述聚焦应用场景,提出三层渐进框架,梳理扩散与基于流的模型中表示学习的双向关系,分类下游任务方法,明确研究挑战并指明未来方向,为相关应用研究提供参考。

Comments Accepted by Vicinagearth

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24020 2026-08-26 cs.CV cs.AI 新提交

IterCAD: Iterative Program Repair for CAD Code Generation from Orthographic Views

IterCAD:基于正交视图的CAD代码生成的迭代程序修复方法

Yuchuan Wu, Ke Niu, Haiyang Yu, Zhuofan Chen, Xiangyang Xue, Bin Li

机构 * Fudan University(复旦大学) ByteDance Inc.(字节跳动公司)

AI总结 IterCAD是一种迭代框架,将正交视图转CAD代码任务重构为渐进式程序修复,通过三阶段训练与监督集优化,在CADExpert上显著提升了代码可执行性与几何保真度。

Comments Accepted to the 34th ACM International Conference on Multimedia (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24011 2026-08-26 cs.CL cs.AI 新提交

SAGE: From Direct Answering to Evidence-Grounded Inference for Chinese Ancient Document Understanding

SAGE:面向中国古代文献理解的从直接回答到证据导向推理

Yuchuan Wu, Xuan Luo, Yinglian Zhu, Meng Fang, Xiangyang Xue, Bin Li

机构 * Fudan University(复旦大学) University of Liverpool(利物浦大学)

AI总结 针对现有大型视觉语言模型(LVLMs)在古代文献理解中证据支撑不足的问题,本文提出SAGE多智能体框架,通过多阶段证据导向推理实现任务规划、证据获取与验证,在AncientDoc基准上优于基线,搭载Qwen3.5-9B的SAGE性能超更大单体模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23864 2026-08-26 cs.CV 新提交

AffineTok: Semantic Affine Consistency for Diffusion-Friendly Visual Tokenizer

AffineTok:面向扩散模型友好型视觉分词器的语义仿射一致性

Junqiu Yu, Pandeng Li, Yikai Wang, Jiaxing Zhao, Yujie Wei, Kaixun Jiang, Quanhao Li, Hongtao Yu, Zhihang Liu, Zhaohe Liao, Junjie Zhou, Yun Zheng, Yu Liu, Yanwei Fu

机构 * Fudan University(复旦大学) Alibaba Group(阿里巴巴集团)

AI总结 本文提出AffineTok,通过语义仿射一致性(SAC)引导视觉分词器训练,引入M_SAC作为代理指标,在ImageNet 256上实现了gFID的显著降低,达到无引导1.21、有引导1.10的SOTA性能。

Comments Project page: this https URL (https://michaelyu781.github.io/AffineTok-site/)

详情

展开后加载摘要…

URL PDF HTML 收藏