arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-01-19 至 2026-01-19 共收录 6
2601.10527 2026-01-19 cs.AI cs.CL cs.CV cs.LG

A Safety Report on GPT-5.2, Gemini 3 Pro, Qwen3-VL, Grok 4.1 Fast, Nano Banana Pro, and Seedream 4.5

GPT-5.2、Gemini 3 Pro、Qwen3-VL、Grok 4.1 Fast、Nano Banana Pro 和 Seedream 4.5 的安全报告

Xingjun Ma, Yixu Wang, Hengyuan Xu, Yutao Wu, Yifan Ding, Yunhan Zhao, Zilong Wang, Jiabin Hua, Ming Wen, Jianan Liu, Ranjie Duan, Yifeng Gao, Yingshui Tan, Yunhao Chen, Hui Xue, Xin Wang, Wei Cheng, Jingjing Chen, Zuxuan Wu, Bo Li, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation institute(上海创新研究院) Deakin University(德克萨斯大学) UIUC(伊利诺伊大学香槟分校)

AI总结 本报告对六个前沿模型进行综合安全性评估,揭示其在安全性和鲁棒性方面的差异,强调需要标准化评估以指导负责任的部署。

Comments 41 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11248 2026-01-19 cs.CV

Language-Agnostic Visual Embeddings for Cross-Script Handwriting Retrieval

跨脚本手写检索的语言无关视觉嵌入

Fangke Chen, Tianhao Dong, Sirry Chen, Guobin Zhang, Yishu Zhang, Yining Chen

机构 * School of Integrated Circuits, Zhejiang University(浙江大学集成电路学院) Shanghai Innovation Institute(上海创新研究院) School of Electrical and Electronic Engineering (EEE), Nanyang Technological University(南洋理工大学电子与电气工程学院) School of Data Science, Fudan University(复旦大学数据科学学院)

AI总结 本文提出了一种轻量级双编码框架,通过学习语言无关的视觉嵌入,实现跨脚本手写检索的高精度与低资源消耗。

Comments 9 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11077 2026-01-19 cs.SE cs.AI cs.CL

ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development

ABC-Bench: 评估现实世界开发中自主后端编码的基准测试

Jie Yang, Honglin Guo, Li Ji, Jiazheng Zhou, Rui Zheng, Zhikai Lei, Shuo Zhang, Zhiheng Xi, Shichun Liu, Yuxin Wang, Bo Wang, Yining Zheng, Tao Gui, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Qiji Zhifeng Co., Ltd.(上海启济智风有限公司) Shanghai Innovation Institute(上海创新研究院)

AI总结 ABC-Bench是一个评估自主后端编码在真实可执行工作流中性能的基准测试,通过224个实际任务揭示了当前模型在复杂后端工程任务中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11030 2026-01-19 cs.CV cs.AI

IDDR-NGP: Incorporating Detectors for Distractor Removal with Instant Neural Radiance Field

IDDR-NGP: 结合检测器去除干扰物的瞬时神经辐射场

Xianliang Huang, Jiajie Gou, Shuhang Chen, Zhizhou Zhong, Jihong Guan, Shuigeng Zhou

机构 * Fudan University(复旦大学) Tongji University(同济大学)

AI总结 IDDR-NGP通过结合检测器与隐式3D表示,实现对多种干扰物的高效去除,具有端到端训练和高鲁棒性。

Comments 8 pages, 7 figures, accepted by ACM-MM23

Journal ref Proceedings of the 31st ACM International Conference on Multimedia. 2023: 1343-1351

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10343 2026-01-19 cs.CL cs.AI

OctoBench: Benchmarking Scaffold-Aware Instruction Following in Repository-Grounded Agentic Coding

OctoBench:面向仓库基础代理编程的支架意识指令遵循基准测试

Deming Ding, Shichun Liu, Enhui Yang, Jiahang Lin, Ziying Chen, Shihan Dou, Honglin Guo, Weiyu Cheng, Pengyu Zhao, Chengjun Xiao, Qunhong Zeng, Qi Zhang, Xuanjing Huang, Qidi Xu, Tao Gui

机构 * Fudan University(复旦大学) MiniMax Peking University(北京大学)

AI总结 OctoBench通过评估仓库基础代理编程中的支架意识指令遵循能力,揭示了任务解决与合规性之间的差距,推动更高效的编码代理发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08689 2026-01-19 cs.CL

QuantEval: A Benchmark for Financial Quantitative Tasks in Large Language Models

QuantEval:大型语言模型中金融量化任务的基准测试

Zhaolu Kang, Junhao Gong, Wenqing Hu, Shuo Yin, Kehan Jiang, Zhicheng Fang, Yingjie He, Chunlei Meng, Rong Fu, Dongyang Chen, Leqi Zheng, Eric Hanchen Jiang, Yunfei Feng, Yitong Leng, Junfan Zhu, Xiaoyou Chen, Xi Yang, Richeng Xuan

机构 * Peking University(北京大学) Tsinghua University(清华大学) Fudan University(复旦大学) University of Macau(澳门大学) University of California, Los Angeles(加州大学洛杉矶分校) Shanghai Jiao Tong University(上海交通大学) Imperial College London(伦敦帝国理工学院) University of Chicago(芝加哥大学) Shanghai Weina Software Technology(上海韦纳软件技术) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 QuantEval是一个用于评估大型语言模型在金融量化任务中能力的基准测试,涵盖知识问答、数学推理和策略编程,通过回测框架评估模型性能,并展示了改进方法。

详情

展开后加载摘要…

URL PDF HTML 收藏