arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2025-12-19 至 2025-12-19 共收录 8
2512.16778 2025-12-19 quant-ph cs.CR cs.IT cs.LG math.IT

Non-Linear Strong Data-Processing for Quantum Hockey-Stick Divergences

非线性强数据处理用于量子曲棍球发散度

Theshani Nuradha, Ian George, Christoph Hirche

机构 * Department of Mathematics and Illinois Quantum Information Science and Technology (IQUIST) Center, University of Illinois Urbana-Champaign(数学系和伊利诺伊大学量子信息科学与技术中心,伊利诺伊大学厄巴纳-香槟分校) Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子技术中心) Institute for Information Processing (tnt/L3S), Leibniz Universität Hannover(汉诺威莱布尼茨信息处理研究所(tnt/L3S))

AI总结 本文提出非线性强数据处理不等式,用于改进量子曲棍球发散度的隐私保障,通过更紧的有限混合时间提升隐私保护效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16565 2025-12-19 math.OC cs.LG

Non-Asymptotic Global Convergence of PPO-Clip

PPO-Clip算法的非渐近全局收敛性

Yin Liu, Qiming Dai, Junyu Zhang, Zaiwen Wen

机构 * Beijing International Center for Mathematical Research, Peking University(北京国际数学研究中心,北京大学) School of Mathematical Sciences, Peking University(北京大学数学学院) Department of Industrial Systems Engineering and Management, National University of Singapore(新加坡国立大学工业系统工程与管理系) Beijing International Center for Mathematical Research and Center for Machine Learning Research, Peking University(北京国际数学研究中心和机器学习研究中心,北京大学)

AI总结 本文研究了PPO-Clip算法的非渐近全局收敛性,通过理论分析建立了前向KL正则化器的线性收敛率及反向KL正则化器的静止收敛与局部线性收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08697 2025-12-19 cs.SE cs.AI cs.CL

BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution

BigCodeArena: 通过执行揭示更多可靠的代码生成人类偏好

Terry Yue Zhuo, Xiaolong Jin, Hange Liu, Juyong Jiang, Tianyang Liu, Chen Gong, Bhupesh Bishnoi, Vaisakhi Mishra, Marek Suppa, Noah Ziems, Saiteja Utpala, Ming Xu, Guangyu Song, Kaixin Li, Yuhan Cao, Bo Liu, Zheng Liu, Sabina Abdurakhmanova, Wenhao Yu, Mengzhao Jia, Jihan Yao, Kenneth Hamilton, Kumar Shridhar, Minh Chien Vu, Dingmin Wang, Jiawei Liu, Zijian Wang, Qian Liu, Binyuan Hui, Meg Risdal, Ahsen Khaliq, Atin Sood, Zhenchang Xing, Wasi Uddin Ahmad, John Grundy, David Lo, Banghua Zhu, Xiaoning Du, Torsten Scholak, Leandro von Werra

机构 * Monash University(墨尔本大学) CSIRO’s Data61(CSIRO的数据61) Purdue University(普渡大学) Independent(独立) HKUST (Guangzhou)(香港科技大学(广州)) UCSD(加州大学圣地亚哥分校) UVA(弗吉尼亚大学) CNRS, France(法国国家科学研究中心) IBM Cisco(思科) Comenius University in Bratislava(布拉提斯拉瓦康门纽斯大学) University of Notre Dame(Notre Dame大学) Uber Tano Labs(Tano实验室) NUS(国立大学新加坡) Institute of Automation, CAS(中国科学院自动化研究所) Tencent AI Lab(腾讯AI实验室) University of Washington(华盛顿大学) Nevsky Collective(Nevsky集体) ETH Zurich(苏黎世联邦理工学院) Detomo Inc(Detomo公司) University of Oxford(牛津大学) UIUC(伊利诺伊大学香槟分校) Google(谷歌) NVIDIA Singapore Management University(新加坡管理学院) ServiceNow Research(ServiceNow研究) Hugging Face

AI总结 BigCodeArena通过执行揭示更多可靠的代码生成人类偏好,提出自动评分基准评估LLM编码质量。

Comments Built with love by the BigCode community :)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07347 2025-12-19 eess.SY cs.AI cs.LG cs.SY

Distributed Risk-Sensitive Safety Filters for Uncertain Discrete-Time Systems

分布式风险敏感安全滤波器用于不确定离散时间系统

Armin Lederer, Erfaun Noorani, Andreas Krause

机构 * Department of Electrical and Computer Engineering, College of Design and Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系,设计与工程学院) Learning & Adaptive Systems Group, Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系学习与自适应系统小组)

AI总结 本文提出一种分布式风险敏感安全滤波器,用于不确定离散时间多智能体系统,通过价值函数定义的控制屏障函数和两种替代策略确保安全性与鲁棒性。

Journal ref IEEE Control Systems Letters, vol. 9, pp. 1231-1236, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16302 2025-12-19 cs.RO

ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation

ManiLong-Shot:交互感知的一次学习方法用于长周期操控

Zixuan Chen, Chongkai Gao, Lin Shao, Jieqi Shi, Jing Huo, Yang Gao

机构 * National University of Singapore(新加坡国立大学)

AI总结 ManiLong-Shot通过交互感知原语分解实现长周期操控任务的一次学习,有效提升机器人任务执行能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16149 2025-12-19 cs.AI

ToolForge: A Data Synthesis Pipeline for Multi-Hop Search without Real-World APIs

ToolForge: 一种无需真实世界API的多跳搜索数据合成管道

Hao Chen, Zhexin Hu, Jiajun Chai, Haocheng Yang, Hang He, Xiaohan Wang, Wei Lin, Luhang Wang, Guojun Yin, Zhuofeng zhao

机构 * North China University of Technology(华北理工大学) Meituan(美团) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National University of Singapore(新加坡国立大学) East China Normal University(华东师范大学)

AI总结 ToolForge通过构建虚拟工具生成多跳搜索数据,无需真实API调用,提升模型在多跳推理任务中的性能。

Comments 13 pages, 9 tables, 6 figures. Code available at https://github.com/Buycar-arb/ToolForge

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15751 2025-12-19 cs.LG cs.AI cs.MA

GLOW: Graph-Language Co-Reasoning for Agentic Workflow Performance Prediction

GLOW:基于图-语言协同推理的代理工作流性能预测

Wei Guan, Jian Cao, Jinyu Cai, Qiqi Cai, Jianqi Gao, See-Kiong Ng

机构 * School of Computer Science, Shanghai Jiao Tong University, China(上海交通大学计算机科学学院) Institute of Data Science, National University of Singapore, Singapore(新加坡国立大学数据科学研究所) School of Computer Engineering and Science, Shanghai University, China(上海大学计算机工程与科学学院)

AI总结 GLOW通过结合图神经网络与大语言模型,提出了一种统一的代理工作流性能预测框架,有效捕捉拓扑依赖和语义逻辑,提升预测准确性与排序效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19565 2025-12-19 cs.CL cs.AI q-bio.QM

Knowledge-Driven Agentic Scientific Corpus Distillation Framework for Biomedical Large Language Models Training

面向生物医学大语言模型训练的知识驱动代理科学语料库精简框架

Meng Xiao, Xunxin Cai, Qingqing Long, Chengrui Wang, Yuanchun Zhou, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences, Beijing, China(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) Duke-NUS Medical School, National University of Singapore, Singapore(新加坡国立大学杜克-新加坡医学部)

AI总结 本文提出一种知识驱动的代理框架,用于生物医学大语言模型训练中的语料库精简,通过多代理协作提升问答任务性能。

Comments Biomedical Large Language Models, Agentic Corpus Distillation, Synthetic Question-Answer Generation, Agentic AI, Knowledge Hierarchy Guidance

详情

展开后加载摘要…

URL PDF HTML 收藏