arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

2025-12-19 至 2025-12-19 共收录 6
2512.16778 2025-12-19 quant-ph cs.CR cs.IT cs.LG math.IT

Non-Linear Strong Data-Processing for Quantum Hockey-Stick Divergences

非线性强数据处理用于量子曲棍球发散度

Theshani Nuradha, Ian George, Christoph Hirche

机构 * Department of Mathematics and Illinois Quantum Information Science and Technology (IQUIST) Center, University of Illinois Urbana-Champaign(数学系和伊利诺伊大学量子信息科学与技术中心,伊利诺伊大学厄巴纳-香槟分校) Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子技术中心) Institute for Information Processing (tnt/L3S), Leibniz Universität Hannover(汉诺威莱布尼茨信息处理研究所(tnt/L3S))

AI总结 本文提出非线性强数据处理不等式,用于改进量子曲棍球发散度的隐私保障,通过更紧的有限混合时间提升隐私保护效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16649 2025-12-19 cs.CL

JustRL: Scaling a 1.5B LLM with a Simple RL Recipe

JustRL: 通过简单强化学习方法扩展1.5B语言模型

Bingxiang He, Zekai Qu, Zeyuan Liu, Yinghao Chen, Yuxin Zuo, Cheng Qian, Kaiyan Zhang, Weize Chen, Chaojun Xiao, Ganqu Cui, Ning Ding, Zhiyuan Liu

机构 * Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Shanghai AI Lab(上海人工智能实验室)

AI总结 JustRL通过简单强化学习方法在1.5B语言模型上实现高性能,省去复杂训练流程,展现稳定训练效果。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08697 2025-12-19 cs.SE cs.AI cs.CL

BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution

BigCodeArena: 通过执行揭示更多可靠的代码生成人类偏好

Terry Yue Zhuo, Xiaolong Jin, Hange Liu, Juyong Jiang, Tianyang Liu, Chen Gong, Bhupesh Bishnoi, Vaisakhi Mishra, Marek Suppa, Noah Ziems, Saiteja Utpala, Ming Xu, Guangyu Song, Kaixin Li, Yuhan Cao, Bo Liu, Zheng Liu, Sabina Abdurakhmanova, Wenhao Yu, Mengzhao Jia, Jihan Yao, Kenneth Hamilton, Kumar Shridhar, Minh Chien Vu, Dingmin Wang, Jiawei Liu, Zijian Wang, Qian Liu, Binyuan Hui, Meg Risdal, Ahsen Khaliq, Atin Sood, Zhenchang Xing, Wasi Uddin Ahmad, John Grundy, David Lo, Banghua Zhu, Xiaoning Du, Torsten Scholak, Leandro von Werra

机构 * Monash University(墨尔本大学) CSIRO’s Data61(CSIRO的数据61) Purdue University(普渡大学) Independent(独立) HKUST (Guangzhou)(香港科技大学(广州)) UCSD(加州大学圣地亚哥分校) UVA(弗吉尼亚大学) CNRS, France(法国国家科学研究中心) IBM Cisco(思科) Comenius University in Bratislava(布拉提斯拉瓦康门纽斯大学) University of Notre Dame(Notre Dame大学) Uber Tano Labs(Tano实验室) NUS(国立大学新加坡) Institute of Automation, CAS(中国科学院自动化研究所) Tencent AI Lab(腾讯AI实验室) University of Washington(华盛顿大学) Nevsky Collective(Nevsky集体) ETH Zurich(苏黎世联邦理工学院) Detomo Inc(Detomo公司) University of Oxford(牛津大学) UIUC(伊利诺伊大学香槟分校) Google(谷歌) NVIDIA Singapore Management University(新加坡管理学院) ServiceNow Research(ServiceNow研究) Hugging Face

AI总结 BigCodeArena通过执行揭示更多可靠的代码生成人类偏好,提出自动评分基准评估LLM编码质量。

Comments Built with love by the BigCode community :)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21112 2025-12-19 cs.CL cs.LG stat.ML

InsurTech innovation using natural language processing

保险科技创新使用自然语言处理

Panyi Dong, Zhiyu Quan

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文探讨了自然语言处理在保险科技中的创新应用,通过实际案例展示NLP如何提升保险数据分析的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01228 2025-12-19 cs.CL cs.LG

Who is In Charge? Dissecting Role Conflicts in Instruction Following

谁在掌控?解析指令遵循中的角色冲突

Siqi Zeng

机构 * University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究揭示大型语言模型在指令遵循中存在角色冲突,通过机制分析发现系统-用户冲突与社会冲突的不同处理方式,并强调了对齐方法的重要性。

Comments 12 pages, 5 figures, Mech Interp Workshop (NeurIPS 2025) Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11711 2025-12-19 cs.LG

Reinforcement Learning Finetunes Small Subnetworks in Large Language Models

强化学习在大型语言模型中微调小型子网络

Sagnik Mukherjee, Lifan Yuan, Dilek Hakkani-Tur, Hao Peng

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 强化学习在大型语言模型中通过微调小型子网络显著提升性能,且该子网络更新稀疏性源于数据分布和正则化技术的影响。

Comments NeuRIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏