Learning to Allocate Incentives for Incentivized Advertising via Offline Model-Based Reinforcement Learning
基于离线模型强化学习的激励式广告激励分配学习
机构 * State Key Laboratory of Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室) ; ByteDance(字节跳动) ; The Hong Kong University of Science and Technology(香港科技大学)
AI总结 本研究针对激励式广告的序列激励分配问题,提出离线模型强化学习框架,实验显示MB-IQL可显著提升人均净利润,验证了该框架的有效性。