Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
Pet-Bench: 评估大型语言模型作为社交网络服务中电子宠物的能力基准
机构 * Fudan University(复旦大学) ; Xiaohongshu Inc.(小红书公司) ; Beihang University(北航) ; Zhejiang University(浙江大学) ; Singapore University of Technology and Design(新加坡科技设计大学)
AI总结 Pet-Bench是一个评估大型语言模型作为电子宠物在社交网络服务中能力的基准测试,通过多样化的任务和7500多个互动实例,评估模型在自我进化和人际互动方面的表现,揭示模型大小和能力对性能的影响,推动情感沉浸式人-宠物互动的发展。