APeB: Benchmarking Personalization Ability of Large Language Model Agents
APeB:大型语言模型智能体个性化能力基准测试
机构 * The Chinese University of Hong Kong(香港中文大学) ; ByteDance(字节跳动)
AI总结 研究大型语言模型智能体在处理原始、未明确查询时的个性化问题,通过引入个性化产品搜索测试平台构建基准测试,评估发现模型处理明确查询较好,但早期查询有困难,简单方法能提升性能。
Comments NA