DxHF: Providing High-Quality Human Feedback for LLM Alignment via Interactive Decomposition
机构 * Aalto University(阿alto大学) ; ETH Zürich(苏黎世联邦理工学院) ; KTH Royal Institute of Technology(皇家理工学院)
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)