データセット: Nvidia/Helpsteer2

term_id: datasetnvidiahelpsteer2

Category: basic_concepts

Definition

Helpsteer2はNVIDIAが公開したキュレーション済みデータセットで、大規模言語モデル(LLM)によって生成された回答のペアワイズ比較を含みます。このデータセットは、有用性、安全性、正確性などの多次元的な人間の好みや選好に焦点を当てています。

Summary

強化学習における人間のフィードバックからの強化学習(RLHF)で報酬モデルを訓練するために特別に設計された、高品質な人間の好み(バイアス)データセット。

Key Concepts

  • RLHF(人間のフィードバックからの強化学習)
  • 報酬モデリング
  • 人間の好み
  • アライメント(整列)

Use Cases

  • LLMのアライメントのための報酬モデルの訓練
  • モデルの有用性と安全性の評価
  • 好みデータを用いたベースモデルのファインチューニング