第2章

RLHFとは

人間のフィードバックを使ってAIの出力を調整する強化学習の考え方です。

試験での出題ポイント

  • ChatGPTの調整と関連
  • 事前学習そのものではない
  • アライメントと関連

学習のコツ

この用語は単独で暗記するより、関連する章・テーマと一緒に確認すると理解が安定します。説明できる状態になったら、ジャンル別クイズや模試で定着度を確認してください。