第2章
RLHFとは
人間のフィードバックを使ってAIの出力を調整する強化学習の考え方です。
試験での出題ポイント
- ChatGPTの調整と関連
- 事前学習そのものではない
- アライメントと関連
学習のコツ
この用語は単独で暗記するより、関連する章・テーマと一緒に確認すると理解が安定します。説明できる状態になったら、ジャンル別クイズや模試で定着度を確認してください。
人間のフィードバックを使ってAIの出力を調整する強化学習の考え方です。
この用語は単独で暗記するより、関連する章・テーマと一緒に確認すると理解が安定します。説明できる状態になったら、ジャンル別クイズや模試で定着度を確認してください。