生成AIの仕組み

生成AIパスポート 一問一答の問題です。解説付きで個別に学習できます。

第2章 標準 ID: TF-0165

問題

RLHFは、人間のフィードバックを用いてモデルの出力を望ましい方向へ調整する考え方である。

正解: ○

解説

○です。RLHFは、人間による評価やフィードバックを利用して、モデルがより望ましい応答を出しやすくするための調整手法です。単なる大量データの追加投入とは異なります。

演習モードで解く 前の問題 次の問題