G検定
G検定|人の評価した応答の良し悪しを学習へ反映したい
QUESTION
人の評価した応答の良し悪しを学習へ反映したい
人の評価した応答の良し悪しを学習へ反映したい。最も適切なものはどれですか。
ANSWER & EXPLANATION
正解:C
人の選好を報酬にして応答を調整する方法です。学習目標と必要なラベルの量を区別します。
選択肢のポイント
- Aカリキュラム学習は課題の難しさを段階的に変える学習方法です。この設問で求めるものとは異なります。
- Bマスク言語モデルは隠した語を周囲から予測する学習方法です。この設問で求めるものとは異なります。
- C正解です。人の選好を報酬にして応答を調整する方法です。
- Dゼロショット学習はその課題の例を与えず対応することです。この設問で求めるものとは異なります。
関連キーワード
- 人間のフィードバックによる強化学習
- モデルを学ばせる方法
参考にした公式情報:日本ディープラーニング協会 G検定の試験範囲(シラバス) / 確認日:2026年9月29日