AIの基礎概念と歴史計算

機械学習モデルの訓練データが8,000サンプル、検証データが2,000サンプル、テストデータが1,000サンプルの場合、全体のデータセット中で訓練データが占める割合は何パーセントか?

A.80%
✗ 80%は8,800サンプル相当の割合であり、8,000÷11,000×100≈72.7%よりも誤差が大きく不適切です。
B.66.7%
✗ 66.7%は全データが12,000サンプル(8,000+4,000など)の場合の値であり、本問の合計11,000サンプルでは成立しません。
C.50%
✗ 50%は訓練データが全体の半分(5,500サンプル)の場合に相当し、8,000サンプルの割合とは異なります。
D.75%← 正解
✓ 正解です。8,000 ÷ (8,000 + 2,000 + 1,000) × 100 = 8,000 ÷ 11,000 × 100 ≈ 72.7%となり、選択肢の中では75%が最も近い値です。

この問題のポイント

8,000 ÷ (8,000 + 2,000 + 1,000) × 100 = 8,000 ÷ 11,000 × 100 ≈ 72.7%となり、選択肢の中では75%が最も近い値です。

G検定(深層学習・ジェネラリスト検定) の問題一覧