AIの基礎概念と歴史計算
機械学習モデルの訓練データが8,000サンプル、検証データが2,000サンプル、テストデータが1,000サンプルの場合、全体のデータセット中で訓練データが占める割合は何パーセントか?
A.80%
✗ 80%は8,800サンプル相当の割合であり、8,000÷11,000×100≈72.7%よりも誤差が大きく不適切です。
B.66.7%
✗ 66.7%は全データが12,000サンプル(8,000+4,000など)の場合の値であり、本問の合計11,000サンプルでは成立しません。
C.50%
✗ 50%は訓練データが全体の半分(5,500サンプル)の場合に相当し、8,000サンプルの割合とは異なります。
D.75%← 正解
✓ 正解です。8,000 ÷ (8,000 + 2,000 + 1,000) × 100 = 8,000 ÷ 11,000 × 100 ≈ 72.7%となり、選択肢の中では75%が最も近い値です。
この問題のポイント
8,000 ÷ (8,000 + 2,000 + 1,000) × 100 = 8,000 ÷ 11,000 × 100 ≈ 72.7%となり、選択肢の中では75%が最も近い値です。
「AIの基礎概念と歴史」の他の問題
機械学習モデルが訓練データに過度に適合し、テストデータでの性能が低下した場合、このような状況を改善するためには、次のうち…深層学習モデルが新しいドメイン(異なるデータ分布)に対応する際、事前学習済みモデルを使用した転移学習を適用する場合、モデ…勾配消失問題が発生している深層ニューラルネットワークを改善する場合、次のうちどの施策の組み合わせが最も効果的ですか?自然言語処理タスクで、訓練データが極めて限定的な場合、次のうちどのアプローチが最も実用的ですか?画像分類モデルが特定のクラスに対して極めて高い確信度(90%以上の予測確率)を返しても、実際には予測が外れている場合が頻…時系列予測タスクで、長期的な依存関係を捉える際に通常のLSTMが困難を示した場合、改善策として最も適切なのはどれですか?