Model Seçimi ve Kullanım Amacı
Hangi modelin daha uygun olduğuna hangi kanıtlarla karar verilir?
Kavram
Model seçimi, aynı görev ve doğrulama düzeninde karşılaştırma gerektirir. Başarı metriği, açıklanabilirlik, bakım yükü, gecikme ve veri gereksinimi birlikte değerlendirilir. Bir algoritma ailesinin adı, belirli bir veri setindeki başarısını önceden belirlemez.
Bir örnek üzerinden
Aşağıdaki karar tablosunda A ve B iki varsayımsal adaydır. Puanlar gerçek bir karşılaştırma çalışmasının sonucu değildir; ölçüt ağırlıklarının tercihi nasıl etkilediğini görünür kılar. Bütün puanlarda yüksek değer daha iyidir; gecikme ve bakım maliyeti de buna göre yarar puanına çevrilmiştir.
Görsel üzerinden
Ağırlıklı puan Σ(wᵢsᵢ)/Σwᵢ ile hesaplanır. Ağırlık değişince sıralama değişebilir. Bütün ağırlıklar sıfırken sonuç tanımsızdır. Bir adayın zorunlu gereksinimi karşılamaması, yüksek toplam puanla telafi edilmemelidir.
Örnek karar tablosu
Puanlar 0–100 ölçeğinde temsili değerlerdir.
| Ölçüt | A | B | Ağırlık |
|---|---|---|---|
| Doğrulama başarısı | 74 | 86 | |
| Açıklama kolaylığı | 90 | 65 | |
| Tahmin hızı | 92 | 72 | |
| Bakım kolaylığı | 85 | 60 |
Yorumlama
Gerçek model seçiminde tahmini puanlar yerine ölçülmüş ve belirsizliği değerlendirilmiş kanıt kullanılır. Aynı doğrulama üzerinde çok sayıda alternatif denemek seçim yanlılığı yaratabilir. Son seçimin ayrı test verisiyle sınanması gerekir.
Kapsam ve okuma
Bu modülün görselleri öğretim amaçlıdır. İlgili okuma: scikit-learn · Çapraz doğrulama. Açıklamalı kaynak dizini →