python basic data analysis pima indians diabetes dataset

Python ile Temel Veri Analizi

Çalışma/İnceleme Süreci

  • Veriseti yükleme,
  • Veriseti tanıma (Analizi),
  • Temel seviye görselleştirmeler,
  • Makine öğrenmesi modeli uyarlanması,
  • Başarı değerlendirmeleri

Veriseti Yükleme

Veriseti Tanıma ve Temel Analiz Görselleştirmeleri

https://www.kaggle.com/datasets/uciml/pima-indians-diabetes-database

https://github.com/miracozturk17/basic-python-data-analysis

# Sutunlari yeniden adlandirdik.
data.columns = [
    'n_times_pregnant', # Number of Times Pregnant - Gebe Kalma Sayisi
    'p_g_concentration', # Plasma glucose Concentration - Plazma Glikoz Konsantrasyonu
    'd_b_pressure', # Diastolic Blood Pressure - Diyastoli Kan Basinci
    't_s_thickness', # Triceps Skinfold Thickness - Triseps Deri Kivrim Kalinligi
    's_insulin', # 2-Hour Serum Insulin - 2 Saatlik Serum Insulini
    'b_m_index', # Body Mass Index - Vucut Kitle Indeksi
    'd_p_function', # Diabetes Pedigree Function - Diyabet Soyagaci Islevi
    'age', # Age - Yas
    'c_variable' # Class Variable - Sinif Degiskeni
]
python basic data analysis view dataset
python basic data analysis view data characteristic
  • Alan sayısı,
  • Alan adları,
  • Alan veri kalitesi,
  • Alan veritipi,
  • Özet veritipi sayısı,
  • Hafıza kullanım boyutu
python basic data analysis view data statistical

Burada, mevcut verisetimize yönelik;

  • Toplam veri sayisi, (Satır bazlı.)
  • Alanların ortalaması,
  • Alanların standart sapması,
  • Alanların minumum değeri,
  • Alanların maksimum değeri

ve,

  • %25 (Birinci Çeyrek, veya Q1): Bu değer, verilerin altından yukarıya doğru sıralandığında ilk %25’lik dilimi temsil eder.Yani; tüm verilerin %25’i bu değerden daha küçük veya buna eşittir.
  • %50 (Medyan, veya Q2): Medyan, verilerin orta noktasını temsil eder.Veriler küçükten büyüğe sıralandığında, medyan verilerin tam ortasında yer alır.Tüm verilerin yarısı bu değerden daha küçük veya buna eşittir.
  • %75 (Üçüncü Çeyrek, veya Q3): Bu değer, verilerin altından yukarıya doğru sıralandığında ilk %75’lik dilimi temsil eder.Yani; tüm verilerin %75’i bu değerden daha küçük veya buna eşittir.
python basic data analysis view data statistical histogram
python basic data analysis view data statistical bar chart
python basic data analysis view data statistical bubble chart
python basic data analysis view data statistical detail chart

Makine Öğrenmesi Modeli Uyarlanması

Başarı Değerlendirmeleri

python basic data analysis view data statistical decision tree graph

, ,

İlgili Yazılar