38 vocabulary entries in this category
Metrik evaluasi model klasifikasi yang menghitung persentase prediksi yang benar secara keseluruhan dari total seluruh p...
Rumus matematika untuk menghitung probabilitas bersyarat suatu kejadian berdasarkan pengetahuan atau bukti awal yang ber...
Kumpulan dataset dalam volume sangat besar, bergerak cepat, dan beraneka ragam format sehingga memerlukan teknologi pemr...
Korelasi adalah ukuran statistik yang menyatakan sejauh mana dua variabel berfluktuasi bersama-sama. Korelasi positif me...
Dalam statistik dan machine learning, Estimator adalah aturan untuk menghitung estimasi kuantitas tertentu berdasarkan d...
False Negative (Negatif Palsu), atau Kesalahan Tipe II (Type II Error), terjadi ketika model gagal mendeteksi keberadaan...
False Positive (Positif Palsu), sering disebut sebagai Kesalahan Tipe I (Type I Error), terjadi ketika model machine lea...
Distribusi Gaussian (atau Distribusi Normal/Kurva Lonceng) adalah distribusi probabilitas kontinu yang simetris di sekit...
Histogram adalah representasi grafis dari distribusi data numerik. Histogram membagi rentang nilai data menjadi interval...
Hypothesis Testing (Uji Hipotesis) adalah metode statistik yang menggunakan data sampel untuk mengevaluasi hipotesis ten...
Variabel Independen (sering dilambangkan sebagai X) adalah variabel yang nilainya tidak dipengaruhi oleh variabel lain y...
Interquartile Range (IQR) adalah ukuran variabilitas statistik yang didasarkan pada membagi kumpulan data menjadi kuarti...
Indeks Jaccard (atau Koefisien Jaccard) adalah statistik yang digunakan untuk mengukur kesamaan dan keragaman set sampel...
Joint Probability (Probabilitas Gabungan) adalah ukuran statistik yang menghitung kemungkinan dua peristiwa terjadi bers...
Kullback-Leibler (KL) Divergence adalah ukuran statistik yang menghitung seberapa jauh satu distribusi probabilitas berb...
Kurtosis adalah ukuran statistik yang menggambarkan bentuk distribusi data, khususnya seberapa "berat" ekornya (tail) di...
Metode Kuadrat Terkecil (Least Squares) adalah pendekatan standar dalam analisis regresi untuk memperkirakan solusi sist...
Likelihood (Kemungkinan) adalah konsep statistik yang sering tertukar dengan Probabilitas. Probabilitas memprediksi data...
Regresi Linear adalah algoritma machine learning dasar yang memodelkan hubungan antara variabel independen (input) dan v...
Rantai Markov adalah model stokastik yang menggambarkan urutan peristiwa yang mungkin, di mana probabilitas setiap peris...
Mean Absolute Error (MAE) adalah metrik evaluasi model regresi yang menghitung rata-rata selisih mutlak (absolut) antara...
Mean Squared Error (MSE) adalah salah satu fungsi kerugian (loss function) yang paling umum digunakan untuk masalah regr...
Simulasi Monte Carlo adalah teknik matematika yang digunakan untuk memperkirakan kemungkinan hasil dari peristiwa yang t...
Normalisasi adalah teknik preprocessing data yang digunakan untuk mengubah nilai kolom numerik dalam dataset ke skala um...
Outlier (Pencilan) adalah titik data yang berbeda secara signifikan dari pengamatan lainnya dalam suatu dataset. Outlier...
P-value adalah ukuran probabilitas dalam uji hipotesis statistik yang membantu menentukan apakah hasil eksperimen valid ...
PCA adalah teknik pengurangan dimensi (dimensionality reduction) statistik yang digunakan untuk menyederhanakan dataset ...
Probabilitas adalah cabang matematika yang mengukur kemungkinan terjadinya suatu peristiwa. Nilai probabilitas berkisar ...
Quantile adalah titik potong yang membagi rentang distribusi probabilitas menjadi interval kontinu dengan probabilitas y...
Analisis Kuantitatif adalah teknik yang menggunakan model matematika dan statistik, pengukuran, dan penelitian untuk mem...
Kuartil adalah nilai-nilai yang membagi data yang telah diurutkan menjadi empat bagian yang sama besar. Ada tiga kuartil...
Regresi adalah teknik statistik dan machine learning untuk memprediksi nilai kontinu (angka) berdasarkan hubungan antar ...
Dalam analisis regresi, Residu adalah perbedaan antara nilai yang diamati (data asli) dan nilai yang diprediksi oleh mod...
Sampling adalah proses memilih sebagian (subset) data dari populasi yang lebih besar untuk dianalisis. Tujuannya adalah ...
Standar Deviasi adalah ukuran yang digunakan untuk mengukur jumlah variasi atau sebaran dari sekumpulan nilai data. Stan...
Analisis Deret Waktu adalah metode statistik untuk menganalisis serangkaian titik data yang diurutkan berdasarkan waktu....
Dalam konteks Bias-Variance Tradeoff, Varian mengukur seberapa sensitif model terhadap fluktuasi spesifik dalam data lat...
Z-Score (Skor Standar) adalah ukuran statistik yang menunjukkan berapa banyak standar deviasi sebuah elemen data berada ...