Tingginya angka kematian akibat penyakit jantung diperparah oleh proses diagnosis konvensional yang membutuhkan ketelitian tinggi serta rentan terhadap risiko kesalahan manusia (human error). Penelitian ini bertujuan untuk melakukan analisis komparasi performa algoritma Logistic Regression, Decision Tree, dan Support Vector Machine (SVM) guna mengidentifikasi model klasifikasi risiko penyakit jantung yang paling optimal bagi domain medis. Eksperimen diimplementasikan menggunakan skrip Python interaktif yang menguji 1.025 baris sampel klinis lewat pembagian data 80:20, standardisasi fitur, serta pengujian silang 5-Fold Cross-Validation. Berdasarkan hasil pengujian sistem, algoritma Decision Tree mencatatkan nilai Test Accuracy tertinggi mencapai 98,5%. Namun, pengujian validasi silang mengungkap performa aslinya jatuh di angka 82,2%, yang membuktikan adanya fenomena overfitting parah akibat rekayasa duplikasi data latihan, sehingga model ini dieksklusi dari pemilihan akhir. Sementara itu, algoritma Logistic Regression menunjukkan performa yang cukup stabil dengan nilai Test Accuracy sebesar 81,0% dan CV Mean Accuracy 84,4%. Di sisi lain, algoritma SVM dengan Linear Kernel terbukti menghasilkan stabilitas performa terbaik dengan Test Accuracy 81,5% dan CV Mean Accuracy mencapai 85,6%. Meskipun akurasi globalnya berada di bawah Decision Tree, SVM Linear menjadi model paling unggul karena mencatatkan metrik Recall (sensitivitas) kelas sakit tertinggi sebesar 92,38% yang krusial untuk menekan persentase kesalahan diagnosis fatal berupa False Negative. Dengan demikian, algoritma SVM Linear disimpulkan sebagai instrumen alternatif pendukung keputusan klinis terbaik yang paling andal bagi tim kardiologi.
Copyrights © 2026