Mahattir Rahman Muhammad
Universitas Ibrahimy

Published : 1 Documents Claim Missing Document
Claim Missing Document
Check
Articles

Found 1 Documents
Search

Klasifikasi Risiko Stroke Menggunakan Metode Decision Tree pada Healthcare Dataset Stroke Data Mahattir Rahman Muhammad; Zaehol fatah
Jurnal Mahasiswa Teknik Informatika Vol. 5 No. 1 (2026): Volume 5 Nomor 1 April 2026
Publisher : Universitas Ngudi Waluyo

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.35473/jamastika.v5i1.4665

Abstract

Artikel ini menguraikan tahapan penggunaan algoritma Decision Tree guna membangun model prediktif untuk klasifikasi status pekerjaan menggunakan atribut usia dan level glukosa rata-rata sebagai variabel prediktor. Fokus utama adalah pada tantangan ketidakseimbangan kelas dalam data sosial dan kesehatan, yang mempengaruhi performa model dalam mengidentifikasi kelas minoritas. Dalam era Big Data, data mining dan machine learning memungkinkan ekstraksi pola dari data kompleks, tetapi sering kali bias terhadap kelas mayoritas terjadi. Oleh karena itu, proses pra-pemrosesan data yang meliputi teknik penanganan ketidakseimbangan seperti SMOTE penting dilakukan sebelum pembangunan model. Model yang dibangun menggunakan perangkat lunak RapidMiner Studio divalidasi melalui Cross Validation 10-Fold guna memastikan generalisasi dan mengurangi risiko overfitting. Hasil evaluasi menunjukkan bahwa meskipun Decision Tree mampu menghasilkan model interpretatif dan cukup akurat, performa pada kelas minoritas masih rendah akibat ketidakseimbangan data, tercermin dari rendahnya nilai Recall. Penggunaan teknik balancing data seperti SMOTE terbukti meningkatkan Recall dan keadilan model, menghasilkan prediksi yang lebih seimbang dan adil. Temuan ini menegaskan pentingnya penanganan ketidakseimbangan data dalam membangun model klasifikasi yang handal serta sebagai panduan pengembangan metode klasifikasi yang lebih efektif dalam bidang sosial dan kesehatan. Kata Kunci: Decision Tree, Ketidakseimbangan, Data Mining, Klasifikasi, Kesehatan   This article describes the stages of using the Decision Tree algorithm to build a predictive model for occupational status classification using age and average glucose level attributes as predictor variables. The main focus is on the challenge of class imbalance in social and health data, which affects the model's performance in identifying minority classes. In the Big Data era, data mining and machine learning enable pattern extraction from complex data, but often bias towards the majority class occurs. Therefore, data preprocessing processes that include imbalance handling techniques such as SMOTE are important before model development. The model built using RapidMiner Studio software was validated through 10-Fold Cross Validation to ensure generalization and reduce the risk of overfitting. The evaluation results show that although Decision Tree is capable of producing interpretive and fairly accurate models, its performance on minority classes is still low due to data imbalance, reflected in the low Recall value. The use of data balancing techniques such as SMOTE has been shown to improve model Recall and fairness, resulting in more balanced and fair predictions. These findings emphasize the importance of handling data imbalance in building reliable classification models and serve as a guide for developing more effective classification methods in the social and health fields. Keyword: Decision Tree, Imbalance, Data Mining, Classification, Health