Serly Sustiana Saputri
Sistem Informasi, Fakultas Teknik, Universitas Tiga Serangkai

Published : 1 Documents Claim Missing Document
Claim Missing Document
Check
Articles

Found 1 Documents
Search

KLASIFIKASI PRESTASI AKADEMIK MAHASISWA MENGGUNAKAN METODE RANDOM FOREST Serly Sustiana Saputri; Dwi Remawati; Teguh Susyanto; Wawan Laksito Yuly Saptomo
JRIS : Jurnal Rekayasa Informasi Swadharma Vol 6, No 2 (2026): JURNAL JRIS EDISI JULI 2026
Publisher : Institut Teknologi dan Bisnis (ITB) Swadharma

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.56486/jris.vol6no2.1179

Abstract

This study aims to classify student academic achievement using the Random forest algorithm, utilizing the Student Performance dataset from Kaggle. The main attributes used as predictors include attendance rate, weekly study duration, and class engagement. The research methodology included data preprocessing with label encoding, an 80:20 split between training and test sets, and standardized model evaluation using accuracy, precision, recall, and F1-score. The results showed an accuracy of 31.03%. This low accuracy is due to the complexity of multi-class classification and imbalanced data distribution. This research contributes to mapping student learning behavior patterns and serves as a reference for developing more optimal academic prediction models.Penelitian ini bertujuan untuk mengklasifikasikan prestasi akademik mahasiswa menggunakan algoritma Random forest dengan memanfaatkan dataset Students Performance dari Kaggle. Atribut utama yang digunakan sebagai prediktor meliputi tingkat kehadiran, durasi belajar mingguan, dan keterlibatan di kelas. Metodologi penelitian mencakup pra-pemrosesan data dengan label encoding, pembagian data latih dan uji (80:20), serta evaluasi model yang diseragamkan menggunakan metrik akurasi, precision, recall, dan F1-score. Hasil penelitian menunjukkan nilai akurasi sebesar 31,03%. Rendahnya akurasi tersebut merupakan dampak dari kompleksitas klasifikasi multi-kelas dan distribusi data yang tidak seimbang (imbalanced data). Penelitian ini memberikan kontribusi dalam memetakan pola perilaku belajar mahasiswa serta menjadi referensi bagi pengembangan model prediksi akademik yang lebih optimal.