Perkembangan layanan telekomunikasi digital mendorong bertambahnya jumlah ulasan pengguna yang digunakan sebagai bahan informasi guna mendukung pengambilan keputusan berbasis data. Penelitian ini bertujuan menganalisis sentimen ulasan aplikasi by.U menggunakan dua metode pelabelan data, yaitu rating-based labeling dan lexicon-based labeling, menggunakan algoritma Multinomial Naïve Bayes (MNB). Metode penelitian menerapkan framework Knowledge Discovery in Databases yang meliputi tahapan selection, preprocessing, transformation, data mining, dan evaluation. Dataset penelitian diperoleh dari Google Play sebanyak 8.000 ulasan berbahasa Indonesia. Tahap prapemrosesan mencakup cleaning, case folding, normalisasi, tokenisasi, stopword removal, serta stemming. Representasi fitur dilakukan menggunakan TF-IDF, sedangkan penyeimbangan data diterapkan melalui metode SMOTE. Evaluasi model dilakukan menggunakan metrik accuracy, precision, recall, dan F1-score dengan skema 10-fold cross validation. Hasil penelitian menunjukkan bahwa pendekatan lexicon-based labeling memberikan performa yang lebih baik dibandingkan rating-based labeling. Pendekatan rating-based menghasilkan accuracy sebesar 82,59%, precision 83,79%, recall 82,59%, dan F1-score 82,43%. Sementara itu, pendekatan lexicon-based memperoleh accuracy sebesar 88,96%, precision 89,69%, recall 88,96%, serta F1-score 88,91%. Temuan tersebut menunjukkan bahwa strategi pelabelan memiliki pengaruh terhadap performa klasifikasi sentimen. Pendekatan berbasis leksikon dinilai lebih efektif karena mampu memahami konteks linguistik dan ekspresi emosional pengguna secara lebih baik dibandingkan pendekatan berbasis rating.
Copyrights © 2026