Claim Missing Document
Check
Articles

Found 13 Documents
Search

Lexical Rule and Lexicon Effect for Part of Speech Tagging Bahasa Madura Nindian Puspa Dewi; Ubaidi Ubaidi
MATRIK : Jurnal Manajemen, Teknik Informatika dan Rekayasa Komputer Vol. 18 No. 1 (2018)
Publisher : Universitas Bumigora

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.30812/matrik.v18i1.332

Abstract

POS Tagging adalah dasar untuk pengembangan Text Processing suatu bahasa. Dalam penelitian ini kita meneliti pengaruh penggunaan lexicon dan perubahan morfologi kata dalam penentuan tagset yang tepat untuk suatu kata. Aturan dengan pendekatan morfologi kata seperti awalan, akhiran, dan sisipan biasa disebut sebagai lexical rule. Penelitian ini menerapkan lexical rule hasil learner dengan menggunakan algoritma Brill Tagger. Bahasa Madura adalah bahasa daerah yang digunakan di Pulau Madura dan beberapa pulau lainnya di Jawa Timur. Objek penelitian ini menggunakan Bahasa Madura yang memiliki banyak sekali variasi afiksasi dibandingkan dengan Bahasa Indonesia. Pada penelitian ini, lexicon selain digunakan untuk pencarian kata dasar Bahasa Madura juga digunakan sebagai salah satu tahap pemberian POS Tagging. Hasil ujicoba dengan menggunakan lexicon mencapai akurasi yaitu 86.61% sedangkan jika tidak menggunakan lexicon hanya mencapai akurasi 28.95 %. Dari sini dapat disimpulkan bahwa ternyata lexicon sangat berpengaruh terhadap POS Tagging.
Enhanced OCR Recognition for Madurese Text Documents: A Genetic Algorithm Approach with Tesseract 5.5 Muhammad Nazir Arifin; Muhammad Umar Mansyur; Ali Rahman; Nindian Puspa Dewi; Fauzan Prasetyo Eka Putra
JUITA: Jurnal Informatika JUITA Vol. 13 Issue 2, July 2025
Publisher : Department of Informatics Engineering, Universitas Muhammadiyah Purwokerto

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.30595/juita.v13i2.25794

Abstract

Character Recognition (OCR) for the Madurese language using Genetic Algorithms (GA). The study addresses the challenges in processing Madurese text documents by implementing a nine-step image preprocessing workflow optimized through GA. Our methodology combines rescaling, grayscale conversion, adaptive thresholding, deskewing, median blur, Otsu thresholding, border removal, contrast enhancement, and noise reduction, with the sequence determined by GA optimization. The system utilizes Tesseract 5.5 OCR engine configured with Vietnamese language model parameters to accommodate Maderese writing characteristics. Experiments conducted on a dataset of 500 images demonstrated significant improvements in recognition accuracy. The GA-optimized preprocessing sequence achieved a 24.32% Word Error Rate (WER) and 7.47% Character Error Rate (CER), marking substantial improvements over the baseline Tesseract implementation. Further optimization through language model selection, particularly using the Occitan (OCI) model, yielded 100% accuracy in specific test cases. The research also explored various fitness function configurations, with a 0.7:0.3 WER-to-CER ratio proving most effective. These results demonstrate the potential of GA optimization in enhancing OCR performance for regional languages with unique characteristics, contributing to the broader field of document digitization and language preservation
Digitalisasi Rapor Madrasah: Pengembangan Platform Entry Nilai Berbahasa Arab Berbasis Web untuk MI Al-Islamiyah Galis, Pamekasan Ubaidi Ubaidi; Badar Said; Idon Joni; Nindian Puspa Dewi; Ukhti Raudhatul Jannah
NGABDIMAS UNIRA : JURNAL PENGABDIAN KEPADA MASYARAKAT UNIRA Vol. 6 No. 1 (2026): Pengabdian kepada Masyarakat (Ngabdimas)
Publisher : Universitas Madura

Show Abstract | Download Original | Original Source | Check in Google Scholar

Abstract

Kegiatan pengabdian kepada masyarakat ini bertujuan untuk memberikan solusi digital bagi Madrasah Diniyah Takmiliyah Al-Islamiyah Galis, Kabupaten Pamekasan, dalam mengatasi permasalahan pengisian rapor siswa yang masih dilakukan secara manual dan menggunakan bahasa Arab. Kendala utama yang dihadapi adalah kesulitan guru dalam menyusun deskripsi penilaian berbahasa Arab secara konsisten dan akurat, yang berdampak pada keterlambatan administrasi, ketidakseragaman istilah, serta potensi kesalahan penulisan dan inkonsistensi data nilai. Sebagai solusi, tim pengabdi dari Universitas Madura merancang dan mengembangkan platform aplikasi berbasis web untuk memfasilitasi proses input nilai dan penyusunan deskripsi rapor secara terstandar. Sistem ini dilengkapi dengan pustaka istilah pendidikan berbahasa Arab, template deskripsi penilaian yang dapat disesuaikan, serta antarmuka yang ramah pengguna. Metode pelaksanaan meliputi analisis kebutuhan melalui observasi dan wawancara, perancangan dan pengembangan aplikasi, pelatihan guru, implementasi sistem di madrasah, serta evaluasi efektivitas penggunaan. Hasil yang diharapkan dari kegiatan ini adalah meningkatnya efisiensi dan efektivitas pengisian rapor, terjaminnya akurasi dan konsistensi data nilai siswa, serta meningkatnya literasi digital guru. Luaran kegiatan meliputi aplikasi web sistem rapor, modul pelatihan, laporan pengabdian, dan artikel ilmiah pada jurnal nasional terakreditasi.