Claim Missing Document
Check
Articles

Found 1 Documents
Search

Analisis Performa Wav2Vec2.0 pada Transkripsi Nama Barang dalam Kondisi Audio Bersih dan Bising Dhimas Taka Desfrika Perdana; Daniel Swanjaya; Resty Wulanningrum
Prosiding SEMNAS INOTEK (Seminar Nasional Inovasi Teknologi) Vol. 10 No. 3 (2026): Prosiding Seminar Nasional Inovasi Teknologi Tahun 2026
Publisher : Universitas Nusantara PGRI Kediri

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.29407/ecv7ey20

Abstract

Automatic Speech Recognition (ASR) merupakan teknologi yang memungkinkan suara diubah menjadi teks secara otomatis. Penelitian ini bertujuan menganalisis performa model Wav2Vec2.0 pada transkripsi nama barang berbahasa Indonesia dalam kondisi audio bersih dan bising. Dataset terdiri atas 400 rekaman audio yang dikumpulkan dari empat pembicara dengan kosakata terbatas berupa 20 nama barang. Evaluasi dilakukan menggunakan metrik Word Error Rate (WER) dan Character Error Rate (CER) pada kondisi audio bersih, babble noise, crowd noise, dan vehicle noise. Hasil pengujian menunjukkan bahwa kondisi audio bersih menghasilkan performa terbaik dengan nilai WER sebesar 2,08% dan CER sebesar 0,35%, sedangkan crowd noise menghasilkan tingkat kesalahan tertinggi dengan WER sebesar 22,92% dan CER sebesar 9,44%. Hasil penelitian menunjukkan bahwa peningkatan tingkat kebisingan berpengaruh terhadap penurunan performa transkripsi model Wav2Vec2.0 pada tugas pengenalan kosakata terbatas.