Muhammad Sobri Maulana
Rumah Sakit Angkatan Udara Prof. dr. Abdulrachman Saleh Jakarta

Published : 1 Documents Claim Missing Document
Claim Missing Document
Check
Articles

Found 1 Documents
Search

Dapatkah Large Language Models Melakukan Triase Kasus Layanan Primer di Indonesia Dengan Aman? Muhammad Sobri Maulana; Dwitia Pratiwi; Arditya Prayogi
JINTEN: Journal of Intelligent Systems and Digital Science Vol 1 No 2: September 2026
Publisher : CV. Ihsan Cahaya Pustaka

Show Abstract | Download Original | Original Source | Check in Google Scholar | DOI: 10.66031/jinten.v1i2.664

Abstract

Model bahasa besar atau large language models (LLMs) berpotensi mendukung triase yang berhadapan langsung dengan pasien, tetapi bukti keselamatannya masih didominasi konteks emergency department berbahasa Inggris dan belum menjawab kebutuhan layanan primer Indonesia. Penelitian ini mengusulkan benchmark empat tingkat untuk self-care, konsultasi rutin, penilaian urgent pada hari yang sama, dan rujukan emergency menggunakan 240 vignette klinis berbahasa Indonesia. Empat LLM anonim dievaluasi melalui exact triage accuracy, macro F1, weighted kappa, high-acuity sensitivity, under-triage, unsafe under-triage, serta robustness terhadap variasi redaksi. Untuk mendemonstrasikan pipeline analitik sebelum eksperimen prospektif, seluruh hasil numerik pada artikel ini disimulasikan. Pada simulasi, exact accuracy berkisar 60,4%–78,3%; model terbaik mencapai macro F1 78,4%, weighted kappa 0,886, high-acuity sensitivity 92,5%, dan unsafe under-triage 0,8%. Performa menurun ketika ambiguitas vignette meningkat dan kegagalan penting terkonsentrasi pada presentasi atipikal atau tidak lengkap. Temuan demonstratif ini menunjukkan bahwa benchmark triase perlu memprioritaskan metrik sensitif terhadap bahaya, bukan accuracy semata, dan memerlukan validasi Indonesia dengan versi model terkunci, adjudikasi klinisi, serta ambang keselamatan yang diprespesifikasi sebelum deployment patient-facing.