GUNAWAN, ANDES PUTRA (2026) EKSTRAKSI DATA OTOMATIS DARI KARTU TANDA MAHASISWA (KTM) MENGGUNAKAN OPTICAL CHARACTER RECOGNITION (OCR) DAN REGULAR EXPRESSION BERBASIS GUI TKINTER. Skripsi (Bachelor) thesis, Universitas Muhammadiyah Bengkulu.
|
Text (FULLTEXT)
Andes_Putra_Gunawan_2255201038_FullText.pdf - Submitted Version Restricted to Repository staff only Download (2MB) | Request a copy |
|
|
Text (TURNITIN)
Andes_Putra_Gunawan_2255201038_TURNITIN.pdf - Submitted Version Restricted to Repository staff only Download (10MB) | Request a copy |
|
|
Text (ABSTRAK & BAB 1)
Andes_Putra_Gunawan_2255201038_ABSTRAK & BAB 1.pdf - Submitted Version Download (315kB) |
|
|
Text (BAB 2)
Andes_Putra_Gunawan_2255201038_BAB 2.pdf - Submitted Version Download (392kB) |
|
|
Text (BAB 3)
Andes_Putra_Gunawan_2255201038_BAB 3.pdf - Submitted Version Restricted to Repository staff only Download (648kB) | Request a copy |
|
|
Text (BAB 4)
Andes_Putra_Gunawan_2255201038_BAB 4.pdf - Submitted Version Restricted to Repository staff only Download (1MB) | Request a copy |
|
|
Text (BAB 5)
Andes_Putra_Gunawan_2255201038_BAB 5.pdf - Submitted Version Download (240kB) |
|
|
Text (REF & LAMP)
Andes_Putra_Gunawan_2255201038_REF & LAMP.pdf - Submitted Version Download (243kB) |
Abstract
Penelitian ini bertujuan merancang dan mengimplementasikan sistem ekstraksi data otomatis dari citra KTM menggunakan kombinasi Optical Character Recognition (OCR) berbasis Tesseract dan Regular Expression, dengan antarmuka pengguna grafis berbasis Tkinter. Sistem yang dibangun terdiri atas tahap pra-pemrosesan citra (pemangkasan zona teks, koreksi kemiringan dengan penjagaan terhadap latar belakang bertekstur, dan binerisasi Otsu), ekstraksi teks OCR menggunakan strategi multi-sumber dan multi-mode segmentasi halaman, serta ekstraksi field data menggunakan pola Regular Expression bertingkat yang dilengkapi kamus pemetaan kata kunci untuk field Program Studi dan Fakultas. Pengujian dilakukan terhadap 100 citra KTM Universitas Muhammadiyah Bengkulu menggunakan metrik evaluasi confusion matrix berupa Precision, Recall, F1-Score, dan Accuracy untuk setiap field data. Hasil pengujian menunjukkan sistem mencapai akurasi keseluruhan sebesar 93,8%, dengan Precision 94,86%, Recall 98,72%, dan F1-Score 96,75%. Akurasi per-field menunjukkan NPM mencapai 100%, Fakultas 98%, Program Studi 95%, TTL 94%, dan Nama 82%. Penelitian ini juga menemukan dan mengatasi permasalahan lintas platform pada pustaka OCR yang menyebabkan hilangnya spasi dan tanda baca pada hasil ekstraksi ketika dijalankan pada sistem operasi Windows. Hasil penelitian menunjukkan bahwa kombinasi OCR dan Regular Expression yang dirancang khusus sesuai karakteristik visual KTM mampu menghasilkan sistem ekstraksi data yang akurat dan layak digunakan untuk mendukung proses administrasi akademik. Kata Kunci: Ekstraksi Data, Kartu Tanda Mahasiswa (KTM), Optical Character Recognition (OCR), Regular Expression, Tesseract, Confusion Matrix, Tkinter
| Item Type: | Thesis (Skripsi (Bachelor)) |
|---|---|
| Additional Information: | Pembimbing : Dr. Yulia Darmi, S.Kom., M.Kom |
| Uncontrolled Keywords: | Ekstraksi Data, Kartu Tanda Mahasiswa (KTM), Optical Character Recognition (OCR), Regular Expression, Tesseract, Confusion Matrix, Tkinter |
| Subjects: | Universitas Muhammadiyah Bengkulu > 02-Fakultas Teknik > 55201-(S1) Teknik Informatika 02-Fakultas Teknik > 55201-(S1) Teknik Informatika |
| Divisions: | 02-Fakultas Teknik > 55201-(S1) Teknik Informatika Subjek Terkait > 02-Fakultas Teknik > 55201-(S1) Teknik Informatika |
| Depositing User: | Mrs Hesti Ayu |
| Date Deposited: | 05 Sep 2026 07:02 |
| Last Modified: | 05 Sep 2026 07:02 |
| URI: | http://repository.umb.ac.id/id/eprint/4114 |
Actions (login required)
![]() |
View Item |

