Klasifikasi Potensi Pelanggaran Pemilu 2024 pada Platform X Menggunakan Model IndoBERTweet

Authors

  • Christenia Tagah Universitas Negeri Manado Author

DOI:

https://doi.org/10.67142/edutik.v6i4.522

Keywords:

IndoBERTweet, Klasifikasi Teks, Media Sosial X, Pelanggaran Pemilu, Pemrosesan Bahasa Alami

Abstract

ABSTRAK

             Media sosial X (sebelumnya Twitter) telah muncul sebagai saluran utama untuk penyebaran informasi, sekaligus menghadirkan risiko signifikan terhadap pelanggaran pemilu selama Pemilihan Umum (Pemilu) Indonesia 2024. Penelitian ini bertujuan untuk mendeteksi potensi pelanggaran terkait pemilu, seperti kampanye hitam (black campaign) dan hoaks, menggunakan teknik Pemrosesan Bahasa Alami (Natural Language Processing/NLP). Kumpulan data (dataset) yang terdiri dari 1.141 twit dikumpulkan dan melalui tahapan pra-pemrosesan (preprocessing) yang ketat serta pelabelan biner. Penelitian ini mengimplementasikan IndoBERTweet, sebuah model deep learning transformer yang dilatih khusus sebelumnya (pre-trained) menggunakan diskursus Twitter berbahasa Indonesia. Hasil eksperimen menunjukkan bahwa model IndoBERTweet mencapai akurasi luar biasa sebesar 98% dan F1-score sebesar 98% dalam mengidentifikasi potensi pelanggaran. Visualisasi Word Cloud lebih lanjut mengidentifikasi dominasi istilah-istilah kunci seperti "hoax" (hoaks), "fitnah", dan "black campaign" (kampanye hitam) di dalam data pelanggaran yang terdeteksi. Temuan ini membuktikan bahwa melakukan penyesuaian (fine-tuning) pada model bahasa yang dilatih secara lokal sangat efektif untuk memantau konten pemilu digital di Indonesia. Penelitian ini berkontribusi dalam menyediakan kerangka kerja yang kuat bagi pihak berwenang untuk memitigasi eskalasi pelanggaran digital secara real-time.

ABSTRACT

              Social media platform X (formerly Twitter) has emerged as a primary channel for information dissemination while simultaneously presenting significant risks for election violations during the 2024 Indonesian General Election. This study aims to detect potential election-related violations, such as black campaigns and hoaxes, using Natural Language Processing (NLP) techniques. A dataset comprising 1,141 tweets was collected and subjected to a rigorous preprocessing pipeline and binary labeling. The research implements IndoBERTweet, a deep learning transformer model specifically pre-trained on Indonesian Twitter discourse. The experimental results demonstrate that the IndoBERTweet model achieves an exceptional accuracy of 98% and an F1-score of 98% in identifying potential violations. Word Cloud visualizations further identify a dominance of key terms such as "hoax," "slander" (fitnah), and "black campaign" within the detected violation data. These findings prove that fine-tuning a locally pre-trained language model is highly effective for monitoring digital election content in Indonesia. This study contributes a robust framework for authorities to mitigate the escalation of digital violations in real-time.

Downloads

Download data is not yet available.

References

Aermadepa, A., Apriyanto, A., Mulyeni, Y., Judijanto, L., Lawra, R. D., & Nizwana, Y. (2024). Penegakan Hukum Pemilu dalam Pemilihan Kepala Daerah Serentak Indonesia Tahun 2024. PT. Sonpedia Publishing Indonesia.

Damayanti, N. M., Ariningtyas, I. D., Icham, M. I. A., & Sari, A. P. (2025). Analisis Sentimen Publik Pada Tagar# Btscomeback Di Platform X Menggunakan Indobertweet. Jurnal Informatika dan Teknik Elektro Terapan, 13(3).

Dewi, B. E. S. (2025). Sentiment analysis model on electric vehicles using IndoBERTweet and IndoBERT algorithm. Antivirus: Jurnal Ilmiah Teknik Informatika, 19(1), 169-179.

Fawcett, T. (2006). An introduction to ROC analysis. Pattern recognition letters, 27(8), 861-874.

Koto, F., Lau, J. H., & Baldwin, T. (2021, November). IndoBERTweet: A pretrained language model for Indonesian Twitter with effective domain-specific vocabulary initialization. In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing (pp. 10660-10668).

Mola, S. A. S., Djawa, S. N. R., & Mauko, A. Y. (2025). Text Mining: Analisis Sentimen dengan Naïve Bayes. Kaizen Media Publishing.

Nampira, A. A., Judijanto, L., Wati, D. C., Hermawan, E., Cahyono, T. A., Prayudani, S., ... & Sitanggang, A. T. (2025). Artificial Intelligence: A Guide for Thinking Humans. PT. Green Pustaka Indonesia.

Permana, A. A. J., & Wijaya, I. N. S. W. (2024). Identifikasi Dan Normalisasi Teks Slang Dengan Fasttext Pada Twitter Dalam Bahasa Indonesia. Jurnal Pendidikan Teknologi dan Kejuruan, 21(1), 33-44.

Syah, F. P., & Hasanuddin, T. (2025). Implementasi Naive Bayes Untuk Analisis Sentimen Pada data Twitter Tentang Isu Politik di Indonesia. LINIER: Literatur Informatika dan Komputer, 2(3), 302-316.

Tribuana, D., Maramis, L., Resky, A. M., & Hidayat, R. (2025). Deep Learning. Serasi Media Teknologi.

Downloads

Published

2026-08-04