Analisis Performa Algoritma Random Forest dalam Mengatasi Overfitting pada Model Prediksi

Authors

  • Muhammad Wisnu Nugroho Universitas Kristen Satya Wacana
  • Hendry Hendry Satya Wacana Christian University image/svg+xml

DOI:

https://doi.org/10.35870/jtik.v9i4.4236

Keywords:

Random Forest, Machine Learning, Prediction Model, Accuracy, Ensemble Learning

Abstract

The Random Forest algorithm is an ensemble-based machine learning method widely used to improve the accuracy of predictive models. This algorithm works by randomly constructing many decision trees and combining the results to produce more accurate predictions and reduce the risk of overfitting. The advantages of Random Forest lie in its ability to handle complex datasets, manage variables with high correlation, and provide stable results in various scenarios. This study aims to analyze the performance of the Random Forest algorithm in overcoming overfitting and improving the accuracy of predictive models in various fields. The method used in this study is a literature study (library research), by collecting and analyzing 40 scientific literature from various sources such as international journals, proceedings, and relevant academic articles. Data were analyzed qualitatively with a comparative-descriptive approach to the advantages and disadvantages of Random Forest compared to other algorithms such as Decision Tree, Support Vector Machine (SVM), K-Nearest Neighbors (KNN), Naïve Bayes, and Neural Networks. The results show that Random Forest excels in handling high-dimensional data, reduces the risk of overfitting, and provides stable prediction results in various applications such as healthcare, finance, manufacturing, and environmental analysis. This research is limited to literature-based analysis without empirical testing using actual datasets. For future research, it is recommended to conduct direct experiments implementing the Random Forest algorithm on real-world datasets, as well as explore combinations of other ensemble algorithms, such as XGBoost or LightGBM, to improve the accuracy and efficiency of predictive models.

Downloads

Download data is not yet available.

Author Biographies

  • Muhammad Wisnu Nugroho, Universitas Kristen Satya Wacana

    Program Studi Teknik Informatika, Fakultas Teknologi Informasi, Universitas Kristen Satya Wacana, Kota Salatiga, Provinsi Jawa Tengah, Indonesia.

  • Hendry Hendry, Satya Wacana Christian University

    Program Studi Teknik Informatika, Fakultas Teknologi Informasi, Universitas Kristen Satya Wacana, Kota Salatiga, Provinsi Jawa Tengah, Indonesia

References

Alhabib, I. (2022). Komparasi metode deep learning, naïve Bayes dan random forest untuk prediksi penyakit jantung. Informatics for Educators and Professional: Journal of Informatics, 6(2), 176. https://doi.org/10.51211/itbi.v6i2.1881.

Apriliah, W., Kurniawan, I., Baydhowi, M., & Haryati, T. (2021). Prediksi kemungkinan diabetes pada tahap awal menggunakan algoritma klasifikasi random forest. Sistemasi, 10(1), 163. https://doi.org/10.32520/stmsi.v10i1.1129.

Aulia, Y., Andriyansyah, A., Suharjito, S., & Nensi, S. W. (2024). Analisis prediksi stroke dengan membandingkan tiga metode klasifikasi decision tree, naïve Bayes, dan random forest. Jurnal Ilmu Komputer dan Informatika, 3(2), 89–98. https://doi.org/10.54082/jiki.90.

Breiman, L. (2001). Random forests. Machine Learning, 45, 5–32.

Depari, D. H., Widiastiwi, Y., & Santoni, M. M. (2022). Perbandingan model decision tree, naïve Bayes dan random forest untuk prediksi klasifikasi penyakit jantung. Informatik: Jurnal Ilmu Komputer, 18(3), 239. https://doi.org/10.52958/iftk.v18i3.4694.

Fatunnisa, A., & Marcos, H. (2024). Prediksi kelulusan tepat waktu siswa SMK teknik komputer menggunakan algoritma random forest. Jurnal Manajemen Informatika (JAMIKA), 14(1), 101–111. https://doi.org/10.34010/jamika.v14i1.12114

Herjanto, M. F. Y., & Carudin, C. (2024). Analisis sentimen ulasan pengguna aplikasi Sirekap pada Play Store menggunakan algoritma random forest classifier. Jurnal Informatika dan Teknik Elektro Terapan, 12(2), 1204–1210. https://doi.org/10.23960/jitet.v12i2.4192.

Imaniar Ikko Mulya Rizky, Suhendro Yusuf Irianto, & Sriyanto. (2023). Perbandingan kinerja algoritma naïve Bayes, support vector machine dan random forest untuk prediksi penyakit ginjal kronis. Seminar Nasional Hasil Penelitian dan Pengabdian Masyarakat, 18, 139–151.

Irfannandhy, R., Handoko, L. B., & Ariyanto, N. (2024). Analisis performa model random forest dan CatBoost dengan teknik SMOTE dalam prediksi risiko diabetes. Edumatic: Jurnal Pendidikan Informatika, 8(2), 714–723. https://doi.org/10.29408/edumatic.v8i2.27990.

Iskandar, D. (2023). Optimasi parameter random forest menggunakan grid search untuk analisis time series. Petir, 16(2), 267–277. https://doi.org/10.33322/petir.v16i2.2084.

Jan Melvin Ayu Soraya Dachi, & Pardomuan Sitompul. (2023). Analisis perbandingan algoritma XGBoost dan algoritma random forest ensemble learning pada klasifikasi keputusan kredit. Jurnal Riset Rumpun Matematika dan Ilmu Pengetahuan Alam, 2(2), 87–103. https://doi.org/10.55606/jurrimipa.v2i2.1470

Manullang, O., Prianto, C., & Harani, N. H. (2023). Analisis sentimen untuk memprediksi hasil calon pemilu presiden menggunakan lexicon based dan random forest. Jurnal Ilmiah Informatika, 11(2), 159–169. https://doi.org/10.33884/jif.v11i02.7987.

Prasojo, B., & Haryatmi, E. (2021). Analisa prediksi kelayakan pemberian kredit pinjaman dengan metode random forest. Jurnal Nasional Teknologi dan Sistem Informasi, 7(2), 79–89. https://doi.org/10.25077/teknosi.v7i2.2021.79-89.

Rafrastara, F. A., Supriyanto, C., Paramita, C., & Astuti, Y. P. (2023). Deteksi malware menggunakan metode stacking berbasis ensemble. Jurnal Informatika: Jurnal Pengembangan IT, 8(1), 11–16. https://doi.org/10.30591/jpit.v8i1.4606.

Rayadin, M. A., Musaruddin, M., Saputra, R. A., & Isnawaty, I. (2024). Implementasi ensemble learning metode XGBoost dan random forest untuk prediksi waktu penggantian baterai aki. BIOS: Jurnal Teknologi Informasi dan Rekayasa Komputer, 5(2), 111–119.

Ristianto, A., & Sanjaya, F. I. (2025). Klasifikasi kualitas air sungai Daerah Istimewa Yogyakarta (DIY) menggunakan algoritma random forest. Jurnal Sistem Informasi dan Sistem Komputer, 10(1), 168–181.

Salsabil, M., Lutvi, N., & Eviyanti, A. (2024). Implementasi data mining dalam melakukan prediksi penyakit diabetes menggunakan metode random forest dan XGBoost. Jurnal Ilmiah Komputasi, 23(1), 51–58. https://doi.org/10.32409/jikstik.23.1.3507.

Saputra, D. B., Atina, V., & Nastiti, F. E. (2024). Penerapan model CRISP-DM pada prediksi nasabah kredit menggunakan algoritma random forest. Idealis: Indonesia Journal Information System, 7, 240–247.

Sobari, S., Purnamasari, A. I., Bahtiar, A., & Kaslani, K. (2025). Meningkatkan model prediksi kelulusan santri tahfidz di Pondok Pesantren Al-Kautsar menggunakan algoritma random forest. Jurnal Informatika dan Teknik Elektro Terapan, 13(1).

Tarigan, L. R. A., & Dahlan, D. (2024). Optimalisasi fitur dengan forward selection pada estimasi tingkat penyakit paru-paru menggunakan algoritma klasifikasi random forest. JATI (Jurnal Mahasiswa Teknik Informatika), 8(5), 10341–10348.

Wahyuni, R., & Irawan, Y. (2025). Model prediksi risiko kebakaran hutan menggunakan algoritma random forest dengan seleksi fitur lasso regression. JEKIN - Jurnal Teknik Informatika, 5(1), 91–100.

Zed, M. (2008). Metode penelitian kepustakaan. Yayasan Pustaka Obor Indonesia.

Downloads

Published

2025-10-01

Issue

Section

Computer & Communication Science

How to Cite

Nugroho, M. W., & Hendry, H. (2025). Analisis Performa Algoritma Random Forest dalam Mengatasi Overfitting pada Model Prediksi. Jurnal JTIK (Jurnal Teknologi Informasi Dan Komunikasi), 9(4), 1562-1571. https://doi.org/10.35870/jtik.v9i4.4236