Analisis Frekuensi Kata dalam Sastra Bali Klasik Menggunakan Pendekatan Computational Linguistics

Authors

  • Pande Gede Brahmandika STKIP Agama Hindu Amlapura

DOI:

https://doi.org/10.59698/vilvatikta.v2i2.591

Keywords:

sastra bali klasik, linguistik, komputasional, hukum zipf, n-gram, filologi digital

Abstract

Sastra Bali klasik merupakan sumber pengetahuan peradaban yang kaya, namun pembedahan maknanya sering kali terbatas pada metode kualitatif manual. Penelitian ini bertujuan untuk menganalisis distribusi frekuensi kata dalam korpus sastra Bali klasik menggunakan pendekatan Computational Linguistics. Metode yang digunakan adalah kuantitatif deskriptif dengan tahapan text preprocessing yang meliputi tokenization, stopword removal, dan stemming. Analisis data dilakukan dengan menerapkan Hukum Zipf untuk melihat distribusi leksikal serta analisis N-Gram untuk mengidentifikasi kolokasi kata. Hasil penelitian menunjukkan bahwa distribusi kata dalam sastra Bali klasik secara konsisten mengikuti Hukum Zipf, dengan dominasi signifikan pada kosakata religius dan filosofis seperti dharma, hyang, dan atma. Selain itu, ditemukan pola kolokasi yang bersifat formulaic yang mencerminkan ketatnya aturan puitika tradisional. Penelitian ini juga berhasil mengidentifikasi ribuan kosakata arkais yang penting bagi revitalisasi bahasa. Implikasi dari penelitian ini adalah tersedianya fondasi data korpus untuk pengembangan teknologi bahasa Bali masa depan, seperti mesin penerjemah otomatis dan filologi digital.

References

Agastia, I. B. G. (2023). Sastra Bali Purwa: Kebertahanan dan Tantangan. Denpasar: Yayasan Dharma Sastra.

Baeza-Yates, R., & Ribeiro-Neto, B. (2011). Modern Information Retrieval: The Concepts and Technology behind Search. ACM Press.

Bird, S., Klein, E., & Loper, E. (2022). Natural Language Processing with Python: Analyzing Text with the Natural Language Toolkit. Sebastopol, CA: O'Reilly Media.

Ginaya, G. (2021). Digital Heritage: Preserving Balinese Culture in Modern Era. Journal of Cultural Studies, 15(2), 112-125.

Indrawan, I. K. A., Arthana, I. K. R., & Sastra, N. P. (2022). Digitalisasi Naskah Lontar Bali: Tantangan Komputasi dan Linguistik. Jurnal Teknologi Informasi dan Komputer, 8(1), 45-58.

Jatiyasa, I. W. (2022). Problem Filologi dalam Naskah Bali Tradisional. Denpasar: Pustaka Larasan.

Jurafsky, D., & Martin, J. H. (2023). Speech and Language Processing: An Introduction to Natural Language Processing, Computational Linguistics, and Speech Recognition. Stanford University: Draft online edition.

Manning, C. D., & Schütze, H. (2019). Foundations of Statistical Natural Language Processing. Cambridge, MA: MIT Press.

Medera, I. N. (2020). Linguistik Deskriptif Bahasa Bali Klasik. Denpasar: Universitas Udayana.

Putra, I. G. N. A., & Arthana, I. K. R. (2023). Computational Approaches for Balinese Script and Language. International Journal of Cultural Computing, 4(3), 210-228.

Suarka, I. N. (2021). Filologi Bali: Teori dan Implementasi. Denpasar: Pustaka Larasan.

Sudiana, I. M. (2024). Analisis Kuantitatif Sastra Jawa Kuno dan Bali dalam Perspektif Linguistik Komputasional. Jurnal Linguistik Indonesia, 42(1), 89-104.

Downloads

Published

2026-07-23

How to Cite

Pande Gede Brahmandika. (2026). Analisis Frekuensi Kata dalam Sastra Bali Klasik Menggunakan Pendekatan Computational Linguistics. Vilvatikta: Jurnal Pengembangan Bahasa Dan Sastra Daerah, 2(2), 57–65. https://doi.org/10.59698/vilvatikta.v2i2.591

Issue

Section

Articles