Proyek pemrosesan bahasa alami (NLP) dan machine learning menggunakan Python untuk mengklasifikasikan komentar publik terkait pembangunan dan isu Ibu Kota Nusantara (IKN) dari dataset CSV.
data/— Menyimpan dataset komentar IKN mentah maupun hasil preprocessing (format.csv).models/— File model machine learning yang sudah dilatih (misalnya format.pklatau model weights).src/— Kumpulan modul preprocessing teks (cleaning, case folding, stemming/lemmatization, tokenizing) dan feature extraction.cekaduan.py— Skrip untuk pengujian atau pengecekan klasifikasi teks komentar secara spesifik.main.py— File eksekusi utama untuk pelatihan, evaluasi, atau inferensi model.
- Python 3.8 ke atas
- Pustaka pendukung umum:
pandasnumpyscikit-learnnltkatauSastrawi(untuk preprocessing bahasa Indonesia)
- Clone repositori:
git clone [https://github.com/johnsonteks/Klasifikasi_IKN.git](https://github.com/johnsonteks/Klasifikasi_IKN.git) cd Klasifikasi_IKN