Pipeline platform disederhanakan: kamu masukkan monitoring project, sistem mengumpulkan data publik, NLP mengklasifikasi, dan kamu dapat dashboard siap-baca.
Definisikan keyword atau hashtag yang mau dipantau. Boolean logic didukung penuh: "BBM subsidi" AND (naik OR mahal) NOT hoax. Pilih platform (IG / FB / Threads) dan frekuensi crawl.
Sistem memanggil third-party data provider (Apify, EnsembleData, Data365) melalui abstraction layer. Multi-provider dengan failover otomatis — jika satu provider down, provider berikutnya mengambil alih.
Data mentah disimpan di object storage untuk audit & reprocessing. Kolom identitas (author_handle, author_id) dienkripsi at-rest sesuai UU PDP. Deduplication otomatis.
Setiap komentar melewati pipeline: preprocessing (slang, emoji, code-mixing) → IndoBERT tokenize → multi-head classifier untuk sentiment / toxicity / stance → confidence scoring. Komentar dengan confidence < threshold di-enrich pakai LLM.
Ekstrak relasi mention / reply / tag / repost → bangun graf di Neo4j → hitung centrality (degree, betweenness) → deteksi komunitas (Louvain) → identifikasi klaster penyebar awal berdasarkan timestamp.
Hasil dirender di dashboard interaktif. Alert otomatis (volume spike, sentiment surge, keyword sensitif) dikirim via email, WhatsApp (Fonnte), atau in-app. Export data mentah (CSV) atau laporan visual (PDF) dengan pseudonymization untuk file publik.
Data yang dikumpulkan hanya konten publik. Kami mematuhi UU PDP No. 27/2022 dengan enkripsi at-rest, retention window, deletion mechanism (DSAR), dan audit log. Kami tidak mengklaim "penyebar pertama tunggal" — output SNA selalu menyertakan disclaimer metodologis. Konsultasi ahli hukum data merupakan bagian dari pra-launch.