Sistem pemeriksaan fakta otomatis diperlukan untuk membantu proses verifikasi
klaim berdasarkan bukti yang tersedia. Satu di antara pendekatan yang dapat
digunakan adalah Knowledge Stream (KS), yaitu metode berbasis graf pengetahuan
yang menilai dukungan suatu klaim melalui aliran pengetahuan antara entitas
subyek dan obyek. Namun penerapan metode KS pada dataset pemeriksaan fakta
berbasis teks membutuhkan informasi terstruktur dalam bentuk triplet subyekpredikat-
obyek (S-P-O). Sedangkan dataset pemeriksaan fakta yang tersedia,
khususnya yang berbahasa Indonesia, biasanya disajikan dalam bentuk teks tidak
terstruktur. Penelitian ini bertujuan untuk membentuk representasi triplet S-P-O
dari klaim dan bukti pada pemeriksaan fakta berbahasa Indonesia, sehingga dapat
digunakan untuk pemeriksaan fakta menggunakan metode KS.
Penelitian dilakukan menggunakan 300 data Mafindo yang terdiri atas 150 data real
dan 150 data fake. Data tersebut dibagi menjadi data validasi dan data uji dengan
perbandingan 7:3. Dilakukan prapemrosesan terhadap klaim, bukti hasil crawling,
dan bukti hasil peringkasan berupa pembersihan menggunakan Qwen3-8B dan
normalisasi berbasis regex. Eksperimen pembentukan triplet menggunakan Qwen3-
8B dilakukan dalam tiga skenario sumber bukti yaitu bukti hasil crawling, bukti
hasil ringkasan, dan gabungan keduanya. Kualitas pembentukan triplet dievaluasi
menggunakan recall, pair success rate, dan path success rate, sedangkan hasil
pemeriksaan fakta dievaluasi menggunakan akurasi dan Makro-F1.
Hasil eksperimen menunjukkan bahwa skenario gabungan bukti menghasilkan
keterhubungan triplet terbaik dengan recall sebesar 87,3%, pair success rate
sebesar 77,25%, dan path success rate sebesar 29,67%. Skenario bukti hasil
crawling dan gabungan bukti memberikan kinerja pemeriksaan fakta terbaik pada
data uji dengan akurasi sebesar 65,38% dan Makro-F1 sebesar 48,12%. Hasil
tersebut menunjukkan bahwa cakupan bukti yang lebih luas dapat meningkatkan
keterhubungan graf dibandingkan penggunaan bukti hasil peringkasan. Namun
rendahnya path success rate menunjukkan bahwa perbedaan representasi entitas
dan relasi antara klaim dan bukti masih menjadi keterbatasan utama dalam
penerapan KS pada dataset pemeriksaan fakta berbahasa Indonesia.
Perpustakaan Digital ITB