Paket Replikasi — Analisis Komparatif Kerentanan Kode Hasil Generasi LLM pada Prompt Berbahasa Indonesia dan Inggris Menggunakan SAST
收藏资源简介:
Paket Replikasi - Analisis Komparatif Kerentanan Kode Hasil Generasi LLM pada Prompt Berbahasa Indonesia dan Inggris Menggunakan SAST Paket ini berisi data, kode, dan hasil antara yang digunakan dalam penelitian mengenai perbandingan kerentanan kode hasil generasi Large Language Model (LLM) pada prompt berbahasa Indonesia dan Inggris. Penelitian menggunakan 42 task pemrograman Python dari enam kategori OWASP Top 10:2025. Setiap task diberikan dalam dua bahasa dengan tiga repetisi, menghasilkan 252 berkas kode. Kode yang lolos validasi fungsional dianalisis menggunakan Semgrep dan Bandit, kemudian temuan yang relevan diverifikasi secara manual oleh dua penilai secara buta. Analisis perbedaan dilakukan menggunakan uji McNemar eksak dengan koreksi Benjamini-Hochberg. Paket mencakup task dan prompt, kode hasil generasi, hasil validasi fungsional, temuan SAST, tabel pemetaan CWE–OWASP, hasil blinding, formulir verifikasi penilai, serta skrip analisis dan pembuatan grafik. Data dan kode dalam paket ini disediakan untuk mendukung reprodusibilitas penelitian. Beberapa berkas kode merupakan keluaran mentah model dan dapat mengandung pola kode yang rentan. Berkas tersebut tidak dimaksudkan untuk digunakan dalam lingkungan produksi.



