Tim peneliti yang terdiri dari dosen dan mahasiswa Program Studi Teknologi Rekayasa Perangkat Lunak (TRPL), Sekolah Vokasi Universitas Gadjah Mada (UGM), yakni Umar Taufiq, S.Kom., M.Cs., Nur Rohman Rosyid, S.T., M.T., D.Eng., dan Melani Putri Pratama, berhasil mengembangkan metode baru untuk mendeteksi plagiarisme ide pada dokumen berbahasa Indonesia. Penelitian ini menawarkan solusi atas keterbatasan alat deteksi plagiarisme konvensional yang sering kali gagal mengenali pencurian ide yang disamarkan melalui peringkasan (summarization).
Plagiarisme ide merupakan bentuk kecurangan akademik yang kompleks, di mana seseorang mengambil ringkasan atau inti sari dari dokumen orang lain dan memasukkannya ke dalam tulisan mereka sendiri. Metode deteksi plagiarisme umum sering kesulitan melacak hal ini karena struktur kalimat yang telah berubah, berbeda dengan plagiarisme copy-paste yang lebih mudah dikenali. Masalah ini semakin pelik karena mayoritas metode deteksi canggih yang ada saat ini lebih difokuskan untuk teks berbahasa Inggris, sementara pengembangan untuk teks Bahasa Indonesia masih sangat minim.
Melihat peluang dari berkembangnya pustaka Natural Language Processing (NLP) yang mendukung Bahasa Indonesia, tim peneliti mengembangkan metode deteksi yang memanfaatkan teknologi Named Entity Recognition (NER) dan Dependency Parsing. Inovasi utama dalam penelitian ini terletak pada adaptasi kedua teknologi tersebut agar sesuai dengan tata bahasa dan struktur sintaksis Bahasa Indonesia.
Dalam proses pengujiannya, tim peneliti menggunakan dataset standar internasional PAN13-14 summary obfuscation yang telah diterjemahkan ke dalam Bahasa Indonesia. Penggunaan dataset ini bertujuan untuk mengukur ketangguhan metode dalam mengenali pola plagiarisme ide yang telah dimanipulasi melalui peringkasan.
Hasil penelitian ini menunjukkan langkah maju yang signifikan dalam teknologi pemrosesan teks di Indonesia. Metode berbasis NER dan Dependency Parsing yang dikembangkan terbukti mampu mengidentifikasi kesamaan ide antar dokumen meskipun struktur kalimatnya berbeda.
Penelitian ini diharapkan dapat berkontribusi besar dalam menjaga integritas akademik di Indonesia. Dengan adanya alat deteksi yang mampu mengenali plagiarisme ide dalam Bahasa Indonesia, institusi pendidikan dapat lebih efektif dalam mencegah praktik kecurangan dan mendorong orisinalitas karya ilmiah. Selain itu, riset ini juga memperkaya khazanah teknologi NLP khusus untuk Bahasa Indonesia yang selama ini masih perlu banyak dieksplorasi.
Terobosan dalam teknologi pemrosesan bahasa ini merupakan wujud nyata dukungan terhadap SDG 9 (Industry, Innovation, and Infrastructure), khususnya dalam memperkuat kapasitas riset dan inovasi teknologi yang adaptif terhadap konteks lokal. Di sisi lain, upaya penegakan integritas akademik melalui sistem deteksi yang presisi selaras dengan prinsip SDG 4 (Quality Education). Dengan menjamin keaslian karya ilmiah, inovasi ini turut membangun fondasi ekosistem pendidikan yang berkualitas, jujur, dan bermartabat.
