Kenapa Tulisan Manusia Bisa Kedeteksi AI di GPTZero? Ini Penjelasannya
Kalau kamu sudah capek-capek nulis sendiri tapi tetap kedeteksi sebagai "kemungkinan ditulis AI", kamu nggak sendirian. Ini situasi yang cukup umum terjadi, terutama di kalangan mahasiswa yang menulis tugas akhir dengan gaya bahasa formal, dan ada penjelasan teknis yang jelas di baliknya — bukan berarti tulisanmu jelek atau kampus akan langsung menuduhmu curang tanpa proses klarifikasi.
Artikel ini membahas secara khusus fenomena false positive di GPTZero: kenapa itu bisa terjadi, karakteristik tulisan manusia yang paling rawan kena flag, dan langkah konkret yang bisa kamu ambil supaya lebih tenang menghadapi situasi ini.
Bagaimana GPTZero sebenarnya bekerja
GPTZero (dan tools sejenis) nggak benar-benar "tahu" siapa yang menulis suatu teks. Tools ini menebak berdasarkan pola statistik bahasa, bukan mendeteksi identitas penulis secara langsung. Dua indikator utama yang dipakai:
Perplexity — mengukur seberapa "mudah ditebak" kata berikutnya dalam sebuah kalimat berdasarkan model bahasa. Semakin mudah ditebak polanya, semakin besar kemungkinan dianggap output AI.
Burstiness — mengukur seberapa bervariasi panjang serta struktur kalimat dalam satu dokumen. Tulisan AI generatif cenderung punya pola yang lebih rata dan konsisten dari awal sampai akhir; tulisan manusia biasanya lebih naik-turun, mengikuti ritme berpikir yang natural dan tidak selalu konsisten.
Karena mekanismenya murni statistik, bukan pemahaman kontekstual sesungguhnya, tools ini pada dasarnya menebak berdasarkan kemiripan pola — dan pola tertentu dalam tulisan manusia memang bisa kebetulan mirip dengan karakteristik output AI.
Kenapa tulisan manusia bisa "kena flag" juga
Beberapa gaya menulis manusia justru punya karakteristik statistik yang mirip pola AI generatif, meski ditulis 100% oleh manusia tanpa bantuan apa pun. Ini beberapa penyebab paling umum:
Gaya formal dan sangat terstruktur. Bagian metodologi atau kajian teori yang ditulis dengan kalimat baku dan konsisten cenderung lebih rawan ke-flag, karena variasi struktur kalimatnya memang rendah — bukan karena ditulis AI, tapi karena tuntutan gaya bahasa akademik formal memang menuntut konsistensi semacam itu.
Topik dengan istilah teknis baku. Bidang yang banyak memakai terminologi standar — seperti hukum, kedokteran, atau teknik — menghasilkan kalimat yang polanya lebih seragam antar-penulis, karena memang ada batasan istilah yang harus dipakai secara konsisten sesuai konvensi keilmuan masing-masing bidang.
Penulis non-native yang belajar formula akademik baku. Kalau kamu belajar menulis akademik dari template, contoh skripsi kakak tingkat, atau pola kalimat yang itu-itu saja secara berulang, gaya bahasamu bisa jadi lebih "rata" secara statistik — ciri yang kebetulan mirip pola AI, meski sepenuhnya hasil tulisan tanganmu sendiri.
Hasil editing berkali-kali sampai sangat rapi. Ironisnya, tulisan yang diedit terlalu halus supaya "kedengaran akademis" — menghilangkan semua kejanggalan, menyeragamkan struktur kalimat, membuang semua variasi yang terasa "kasar" — malah bisa mengurangi variasi alami yang justru jadi ciri khas tulisan manusia yang belum terlalu banyak diedit.
Menulis dalam kondisi sangat fokus dan terstruktur. Kadang saat menulis dengan kerangka yang sudah sangat matang di kepala (misalnya setelah riset mendalam dan sudah tahu persis apa yang mau disampaikan), hasil tulisan bisa jadi terlalu "rapi" dan runtut sampai polanya menyerupai output yang direncanakan secara sistematis — mirip karakteristik AI.
Ini disebut false positive, dan itu masalah yang diakui secara luas
Bahkan pembuat tools deteksi AI sendiri mengakui bahwa false positive (tulisan manusia yang salah terdeteksi sebagai AI) itu nyata dan belum sepenuhnya terpecahkan sebagai masalah teknis. Beberapa institusi pendidikan di berbagai negara bahkan mulai lebih hati-hati mengandalkan skor deteksi AI sebagai bukti tunggal kecurangan, dan lebih memilih menjadikannya bahan diskusi lanjutan dengan mahasiswa yang bersangkutan daripada vonis otomatis.
Ini bukan berarti tools deteksi AI tidak berguna sama sekali — untuk kasus teks yang murni hasil generate AI tanpa diedit sama sekali, akurasinya cukup baik. Masalahnya lebih ke batas antara "pasti AI" dan "kemungkinan AI" yang seringkali tidak setegas yang diharapkan, terutama untuk teks yang berada di area abu-abu seperti tulisan akademik formal.
Apa yang bisa kamu lakukan kalau ini terjadi
- Jangan langsung panik atau merasa bersalah. Ini masalah teknis di alat deteksinya, bukan otomatis berarti kamu curang. Memahami ini penting supaya kamu bisa merespons situasi dengan tenang, bukan dengan panik yang justru bisa memicu keputusan revisi yang tergesa-gesa dan kurang efektif.
- Tambah variasi kalimat. Campur kalimat pendek dan panjang, ubah struktur klausa, hindari pola kalimat yang terlalu seragam dari paragraf ke paragraf. Baca dulu satu bab secara keseluruhan, lalu perhatikan apakah ritme kalimatnya terasa monoton — kalau iya, itu titik awal yang baik untuk direvisi.
- Masukkan lebih banyak opini dan analisis personal. Bagian yang berisi pemikiranmu sendiri — bukan sekadar menjelaskan ulang teori dari sumber lain — biasanya polanya lebih "manusiawi" secara alami, karena melibatkan proses berpikir yang lebih personal dan tidak mengikuti formula baku.
- Simpan bukti proses menulis. Draft, riwayat revisi di Google Docs atau Word (version history), atau catatan penelitianmu bisa jadi bukti konkret kalau suatu saat kejujuran proses menulismu dipertanyakan oleh dosen penguji.
- Diskusikan lebih dulu dengan dosen pembimbing. Kalau kamu khawatir gaya bahasamu rawan ke-flag (misalnya karena kamu memang menulis dengan gaya yang sangat formal dan terstruktur), lebih baik dikomunikasikan di awal proses bimbingan daripada menunggu jadi masalah mendadak saat sidang.
Bedanya dengan kasus tulisan AI yang memang sengaja diedit supaya lolos deteksi
Penting dibedakan: artikel ini membahas kasus tulisan manusia asli yang kebetulan kena false positive, bukan strategi untuk menyamarkan tulisan hasil AI generatif supaya lolos deteksi. Kalau kamu memang menggunakan ChatGPT atau tools AI lain untuk membantu menulis dan hasilnya perlu diproses lebih lanjut, itu situasi yang berbeda — baca juga artikel kami soal risiko copy-paste dari ChatGPT ke skripsi untuk memahami konteks dan risikonya secara lebih lengkap.
Pertanyaan yang sering muncul
Apakah GPTZero bisa membedakan tulisan yang diedit AI dari tulisan asli manusia yang formal? Ini area yang paling sulit dibedakan oleh tools deteksi AI manapun saat ini, karena keduanya bisa punya karakteristik statistik yang mirip. Inilah kenapa skor deteksi AI sebaiknya tidak dijadikan bukti tunggal tanpa konteks tambahan.
Apakah menulis dengan gaya lebih santai bisa menghindari false positive? Bisa membantu menurunkan risiko, tapi tulisan akademik formal tetap menuntut standar bahasa baku tertentu yang tidak selalu bisa dihindari sepenuhnya, terutama di bagian metodologi atau kajian teori.
Kalau dosen penguji menanyakan soal skor deteksi AI saat sidang, bagaimana sebaiknya menjawabnya? Jelaskan proses menulismu secara jujur, dan kalau memungkinkan tunjukkan bukti riwayat revisi atau draft awal sebagai konteks tambahan. Kejujuran dan kemampuan menjelaskan proses berpikirmu biasanya lebih meyakinkan dosen dibanding sekadar membantah skor tanpa penjelasan.
Kalau butuh bantuan menurunkan skor deteksi AI
Kadang setelah dicek, kamu tetap butuh bagian tertentu diproses ulang supaya polanya lebih natural tanpa kehilangan makna atau argumen aslinya, terutama kalau bagian tersebut memang secara konsisten kena flag berulang kali. Ini yang dikerjakan tim Helpin lewat layanan cek GPT Zero dan parafrase manual untuk GPTZero — bukan asal generate ulang pakai AI lain yang justru berisiko menambah masalah baru, tapi diproses manual oleh orang yang paham konteks akademik dan bisa menjaga argumen aslimu tetap utuh.
