False positive: apa yang sebenarnya diukur detektor AI
Kalau Anda bertanya kenapa tulisan sendiri terdeteksi AI padahal setiap katanya hasil ketikan Anda, mulailah dari apa yang sebenarnya dilihat detektor. Detektor tidak melihat Anda menulis. Yang dilihatnya hanya teks jadi, lalu ia memperkirakan seberapa mirip teks itu dengan pola yang ditinggalkan model bahasa: pilihan kata yang mudah ditebak, ritme kalimat yang seragam, frasa klise.
Artinya, tanda AI adalah tebakan tentang gaya, bukan catatan tentang apa yang terjadi. Tulisan manusia yang cermat dan konvensional sering cocok dengan pola itu, dan itulah sebabnya false positive terjadi. Detektor AI gratis yang menandai setiap kalimat, seperti milik kami, setidaknya menunjukkan baris mana yang membuat skornya condong, bukan hanya memberi satu angka. Untuk mekanisme di baliknya, lihat cara kerja AI detector.
Kenapa tulisan sendiri terdeteksi AI: enam penyebab umum
Ada enam hal yang membuat tulisan manusia terlihat mudah ditebak bagi detektor. Kemungkinan besar Anda mengenali setidaknya satu di antaranya.
1. Gaya bahasa formal yang serba baku
Tulisan sekolah, kampus, dan kantor menghargai frasa yang aman: “selain itu”, “memegang peranan penting”, kalimat utama yang hanya mengulang soal tugas. Model bahasa belajar dari teks semacam itu dalam jumlah sangat besar, jadi model juga memilih frasa yang sama. Kalau Anda menulis dengan gaya yang diharapkan, kalimat Anda jadi mudah ditebak. Dan yang mudah ditebak itulah yang dinilai detektor sebagai AI.
2. Template dan esai lima paragraf
Struktur juga berpengaruh. Pendahuluan yang ditutup dengan tesis tiga bagian, tiga paragraf isi yang panjangnya kira-kira sama, dan penutup yang mengulang tesis adalah juga bentuk bawaan ChatGPT. Kalau rubrik penilaian mengajarkan bentuk itu kepada Anda, esai Anda bisa terlihat seperti buatan mesin di tingkat paragraf, walaupun setiap kalimatnya Anda tulis sendiri.
3. Alat grammar dan parafrase yang menghaluskan teks Anda
Grammarly bisa menulis ulang kalimat utuh, dan QuillBot memang dibuat untuk memparafrasekannya. Kalau Anda menerima saran tulis ulang satu kalimat penuh atau menjalankan satu paragraf lewat alat parafrase, kalimat itu membawa pilihan kata alat tersebut, bukan pilihan kata Anda. Detektor memperhatikan hal ini: Turnitin, misalnya, menyebutkan bahwa modelnya juga mencari teks AI yang diolah ulang dengan alat parafrase seperti QuillBot. Kalimat Anda sendiri, setelah diubah oleh alat yang sama, bisa ikut membawa ciri yang sama.
Memperbaiki ejaan dan tanda koma adalah satu hal. Tulis ulang besar-besaran bisa jadi justru bagian yang ditunjuk oleh tanda AI itu.
4. Menulis dalam bahasa kedua
Penyebab ini punya bukti paling kuat. Dalam studi Stanford tahun 2023 yang terbit di jurnal Patterns, tujuh detektor yang banyak dipakai melabeli lebih dari separuh dari 91 esai TOEFL karya penulis yang bahasa ibunya bukan bahasa Inggris sebagai buatan AI, dengan rata-rata false positive 61,22%. Esai karya siswa kelas 8 di Amerika Serikat diklasifikasikan nyaris sempurna, dan 89 dari 91 esai TOEFL ditandai oleh setidaknya satu detektor.
Para peneliti menelusuri kesenjangan ini sampai ke kosakata. Rentang kata yang lebih sempit dan lebih aman membuat teks lebih mudah ditebak. Ketika mereka meminta ChatGPT menyederhanakan pilihan kata dalam esai siswa Amerika tersebut, rata-rata porsi yang ditandai sebagai AI naik dari 5,19% menjadi 56,65%.
5. Teks pendek
Satu atau dua paragraf memberi detektor sangat sedikit bahan, sehingga beberapa kalimat yang umum saja bisa mengubah hasilnya. Turnitin menaikkan batas minimumnya dari 150 menjadi 300 kata berdasarkan pengujiannya sendiri, dan detektor kami tidak menilai teks di bawah 40 kata karena alasan yang sama. Unggahan singkat di forum diskusi atau sebuah abstrak adalah jenis teks yang paling mudah salah dinilai.
6. Topik umum dan rumusan yang sudah familier
Jutaan orang sudah menulis tentang media sosial dan remaja, atau penyebab Perang Dunia I. Poin-poin yang paling jelas, dan cara paling lazim untuk merumuskannya, adalah yang paling sering dilihat model. Dalam satu contoh terkenal, Ars Technica menunjukkan detektor yang melabeli sebagian Konstitusi Amerika Serikat sebagai tulisan AI, terutama karena teks itu sangat sering muncul dalam data yang dipelajari model-model ini.
Tugas saya terdeteksi AI padahal tidak pakai AI: harus bagaimana?
Tetap tenang dan balas secara tertulis
Tanda AI terasa seperti vonis, tetapi perusahaan pembuat detektor sendiri mengatakan bukan. Turnitin memberi tahu para pengajar bahwa modelnya mungkin tidak selalu akurat dan tidak boleh menjadi satu-satunya dasar untuk mengambil tindakan yang merugikan siswa. Balas dengan sopan, katakan dengan jelas bahwa Anda menulis karya itu sendiri, dan minta waktu untuk membahasnya. Pesannya cukup singkat. Biar bukti Anda yang berbicara.
Kumpulkan bukti cara Anda menulis
Bukti terbaik bahwa Anda menulis sesuatu adalah jejak yang Anda tinggalkan saat menulisnya. Kumpulkan apa yang Anda punya sebelum ada pertemuan.
| Bukti | Tempat menemukannya | Yang ditunjukkan |
|---|---|---|
| Riwayat versi | Google Docs menyimpannya secara otomatis; Word menyimpannya untuk file yang disimpan di OneDrive atau SharePoint | Teks yang tumbuh selama berjam-jam atau berhari-hari, lengkap dengan bagian yang dihapus, salah ketik, dan tulisan ulang |
| Draf dan kerangka | File lama, buku catatan, foto rencana tulisan tangan, email ke diri sendiri | Bagaimana argumen Anda berubah sebelum versi akhir |
| Catatan dan sumber | PDF yang sudah Anda tandai, buku pinjaman perpustakaan, riwayat browser, aplikasi pengelola referensi | Bacaan di balik klaim-klaim Anda |
| Masukan selama proses | Komentar dari tutor, dosen pembimbing, atau teman sekelas | Orang lain melihat karya itu saat masih dikerjakan |
Jangan membuat apa pun yang baru setelah kejadian. “Draf” yang tanggalnya dimundurkan akan jauh lebih merugikan Anda daripada draf yang memang tidak ada.
Tanyakan alat apa yang menandainya dan berapa skornya
Tanyakan detektor apa yang dipakai, berapa skornya, dan bagian mana yang disorot. Detailnya penting. Skor yang tanggung adalah bukti yang lebih lemah daripada skor tinggi, dan Turnitin sendiri memberi tanda bintang pada skor di bawah 20% karena pengujiannya menemukan lebih banyak false positive di rentang itu. Kalau bagian yang disorot adalah bagian yang berpola baku, seperti pendahuluan atau ringkasan penutup, sampaikan hal itu.
Untuk seberapa besar bobot yang layak diberikan pada skor apa pun, baca panduan kami tentang apakah AI detector akurat.
Tawarkan untuk menjelaskan karya Anda secara langsung
Percakapan sering kali menjadi bukti terkuat Anda. Tawarkan untuk menjelaskan alur argumen Anda, alasan Anda memilih sumber-sumber itu, serta apa yang Anda buang dan kenapa. Orang yang benar-benar menulis sebuah esai biasanya bisa membahasnya secara rinci tanpa catatan. Kalau perlu, tawarkan untuk menulis satu paragraf pendek tentang topik itu di depan guru atau dosen Anda.
Pahami aturan kampus dan prosedur bandingnya
Baca pedoman integritas akademik institusi Anda sebelum pertemuan, terutama bagian tentang AI dan tentang banding. Cari tahu apa yang dianggap sebagai bukti, siapa yang memutuskan, dan berapa lama batas waktu untuk mengajukan banding. Kalau keputusannya tidak berpihak pada Anda, minta keputusan itu secara tertulis dan tempuh jalur resmi. Dosen pembimbing akademik atau pihak kampus yang menangani pengaduan mahasiswa bisa membantu Anda bersiap.
Jangan jalankan esai yang sudah ditandai lewat humanizer untuk “memperbaikinya”. Mengubah teks setelah kejadian tidak membuktikan bahwa Anda yang menulisnya, dan bisa memperburuk posisi Anda. Humanizer LumenWrite ditujukan untuk draf berbahasa Inggris yang memang boleh dibantu AI. Kalau Anda dituduh memakai AI padahal tidak, proses menulis Andalah yang membersihkan nama Anda.
Cara membuat tulisan Anda lebih terdengar seperti Anda
Tidak satu pun dari cara ini menjamin detektor akan sependapat dengan Anda, dan Anda tidak seharusnya menulis untuk mesin. Tetapi kebiasaan yang membuat tulisan lebih sulit ditebak juga membuatnya lebih enak dibaca.
- Pakai hal yang spesifik. “Bus saya terlambat empat kali di bulan Maret” lebih bermakna daripada “transportasi umum sering tidak bisa diandalkan”. Nama, angka, tempat, dan judul sulit ditebak.
- Masukkan contoh Anda sendiri. Sesuatu dari kelas, pekerjaan, atau obrolan. Model tidak bisa mengarang pengalaman Anda, dan pembaca bisa merasakan kalau pengalaman itu nyata.
- Variasikan panjang kalimat. Setelah kalimat panjang yang membangun argumen, sisipkan kalimat pendek. Seperti ini.
- Buang frasa klise. “Memegang peranan penting”, “berbagai macam”, “menjadi pengingat bagi kita semua”. Katakan saja hal yang sederhana.
- Ambil sikap. Teks buatan model menyeimbangkan segalanya. Kalau satu argumen lebih kuat, katakan begitu dan jelaskan alasannya.
- Biarkan paragraf tidak sama rata. Tidak setiap paragraf perlu panjang yang sama atau kalimat penutup yang rapi, dan paragraf yang hanya mengulang apa yang baru Anda katakan biasanya bisa dibuang.
- Biarkan proses Anda terlihat. Menulislah di Google Docs, atau di Word dengan file yang disimpan di OneDrive, agar riwayat versi terbentuk seiring Anda menulis.
Kalau Anda pelajar atau mahasiswa yang ingin memeriksa tugas sebelum dikumpulkan, halaman kami tentang cek AI skripsi dan esai menjelaskan arti skor untuk tugas kuliah dan cara membaca warna tiap kalimat.