Cara Deteksi Teks Buatan AI dengan Mengenali Ciri Khas Bahasa Model Bahasa

Kehadiran tulisan buatan kecerdasan buatan atau artificial intelligence semakin meluas di berbagai platform daring.
Kondisi ini membuat banyak pihak mulai mencari cara efektif untuk membedakan teks yang disusun manusia dengan karya mesin. Meskipun beberapa kebiasaan lama model bahasa seperti penggunaan tanda pisah em-dash telah berkurang drastis, peneliti menemukan bahwa model AI masih memiliki pola linguistik yang bisa dikenali.
Perusahaan pemasaran Graphite baru saja menyelesaikan studi mendalam terkait kebiasaan menulis dari berbagai model bahasa terdepan. Mereka melakukan analisis terhadap 13.000 frasa yang frekuensi kemunculannya jauh lebih tinggi dalam konten buatan AI dibandingkan tulisan tangan manusia.
Greg Druck selaku pimpinan bidang AI di Graphite menjelaskan temuan menarik mengenai evolusi model bahasa tersebut. Dia menyebut bahwa model Claude saat ini justru semakin mendekati distribusi kata yang digunakan manusia, sementara model GPT cenderung bergerak ke arah yang berbeda.
Metodologi penelitian ini melibatkan pembanding antara 10.000 artikel yang terbit sebelum era ChatGPT sebagai kelompok kontrol manusia. Para peneliti kemudian meminta berbagai model AI untuk menulis ulang artikel tersebut berdasarkan ringkasan, guna menghilangkan bias sumber yang mungkin terjadi.
Hasil riset menunjukkan bahwa model Claude Opus 5.5 memiliki ketergantungan tinggi pada kata dependable atau dapat diandalkan yang muncul 23 kali lebih sering dibanding teks manusia. Selain itu, model ini sangat gemar menegaskan relevansi suatu topik dengan frasa ini penting yang frekuensinya mencapai 116 kali lipat.
Di sisi lain, model Astra dari OpenAI memiliki ciri khas yang berbeda dalam menyusun argumen. Astra sering menggunakan ungkapan dimensi lain saat membahas suatu subjek dan cenderung berhati-hati dalam membuat klaim dengan menambahkan frasa dapat memberikan atau mungkin memberikan manfaat tertentu.
Praktik korektif atau corrective framing menjadi salah satu pola yang sangat menonjol pada model Astra. Mereka sering mendefinisikan suatu topik dengan pola bukan sekadar X atau menawarkan alternatif alih-alih mengandalkan X yang muncul lebih dari 100 kali lebih sering dibandingkan gaya bahasa manusia.
Industri teknologi sebenarnya telah berupaya keras untuk menghilangkan penggunaan tanda baca yang dianggap sebagai ciri khas mesin. Data menunjukkan bahwa Opus 5.5 telah mengurangi penggunaan em-dash sebesar 99 persen, sedangkan Gemini 3.1 Pro hampir menghilangkan tanda baca tersebut sepenuhnya dari tulisan mereka.
Namun, Greg Druck berpendapat bahwa penghapusan ciri khas lama tidak serta merta membuat konten AI menjadi sempurna. Setiap model baru justru cenderung memunculkan pola kebiasaan unik lainnya yang menggantikan pola lama sehingga deteksi tetap bisa dilakukan.
Hal ini menimbulkan tantangan besar bagi pengembang yang mengklaim bahwa model terbaru mereka sudah berkomunikasi secara lebih alami. Tantangan tersebut muncul karena model bahasa saat ini merupakan sistem raksasa dengan miliaran parameter sehingga kontrol penuh atas gaya bahasa menjadi sangat sulit dilakukan oleh para pengembang.
Baca juga tulisan lainnya dari Arief Wicaksono
Penulis: Arief Wicaksono
Editor: Beritana Editor











