Fitur paling menonjol dari Argon adalah ketahanannya terhadap serangan injeksi perintah tidak langsung. Serangan ini terjadi ketika pelaku menyembunyikan instruksi jahat di dalam konten yang kemudian dibaca oleh AI, sehingga model bisa saja mengikuti perintah asing tersebut alih-alih perintah pengguna asli.
Pada uji coba Gray Swan, Argon hanya mencatat angka kerentanan sebesar 0,7 persen. Sebagai perbandingan, model lain seperti GPT-6 Astra memiliki tingkat kerentanan 8,5 persen, sementara Grok 4.6 dan Kimi K3 bahkan bisa dimanipulasi hingga lebih dari 50 persen.
Untuk menjaga keamanan, akses terhadap Argon saat ini dibatasi hanya bagi tim keamanan yang telah lolos verifikasi melalui Program Fairwind. Program ini merupakan inisiatif Google yang melibatkan lebih dari 650 mitra, termasuk entitas pemerintah dan operator infrastruktur kritis.
Google sengaja menyediakan model ini tanpa batasan siber bawaan, yang biasanya digunakan untuk menolak permintaan terkait peretasan. Strategi ini diambil agar para pembela keamanan siber dapat berpikir layaknya penyerang untuk menemukan celah sebelum pelaku kriminal memanfaatkannya.
Harga perkenalan untuk layanan ini dipatok sebesar USD 2 (sekitar Rp32.000) per satu juta token input dan USD 10 (sekitar Rp160.000) per satu juta token output. Google belum memberikan keterangan resmi mengenai kapan tarif standar sebesar dua kali lipat dari harga promosi tersebut akan diberlakukan.