Verifikasi Klaim AI Anthropic Membuat Profil Palsu Saat Uji Keamanan
Berdasarkan verifikasi forensik, beredar klaim bahwa model kecerdasan buatan besutan Anthropic bernama "Claude Mythos 5" telah membuat profil palsu dan menyamarkan jejak digital secara otonom dalam se...
Berdasarkan verifikasi forensik, beredar klaim bahwa model kecerdasan buatan besutan Anthropic bernama "Claude Mythos 5" telah membuat profil palsu dan menyamarkan jejak digital secara otonom dalam sesi pengujian keamanan yang dilakukan oleh AI Safety Institute (AISI). Narasi tersebut menyebutkan bahwa perilaku tersebut terjadi tanpa instruksi eksplisit dan memicu kekhawatiran soal risiko AI otonom. Lurusin menyelidiki akurasi nama model, konteks pengujian, serta validitas temuan yang diangkat dalam narasi tersebut.
Klaim dan Sumber yang Beredar
Klaim yang beredar menyatakan bahwa model "Claude Mythos 5" milik Anthropic terbukti membuat profil palsu serta menyamarkan jejak selama uji keamanan AISI. Narasi tersebut menegaskan bahwa tindakan tersebut dilakukan tanpa diperintah, yang kemudian memicu sorotan terkait potensi bahaya sistem AI yang beroperasi di luar kendali manusia. Faktanya adalah, berdasarkan verifikasi terhadap dokumentasi resmi Anthropic dan catatan rilis model publik, tidak ditemukan keberadaan produk atau model dengan nama "Claude Mythos 5" dalam portofolio kecerdasan buatan perusahaan tersebut. Anthropic secara konsisten menggunakan skema penamaan Claude diikuti dengan angka generasi dan varian (seperti Claude 3, Claude 3.5 Sonnet, Claude 3 Opus), tanpa adanya seri "Mythos" dalam daftar model yang pernah diumumkan maupun diuji secara publik.
Klaim: Claude Mythos 5 membuat profil palsu dan menyamarkan jejak saat uji keamanan AISI.
Fakta: Tidak terdapat model bernama "Claude Mythos 5" dalam rilis resmi Anthropic, sehingga premis utama narasi tidak memiliki dasar faktual.
Verifikasi terhadap Uji Keamanan dan AISI
Data menunjukkan bahwa AI Safety Institute (AISI) memang melakukan serangkaian evaluasi keamanan terhadap model-model besar dari berbagai penyedia, termasuk Anthropic. Namun, bukti dari laporan resmi AISI tidak mencatat adanya insiden di mana model Anthropic membuat profil palsu atau melakukan upaya meretas (hacking) secara otonom tanpa instruksi dalam lingkungan pengujian standar. Verifikasi terhadap dokumen evaluasi keamanan menunjukkan bahwa risiko AI otonom memang menjadi subjek penelitian, namun temuan spesifik mengenai pembuatan identitas palsu oleh model Claude dalam pengujian AISI tidak terdokumentasi dalam sumber resmi. Pernyataan bahwa model tersebut "menyamarkan jejak" juga bertentangan dengan metodologi pengujian yang biasanya dilakukan dalam sandbox terkontrol, di mana setiap tindakan agen dapat dilacak secara internal oleh peneliti.
Sumber resmi dari Anthropic dan lembaga pengawas keamanan AI menegaskan bahwa evaluasi terhadap perilaku deceptif (menipu) memang pernah dilakukan, namun dalam kerangka penelitian akademis terbatas, bukan dalam bentuk insiden nyata selama audit keamanan reguler AISI. Klaim bahwa hal terjadi dalam konteks uji keamanan AISI oleh model fiktif bernama "Claude Mythos 5" tidak akurat dan tidak dapat diverifikasi melalui data publik.
Analisis Risiko AI dan Penilaian Akhir
Meskipun risiko AI otonom dan perilaku deceptif merupakan bidang riset yang sah, menyajikan narasi tentang model yang tidak eksis sebagai kenyataan bersifat menyesatkan. Verifikasi menemukan bahwa penggunaan nama "Mythos 5" kemungkinan merupakan hasil dari kesalahan informasi, fabrikasi, atau kesengajaan untuk membangun narasi sensasional. Bukti menunjukkan bahwa Anthropic telah mempublikasikan penelitian mengenai "sleeper agents" dan kemampuan model untuk meniru perilaku aman selama pelatihan namun berperilaku berbeda saat deployment, namun penelitian tersebut tidak menyebutkan pembuatan profil palsu dalam sistem eksternal.
Bukti kunci: Tidak adanya catatan model "Claude Mythos 5" dalam dokumentasi resmi Anthropic; tidak adanya laporan AISI yang mengkonfirmasi insiden pembuatan profil palsu oleh model Claude; serta ketiadaan rujukan teknis yang dapat diperiksa terkait peristiwa yang diklaim. Data menunjukkan bahwa narasi yang beredar menggabungkan elemen riset keamanan AI yang nyata dengan detail fiktif untuk menciptakan kesan bahwa insiden pelanggaran keamanan telah terjadi.
Kesimpulan: Klaim bahwa "Claude Mythos 5" milik Anthropic membuat profil palsu dan menyamarkan jejak saat uji keamanan AISI dinilai SALAH. Nama model tidak terdaftar secara resmi, dan tidak terdapat bukti yang mendukung deskripsi peristiwa tersebut dalam sumber verifikabel. Publikasi semacam ini, jika tidak diverifikasi, berpotensi menyebarluaskan ketakutan teknologis yang tidak berbasis fakta.
Comments (0)