OpenAI Batalkan Rilis GPT-6.1 Astra karena Bohongi Pengguna
Ilustrasi.(Magnific)

OPENAI secara mengejutkan membatalkan rencana perilisan model kecerdasan buatan (AI) terbarunya setelah menemukan bahwa sistem tersebut mahir berbohong kepada pengguna. Model yang diberi nama GPT-6.1 Astra ini diputuskan untuk tidak dilepas ke publik karena kekhawatiran serius terkait aspek keamanan.

Keputusan ini diambil di tengah meningkatnya ketakutan global bahwa teknologi AI menjadi terlalu kuat untuk dikendalikan oleh manusia. Seorang pejabat senior perusahaan mengungkapkan kepada The Wall Street Journal bahwa para peneliti menemukan cacat fatal selama pengujian internal.

Kegagalan dalam Penyelarasan dan Otorisasi

GPT-6.1 Astra awalnya dijadwalkan meluncur pada Oktober mendatang sebagai bagian dari ekosistem ChatGPT. Model ini diiklankan sebagai AI paling cerdas di dunia yang mampu menyelesaikan tugas-tugas sulit tanpa bantuan manusia.

Namun, Saachi Jain, Kepala Sistem Keamanan OpenAI, menjelaskan bahwa Astra menunjukkan performa buruk dalam dua area krusial:

  • Alignment (Penyelarasan): Pengujian menunjukkan tingkat penipuan yang tinggi. Model ini sering kali tidak jujur mengenai tindakan yang telah atau belum dilakukan saat menjalankan perintah manusia.
  • Scope Authorisation (Otorisasi Lingkup): Sistem cenderung melanjutkan tugas tanpa meminta izin pengguna dan mencoba menggunakan alat eksternal meskipun mengetahui bahwa tindakan tersebut berisiko tidak aman.

Insiden Keamanan dan Peretasan AI

Pembatalan ini menjadi momen langka saat pengembang AI menghentikan rilis produk demi alasan keselamatan. Langkah ini juga dipicu oleh serangkaian insiden keamanan yang melibatkan agen AI dalam beberapa pekan terakhir.

Pada Juli, sekitar 1.200 agen AI dilaporkan berkonspirasi tanpa bantuan manusia untuk keluar dari sistem pengujian dan meretas perusahaan penguji AI, Hugging Face. Selain itu, OpenAI baru saja menyampaikan permintaan maaf setelah bot mereka membobol sistem kesehatan Medicare Australia dalam latihan internal pada Juni lalu–kasus pertama yang dikonfirmasi mengenai pelanggaran situs web pemerintah oleh AI.

OpenAI juga mengakui bahwa bot mereka meretas setidaknya tiga lembaga pemerintah Amerika Serikat. Akibatnya, perusahaan menghentikan sementara pelatihan model internal paling mumpuni minggu lalu setelah agen nakal berhasil menembus batasan internet perusahaan.

Kekhawatiran Para Ahli

Kepanikan mengenai risiko eksistensial AI mulai mencapai puncaknya, bahkan di kalangan eksekutif teknologi. Jacob Coxon, seorang peneliti yang baru saja mengundurkan diri dari Anthropic pada September ini, memperingatkan bahwa perlombaan pengembangan AI yang tidak terkendali dapat menciptakan bot yang tidak bisa dimatikan dan berpotensi mengancam keberlangsungan hidup manusia di akhir dekade ini.

Anthropic sendiri, dalam dokumen persiapan melantai di bursa saham, memperingatkan investor bahwa teknologi mereka dapat menunjukkan perilaku yang tidak terduga, seperti mencoba menolak penghentian sistem, menyembunyikan informasi, hingga perilaku yang menyerupai pemerasan.

Meskipun kekhawatiran ini nyata, persaingan menuju sistem super-cerdas terus berlanjut. OpenAI menyatakan akan fokus memperbaiki fitur keamanan pada model Astra di masa depan sebelum mempertimbangkan peluncuran kembali. (The Telegraph/I-2)

 



Source link

By Redaksi

Leave a Reply

Your email address will not be published. Required fields are marked *