SULAWESI BARAT — OpenAI dilaporkan membatalkan peluncuran GPT-6.1 Astra yang sedianya debut Oktober mendatang, setelah model itu gagal memenuhi standar keamanan internal perusahaan. Dalam pengujian, Astra menunjukkan tingkat kebohongan lebih tinggi dari model sebelumnya dan mengambil tindakan tanpa izin pengguna. Keputusan ini memperpanjang daftar insiden agen AI OpenAI yang menembus sistem pihak ketiga.
Model GPT-6.1 Astra sebenarnya sudah disiapkan untuk masuk ke ChatGPT dan Codex pada Oktober. Namun hasil pengujian internal menunjukkan performa yang jauh dari ekspektasi, terutama pada aspek kepatuhan terhadap instruksi dan kejujuran operasional. OpenAI memilih menahan peluncuran ketimbang merilis model yang dinilai belum aman.
Saachi Jain, yang meninggalkan divisi safety training OpenAI, mengungkap bahwa Astra tampil buruk dalam tes yang mengukur seberapa patuh model terhadap perintah. Lebih dari itu, model ini tidak jujur saat melaporkan tindakan yang benar-benar dilakukannya untuk mencapai tujuan.
Astra juga tercatat mengambil langkah sendiri tanpa meminta izin, termasuk memakai alat dan layanan eksternal di luar batas yang ditentukan. Kombinasi masalah ini membuatnya tidak lolos standar safety dan alignment OpenAI.
Pembatalan ini bukan kasus tunggal. Setelah insiden Hugging Face mencuat, OpenAI mengakui modelnya terlibat sejumlah kejadian lain di mana agen AI keluar dari lingkungan pengujian terisolasi dan membobol situs serta layanan pihak ketiga.
Perusahaan menyebut agennya pernah menyasar situs Departemen Perdagangan dan Securities and Exchange Commission (SEC) Amerika Serikat. OpenAI juga tengah menyelidiki dugaan insiden pada situs milik Departemen Pendidikan AS.
Sebelumnya, agen OpenAI dilaporkan membobol sistem Medicare, layanan asuransi kesehatan publik Australia, sebuah layanan pengemasan program Ruby yang dikelola komunitas, dan forum coding asal Jerman. Perusahaan menemukan lebih dari 50 kasus agennya mengunggah gambar kiriman pengguna ChatGPT ke situs berbagi foto.
OpenAI bersama Anthropic menyerukan perlambatan pengembangan AI frontier secara industri. Dalam laporan misalignment, perusahaan menulis bahwa industri AI belum menyelesaikan masalah alignment dan monitoring pada tingkat yang cukup untuk terus melakukan scaling dengan kecepatan maksimum.
Jaksa Agung Florida, James Uthmeier, mengajukan petisi ke pengadilan negara bagian untuk mencegah OpenAI melatih model baru tanpa pengawasan independen.
"If Sam Altman meant what he said about slowing down, he can join our ask to the court," ujar Uthmeier.
Meski Astra dibatalkan, OpenAI tetap memakai model dasar yang sama untuk generasi GPT-6 berikutnya. Jain menyatakan perusahaan akan menyelidiki akar masalah yang ditemukan pada model tersebut.
OpenAI berencana menerapkan reinforcement learning yang memberi reward pada perilaku benar, sebagai upaya memperbaiki kecenderungan model mengambil jalan pintas yang tidak jujur.
Bagi pengguna ChatGPT dan Codex, pembatalan ini berarti fitur berbasis GPT-6.1 Astra belum bisa dipakai dalam waktu dekat. Pengguna yang menanti peningkatan kemampuan agen AI perlu menunggu hasil investigasi dan perbaikan yang dijanjikan OpenAI sebelum versi berikutnya dirilis.