Ketua Pegawai Eksekutif OpenAI, Sam Altman, berkata Astra AI akan 'Tersedia Secara Umum,' tetapi Keupayaan Siber Memerlukan Lebih Banyak Kerja Keselamatan

OpenAI sedang memperlahankan sebahagian daripada pembangunan model Astra AI yang akan datang selepas penilaian dalaman menimbulkan kebimbangan tentang keupayaan keselamatan sibernya yang semakin maju.
Syarikat itu berkata pada hari Jumaat bahawa ia tidak dapat menolak kemungkinan Astra mencapai ambang keupayaan siber "kritikal" di bawah Rangka Kerja Kesiapsiagaannya. Hasilnya, OpenAI telah memperkenalkan kawalan keselamatan yang lebih kukuh, pemantauan yang diperluas dan keperluan ujian tambahan sebelum beralih ke arah keluaran yang lebih luas.
Keputusan itu dibuat hanya beberapa hari selepas OpenAI mempublikasikan penyelidikan matematik yang dihasilkan oleh versi dalaman Astra. Model tersebut dilaporkan menghasilkan keputusan baharu yang melibatkan masalah lama dalam matematik dan sains komputer teori, menonjolkan keupayaan yang lebih luas yang sedang dinilai oleh OpenAI menjelang pelancaran model utamanya yang seterusnya.
Walaupun terdapat langkah berjaga-jaga tambahan, Ketua Pegawai Eksekutif OpenAI, Sam Altman, berkata syarikat itu masih berhasrat untuk menyediakan Astra secara umum. Beliau berhujah bahawa AI yang semakin berkemampuan tidak seharusnya terhad kepada sekumpulan kecil pengguna.
OpenAI Memperlahankan Pelepasan AI Astra Atas Risiko Siber
Altman berkata dalam satu catatan di X bahawa Astra ialah "model yang berkuasa" dan OpenAI sedang berusaha untuk menjadikannya "tersedia secara umum".
Kenyataan itu mencerminkan pendekatan OpenAI yang lebih luas dalam memperluas akses kepada AI canggih sambil memperkenalkan kawalan tambahan di sekitar keupayaan yang boleh mewujudkan risiko keselamatan yang ketara.
"Kami tidak fikir ia adalah strategi yang baik untuk mengekalkan model yang berkuasa kepada segelintir orang terpilih," kata Altman.
Walau bagaimanapun, beliau mengakui bahawa keupayaan keselamatan siber Astra telah mengubah jadual waktu. “Memandangkan keupayaan sibernya, kita memerlukan sedikit masa lagi untuk melakukan ini dengan selamat,” kata Altman, sambil menambah, “tetapi diharapkan tidak terlalu lama!”

Sam Altman mengesahkan keupayaan siber canggih Astra telah menyebabkan OpenAI mengklasifikasikannya sebagai risiko keselamatan siber yang "kritikal", mendorong perlindungan yang lebih ketat dan kelembapan pembangunan sementara. Sumber: Sam Altman melalui X
Pendirian OpenAI adalah selaras dengan usaha terbarunya untuk memperluaskan alat keselamatan siber berkuasa AI kepada pembela yang dibenarkan. Syarikat itu telah menyifatkan keselamatan siber sebagai bidang di mana AI yang lebih berkemampuan boleh memberikan manfaat yang besar, di samping mewujudkan risiko baharu jika keupayaan tersebut disalahgunakan.
Syarikat itu telah membangunkan program seperti Trusted Access for Cyber, yang menyediakan akses kepada model yang lebih berkemampuan untuk kerja pertahanan yang dibenarkan di bawah perlindungan tambahan kepada profesional keselamatan dan organisasi yang diluluskan.
Walau bagaimanapun, bagi Astra, OpenAI nampaknya mengenakan tahap berhati-hati yang lebih tinggi. Syarikat itu berkata penilaian baru-baru ini menunjukkan kemajuan yang ketara dalam pengekodan agentik dan keselamatan siber, mendorong pakar dan pasukan dalaman untuk menilai sama ada model tersebut dapat memenuhi kategori risiko keselamatan siber tertinggi dalam Rangka Kerja Kesiapsiagaannya.
Di bawah rangka kerja tersebut, kategori "kritikal" mewakili tahap risiko keupayaan keselamatan siber tertinggi. Rangka kerja OpenAI memerlukan pembangunan dihentikan apabila model mencapai ambang tersebut sehingga perlindungan dan kawalan keselamatan yang sesuai dilaksanakan.
OpenAI Menangguhkan Keluaran Astra AI
OpenAI telah menghentikan sementara aktiviti dalaman yang melibatkan Astra yang tidak memenuhi keperluan keselamatan yang baharu diperkukuh sambil terus menilai model tersebut.
Syarikat itu juga telah melaksanakan pemantauan sejagat untuk aplikasi agentik Astra dan menggunakan persekitaran ujian yang lebih terkawal ketika menilai tingkah laku yang berpotensi berisiko. OpenAI berkata langkah-langkah tambahan itu bertujuan untuk meningkatkan keupayaannya untuk mengenal pasti dan bertindak balas terhadap kebimbangan keselamatan sebelum model tersebut boleh diakses secara meluas.

OpenAI menetapkan Astra sebagai model keselamatan siber "kritikal" pertamanya di bawah Rangka Kerja Kesiapsiagaan, mencetuskan kawalan keselamatan yang dipertingkatkan semasa pembangunan. Sumber: OpenAI melalui X
Syarikat itu menekankan bahawa Astra sendiri tidak bertanggungjawab atas insiden keselamatan siber baru-baru ini yang melibatkan model OpenAI dan platform AI sumber terbuka Hugging Face. Insiden itu melibatkan model lain yang beroperasi dalam persekitaran ujian, dan bukannya Astra.
Walau bagaimanapun, masanya dibuat di tengah-tengah perdebatan industri yang lebih luas tentang sejauh mana sistem AI canggih dapat dikawal dengan berkesan semasa ujian. Pembangun Anthropic, Meta dan China, Moonshot AI juga telah mendedahkan insiden yang melibatkan model yang berkelakuan di luar batasan ujian yang dimaksudkan dalam beberapa bulan kebelakangan ini.
Oleh itu, langkah terbaru OpenAI mewakili lebih daripada sekadar pelarasan keluaran rutin. Ia menunjukkan bagaimana penilaian model semakin mempengaruhi keputusan pembangunan apabila sistem AI menjadi mampu mengendalikan tugas yang lebih lama dan lebih kompleks.
Syarikat itu belum memberikan tarikh keluaran khusus untuk Astra. Komen Altman menunjukkan bahawa OpenAI kekal komited untuk pelancaran meluas sebaik sahaja perlindungan yang diperlukan dilaksanakan, dan bukannya meninggalkan ketersediaan umum kerana keupayaan siber model tersebut.
Pendekatan itu sesuai dengan strategi keselamatan siber OpenAI yang lebih luas. Pada bulan April, syarikat itu menerbitkan pelan tindakan yang menyeru akses yang lebih luas kepada alat pertahanan berkuasa AI di samping memperkukuh perlindungan di sekitar keupayaan siber sempadan. OpenAI berkata matlamatnya adalah untuk meletakkan teknologi canggih di tangan pembela sambil mengekalkan keterlihatan dan kawalan yang sesuai.
Pengumuman Astra itu susulan satu lagi pendedahan besar daripada OpenAI. Pada 1 Ogos, syarikat itu berkata versi dalaman model tersebut telah menghasilkan keputusan mengenai 10 masalah lama dalam matematik, kerumitan kuantum dan sains komputer teori. OpenAI berkata kerja tersebut termasuk sijil Lean yang boleh disemak mesin, menambah lapisan pengesahan rasmi kepada keputusan yang dilaporkan.
Urutan pengumuman tersebut telah meletakkan Astra di pusat perhatian atas prestasi penyelidikan dan keupayaan keselamatan sibernya. OpenAI kini cuba mengimbangi kemajuan tersebut dengan kawalan yang dianggap perlu untuk siaran awam.
Buat masa ini, mesej syarikat itu kekal konsisten: Astra bertujuan untuk ketersediaan meluas, tetapi pelancarannya bergantung pada sama ada OpenAI boleh mewujudkan perlindungan yang mampu menandingi keupayaannya yang semakin berkuasa.








