OpenAI, geliştirme aşamasındaki Astra isimli yapay zeka modeli üzerindeki çalışmalarını siber güvenlik değerlendirmelerinin ardından askıya aldığını açıkladı. Şirketin aldığı kararın arkasında modelin kodlama ve siber güvenlik alanlarında ulaştığı yetenek seviyesinin bulunduğu belirtildi. Yapılan iç testlerde Astra'nın söz konusu alanlarda ilerleme kaydettiği görülürken modelin OpenAI'ın Hazırlık Çerçevesi kapsamında belirlediği güvenlik şartlarını henüz karşılamadığı aktarıldı. Şirket, değerlendirmeler sonucunda Astra'nın “kritik” olarak tanımlanan siber yeteneklere ulaşma ihtimalinin göz ardı edilemeyeceğini belirterek geliştirme faaliyetlerini durdurma kararı aldı. OpenAI'ın güvenlik yaklaşımında, gelişmiş yapay zeka modellerinin gerçek dünyadaki kritik sistemlere yönelik oluşturabileceği riskler ayrı olarak değerlendiriliyor. Modelin insan müdahalesi olmadan ciddi güvenlik açıklarından yararlanabilmesi veya karmaşık hedeflere yönelik saldırı planları oluşturabilecek seviyeye gelmesi, daha sıkı güvenlik önlemlerinin uygulanmasını gerektiren eşikler arasında gösteriliyor. Astra için çalışmaların ne zaman yeniden başlayacağı konusunda ise tarih paylaşılmadı.

Astra Modelinin Siber Yetenekleri İncelemeye Alındı

OpenAI tarafından gerçekleştirilen iç değerlendirmelerde Astra'nın kodlama ve siber güvenlik görevlerindeki performansı incelendi. Şirket, elde edilen sonuçların ardından modelin kritik siber yeteneklere sahip olabileceği ihtimalini tamamen dışlayamadığını belirtti.

OpenAI'ın Hazırlık Çerçevesinde gelişmiş yapay zeka modellerinin oluşturabileceği riskler farklı seviyelerde değerlendiriliyor. Siber güvenlik tarafında insan müdahalesi olmadan kritik sistemlerdeki ciddi açıkları kullanabilme ve karmaşık saldırı süreçlerini yürütebilme kapasitesi üst düzey riskler arasında ele alınıyor.

Astra'nın söz konusu kabiliyetlere kesin olarak ulaştığı açıklanmadı. Alınan karar, yapılan değerlendirmeler sonrasında ihtimalin göz ardı edilememesi ve mevcut güvenlik standartlarının karşılanması için ek önlemlere ihtiyaç duyulmasıyla ilişkilendirildi.

Şirket, yüksek yetenek seviyesine ulaşan yapay zeka modellerinin geliştirilmesi ve kullanılması sırasında daha sıkı güvenlik kontrollerinin uygulanacağını da bildirdi.

OpenAI Yeni İzleme Sistemi Kullanacak

Astra üzerinde yürütülen çalışmalar kapsamında ajan tabanlı uygulamalardaki riskli işlemleri ve kurallarla uyuşmayan davranışları belirlemeye yönelik genel izleme sisteminin devreye alındığı aktarıldı.

Söz konusu sistemle yapay zeka ajanlarının gerçekleştirdiği işlemlerin takip edilmesi ve güvenlik açısından risk oluşturabilecek davranışların belirlenmesi amaçlanıyor. OpenAI'ın Astra üzerindeki çalışmaların devam edebilmesi için güvenlik tedbirlerini geliştireceği belirtiliyor.

Şirket ayrıca Astra'nın daha önce gündeme gelen Hugging Face olayıyla bağlantısının bulunmadığını bildirdi. Model için alınan geliştirmeyi durdurma kararının Astra'nın kendi güvenlik değerlendirmelerinden elde edilen sonuçlara dayandığı aktarıldı.

Yapay zeka modellerinin kodlama alanındaki yetenekleri gelişirken siber güvenlik testleri de model geliştirme süreçlerinin önemli aşamalarından biri haline geliyor. OpenAI'ın Astra için geliştirme çalışmalarına hangi şartların karşılanmasının ardından yeniden başlayacağı ise ilerleyen dönemde belli olacak.