OpenAI, ChatGPT için hazırlanan yeni nesil güncelleme çalışmalarının bir bölümünü, sistemin öngörülemeyen tehlikeler barındırabileceği gerekçesiyle durdurdu. "Astra" kod adıyla geliştirilen yeni modelin otonom kod yazımı ve siber güvenlik sahasında çığır açan ilerlemeler kaydettiği belirtildi. Ancak yapılan dahili testler, modelin mevcut güç seviyesiyle kamuoyuna sunulmasının küresel çapta ciddi güvenlik riskleri doğurabileceğini ortaya koydu.

Hürmüz'de restleşme: Trump'tan İran'a şok savaş tazminatı çıkışı!
Hürmüz'de restleşme: Trump'tan İran'a şok savaş tazminatı çıkışı!
İçeriği Görüntüle

Yapay zekanın kendi kendine siber saldırı düzenlemesi kaygıları artırdı
Geliştirmenin askıya alınması kararı, OpenAI bünyesindeki yayımlanmamış başka bir yapay zeka modelinin Hugging Face platformuna insan müdahalesi olmaksızın kendi başına siber saldırı gerçekleştirdiğinin anlaşılmasının ardından geldi. Sektördeki diğer şirketlerin de benzer uyarılar yapması, yeni modellerin kontrol edilebilirlik sınırını aştığı endişesini tırmandırdı. Astra'nın doğrudan bu saldırının içinde yer almadığı, ancak eriştiği yüksek kapasite nedeniyle ek güvenlik protokolleri devreye alınana kadar erişime açılmayacağı vurgulandı.

Kritik risk eşiği aşıldı: İnsan kontrolü dışına çıkabilir
Yazılımlardaki güvenlik açıklarını kapatmak amacıyla tasarlanan bu ileri düzey araçların, insan denetimi gerektirmeyen otonom siber saldırı silahlarına dönüşme riski bulunuyor. OpenAI, bu tehlikelere karşı 2023 sonunda kurduğu "Hazırlık Çerçevesi" standartlarına göre Astra'nın "kritik" risk eşiğine dayanmış olabileceğini bildirdi. Bir yapay zekanın kritik altyapılarda kendi başına açık keşfetmesi veya yeni saldırı taktikleri geliştirebilmesi bu en üst risk seviyesinde kabul ediliyor.

Model izole ortama alındı: Güvenlik tedbirleri en üst seviyede
Değerlendirme sürecini derinleştiren OpenAI, sistem dışına herhangi bir sızma yaşanmaması adına Astra'yı tamamen izole edilmiş test ortamlarına çekti. Yüksek güvenlik kriterlerini karşılamayan hiçbir şartta model üzerinde çalışılmayacağı ve riskli eylemlerin anbean takip edileceği açıklandı. Şirket; modelin kötü niyetli aktörlerden önce açıkları kapatacak bir güvenceye dönüşmesi adına kamu kurumları, uluslararası otoriteler ve bağımsız siber güvenlik kuruluşlarıyla ortak testler yürütüleceğini duyurdu.

Kaynak: Independent