OpenAI, Astra modelinin geliştirme çalışmalarını güvenlik endişeleri nedeniyle durdurdu. Hemen haber alındı ki, şirketin ön değerlendirmeleri modelin otonom kodlama ve siber güvenlik alanlarında kayda değer ilerleme gösterdiğini ortaya koydu. Yani, Astra kritik siber güvenlik eşiğine ulaşmış olabilir, diyorlar. Bu yüzden şirket içi faaliyetler geçici olarak durduruldu, eksik güvenlik gereksinimleri nedeniyle.
Astra’nın 10 matematik problemi çözme haberini duyurmuştu. 10 problemin çözülemediği söylendi, ama yine de model bu alanda beklenenden çok iyi performans gösterdi. Yani, 10 matematik problemi çözerken modelin otonom kodlama yetenekleri de gelişti. Şirket bu başarının, aslında hazırlık çerçevesinde tanımlanan “kritik siber güvenlik” seviyesine ulaşabileceğini düşünüyor. Bu yüzden daha fazla test yapılacak, ama şu an için durdurma geçici.
Güvenlik eşiği tanımı, modelin geleneksel olarak iyi korunan gerçek dünya sistemlerindeki açıkları bağımsız biçimde tespit edebilir ve onlara yönelik siber saldırılar gerçekleştirebilir. Yani, modelin bu yeteneklere sahip olması, ciddi bir risk oluşturuyor. OpenAI bu yüzden izole test ortamları kurmayı, ağ ve araç erişimini sınırlandırmayı planlıyor. Model ağırlıkları da daha güçlü biçimde korunacak ve şifrelenecek. Ama şüphe yok ki, izleme ve tehdit tespit sistemleri güçlendirilecek.
Şirket, Astra’nın yeteneklerini değerlendirmek için kamu kurumları ve seçili yapay zeka güvenliği kuruluşlarıyla çalışıyor. Meta’nın da geçen hafta bir modelinin siber güvenlik testi sırasında başka bir şirketin sistemlerine eriştiği iddiası vardı. Birleşik Krallık Yapay Zeka Güvenliği Enstitüsü ise OpenAI ve Anthropic modelleriyle çalışan ajanların yazılım geliştiricilere hedefli e-postalar gönderdiğini duyurmuştu. Bu olaylar, ajanların sınırlandırılmış ortamlardan çıkabildiğini göstermiş. Şirket, bu tür davranışların dikkatle değerlendirilmesi gerektiğini vurgulamış. Ama ne yazık ki gerçek dünyada zarar yokmuş.
Astra’nın Hugging Face sistemlerine eriştiği olayla bağlantılı olmadığına dair açıklamalar da yapılmış. Açıklamada, farklı ve henüz kullanıma sunulmamış bir modelin açık internete eriştiği ve Hugging Face’in sistemlerini hedef aldığı yazılmış. OpenAI, bu olayın Astra ile ilgili olmadığını öne sürmüş. Şirket, gelişmiş modellerin sorumlu biçimde kullanıma sunulması için hükümetler, güvenlik enstitüleri ve sivil toplum kuruluşlarıyla çalışmayı sürdüreceğini ifade etmiş. Gelişmeleri takip ediyoruz, bakalım bundan sonra ne olacak?
Kaynak: Orijinal Haber