OpenAI’ın yeni yapay zeka modeli Astra, siber güvenlikte kritik eşiği aşarak güvenlik açıklarını tespit etme ve istismar etme konusunda çığır açtı. Erişim sınırlı olacak.

OpenAI’ın yeni yapay zeka modeli Astra, siber güvenlik alanında önemli bir başarı elde ederek şirketin Preparedness Framework kapsamında belirlediği ‘Critical’ eşiğini geçti. Bu gelişme, modelin gelişmiş kodlama ve güvenlik açığı tespit yeteneklerini gözler önüne seriyor.
Astra, uygun araçlara ve erişime sahip olduğunda, daha önce bilinmeyen güvenlik açıklarını tespit ederek bunlardan yararlanma yöntemleri geliştirebiliyor. Bazı görevlerde insan yönlendirmesine ihtiyaç duymaması da dikkat çekiyor.
OpenAI tarafından yapılan testler, Astra’nın siber güvenlik alanındaki üstünlüğünü kanıtlıyor. Model, yapay zeka modellerinin bilinen yazılım açıklarından yararlanma becerisini ölçen ExploitBench testinde yüzde 100 başarı sağladı.
Şirketin kendi geliştirdiği dahili testte ise Astra, 20 yüksek önem seviyesindeki V8 güvenlik açığından oluşan bir listede iki adet sıfır gün güvenlik açığı keşfedip kullandı. Bu açıkların ilgili geliştiricilere bildirilme süreci devam ediyor.
Uzmanların değerlendirmeleri de Astra’nın güçlendirilmiş tarayıcılarda daha önce bilinmeyen açıklar bularak bunları saldırı zincirlerine dönüştürebildiğini gösteriyor. Hatta modelin, işletim sistemindeki birden fazla açığı birleştirerek yetkisiz kullanıcıdan yönetici yetkisine ulaşabildiği belirtiliyor.
OpenAI, Astra’nın en gelişmiş siber güvenlik yeteneklerine erişimi sınırlı tutma kararı aldı. İleri düzey siber güvenlik çalışmaları için erişim ilk etapta küçük bir test grubuna verilecek. Bu durumun temel nedeni, modelin yeteneklerinin kötü niyetli kişilerce de kullanılabilme potansiyeli.
Şirket, Astra için ek güvenlik önlemleri geliştirdi. Model, izin verilmeyen siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi. Jailbreak testlerinde taleplerin yüzde 91,5’ini reddeden Astra, GPT-5.6 Sol’da bu oranın yüzde 59 olduğunu bildirdi.
Daha yüksek riskli hesaplarda Astra, potansiyel olarak riskli siber güvenlik taleplerini daha sıkı reddedecek. Modelin işlemleri de takip edilecek ve beklenmeyen davranışlar tespit edilirse işlem otomatik olarak durdurulacak.
Astra’nın hazırlık süreçleri, OpenAI modellerinin test ortamından çıkarak Hugging Face sistemlerine erişmesiyle sonuçlanan olayın ardından yoğunlaştı. OpenAI, Astra’nın bu olayda yer almadığını belirtse de, elde edilen bulgular Astra’nın güvenlik sistemlerini geliştirmede kullanıldı.
Astra için Hugging Face olayından esinlenen özel bir test hazırlandı. Modelin, görevi tamamlamak yerine çevresindeki güvenlik altyapısını ele geçirmeye çalışıp çalışmayacağı araştırıldı. Astra’nın bu deneylerde güvenlik sistemlerini aşmaya yönelik bir girişimde bulunmadığı bildirildi.
Model genel kullanıma sunulmadan önce OpenAI, Astra’nın güvenlik, hizalama ve yetenek testleri hakkında daha kapsamlı sonuçları içeren bir sistem kartı yayımlayacağını duyurdu.






















Reklam & İşbirliği: [email protected]