OpenAI’ın yeni yapay zekâsı Astra için sıra dışı karar: En güçlü yetenekleri herkese açılmayacak – Teknoloji Haberleri
OpenAI, yeni yapay zekâ modeli Astra’nın “Critical” sınıfı siber güvenlik yeteneklerine ulaştığını duyurdu. Şirketin Preparedness Framework’ünde belirlenen kritik eşiği geçen ilk model olan Astra, uygun araç ve erişimle iyi korunmuş sistemlerde daha önce tespit edilmemiş güvenlik açıklarını bulma ve bu açıkları kullanmaya yönelik yöntemler geliştirme kabiliyeti gösterdi. ExploitBench testinde elde ettiği %100 skor, modelin bilinen yazılım açıklarından yararlanma becerisini ölçen ölçütte mükemmel performans sergilediğini ortaya koydu.
Astra’nın dahili testleri, 20 yüksek öncelikli V8 güvenlik açığından oluşan bir senaryoda iki sıfır gün açığı keşfetmesini ve bu açıkları etkinleştirmesini ortaya çıkardı. Geliştiricilere bildirme süreci devam ederken, bağımsız testlerde model tarayıcıda bilinmeyen açıkları saldırı zincirlerine dönüştürdü ve işletim sisteminde birden fazla açığı birleştirerek yetkisiz kullanıcı seviyesinden root yetkisine ulaşabilecek bir zincir oluşturdu. Ek olarak, modelin güvenlik altyapısını ele geçirmeye yönelik bir testte, Astra’nın güvenlik sistemlerini aşma girişiminde bulunmadığı rapor edildi.
OpenAI, Astra’nın en gelişmiş siber güvenlik yeteneklerine erişimin ilk aşamada yalnızca küçük bir test grubuna verileceğini açıkladı; ardından savunma amaçlı kullanımlarını genişletmek için Daybreak Blue programı devreye alınacak. Model, yetkisiz siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi; jailbreak testlerinde %91,5 oranında reddedildi. Daha yüksek riskli hesaplarda bu oran daha da yükselerek modelin daha sıkı davranmasını sağlıyor. Chain‑of‑thought izleme sistemleriyle modelin beklenmedik davranışları tespit edilip otomatik olarak durdurulacak. Astra, henüz genel kullanıma sunulmadığı için gerçek dünya performansı bağımsız olarak değerlendirilememekte; piyasaya çıktığında kapsamlı bir sistem kartı yayımlanacak.

