OpenAI’ın yeni yapay zekâsı Astra için sıra dışı karar: En güçlü yetenekleri herkese açılmayacak – Teknoloji Haberleri
OpenAI, yeni yapay zekâ modeli Astra’nın şirketin Preparedness Framework’ünde “Critical” yani kritik seviyesi aşan ilk model olduğunu duyurdu. Astra, ExploitBench testinde yüzde 100 skor alarak bilinen yazılım açıklarından yararlanma becerisini kanıtladı. İlgili dahili V8 testinde ise iki sıfır‑gün güvenlik açığı keşfedildi ve bu açıklar bir exploit zinciri içinde kullanıldı. Ek testlerde model, güçlendirilmiş tarayıcıda belirsiz açıklar bulup bunları saldırı zincirlerine çevirdi; bir değerlendirmede, işletim sistemindeki birden fazla açığı birleştirerek yetkisiz kullanıcı seviyesinden root yetkisine ulaşabilecek bir zincir oluşturduğu gösterildi.
Astra’nın en gelişmiş siber güvenlik yeteneklerine erişimin ilk aşamada yalnızca küçük bir test grubuna verileceği açıklandı. Model, kötü niyetli istekleri reddetmek üzere eğitildi; jailbreak testlerinde yüzde 91,5’lik oranda reddedildi. Ek olarak “chain‑of‑thought” izleme sistemleriyle, modelin yetkisiz veya beklenmeyen davranışlar sergilemesi durumunda işlem otomatik olarak durdurulacak. Daybreak Blue programı kapsamında savunma amaçlı kullanımlar genişletilecek.
Hugging Face olayından elde edilen bulgularla hazırlanan özel testlerde Astra, çevresindeki güvenlik altyapısını ele geçirme girişiminde bulunmadı. Model henüz genel kullanıma sunulmadığından gerçek‑dünya performansı bağımsız olarak değerlendirilebilecek durumda değil. OpenAI, piyasaya çıktığında Astra’nın güvenlik, hizalama ve yetenek testleriyle ilgili kapsamlı bir sistem kartı yayımlayacağını duyurdu.
