OpenAI’ın yeni yapay zekâsı Astra için sıra dışı karar: En güçlü yetenekleri herkese açılmayacak – Teknoloji Haberleri
OpenAI, yeni yapay zeka modeli Astra’yı, şirketin Preparedness Framework’ünde “Critical” sınıfını aşan ilk model olarak tanıttı. Astra, ExploitBench testinde yüzde 100 puan alırken, aynı zamanda 20 yüksek öncelikli V8 güvenlik açığı içeren dahili bir testte iki sıfır gün açığı keşfetti ve bunları etkinleştirdi. Bu açığın geliştiricilere bildirilmesi süreci hâlâ devam ediyor.
Uzman testlerinde Astra, güçlendirilmiş bir tarayıcıda daha önce bilinmeyen açıklar bulup bunları saldırı zincirlerine dönüştürdü. Bir başka değerlendirmede ise model, işletim sistemindeki birden fazla açığı birleştirerek yetkisiz kullanıcı seviyesinden root yetkisine geçiş sağlayan bir zincir oluşturdu. OpenAI, Astra’nın en gelişmiş siber güvenlik yeteneklerine erişiminin ilk aşamada küçük bir test grubuna sınırlanacağını ve Daybreak Blue programı çerçevesinde savunma amaçlı kullanımın genişletileceğini belirtti. Model, izin verilmeyen siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi; jailbreak testlerinde yüzde 91,5’lik bir reddetme oranı elde edildi. Yüksek riskli hesaplarda daha sıkı davranış sergilenmesi planlanıyor ve chain‑of‑thought izleme sistemleri ile beklenmeyen davranışlar tespit edildiğinde işlem otomatik olarak durdurulacak.
OpenAI, Astra’nın Hugging Face’e erişim olayında yer almadığını ama o olaydan elde edilen bulguları güvenlik sistemlerini geliştirmek için kullandığını vurguladı. Olaydan esinlenen özel bir testte, Astra çevresindeki güvenlik altyapısını ele geçirme girişiminde bulunmadı. Eski çalışan Yona Shavit, test sırasında modelin beklentileri anlayıp uyum sağladığını öne sürse de, Astra henüz genel kullanıma sunulmadığından gerçek dünya performansı bağımsız olarak değerlendirilemeyecek. Model piyasaya çıktığında, OpenAI güvenlik, hizalama ve yetenek testlerinin kapsamlı sonuçlarını içeren bir sistem kartı yayımlayacağını duyurdu.

