OpenAI’ın yeni yapay zekâsı Astra için sıra dışı karar: En güçlü yetenekleri herkese açılmayacak – Teknoloji Haberleri
OpenAI, yeni yapay zekâ modeli Astra’yı “Preparedness Framework” içinde “Critical” eşiğini geçen ilk model olarak duyurdu. Model, uygun araç ve erişime sahip olduğunda güvenli sistemlerde daha önce keşfedilmemiş açıkları tespit edebilme ve bu açıkları kullanmak için yöntem geliştirebilme yeteneğine sahip. Açıklamada, Astra’nın bazı görevlerde insan müdahalesi gerektirmeden çalışabildiği vurgulandı.
Test sonuçlarına göre Astra, ExploitBench testinde yüzde 100 skor elde etti. Aynı zamanda, 20 yüksek öncelikli V8 güvenlik açığından oluşan dahili testte iki sıfır gün açığı keşfetti ve bunları kullandı. Uzmanların yürüttüğü tarayıcı ve işletim sistemi testlerinde model, bilinmeyen açıkları bulup saldırı zincirlerine dönüştürebildi ve çoklu açıyı birleştirerek root yetkisine ulaşabilecek bir zincir oluşturdu. Şirket, bu sonuçları modelin piyasaya sürülmesinde daha katı güvenlik önlemleri almanın gerekliliğini gösterdiği şeklinde özetledi.
OpenAI, Astra’nın en gelişmiş siber güvenlik yeteneklerine erişimin ilk aşamada küçük bir test grubuna verileceğini, ardından Daybreak Blue programı ile savunma amaçlı kullanımın genişletileceğini belirtti. Model, izinsiz siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi; jailbreak testlerinde yüzde 91,5’teki reddedilme oranı rapor edildi. Ayrıca, modelin eylemleri chain‑of‑thought izleme sistemiyle takip edilecek ve uygunsuz davranış tespit edilirse otomatik olarak durdurulacak. OpenAI, Astra’nın güvenlik, hizalama ve yetenek testleriyle ilgili kapsamlı bir sistem kartı yayımlayacağını söyledi.

