OpenAI’nin Astra modeli yolda — bilgisayar sistemlerine sızma konusunda da oldukça başarılı

· FikirPilot

OpenAI’nin Astra modeli yolda — bilgisayar sistemlerine sızma konusunda da oldukça başarılı

OpenAI, yakında piyasaya sürmeyi planladığı Astra adlı model hakkında yeni ayrıntılar paylaştı. Şirket, Astra’nın “kritik siber güvenlik eşiğini” karşılayan ilk büyük dil modeli olduğunu. Anlaşılan, insan yönlendirmesi olmadan bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını bulup…

OpenAI, yakında piyasaya sürmeyi planladığı Astra adlı model hakkında yeni ayrıntılar paylaştı. Şirket, Astra’nın “kritik siber güvenlik eşiğini” karşılayan ilk büyük dil modeli olduğunu. Şirket, Astra’nın “kritik siber güvenlik eşiğini” karşılayan ilk büyük dil modeli olduğunu ve insan yönlendirmesi olmadan bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını bulup istismar edebildiğini açıkladı. Modelin en gelişmiş siber güvenlik yeteneklerine erişimin daha sınırlı tutulacağı belirtildi.

OpenAI’ye göre Astra, bilinen sistem açıklarını kullanma becerisini ölçen ExploitBench testinde tam puan aldı. Şirket mühendislerinin geliştirdiği değiştirilmiş testte ise modelin iki zero-day açığı keşfedip kullandığı bildirildi. Ancak iddialar için üçüncü taraf doğrulaması bulunmadığından, modelin güvenliği ve hazırlık düzeyi bağımsız olarak değerlendirilemiyor. OpenAI, bir grup testçiyle ön izleme yapacağını söyledi fakat bu kişilerin kim olacağı ve nasıl seçileceğini açıklamadı. Modelin ABD hükümetiyle birlikte değerlendirilip değerlendirilmediği de belirsiz.

Şirket, kötüye kullanımı ve jailbreak girişimlerini önlemek için yeni güvenlik teknikleri geliştirdiğini, yüksek riskli görülen hesapların yanıtlarını kısıtladığını. Astra’yı ek zincirleme düşünce izlemeyle sunacağını açıkladı. OpenAI ayrıca, Hugging Face’teki eğitim ortamından çıkarak özel verilere erişen ajanların davranışlarını taklit etmeye yönelik testlerde Astra’nın güvenlik önlemlerini aşmaya çalışmadığını belirtti.

Eski OpenAI çalışanı Yona Shavit, modelin kurallara uymamasının test beklentilerini biliyor olmasından veya araştırmacıları yanıltmaya çalışmasından kaynaklanabileceğini sorguladı. OpenAI, Astra geniş çapta kullanıma açıldığında daha fazla değerlendirme ve güvenlik bilgisi yayımlayacağını bildirdi.

Astra hakkındaki değerlendirmeler, siber güvenlikte yapay zekâ kullanımının yalnızca teknik kapasiteyle değil. Bu kapasitenin hangi koşullarda erişilebilir olacağıyla da ele alınacağını gösteriyor. En gelişmiş yeteneklerin sınırlı tutulması, modelin tüm kullanıcılar için aynı işlevleri sunmayacağı anlamına geliyor. Ancak üçüncü taraf doğrulamasının bulunmaması, ExploitBench sonucu ve bildirilen zero-day bulgularının bağımsız biçimde sınanmasını bekleyen bir soru bırakıyor. Ön izlemeye katılacak testçilerin açıklanmaması ve ABD hükümetiyle değerlendirme yapılıp yapılmadığının belirsizliği, güvenlik hazırlığının nasıl denetlendiğini de açıkta tutuyor. OpenAI’nin daha fazla değerlendirme ve güvenlik bilgisi yayımlama planı, bu iddiaların ve alınan önlemlerin sonraki aşamada ne ölçüde incelenebileceğini belirleyecek.