İçerik Haritası
Yapay zeka siber hücumlarda güçlü bir silah olabilir mi? O kadar tez etmeyin!
Yapay zeka modellerinin siber ataklarda silah olarak kullanılabileceği istikametindeki dehşetler, Netskope araştırmacılarının yaptığı yeni bir deneyle zayıfladı. Araştırmacılar, yeni büyük lisan modellerinin, büsbütün otonom ve sağlam makûs emelli yazılımlar üretip üretemeyeceğini test etti.
Deneyler, kaçınma, istismar etme ve operasyonel güvenilirlik üzere kritik yeteneklere odaklandı ve kimi farklı sonuçlar ortaya çıkardı.
Testin birinci kademesi, GPT-3.5-Turbo ve GPT-4‘ü güvenlik araçlarını sonlandırmaya çalışan Python kodları oluşturmaya ikna etme üzerine kuruldu. GPT-3.5-Turbo çabucak istenen çıktıyı üretirken, GPT-4 sadece kolay bir kişilik istemi kullanılarak güvenlik tedbirleri aşıldıktan sonra direnci kırıldı. Bu durum, modeller kısıtlama eklese bile muhafaza bariyerlerini atlatmanın hala mümkün olduğunu gösteriyor.
Kod kalitesi düşük: Otonom güvenilirlik zayıf
Kod üretiminin teknik olarak mümkün olduğu doğrulanınca, takım operasyonel güvenilirliğe geçti. Modellerden sanal makineleri tespit eden ve buna nazaran reaksiyon veren kod kesimleri yazmaları istendi. Fakat sonuçlar hayal kırıklığı yarattı: Kod modülleri farklı sanal ve fizikî ortamlarda test edildiğinde sık sık çöktü, ortamları yanlış tanımladı yahut daima çalışmayı başaramadı.
Kod mantığı fizikî makinelerde daha güzel çalışsa da, bulut tabanlı sanal ortamlarda fonksiyonunu yitirdi. Bu bulgular, AI araçlarının insan müdahalesi olmadan farklı sistemlere ahenk sağlayan otonom makûs emelli yazılımları çabucak destekleyebileceği fikrini zayıflatıyor.
GPT-5’te yeni bir yaklaşım
Netskope, GPT-5 üzerinde yaptığı denemelerde ise kod kalitesinde büyük gelişmeler olduğunu gözlemledi. Lakin modelin makûs niyetli kullanıma karşı geliştirdiği müdafaa bariyerleri de güçlendi. GPT-5, ziyanlı istekleri reddetmek yerine çıktıları daha inançlı fonksiyonlara yönlendiriyor, bu da ortaya çıkan kodun çok adımlı akınlar için kullanılamaz hale gelmesine neden oluyor.
Testler, büyük modellerin denetimli ortamlarda ziyanlı mantık üretebildiğini gösterse de, üretilen kodun tutarsız ve birçok vakit etkisiz kalmaya devam ettiğini kanıtladı. Büsbütün otonom taarruzlar bugün ortaya çıkmıyor ve gerçek dünya olaylarının başarılı olması hala insan nezareti gerektiriyor.
Chip Alıntıdır…


