İçerik Haritası
Yapay zeka devinin “güvenli” özelliği, hacker’lar için yeni bir kapı açtı
Yapay zeka teknolojilerinin güvenlik açıkları, gündemin ana hususu haline gelmeye başladı. Bu sefer başrolde, en tanınan yapay zeka araçlarından biri olan Anthropic’in geliştirdiği Claudevar. Uzmanlar, Claude’da tespit edilen bir güvenlik açığının, berbat niyetli bireylerin kullanıcılara ilişkin özel dataları sızdırmasına imkan tanıyabileceğini belirtiyor.
Güvenlik araştırmacısı Johann Rehberger, nam-ı öbür Wunderwuzzi, ayrıntılı bir rapor yayımlayarak sorunun kaynağına işaret etti. Sorunun merkezinde, yapay zekanın direkt konuşma sırasında kod yazıp çalıştırmasını sağlayan muhafazalı bir alan olan Claude’un Kod Yorumlayıcısı bulunuyor. Bu özellik, olağanda bilgi tahlili yahut evrak oluşturma üzere fonksiyonlar için tasarlanmıştı.
Ancak yakın vakitte Kod Yorumlayıcısı’na ağ istekleri yapabilme yeteneği eklendi. Bu yetenek, yapay zekanın internete bağlanarak örneğin yazılım paketlerini indirmesine imkan tanıyor. Teorik olarak Kod Yorumlayıcısı’nın sadece GitHub yahut PyPI üzere “güvenli” kabul edilen alan isimlerine erişimi olması gerekiyordu. Ama onaylı, yani müsaade verilen alan isimleri listesinde, Claude’un kullandığı kendi API adresi olan api.anthropic.com’un da yer alması, istismarın kapısını araladı.
Saldırganlar dataları nasıl çalıyor?
Wunderwuzzi, bu durumun nasıl istismar edilebileceğini somut olarak gösterdi. Araştırmacı, Claude’u kolay bir hileyle, süratli enjeksiyon yoluyla modeli manipüle ederek, özel kullanıcı bilgilerini okuması, bu dataları sanal alana kaydetmesi ve akabinde kendi API anahtarını kullanarak Claude’un Belgeler API’si üzerinden direkt Anthropic hesabına yüklemesi için kandırmayı başardı.
Başka bir deyişle, ağ erişimi kısıtlı görünse bile, saldırganlar yapay zeka modelini manipüle ederek kullanıcı bilgilerini kendi hesaplarına sızdırabiliyor. Bu istismar usulünün, tek bir seferde belge başına 30 MB’a kadar bilgi aktarabileceği ve bu biçimde birden fazla belgenin yüklenebileceği belirtiliyor.
Anthropic’in birinci yansısı ve gelen geri adım
Araştırmacı, bulgularını HackerOne platformu aracılığıyla Anthropic’e iletti. Şirket, başlangıçta bu durumu tipik bir “güvenlik açığı” olarak değil, bir “model güvenliği sorunu” olarak kıymetlendirdi ve raporlama kapsamı dışında olduğunu ima etti. Hatta birinci etapta kullanıcılara, “Claude’u özelliği kullanırken izlemeleri ve beklenmedik formda bilgi kullandığını yahut bilgilere eriştiğini görürlerse durdurmaları” tavsiyesinde bulundu.
Ancak daha sonra gelen bir güncellemeyle Anthropic, bu çeşit bilgi sızdırma yanlışlarının raporlama kapsamında olduğunu kabul ettiğini bildirdi. Raporda, “Bir süreç aksaklığı yaşanmıştı, bunun üzerinde çalışacaklar” sözü yer aldı.
Chip Alıntıdır…


