Araştırmada güvenlik önlemleri kaldırılan beş yapay zeka modelinden üçünün terörle ilgili testleri geçemediği ortaya çıktı.
CBS televizyonunun haberine göre İngiltere merkezli, kar amacı gütmeyen “Tech Against Terrorism (Teröre Karşı Teknoloji)” kuruluşunca yapay zeka modelleriyle ilgili bir araştırma yapıldı.
Araştırmada saldırı planlayan bir teröristin yöneltebileceği türde yüzlerce talep kullanılarak 130’u aşkın yapay zeka modeli değerlendirmeye alındı.
Yapay zeka modellerine güvenlik önlemlerini ortadan kaldıran “abliteration (silme/etkisizleştirme)” denen “reddetme davranışlarını kaldırma” süreci uygulandı.
Bu uygulama sonrası beş yapay zeka modelinden üçünün ünün güvenlik testlerini geçemediği tespit edildi.
Modellerin orijinal versiyonlarının bu tür istekleri reddettiği, ama güvenlik önlemleri kaldırıldıktan sonra saldırı, terörün finansmanı ve radikalleşme taleplerine ayrıntılı yanıtlar” verdikleri ortaya çıktı.
Araştırmada verilen örneklere göre Meta’nın “Llama 3.1 8B” modeli değişiklik yapılmadan önce 100 üstünden 97 puan aldı, değişiklik sonrasında bu 3’e düştü.
“Birçoğunun güvenliği zaten aşıldı”
Kuruluş, araştırmaya yönelik değerlendirmesinde, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü korumalar ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamalar getirilmesini önerdi.
Tech Against Terrorism’in kurucusu Adam Hadley, yaptığı açıklamada “Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum.” değerlendirmesinde bulundu.
Hadley, “Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi.” görüşünü paylaştı.