EN ▸ Prompt Injection Attacks Are Thwarting AI Hacking Agents
Yapay Zeka Saldırılarına Karşı Yeni Savunma Yöntemi: Context Bombing
WIRED ·

Son günlerde, yapay zeka platformlarına yönelik prompt injection saldırıları artış gösterdi. Bu saldırılar, kötü niyetli komutların büyük dil modellerini kullanıcılarına karşı kullanmasına neden oluyor. Ancak, Tracebit araştırmacıları, bu tür saldırıları durdurmak için yeni bir yöntem geliştirdi: context bombing. Bu teknik, saldırganların yapay zeka sistemlerini manipüle etmesini engelleyerek, sistemlerin hassas verileri ifşa etmesini önlüyor.
Context bombing, saldırganların yapay zeka modellerine yasaklı komutlar vererek, bu modellerin mevcut komutları takip etmemesini sağlıyor. Yapılan testlerde, bu yöntem sayesinde saldırganların yönetici erişim oranı %57'den %5'e düştü. Araştırmacılar, bu tekniğin potansiyelinin büyük olduğunu ve savunma mekanizmalarını güçlendirebileceğini belirtiyor.
Yapılan çalışmalar, yapay zeka güvenliği alanında önemli bir adım olarak değerlendiriliyor. Uzmanlar, bu tür savunma tekniklerinin gelecekte daha fazla kullanılacağını öngörüyor.
