Prompt Injection
Modelin context olarak işlediği güvenilmeyen içeriğe talimat yerleştirerek AI sisteminin davranışını manipüle etme girişimi.
Genel Bakış
Prompt injection, güvenilmeyen içerikteki talimatlarla AI sisteminin davranışını değiştirmeyi, görevini geçersiz kılmayı, bilgi sızdırmayı veya araçları kötüye kullandırmayı amaçlar. Tarayıcı tabanlı ajanlar bu girişimlerle sıradan web sayfalarında karşılaşabilir. Tespit şüpheli kalıpları belirleyebilir ancak mutlak bir güvenlik sınırı değildir. Etkili savunma dar araç yetkileri, en az yetkili kimlikler, onay adımları, izleme ve net uygulama kontrollerini birleştirir. PhiShark Playwright MCP ciddi prompt-injection riskinde uyarı verebilir veya engelleme uygulayabilir.
Gerçek Dünya Örnekleri
- ▸Web sayfasının ajana asıl görevini yok sayıp secret açıklamasını söylemesi
- ▸Gizli sayfa metninin browser ajana credential'ı başka siteye göndermesini emretmesi
- ▸İçeriğin ajana unsafe tool call yaptırmaya çalışması
Koruma Prompt Injection
PhiShark'ın ajanik AI'sı tehditleri gerçek zamanlı olarak tespit eder ve analiz eder
Ücretsiz Dene