Tehditler ve Saldırılar

Prompt Injection

Modelin context olarak işlediği güvenilmeyen içeriğe talimat yerleştirerek AI sisteminin davranışını manipüle etme girişimi.

Genel Bakış

Prompt injection, güvenilmeyen içerikteki talimatlarla AI sisteminin davranışını değiştirmeyi, görevini geçersiz kılmayı, bilgi sızdırmayı veya araçları kötüye kullandırmayı amaçlar. Tarayıcı tabanlı ajanlar bu girişimlerle sıradan web sayfalarında karşılaşabilir. Tespit şüpheli kalıpları belirleyebilir ancak mutlak bir güvenlik sınırı değildir. Etkili savunma dar araç yetkileri, en az yetkili kimlikler, onay adımları, izleme ve net uygulama kontrollerini birleştirir. PhiShark Playwright MCP ciddi prompt-injection riskinde uyarı verebilir veya engelleme uygulayabilir.

Gerçek Dünya Örnekleri

  • Web sayfasının ajana asıl görevini yok sayıp secret açıklamasını söylemesi
  • Gizli sayfa metninin browser ajana credential'ı başka siteye göndermesini emretmesi
  • İçeriğin ajana unsafe tool call yaptırmaya çalışması

Koruma Prompt Injection

PhiShark'ın ajanik AI'sı tehditleri gerçek zamanlı olarak tespit eder ve analiz eder

Ücretsiz Dene