PhiShark Logo
Menaces et Attaques

Prompt Injection

Tentative de manipulation d'un système IA par des instructions placées dans un contenu non fiable que le modèle traite comme contexte.

Vue d'ensemble

La prompt injection se produit lorsqu'un contenu non fiable contient des instructions destinées à modifier le comportement d'un système IA, remplacer sa tâche, divulguer des informations ou détourner ses outils. Les agents de navigateur peuvent rencontrer ces tentatives sur des pages ordinaires. La détection peut identifier des motifs suspects, mais elle ne constitue pas une frontière absolue. Une défense efficace associe outils limités, moindre privilège, validations, supervision et contrôles applicatifs clairs. PhiShark Playwright MCP peut avertir ou bloquer un risque sérieux de prompt injection pendant la navigation.

Exemples du Monde Réel

  • Une page demande à l'agent d'ignorer sa tâche et de révéler des secrets
  • Un texte caché ordonne à l'agent d'envoyer des identifiants vers un autre site
  • Le contenu tente de provoquer un appel d'outil dangereux

Protéger contre Prompt Injection

L'IA agentique de PhiShark détecte et analyse les menaces en temps réel

Essai Gratuit