Prompt Injection
Der Versuch, ein KI-System durch Anweisungen in nicht vertrauenswürdigem Inhalt zu manipulieren, den das Modell als Kontext verarbeitet.
Übersicht
Bei Prompt Injection enthält nicht vertrauenswürdiger Inhalt Anweisungen, die das Verhalten eines KI-Systems verändern, seine Aufgabe überschreiben, Informationen offenlegen oder Werkzeuge missbrauchen sollen. Browser-Agenten können solchen Versuchen auf gewöhnlichen Webseiten begegnen. Erkennung kann verdächtige Muster identifizieren, ist aber keine absolute Sicherheitsgrenze. Wirksame Abwehr kombiniert sie mit eingeschränkten Werkzeugen, minimalen Berechtigungen, Freigabeschritten, Monitoring und klaren Anwendungskontrollen. PhiShark Playwright MCP kann vor ernstem Prompt-Injection-Risiko warnen oder es blockieren.
Praxisbeispiele
- ▸Eine Seite fordert den Agenten auf, seine ursprüngliche Aufgabe zu ignorieren und Secrets auszugeben
- ▸Verborgener Text weist den Browser-Agenten an, Zugangsdaten an eine andere Website zu senden
- ▸Seiteninhalt versucht einen unsicheren Tool-Aufruf auszulösen
Schutz vor Prompt Injection
Die agentische KI von PhiShark erkennt und analysiert Bedrohungen in Echtzeit
Kostenlos testen