Amenazas y Ataques

Prompt Injection

Intento de manipular un sistema de IA colocando instrucciones en contenido no confiable que el modelo procesa como contexto.

Resumen

La prompt injection ocurre cuando contenido no confiable contiene instrucciones destinadas a cambiar el comportamiento de la IA, reemplazar su tarea, revelar información o abusar de sus herramientas. Los agentes de navegador pueden encontrar estos intentos en páginas normales. La detección puede identificar patrones sospechosos, pero no es una frontera absoluta. La defensa efectiva combina herramientas limitadas, credenciales de mínimo privilegio, aprobaciones, monitorización y controles claros de la aplicación. PhiShark Playwright MCP puede avisar o bloquear un riesgo serio de prompt injection durante la navegación.

Ejemplos del Mundo Real

  • Una página pide al agente ignorar su tarea original y revelar secretos
  • Texto oculto ordena enviar credenciales a otro sitio
  • El contenido intenta provocar una llamada insegura a una herramienta

Protegerse Contra Prompt Injection

La IA agéntica de PhiShark detecta y analiza amenazas en tiempo real

Prueba Gratis