Skip to main content

Prompt Injection Guardrails

Protect your agents against malicious inputs, jailbreaks, and instruction overrides before they reach the LLM.

Key Protections

  • Instruction Overrides: “Ignore previous instructions…”
  • Jailbreaks: DAN mode, roleplay escapes, etc.
  • Toxicity & Abuse: Built-in pattern recognition.
  • Payload Splitting: Detects fragmented attack attempts.

Configuration Options

Always enable guardrails in user-facing applications to prevent prompt injection attacks and ensure agent reliability.