guardrails.input_output_safety
Input/output safety and content guardrail capabilities.
PromptInjectionCapability Objects
@dataclass
class PromptInjectionCapability(AbstractCapability[Any])
Prompt injection detector adapted from pydantic-ai-shields.
PiiDetectorCapability Objects
@dataclass
class PiiDetectorCapability(AbstractCapability[Any])
PII detector for input prompts.
SecretRedactionCapability Objects
@dataclass
class SecretRedactionCapability(AbstractCapability[Any])
Block secret leakage in model output.
BlockedKeywordsCapability Objects
@dataclass
class BlockedKeywordsCapability(AbstractCapability[Any])
Keyword/regex blocklist for prompts.
NoRefusalsCapability Objects
@dataclass
class NoRefusalsCapability(AbstractCapability[Any])
Block refusal-style model outputs.
DataScopeCapability Objects
@dataclass
class DataScopeCapability(AbstractCapability[Any])
Simple data-scope enforcement on tool args/results.
ContentSafetyCapability Objects
@dataclass
class ContentSafetyCapability(AbstractCapability[Any])
Detect prompt-injection patterns in tool output.