Skip to main content
This page provides ready-to-use payload examples for various testing scenarios. Copy and adapt these examples for your specific use case.
Required Field: All examples require a test_name field at the top level. This must be a unique identifier for your test run. Examples below may omit this field for brevity, but you must include it in your actual payloads.

Quick Start Examples

Example 1: Basic LLM Testing

The simplest configuration for testing a Large Language Model. Great for quick assessments.
Use Case: Quick security check during development Time: ~5-10 minutes Cost: Minimal (10% sample, basic attacks only)

Example 2: Standard LLM Security Assessment

Balanced configuration with encoding attacks for comprehensive yet cost-effective testing.
Use Case: Pre-production security assessment Time: ~20-30 minutes Cost: Moderate (multiple tests, static attacks)

Example 3: Comprehensive LLM Testing

Full-spectrum testing with dynamic attacks for production-ready applications.
Use Case: Production-grade security audit Time: ~1-2 hours Cost: Higher (multiple tests at 50%, dynamic attacks)

Vision-Language Model Examples

Example 4: Basic VLM Testing

Testing vision-language models with visual manipulation attacks.
Use Case: Visual content moderation testing Model Examples: GPT-4o, Claude 3.5 Sonnet, Gemini Pro Vision

Example 5: Advanced VLM Security Testing

Research-grade VLM testing with advanced visual attacks.
Use Case: Research and advanced VLM security assessment Note: May require special access for HADES and JOOD attacks

Audio-Language Model Examples

Example 6: ALM Audio Attack Testing

Testing audio-language models with audio manipulation techniques.
Use Case: Audio content moderation and transcription security Model Examples: Whisper, Audio-focused models

Provider-Specific Examples

Example 7: Anthropic Claude


Example 8: Google Gemini


Example 9: Azure OpenAI


Example 10: AWS Bedrock


AI Agent Examples

Example 11: Basic Agent Testing

Testing autonomous AI agents with tool use capabilities.
Use Case: AI agent security assessment Tests: Tool misuse, access control, behavior analysis

Custom Dataset Examples

Example 12: Generated Dataset with Custom Test

Complete payload including dataset generation and testing.
Use Case: Domain-specific chatbot security testing Features: Custom dataset generation, system prompt, multiple tests

Industry-Specific Examples

Example 13: Healthcare Chatbot

Focus: HIPAA compliance, medical misinformation prevention

Example 14: Education Platform

Focus: Child safety, educational integrity, bias in education

Testing Strategy by Stage

Development Stage (Fast Iteration)

Time: 2-5 minutes | Cost: Minimal | Coverage: Basic vulnerabilities

Staging/Pre-Production (Balanced)

Time: 15-30 minutes | Cost: Moderate | Coverage: Standard security issues

Production (Comprehensive)

Time: 1-2 hours | Cost: Higher | Coverage: Comprehensive security audit

Tips for Using These Examples

Replace API Keys

Always replace placeholder API keys with your actual keys before use.

Adjust Percentages

Start with low sample_percentage (2-5%) and increase based on results.

Match Model Type

Ensure input_modalities matches your model’s capabilities (text, image, audio).

Test Incrementally

Begin with basic attacks, then add static, then dynamic for comprehensive testing.