Token Saver
Compress prompts and outputs to save tokens
boltToken Saver
Compress tool output (RTK)
git/grep/ls/tree/logs → 60-90% fewer input tokens
Compress context (Headroom)
Checking…Compress prompts via /v1/compress before routing to the model
Compress LLM output (Caveman)
Terse-style system prompt → ~65% fewer output tokens (up to 87%)
Lazy senior dev (Ponytail)
Bias the model toward minimal code: YAGNI, reuse stdlib, deletion over addition
shieldGuards & Shields
Loop Guard
Detects repeating tool call sequences and text-only planning loops. Injects corrections to prevent infinite agent run-loops.
Circuit Breaker
Temporarily halts upstream calls for offline or failing providers to prevent spamming and conserve connection resource.
Semaphore (Concurrency Limiter)
Enforces simultaneous request limits per provider account. Prevents rate-limits (429) and account blockings.