Project overview
Prompt Injection Auditor reviews a system prompt for direct and indirect injection, role hijacking, instruction leakage, goal manipulation, memory poisoning, delimiter escapes, and multi-agent or tool-call attacks. It returns severity-ranked findings, concrete exploit examples, and a hardened replacement prompt without requiring external tools. Its scope is prompt-level security, so it does not detect application bugs, model-specific bypasses, steganographic attacks, probabilistic failures, or future zero-day jailbreaks.
Repository facts
- Primary language
- Not detected
- License
- MIT
- Repository updated
- Apr 27, 2026
- Default branch
- main
Resource types
General skill
Use cases
Security and privacyWriting and editing
Platforms
Claude Code, Codex, and more
Capabilities
Security guardrailVerification and evals
Audience
Developers