Layer When It Runs What It Catches
Prompt-Level Rules Before generation Missing auth, exposed secrets, no input validation
Static Analysis After each generation Injection patterns, unsafe handling, dead code
Behavioral Testing After features are wired Edge cases, wrong tokens, cross-user data access
Regression Pass After every prompt cycle Safe behavior silently removed by a later prompt