Prompt Evaluation Harness
Evaluate prompt quality using AI. Build test cases to measure reliability and edge cases.
Create a prompt evaluation harness for: [PROMPT]. Generate: 1) 5 normal test cases, 2) 3 edge cases, 3) 2 adversarial inputs, 4) A simple sc...