prompt-evaluator

Installation
SKILL.md

Prompt Evaluator

Systematically evaluate LLM prompts across multiple quality dimensions, produce quantitative scores, and generate optimized rewrites.

When to Use

  • Reviewing or auditing system prompts before production deployment
  • Comparing two or more prompt variants to choose the best one
  • Optimizing an existing prompt that produces inconsistent results
  • Establishing prompt quality standards for a team or organization
  • Debugging why an LLM is not following instructions correctly

Evaluation Rubric

Score every prompt on the following 8 dimensions (each 1-10):

Installs
18
GitHub Stars
1
First Seen
Mar 17, 2026
prompt-evaluator — viliawang-pm/ai-engineering-toolkit