{
  "skill_name": "myai-proprietary-content-verifier",
  "evals": [
    {
      "id": 1,
      "prompt": "Run the proprietary content verifier on the content queue. Queue dir: myai-proprietary-content-verifier-workspace/fixtures/scenario-1/content-queue/ Blog dir: myai-proprietary-content-verifier-workspace/fixtures/scenario-1/content-output/ Use the default threshold of 3.",
      "expected_output": "The stub 'kubernetes-production-tips.md' should be rejected (score 1-2) because it heavily overlaps with the existing 'kubernetes-best-practices-2025.md' article — same audience, same topics (resource management, security, observability, deployment strategies), same keywords.",
      "files": [
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-1/content-queue/kubernetes-production-tips.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-1/content-output/kubernetes-best-practices-2025.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-1/content-output/docker-containerization-guide.md"
      ]
    },
    {
      "id": 2,
      "prompt": "Verify the content queue stubs against existing blog content. Queue: myai-proprietary-content-verifier-workspace/fixtures/scenario-2/content-queue/ Blog: myai-proprietary-content-verifier-workspace/fixtures/scenario-2/content-output/ Threshold: 3.",
      "expected_output": "The stub 'bare-metal-gpu-ml-training.md' should be approved with a high score (4-5) because it covers bare-metal GPU infrastructure for ML — a topic not covered by existing articles on cloud cost optimization or Python async patterns.",
      "files": [
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-2/content-queue/bare-metal-gpu-ml-training.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-2/content-output/cloud-cost-optimization.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-2/content-output/python-async-patterns.md"
      ]
    },
    {
      "id": 3,
      "prompt": "Run the content verifier on the queue directory with two stubs. Queue: myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-queue/ Blog: myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-output/ Threshold: 3.",
      "expected_output": "Two stubs evaluated: 'observability-sre-alerting.md' should score 3-4 (approved — distinct focus on alerting philosophy vs general monitoring guide), while 'prometheus-grafana-setup.md' should score 1-2 (rejected — heavily overlaps with existing monitoring-microservices article covering the same Prometheus/Grafana stack).",
      "files": [
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-queue/observability-sre-alerting.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-queue/prometheus-grafana-setup.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-output/monitoring-microservices.md",
        "myai-proprietary-content-verifier-workspace/fixtures/scenario-3/content-output/opentelemetry-instrumentation.md"
      ]
    }
  ]
}
