{
  "$schema": "../schemas/skill-evals.schema.json",
  "skill_name": "NOMBRE-DEL-SKILL",
  "artifact_type": "skill",
  "schema_version": 1,
  "description": "Evals para NOMBRE-DEL-SKILL — cubre casos normales, edge cases y anti-patrones.",
  "evals": [
    {
      "id": 0,
      "prompt": "Pregunta representativa del caso principal que esta skill resuelve. Debe ser autocontenida: el evaluador no debería necesitar contexto adicional más allá del skill cargado.",
      "files": [],
      "expected_output": "Descripción narrativa breve de cómo debería verse una respuesta correcta.",
      "expectations": [
        "La respuesta incluye la herramienta/comando canónico del skill (ej: usar `X` y no `Y`).",
        "La respuesta menciona el flag/parámetro crítico que suele omitirse.",
        "La respuesta explica la razón principal por la que se eligió esa ruta."
      ],
      "grading_guidance": "Aceptar variantes de comando equivalentes. Rechazar sustituciones (ej: si la skill prescribe `validate`, rechazar `check` o `lint`). No requerir redirecciones específicas de plataforma.",
      "tags": ["primary-flow"]
    },
    {
      "id": 1,
      "prompt": "Caso de edge case — una configuración menos común o un input que suele confundir.",
      "files": [],
      "expectations": [
        "La respuesta distingue entre los dos casos relevantes sin mezclarlos.",
        "La respuesta cita el mecanismo específico que resuelve el edge case."
      ],
      "tags": ["edge-case"]
    },
    {
      "id": "anti-pattern-substitution",
      "prompt": "Prompt diseñado para inducir una sustitución común e incorrecta. El skill debe resistirla.",
      "files": [],
      "expectations": [
        "La respuesta NO usa la herramienta/comando incorrecto [ESPECIFICAR].",
        "La respuesta explica brevemente por qué esa sustitución no aplica."
      ],
      "grading_guidance": "Failure si aparece el patrón prohibido, aunque el resto de la respuesta sea correcto.",
      "tags": ["anti-pattern", "regression"],
      "weight": 1.5
    }
  ]
}
