# 技能/工作/常识提示词的质量评估标准和检查清单

## 1. 通用质量评估维度

所有提示词类型均需从以下5个维度评估：

| 维度 | 权重 | 评估要点 | 评分标准（1-5分） |
|:-----|:----:|:---------|:-----------------|
| **完整性** | 30% | 是否包含所有必要要素 | 5=全部完整，1=严重缺失 |
| **清晰度** | 25% | 表述是否明确无歧义 | 5=一目了然，1=模糊不清 |
| **可执行性** | 25% | 是否能按提示词直接执行 | 5=可直接执行，1=无法执行 |
| **一致性** | 10% | 内部逻辑是否自洽 | 5=完全一致，1=前后矛盾 |
| **规范性** | 10% | 是否符合命名/格式规范 | 5=完全合规，1=不合规 |

## 2. 技能提示词（Skill）检查清单

| # | 检查项 | 说明 |
|:-:|:-------|:------|
| 1 | ✅ 有技能名称（name）和标题（title） | 唯一标识和中文显示名 |
| 2 | ✅ 有描述（description） | 50字以内，含触发关键词 |
| 3 | ✅ 有依赖工具列表（tools） | 列出所有需要的工具 |
| 4 | ✅ 有执行步骤（steps） | Step1→Step2→Step3 格式 |
| 5 | ✅ 每步骤写明工具和参数 | 如 `使用 write_text 写入文件，mode='overwrite'` |
| 6 | ✅ 每步骤写明文件路径 | 如 `./skill/{group}/{name}/skill.md` |
| 7 | ✅ 有输出成果清单 | 列出所有产出物 |
| 8 | ✅ 有禁止行为 | 明确列出不能做的事 |
| 9 | ✅ 无7种反模式 | 逐项扫描大纲步骤、无名文件等 |
| 10 | ✅ 步骤数适中 | 3-8个步骤为佳，不超过10个 |

## 3. 做事提示词（Work）检查清单

| # | 文件 | 检查项 |
|:-:|:-----|:--------|
| 1 | rule.md | ✅ 定义了任务目标和范围 |
| 2 | rule.md | ✅ 明确了输入条件和前置要求 |
| 3 | rule.md | ✅ 列出了必须遵守的规则 |
| 4 | method.md | ✅ 有清晰的操作步骤流程 |
| 5 | method.md | ✅ 步骤有编号（Step1/2/3） |
| 6 | method.md | ✅ 无工具调用和文件读写 |
| 7 | method.md | ✅ 纯人工操作指引 |
| 8 | trick.md | ✅ 有经验技巧和最佳实践 |
| 9 | trick.md | ✅ 有常见问题和注意事项 |
| 10 | work.json | ✅ 配置正确，引用路径有效 |

## 4. 常识知识（Knowledge）检查清单

| # | 检查项 | 说明 |
|:-:|:-------|:------|
| 1 | ✅ 有 YAML Frontmatter | name, description, tags |
| 2 | ✅ 内容纯声明性 | 只有数据、表格、规则、标准 |
| 3 | ✅ 无步骤编号 | 禁止出现 Step1/2/3 |
| 4 | ✅ 无工具调用 | 禁止出现工具名和代码 |
| 5 | ✅ 有标签关联 | tags 关联到相关技能/智能体 |
| 6 | ✅ 分组合理 | 按领域分组，便于查找 |
| 7 | ✅ 内容准确 | 数据正确，无过时信息 |

## 5. 反模式严重程度分级

| 级别 | 反模式 | 处理方式 |
|:-----|:-------|:---------|
| 🔴 **致命** | 大纲步骤、空话禁止 | 必须修改，否则技能不可用 |
| 🟡 **严重** | 无名文件、无路径文件、套话回退 | 强烈建议修改 |
| 🟢 **轻微** | 模糊表述、占位示例 | 建议优化 |

## 6. 质量等级判定标准

| 等级 | 评分范围 | 说明 | 处理建议 |
|:-----|:---------|:------|:---------|
| **S级** | 90-100分 | 完美，可直接使用 | 可作为示范案例 |
| **A级** | 80-89分 | 优良，少量可优化项 | 建议微调后使用 |
| **B级** | 70-79分 | 合格，有改进空间 | 优化后再使用 |
| **C级** | 60-69分 | 及格，需较大改进 | 必须修改后才能使用 |
| **D级** | <60分 | 不合格，需重写 | 重新设计技能提示词 |
