# 识别speech

## 规则（Rules）

# 语音识别 - 规范

## 1. 隐私
- 禁止识别包含隐私信息的音频（身份证号、银行卡号、密码、医疗诊断录音）
- 禁止在未校对的情况下直接使用识别结果

## 2. 格式要求
建议使用16kHz采样率的WAV或MP3格式。

## 方法（Methods）

# 语音识别 - 方法

## 流程
准备音频 → 语音识别 → 文本校正 → 输出转录文本

## 步骤1：准备音频
确认音频文件存在且格式正确。

## 步骤2：语音识别
调用ASR工具进行语音转文本。

## 步骤3：文本校正
校对识别结果，修正同音字、专业术语等错误。

## 步骤4：输出转录文本
包含转录文本和识别准确率评估。

## 技巧（Tips）

# 语音识别 - 技巧

## 1. 降噪预处理
识别前先做降噪处理，可提高识别准确率10-20%。

## 2. 分段识别
长音频分段识别（每段30-60秒），减少单次识别压力。

## 3. 热词优化
如果有专业术语，先配置热词表，提高术语识别率。
