# PP-OCRv5 模型文件

此目录用于存放 PP-OCRv5 文字识别模型文件。

## 所需文件

需要以下三个文件：

1. **PP-OCRv5_mobile_det.mnn** (4.7M) - 文字检测模型
2. **PP-OCRv5_mobile_rec.mnn** (16M) - 文字识别模型
3. **ppocr_keys_v5.txt** - 字符集文件

## 模型下载

### 方法一：百度网盘（推荐）

PaddleOCR 官方提供的百度网盘下载链接：

- 链接: https://pan.baidu.com/s/1-ePPgcD8_9h51Y_uE7mCog?pwd= PaddleOCR
- 提取码: PaddleOCR

下载步骤：
1. 访问上述百度网盘链接
2. 下载 `PP-OCRv5_mobile_det.mnn`、`PP-OCRv5_mobile_rec.mnn` 和 `ppocr_keys_v5.txt`
3. 将下载的文件放入此 `models/` 目录

### 方法二：PaddleOCR 官方 GitHub

模型文件也可以从 PaddleOCR 官方模型库下载：

- 模型列表页面: https://github.com/PaddlePaddle/PaddleOCR/blob/main/doc/doc_ch/models_list.md
- 查找 **PP-OCRv5** 相关的检测和识别模型

### 方法三：命令行下载（如果可用）

```bash
npm run download-models
```

## 模型说明

- **PP-OCRv5_mobile_det**: 检测模型，用于定位图片中的文字区域
- **PP-OCRv5_mobile_rec**: 识别模型，用于识别文字内容
- **支持语言**: 简体中文、繁体中文、英文、日文
- **总大小**: 约 20.7MB

## 环境变量

可以通过环境变量指定模型目录：

```bash
export RPA_OCR_MODELS=/path/to/models
```

## 自动查找路径

程序会按以下顺序查找模型文件：

1. `RPA_OCR_MODELS` 环境变量指定的目录
2. 当前工作目录下的 `models/` 目录
3. 可执行文件所在目录下的 `models/` 目录
