Docs aligment on latest metrics.
Some checks failed
build_docker / essential (pull_request) Successful in 1s
build_docker / build_gpu (pull_request) Has been cancelled
build_docker / build_easyocr (pull_request) Has been cancelled
build_docker / build_cpu (pull_request) Successful in 5m25s
build_docker / build_easyocr_gpu (pull_request) Has been cancelled
build_docker / build_doctr (pull_request) Has been cancelled
build_docker / build_doctr_gpu (pull_request) Has been cancelled
Some checks failed
build_docker / essential (pull_request) Successful in 1s
build_docker / build_gpu (pull_request) Has been cancelled
build_docker / build_easyocr (pull_request) Has been cancelled
build_docker / build_cpu (pull_request) Successful in 5m25s
build_docker / build_easyocr_gpu (pull_request) Has been cancelled
build_docker / build_doctr (pull_request) Has been cancelled
build_docker / build_doctr_gpu (pull_request) Has been cancelled
This commit is contained in:
@@ -1,5 +1,7 @@
|
||||
# Resultados de Ajuste de Hiperparámetros PaddleOCR
|
||||
|
||||
> **Nota:** Los resultados de este documento corresponden a la fase de validación GPU con 45 páginas. El resultado oficial del TFM es **CER 1.49%** obtenido en la validación final de 24 páginas con la configuración optimizada (ver `docs/04_desarrollo_especifico.md`).
|
||||
|
||||
**Fecha de Ajuste:** 2026-01-19
|
||||
**Plataforma:** NVIDIA RTX 3060 Laptop GPU
|
||||
**Muestras:** 64
|
||||
@@ -89,3 +91,51 @@ curl -X POST http://localhost:8002/evaluate_full \
|
||||
```
|
||||
|
||||
**Resultado:** CER 7.72%, WER 11.40%, 0.55s/página
|
||||
|
||||
## Configuración del Modelo
|
||||
|
||||
### Modelo Actual (Correcto para Español)
|
||||
|
||||
| Componente | Modelo | Estado |
|
||||
|------------|--------|--------|
|
||||
| Detección | `PP-OCRv5_mobile_det` | Correcto |
|
||||
| Reconocimiento | `PP-OCRv5_mobile_rec` | Correcto |
|
||||
|
||||
Los modelos PP-OCRv5 mobile soportan múltiples idiomas incluyendo español con buen manejo de diacríticos.
|
||||
|
||||
### Nota sobre Modelos Server
|
||||
|
||||
PaddleOCR ofrece modelos "server" más precisos:
|
||||
- `PP-OCRv5_server_det` + `PP-OCRv5_server_rec`
|
||||
- Requieren ~5.3 GB VRAM
|
||||
|
||||
**Limitación:** En la RTX 3060 (5.66 GB VRAM) los modelos server causan **OOM (Out of Memory)** en la página 2. Los modelos mobile usados (7.72% CER) son la mejor opción práctica para este hardware.
|
||||
|
||||
Para hardware con más VRAM (8+ GB), los modelos server podrían mejorar la precisión.
|
||||
|
||||
## Análisis de Errores del Debugset
|
||||
|
||||
### Errores Observados
|
||||
|
||||
| Ground Truth | PaddleOCR | Tipo de Error |
|
||||
|--------------|-----------|---------------|
|
||||
| `bibliografía` | `bibliografia` | Acento omitido |
|
||||
| `amplían` | `amplian` | Acento omitido |
|
||||
| `, debes` | `, debes` | Coma Unicode china |
|
||||
| Líneas separadas | Footer fusionado | Estructura menor |
|
||||
|
||||
### Fortalezas
|
||||
|
||||
- **Preserva estructura de líneas**: Mantiene saltos de línea correctamente
|
||||
- **Buen manejo de español**: La mayoría de acentos se reconocen bien
|
||||
- **Bajo ruido**: No inserta caracteres espurios
|
||||
|
||||
### ¿Fine-tuning Recomendado?
|
||||
|
||||
**No.** Con 7.72% CER, PaddleOCR ya tiene excelente precisión para documentos españoles. Los errores observados son menores:
|
||||
|
||||
- Acentos omitidos: ~5% de casos
|
||||
- Puntuación Unicode: Muy ocasional
|
||||
- Impacto en legibilidad: Mínimo
|
||||
|
||||
El esfuerzo de fine-tuning no se justifica para ganancias marginales. Para casos de uso críticos donde se requiera <5% CER, considerar post-procesamiento con corrector ortográfico
|
||||
|
||||
Reference in New Issue
Block a user