davidcastagnetoa/skills

tesseract_ocr

Motor OCR open-source clásico como alternativa de fallback

First seen Mar 6, 2026

Installation

$ npx skills add davidcastagnetoa/skills --skill tesseract_ocr

Also in this package

Other skills from davidcastagnetoa/skills · top by installs.

npx skills add davidcastagnetoa/skills

Browse all from davidcastagnetoa/skills

More details

Agent compatibility

Declared targets from SKILL.md / docs. Unmarked agents are not listed — the skill may still install via the CLI.

Claude Code Not declared
Cursor Not declared
Codex Not declared
GitHub Copilot Not declared
Windsurf Not declared
Gemini CLI Not declared
Cline Not declared
OpenCode Not declared

Repository health

Stars 1
Default branch main
Open issues 0
Status Active

Package contents

Files included with this skill beyond the listing page.

  • skill md SKILL.md 1,399 B
  • docs SUMMARY.md 80 B

History

  1. First seen on skills.sh
  2. First recorded snapshot · 5 installs

SKILL.md

tesseract_ocr

Tesseract OCR es el motor OCR open-source más maduro, mantenido por Google. Aunque menos preciso que PaddleOCR/EasyOCR en documentos complejos, es extremadamente rápido y ligero como tercer nivel de fallback.

When to use

Usar en el ocr_agent como tercer motor de fallback cuando PaddleOCR y EasyOCR fallan o no están disponibles. Útil en modo de degradación cuando los recursos GPU son limitados.

Instructions

  1. Instalar: apt install tesseract-ocr tesseract-ocr-spa y pip install pytesseract.
  2. Configurar: pytesseract.pytesseract.tesseract_cmd = '/usr/bin/tesseract'.
  3. Ejecutar OCR: text = pytesseract.imagetostring(image, lang='spa+eng').
  4. Para bounding boxes: data = pytesseract.imagetodata(image, output_type=Output.DICT).
  5. Pre-procesar imagen: binarizar con Otsu, aplicar deskew antes del OCR.
  6. Usar PSM 6 para bloques de texto uniforme: --psm 6.
  7. Filtrar resultados con confianza del campo conf > 60.

Notes

  • Tesseract requiere imágenes bien preprocesadas; sin CLAHE/sharpening los resultados son pobres.
  • Instalar datos de idioma adicionales: tesseract-ocr-fra, tesseract-ocr-deu, etc.
  • No usar para MRZ; es menos preciso que PaddleOCR en fuentes monoespaciadas.