Saltar al contenido
BrowserOCR

Acerca de

OCR pequeño, honesto y local

BrowserOCR es una aplicación web estática que convierte hasta 10 imágenes compatibles o un PDF en texto editable. Excluye deliberadamente cuentas, subidas, traducción y alternativas de servidor.

Cómo funciona

ONNX Runtime Web ejecuta PP-OCRv6 fuera del hilo principal. TypeScript gestiona localmente la decodificación, normalización, detección, recortes, CTC y orden de lectura. En PDF se extrae el texto nativo y solo las páginas necesarias pasan al OCR local.

Atribuciones de código abierto

La inspección PDF usa LiteParse/PDFium y las páginas escaneadas usan PDF.js, ambos bajo Apache-2.0. Los modelos son PP-OCRv6. TIFF usa UTIF (MIT) y HEIC/HEIF usa el decodificador Rust/WASM de heictosize.com distribuido bajo AGPL-3.0. Todo se sirve desde el mismo origen.

Límites

El OCR puede equivocarse. Alta precisión solo cambia el reconocimiento y no recupera líneas que el detector común no encontró. Comprueba siempre el texto importante.

Contacto

Envía preguntas y errores a [email protected].