Acerca de
OCR pequeño, honesto y local
BrowserOCR es una aplicación web estática que convierte hasta 10 imágenes compatibles o un PDF en texto editable. Excluye deliberadamente cuentas, subidas, traducción y alternativas de servidor.
Cómo funciona
ONNX Runtime Web ejecuta PP-OCRv6 fuera del hilo principal. TypeScript gestiona localmente la decodificación, normalización, detección, recortes, CTC y orden de lectura. En PDF se extrae el texto nativo y solo las páginas necesarias pasan al OCR local.
Atribuciones de código abierto
La inspección PDF usa LiteParse/PDFium y las páginas escaneadas usan PDF.js, ambos bajo Apache-2.0. Los modelos son PP-OCRv6. TIFF usa UTIF (MIT) y HEIC/HEIF usa el decodificador Rust/WASM de heictosize.com distribuido bajo AGPL-3.0. Todo se sirve desde el mismo origen.
Límites
El OCR puede equivocarse. Alta precisión solo cambia el reconocimiento y no recupera líneas que el detector común no encontró. Comprueba siempre el texto importante.
Contacto
Envía preguntas y errores a [email protected].