Lewati ke isi
BrowserOCR

Tentang

OCR kecil, jujur, dan lokal

BrowserOCR adalah aplikasi web statis untuk mengubah hingga 10 gambar yang didukung atau satu PDF menjadi teks yang dapat diedit. Produk ini sengaja tidak memiliki akun, unggahan, penerjemahan, atau fallback server.

Cara kerja

ONNX Runtime Web menjalankan PP-OCRv6 di luar thread utama. TypeScript menangani dekode, normalisasi, pascaproses deteksi, potongan baris, CTC, dan urutan baca secara lokal. PDF mengekstrak teks asli dan hanya mengirim halaman yang perlu dikenali ke OCR lokal.

Atribusi sumber terbuka

Pemeriksaan PDF memakai LiteParse/PDFium dan pindaian memakai PDF.js (Apache-2.0). Modelnya adalah PP-OCRv6. TIFF memakai UTIF (MIT), sedangkan HEIC/HEIF memakai dekoder Rust/WASM heictosize.com yang didistribusikan di bawah AGPL-3.0. Semua aset berasal dari domain yang sama.

Batasan

Hasil OCR dapat keliru. Akurasi tinggi hanya mengubah pengenalan dan tidak dapat memulihkan baris yang terlewat oleh detektor bersama. Selalu periksa teks penting.

Kontak

Kirim pertanyaan dan laporan masalah ke [email protected].