跳到正文
BrowserOCR

关于

小巧、诚实、本地的 OCR

BrowserOCR 是静态网页应用,可把最多 10 张支持的图片或一个 PDF 转成可编辑文字。它明确不提供账户、上传、翻译或服务器回退。

工作方式

ONNX Runtime Web 在主线程之外运行 PP-OCRv6。TypeScript 在本地完成图片解码、归一化、检测后处理、文字行裁切、CTC 解码与阅读顺序;PDF 会先提取原生文字,仅把需要识别的页面交给同一本地 OCR。

开源归属

PDF 检查与原生文字提取使用 Apache-2.0 的 LiteParse/PDFium;扫描页使用 Mozilla PDF.js。检测和识别模型是 PaddlePaddle 的 PP-OCRv6。TIFF 使用 MIT 许可的 UTIF;HEIC/HEIF 使用 heictosize.com 维护的纯 Rust WASM 解码器,并按 AGPL-3.0 分发。所有资源均同源加载,不调用文档服务。

限制

OCR 结果可能有误。高精度模式只改变识别,无法找回共用检测器漏掉的文字行;关键文字请始终与原图或 PDF 核对。

联系

问题、错误报告和支持请求请发送至 [email protected]