Docs

Tools

PDF to OCR

Turn scanned PDFs into searchable, copy-pasteable documents.

Every page is rasterised at 300 DPI and processed with Tesseract.js. The output is a searchable PDF — the visible scan plus an invisible text layer.

Languages

English, Slovak, Czech, German, French, Spanish, Italian, Polish, Portuguese, Turkish, Ukrainian, Dutch, Danish, Swedish. Additional languages available on request.

Accuracy

Clean printed text: 95-98 percent character accuracy. Photographs of pages: 88-92 percent, depending on lighting and angle.

Last updated July 27, 2026 Edit on GitHub