Afbeelding naar doorzoekbare PDF
Zet een scan, screenshot of foto in je browser om naar een doorzoekbare PDF met Tesseract.js-OCR en pdf-lib. Zonder uploads, alles blijft lokaal.
🔒 Draait volledig in uw browser — niets wordt geüploadMaak een gescande afbeelding doorzoekbaar
Een foto of screenshot van een document is gemakkelijk te delen, maar moeilijk te doorzoeken. De woorden maken deel uit van het beeld, waardoor een pdf-viewer geen naam, factuurnummer of alinea in het bestand kan vinden. Deze tool Afbeelding naar doorzoekbare PDF behoudt je originele afbeelding als zichtbare pagina en voegt OCR-tekst toe aan de PDF, zodat viewers de herkende inhoud kunnen doorzoeken en selecteren. Handig voor scans van één pagina, bonnetjes, brieven, formulieren, whiteboardfoto's en screenshots die je als PDF wilt archiveren.
Alles draait in de browser. Tesseract.js leest de geüploade afbeelding met WebAssembly-OCR en pdf-lib maakt een nieuw PDF-document zonder contact met een server. De pagina krijgt het formaat van de afbeelding, zodat de PDF eruitziet als het bronbestand. Over de afbeelding wordt een kleine tekstlaag met lage dekking getekend, zodat de herkende woorden beschikbaar zijn voor PDF-zoekfuncties en tekstselectie. De afbeelding, het OCR-resultaat en de uiteindelijke PDF blijven in het lokale browsergeheugen tot je het bestand downloadt.
Zo krijg je betere doorzoekbare PDF's
Begin met de scherpste afbeelding die je hebt. Rechte scans en scherpe screenshots werken meestal beter dan scheef genomen telefoonfoto's. Fotografeer je papier, leg het document dan op een vlak oppervlak, gebruik gelijkmatig licht en houd de camera evenwijdig aan de pagina. Snijd waar mogelijk bureaus, randen en schaduwen weg voordat je uploadt. Een hoog contrast tussen letters en achtergrond helpt de OCR tekens te scheiden, vooral bij kleine letters.
Kies vóór het maken van de PDF de taal die bij het document past. De eerste keer dat je een taal gebruikt, kan de browser de OCR-engine en het model downloaden, waardoor de eerste taak langzamer kan zijn; latere taken zijn meestal sneller omdat de bestanden in de cache staan. OCR is niet perfect: zoek daarom naar belangrijke termen in de voltooide PDF en vergelijk ze met de originele afbeelding voordat je het bestand gebruikt voor administratie, contracten, facturen of andere werkwijzen die hoge nauwkeurigheid vereisen.
Wat de gegenereerde PDF bevat
De uitvoer-PDF bevat één pagina met de originele afbeelding op volledige grootte en een selecteerbare tekstlaag die met OCR is gemaakt. Zo is het bestand handig voor persoonlijke archieven, notitie-apps, documentmappen en e-mailbijlagen waarbij PDF de voorkeur heeft boven een afbeelding. De tekstlaag is bedoeld voor doorzoekbaarheid en niet voor een perfecte visuele reconstructie, dus complexe kolommen, tabellen of handschrift sluiten mogelijk niet precies aan. Gebruik voor meerdere pagina's de tools voor PDF-OCR of batch-OCR en voeg bestanden zo nodig samen met een aparte PDF-editor.
Hoe te gebruiken
- Voeg een afbeelding toeSleep een scan, screenshot of foto naar het uploadvak, of klik om te bladeren.
- Kies de taalSelecteer de taal die het best past bij de tekst in de afbeelding.
- Maak de PDFVoer OCR uit, plaats de afbeelding op een PDF-pagina en voeg een doorzoekbare tekstlaag toe.
- DownloadenSla de doorzoekbare PDF direct op vanuit je browser.