Bild in durchsuchbares PDF
Wandeln Sie Scan, Screenshot oder Foto im Browser mit Tesseract.js-OCR und pdf-lib in ein durchsuchbares PDF um. Ohne Upload, alles lokal.
🔒 Läuft vollständig in Ihrem Browser — nichts wird hochgeladenEin gescanntes Bild durchsuchbar machen
Ein Foto oder Screenshot eines Dokuments lässt sich leicht teilen, ist aber schwer zu durchsuchen. Die Wörter sind Teil des Bildes, sodass ein PDF-Viewer einen Namen, eine Rechnungsnummer oder einen Absatz in der Datei nicht finden kann. Dieses Tool Bild in durchsuchbares PDF behält Ihr Originalbild als sichtbare Seite und fügt dem PDF OCR-Text hinzu, damit Viewer den erkannten Inhalt durchsuchen und markieren können. Es eignet sich für einseitige Scans, Belege, Briefe, Formulare, Whiteboard-Aufnahmen und Screenshots, die Sie als PDF archivieren möchten.
Alles läuft im Browser. Tesseract.js liest das hochgeladene Bild mit WebAssembly-OCR, und pdf-lib erstellt ein neues PDF-Dokument, ohne einen Server zu kontaktieren. Die Seite hat die Größe des Bildes, sodass das PDF wie die Quelldatei aussieht. Über dem Bild wird eine kleine, kaum sichtbare Textebene gezeichnet, damit die erkannten Wörter für die PDF-Suche und Textmarkierung verfügbar sind. Bild, OCR-Ergebnis und fertiges PDF bleiben im lokalen Browserspeicher, bis Sie die Datei herunterladen.
So erhalten Sie bessere durchsuchbare PDFs
Beginnen Sie mit dem klarsten Bild, das Sie haben. Gerade Scans und scharfe Screenshots funktionieren meist besser als schräg aufgenommene Handyfotos. Wenn Sie Papier fotografieren, legen Sie das Dokument auf eine ebene Fläche, sorgen Sie für gleichmäßiges Licht und halten Sie die Kamera parallel zur Seite. Schneiden Sie Tischflächen, Ränder und Schatten möglichst vor dem Hochladen weg. Ein hoher Kontrast zwischen Buchstaben und Hintergrund hilft der OCR, Zeichen zu trennen, besonders bei kleiner Schrift.
Wählen Sie vor dem Erstellen des PDFs die Sprache, die zum Dokument passt. Bei der ersten Verwendung einer Sprache lädt der Browser unter Umständen die OCR-Engine und das Modell herunter, wodurch der erste Durchlauf langsamer sein kann; spätere Durchläufe sind meist schneller, weil die Dateien im Cache liegen. OCR ist nicht perfekt. Suchen Sie daher im fertigen PDF nach wichtigen Begriffen und vergleichen Sie sie mit dem Originalbild, bevor Sie die Datei für Unterlagen, Verträge, Rechnungen oder andere Arbeitsabläufe mit hohen Genauigkeitsanforderungen verwenden.
Was das erzeugte PDF enthält
Das Ausgabe-PDF enthält eine Seite mit dem Originalbild in voller Größe und einer per OCR erzeugten, markierbaren Textebene. Damit eignet sich die Datei für persönliche Archive, Notiz-Apps, Dokumentenordner und E-Mail-Anhänge, bei denen PDF gegenüber einem Bild bevorzugt wird. Die Textebene dient der Durchsuchbarkeit und nicht der perfekten optischen Rekonstruktion, daher können komplexe Spalten, Tabellen oder Handschrift nicht exakt ausgerichtet sein. Verwenden Sie für mehrseitige Aufgaben die Tools für PDF-OCR oder Batch-OCR und führen Sie die Dateien bei Bedarf mit einem speziellen PDF-Editor zusammen.
So verwenden Sie
- Bild hinzufügenZiehen Sie einen Scan, Screenshot oder ein Foto in das Upload-Feld oder klicken Sie, um eine Datei auszuwählen.
- Sprache wählenWählen Sie die Sprache, die am besten zum Text im Bild passt.
- PDF erstellenStarten Sie die OCR, binden Sie das Bild in eine PDF-Seite ein und fügen Sie eine durchsuchbare Textebene hinzu.
- HerunterladenSpeichern Sie das durchsuchbare PDF direkt aus Ihrem Browser.