tomai
Anmelden
☁️ Cloud · Credits

OCR zu durchsuchbarem PDF

Scans und reine Bild-PDFs in ein durchsuchbares, markierbares PDF verwandeln — 10 Sprachen

🪙 2 Credits pro Datei · Bilder und PDFs bis 20 Seiten

Serverseitiges FFmpeg verarbeitet jedes Format — auch HEVC/H.265-Dateien, die dein Browser nicht abspielen kann. Dateien werden innerhalb von 30 Minuten vom Server gelöscht.

Häufige Fragen

Wie unterscheidet sich das vom normalen OCR-Tool?

Das normale OCR-Tool liefert den erkannten Text als .txt-Datei. Dieses Tool behält die ursprünglichen Seitenbilder exakt bei und fügt darunter eine unsichtbare Textebene hinzu — das Ergebnis ist weiterhin ein PDF, das wie das Original aussieht, aber dessen Text Sie jetzt markieren, kopieren und durchsuchen können.

Sehen die Seiten anders aus?

Nein — die sichtbaren Seitenbilder bleiben unverändert. Es wird nur eine unsichtbare, durchsuchbare Textebene darunter hinzugefügt.

Welche Sprachen werden unterstützt, und wie viele Seiten?

Vereinfachtes und traditionelles Chinesisch, Englisch, Japanisch, Koreanisch, Französisch, Spanisch, Deutsch, Russisch und Portugiesisch, bis zu 20 Seiten pro Datei. Wählen Sie für mehrsprachige Dokumente eine Kombination wie „中文 + English“.

Verändert OCR das Aussehen des Scans?

Nein — die Bildebene bleibt byteidentisch erhalten. Ergänzt wird nur die versteckte Textebene, die Viewer indizieren, aber nie anzeigen.

Details der OCR-Pipeline

Die Erkennung läuft mit Tesseract über 100+ Sprachen hinweg, mit Skriptbestimmung pro Seite:

So funktioniert es

  1. 1

    Laden Sie ein gescanntes PDF oder ein Foto/einen Screenshot eines Dokuments hoch.

  2. 2

    Wählen Sie die Sprache des Dokuments (Mischung mit Englisch wird unterstützt).

  3. 3

    Laden Sie das durchsuchbare PDF herunter — Text kann jetzt markiert, kopiert und mit Strg+F gefunden werden.

Scans, die sich wie echte Dokumente verhalten

Bildseiten bekommen darunter eine unsichtbare, durchsuchbare Textebene — Kopieren/Einfügen und Ctrl+F funktionieren, während das Sichtbare unangetastet bleibt.

🔎

Scans werden durchsuchbar

Eine gescannte Seite ist als Bild im PDF gespeichert — dieses Werkzeug legt eine durchsuchbare Textebene darüber, sodass die Datei wie ein digitales Dokument durchsuchbar wird.

📄

Unsichtbare Textebene

Der Text sitzt unsichtbar unter jeder Seite, bereit für Strg+F, Auswahl und Kopieren-Einfügen, während der sichtbare Scan exakt so bleibt, wie er eingescannt wurde.

🔗

Behält das Original-Layout

Bis zu 20 Seiten Bilder oder PDFs werden in einem Auftrag verarbeitet, und die Ausgabe behält das ursprüngliche Layout, statt das Dokument neu umzubrechen.

Ähnliche Tools

Was ist ein durchsuchbares PDF?

Ein durchsuchbares PDF sieht exakt wie dein Scan aus, trägt aber eine unsichtbare Textebene unter dem Seitenbild. So wird das Dokument in jedem PDF-Reader durchsuchbar, auswählbar und kopierbar, während die Seite optisch identisch mit dem Original-Scan bleibt. Dieses Werkzeug baut diese Ebene mit Server-OCR: Ein gescanntes Bild oder ein reines Bild-PDF hochladen, aus 10 Sprachen wählen, und Tesseract liest die Seiten und schreibt ein neues PDF, in dem der erkannte Text unsichtbar unter den Original-Seitenbildern liegt. Danach kannst du in einem Vertrag nach Stichwörtern suchen, Sätze auswählen, Absätze kopieren oder das Dokument von Software indexieren lassen. Es ist gedacht für Archivare, die Papier digitalisieren, Anwälte und Buchhalter, die Verträge scannen, und alle, deren Scanner schöne, aber nicht durchsuchbare PDFs erzeugt. Es braucht ein Konto und verbraucht Credits.

Das kann dieses Werkzeug

  • Eine unsichtbare, auswählbare Textebene zu Scans und reinen Bild-PDFs hinzufügen
  • 10 Sprachen erkennen, von vereinfachtem und traditionellem Chinesisch bis Englisch, Japanisch, Koreanisch, Französisch, Spanisch, Deutsch, Russisch und Portugiesisch
  • Die Original-Seitenbilder exakt wie gescannt belassen — visuell ändert sich nichts
  • Mehrseitige Dokumente in einem Durchgang zu einem durchsuchbaren PDF verarbeiten
  • Text in jedem PDF-Reader auswählen und kopieren lassen
  • Das fertige durchsuchbare PDF direkt von der Seite herunterladen

Wann du es brauchst

  • Einen gescannten Vertrag durchsuchbar machen, um Klauseln per Stichwort zu finden
  • Ein durchsuchbares digitales Archiv aus Papierdokumenten und Belegen aufbauen
  • Gescannte Vorlesungsnotizen in ein zitierfähiges Dokument verwandeln
  • Gescannte Formulare oder Beweismittel für Suche und Zitation vorbereiten
  • Dem Kunden ein PDF liefern, in dem man Text auswählen statt auf dem Scan zu schielen

Datenschutz und Grenzen: Die OCR läuft auf dem VPS der Seite — deine Scans werden zur Verarbeitung hochgeladen und nach Abschluss des Jobs gelöscht. Es braucht ein Konto und verbraucht Credits. Die Erkennungsqualität spiegelt die Quelle: saubere, gerade, kontrastreiche Scans ergeben eine fast perfekte Textebene, während minderwertige oder handschriftliche Seiten Fehler im unsichtbaren Text verstecken können — wichtige Dokumente nach der Konvertierung prüfen.

Zuletzt aktualisiert · 2026-09-01

Ähnliche Tools