PDF, Scans und OCR

PDF in Bilder umwandeln, Scans verbessern und OCR ausführen

PDF in JPG/PNG/WEBP umwandeln, Papierhintergrund bereinigen, Schieflage und Perspektive korrigieren, Informationen verdecken, Unterschriften oder Stempel extrahieren und mehrsprachige OCR lokal nutzen.

PDF → JPG/PNG/WEBPTool Office
Schieflage + PerspektiveTool Office
Lokale SchwärzungTool Office
OCR für 12 SprachenTool Office

Tool für Dokumentbilder

Seitenextraktion, Scanverbesserung, Geometriekorrektur, Datenschutz, OCR und Ausgabe laufen über eine zentrale Engine.

Tool wird geladen

Passende PDF- oder Scanverarbeitung auswählen

Wählen Sie nach gewünschtem Ergebnis. Nutzen Sie kein OCR, wenn ein Bild genügt, und prüfen Sie Maskierungen in der Ausgabedatei.

PDF in Bilder umwandeln

DPI und Format wählen und bis zu 30 Seiten in Originalreihenfolge einzeln oder als ZIP ausgeben.

Scans verbessern

Graustufen, Schwarzweiß, Hintergrundaufhellung, Drehung, Schieflage und Perspektive vor Speichern oder OCR anwenden.

OCR und Datenschutz

Sichtbare Daten schwärzen, eine von 12 unterstützten Sprachen erkennen und Text, TSV oder ein durchsuchbares PDF exportieren.

Alle PDF-Seiten in Bilder umwandeln

PDF.js rendert Seiten bei gewähltem DPI statt Bildschirmfotos zu erstellen.

  1. Eine PDF bis 25 MB und 30 Seiten auswählen.
  2. JPG, PNG oder WEBP und 150, 200 oder 300 DPI wählen.
  3. Verarbeitung starten und erste Ausgabeseite prüfen.
  4. Eine Seite oder ZIP mit allen Seiten in PDF-Reihenfolge speichern.
  • 150 DPI für Anzeige, 300 DPI für Druck oder OCR kleinen Texts mit größerer Datei.
  • Passwortgeschützte oder beschädigte PDF-Dateien können nicht rendern.

Grauen oder schiefen Scan verbessern

Dokumentfilter trennen Papier und Tinte, können aber sehr feine Linien entfernen.

  1. Scan verbessern auswählen.
  2. Mit Graustufen beginnen und bei Bedarf moderaten Kontrast ergänzen.
  3. Papier aufhellen oder Schwarzweiß wählen und Schwelle einstellen.
  4. Automatische oder manuelle Schieflage anwenden und kleinen Text prüfen.
  • Originalen Farbscan zum Vergleich behalten.
  • Automatik schätzt nur ±5° und korrigiert keine starke Perspektive.

Perspektive eines fotografierten Dokuments korrigieren

Vier Ecken des Originals werden auf ein Rechteck abgebildet.

  1. Zu korrigierende Seite wählen.
  2. Grenzen erkennen lassen.
  3. Acht X-/Y-Werte an Papierkanten anpassen.
  4. Textproportionen, Kanten und abgeschnittene Inhalte prüfen.
  • Deutlicher Farbunterschied zwischen Papier und Hintergrund hilft.
  • Bei trapezförmigem Papier Ecken manuell korrigieren.

Personenbezogene Daten vor dem Teilen verdecken

Eine neue Rasterkopie deckt den gewählten Bereich ab.

  1. Maskierungsmodus und Seite wählen.
  2. Position und Größe in der Vorschau einstellen.
  3. Für vertrauliche Daten Schwärzung bevorzugen; Blur oder Pixel können unzureichend sein.
  4. Ausgabedatei erneut öffnen, vergrößern und Unlesbarkeit prüfen.
  • Aktuell wird ein eingestellter Bereich je Seite und Durchgang angewendet.
  • Nicht das Original teilen, wenn nur die Ausgabekopie maskiert ist.

Unterschrift oder Stempel extrahieren

Unterschrift nutzt Dunkelheit, Stempel Rotanteil, um Transparenz zu erzeugen.

  1. Gleichmäßig beleuchteten Scan auf weißem Hintergrund verwenden.
  2. Unterschrift/dunkle Tinte oder Stempel/rote Tinte wählen.
  3. Schwelle einstellen, sodass Papier verschwindet und Linien bleiben.
  4. Als PNG ausgeben und Kanten prüfen.
  • Extrahierte Unterschriften oder Stempel nicht zur Dokumentfälschung verwenden.
  • Schatten und ähnliche Farben senken die Genauigkeit.

OCR auf Bild oder Scan-PDF ausführen

PDF-Seiten werden zuerst gerendert und dann lokal vom OCR Worker erkannt.

  1. Wählen Sie die passende OCR-Sprache und den Dokumenttyp.
  2. Für eine Textebene durchsuchbare PDF aktivieren.
  3. OCR starten und beim ersten Mal Sprachmodell laden.
  4. Prüfen Sie Text, Zahlen, Beträge, sprachspezifische Zeichen und TSV vor der Nutzung.
  • OCR-Genauigkeit ist nicht garantiert; vergleichen Sie mit der Quelle.
  • Einfaches TSV bildet verbundene Zellen und komplexe Tabellen nicht vollständig ab.

Vertrauliche Dokumente im Browser verarbeiten

PDF.js, Canvas und OCR Worker arbeiten auf Ihrem Gerät; große Bibliotheken und Modelle werden nur bei der passenden Aufgabe geladen.

Kein Dokument-Upload

Es gibt keine API zum Senden an Tool Office; Ergebnisse entstehen als lokale Blob-Dateien.

Prüfbare Ergebnisse

Rendering, Filter, Ausschnitt, Maskierung und OCR können in Vorschau und Ausgabe kontrolliert werden.

Sicherheitsgrenzen

Maximal 30 Seiten/Bilder, 25 MB je Datei und gemeinsame Canvas-Limits reduzieren Absturzrisiken.

Häufige Fragen zu PDF, Scan und OCR

Werden PDF und Scans hochgeladen?

Nein. Dateien werden lokal verarbeitet. Tesseract kann Code und Sprachmodell von einem CDN laden, überträgt aber keine Bilder an einen OCR-Dienst.

Welche DPI für PDF zu Bild?

150 DPI für leichte Vorschau, 200 DPI als Ausgleich, 300 DPI für Druck oder OCR kleinen Texts. Höhere DPI erhöht Speicher und Größe.

Schieflage oder Perspektive?

Schieflage dreht wenige Grad für horizontale Textzeilen; Perspektive entzerrt ein trapezförmiges, schräg fotografiertes Blatt anhand vier Ecken.

Ist Weichzeichnen für vertrauliche Daten sicher?

Nicht unbedingt. Schwarze Rasterabdeckung ist eindeutiger, aber prüfen Sie die Ausgabedatei in jedem Fall erneut.

Wie genau ist deutsches OCR?

Die Genauigkeit hängt von Auflösung, Schrift, Beleuchtung, Schieflage und Scanqualität ab. Prüfen Sie Namen, Zahlen, Daten und Beträge.

Wie funktioniert OCR bei Scan-PDF?

PDF.js rendert jede Seite auf Canvas; anschließend erkennt Tesseract Worker das Bild. Tesseract.js liest PDF nicht direkt.

Was ist eine durchsuchbare PDF?

Sie behält das Seitenbild und ergänzt eine OCR-Textebene für Suche und Auswahl. Die Ebene kann dieselben Erkennungsfehler enthalten.

Kann ich passwortgeschützte PDF verarbeiten?

Nicht zuverlässig. Verschlüsselte PDF kann ein Passwort verlangen oder beim Rendering scheitern; das Tool analysiert oder entfernt keine Passwörter.

Ähnliche Tools