Scannen von Dokumenten: Perspektivkorrektur und Binarisierung
Dokumentenscannen verwandelt ein schräges, schattiges Foto eines Blattes Papier mithilfe fortschrittlicher Bildverarbeitungsalgorithmen in ein flaches, perfekt lesbares, kontrastreiches digitales Dokument.
Die Verwendung kommerzieller Scan-Apps zwingt Sie oft dazu, Ihre sensiblen Verträge oder Ausweise auf Server Dritter hochzuladen. Dieses Tool nutzt OpenCV.js, um die mathematischen Matrizen vollständig clientseitig zu verarbeiten.
Formel & Berechnungsmethode
Clean Scan = Kantenerkennung ➔ Perspective Warp ➔ Graustufenkonvertierung ➔ Adaptive Thresholding
Der Scanner verwendet zunächst den Canny Edge Detection-Algorithmus, um die vier Ecken des Papiers zu finden. Anschließend wird eine perspektivische Verzerrung angewendet, um das Bild zu verflachen, und schließlich wird adaptives Schwellenwertverfahren verwendet, um graue Schatten in reines Weiß umzuwandeln.
Best Practices & Tipps
- Sorgen Sie für kontrastreiche Hintergründe: Ein weißes Blatt Papier auf einem weißen Tisch ist ein mathematischer Albtraum für die Kantenerkennung. Legen Sie das Dokument immer auf einen dunklen Tisch, damit der Algorithmus die vier Ecken sofort finden kann.
- Vermeiden Sie starke Blendung: Wenn Sie Hochglanzpapier unter hellem Licht scannen, werden die Pixel durch die Blendung zu reinem Weiß ausgeblendet, wodurch der darunter liegende Text vollständig zerstört wird. Verwenden Sie diffuses, indirektes Licht.
- Schwarzweiß-Binarisierung für Text verwenden: Wenn das Dokument nur aus Text besteht (z. B. ein Vertrag), verwenden Sie immer den Filter „Schwarzweiß“. Es entfernt mathematisch alle Farbrauschen und Schatten und reduziert so die endgültige PDF-Dateigröße drastisch.