For the complete documentation index, see llms.txt. This page is also available as Markdown.

OCR (EasyOCR)

Ein Funktionsblock, der Text in Bildern mit der EasyOCR-Engine erkennt. Er kann erkannten Text, einzelne Textsegmente, Begrenzungsrahmen und optional ein annotiertes Bild zurückgeben. Enthält automatische Rotationsversuche, um gedrehten Text zu erkennen.

📥 Eingänge

Image Graustufen- oder Farbbild, das den zu erkennenden Text enthält.

📤 Ausgänge

Result Annotiertes Bild mit erkannten Textboxen und optionalen Text-Labels.

Whole Text Gesamter erkannter Text, zusammengefügt zu einem einzigen String.

Texts Liste der erkannten Textsegmente.

Boxes Liste der Polygon-Boxen für jeden erkannten Text (4 Punkte pro Box).

🕹️ Steuerungen

Use auto rotation Aktivieren, um Rotationsversuche (90°, -90°, 180°) durchzuführen, wenn der Text gedreht vorliegen könnte.

Show Texts Umschalter, um erkannte Textlabels auf dem annotierten Result-Bild anzuzeigen.

Threshold Schieberegler für die Vertrauensschwelle, um schwache Erkennungen (0–100%) herauszufiltern.

🎯 Funktionen

  • Mehrwinkel-Erkennung: Führt bei aktiviertem Use auto rotation einfache Rotationen aus, um gedrehten Text zu erkennen.

  • Vertrauensfilter: Entfernt schwache Erkennungen durch Anpassung des Threshold.

  • Visuelle Ausgabe: Liefert ein annotiertes Result-Bild mit Boxen und optionalen Textlabels, wenn Erkennungen vorliegen.

  • Detaillierte Rückgabe: Gibt sowohl das zusammengefügte Whole Text als auch die einzelnen Texts und Boxes für die Weiterverarbeitung zurück.

📝 Nutzung

  1. Verbinden Sie einen bildliefernden Block mit der Buchse Image.

  2. Aktivieren Sie optional Use auto rotation, wenn die Eingangsaufnahmen gedreht sein könnten.

  3. Passen Sie den Threshold an, um Empfindlichkeit vs. Fehlalarme auszubalancieren.

  4. Aktivieren Sie Show Texts, wenn Sie Textlabels auf dem Result-Bild sehen möchten.

  5. Nutzen Sie die Ausgänge, um erkannten Text oder Box-Koordinaten zu speichern, zu protokollieren oder weiterzuverarbeiten.

📊 Bewertung

Bei Ausführung analysiert der Block das Eingangsbild (und ggf. die rotierten Varianten), filtert Erkennungen nach dem Threshold und liefert das annotierte Bild (falls vorhanden), den vollständigen zusammengefügten Text, eine Liste der Textsegmente und die Liste der Polygon-Boxen.

💡 Tipps und Tricks

  • Vorverarbeitung: Verbessern Sie kleine oder unscharfe Texte mit Image Resizer oder Super Resolution.

  • Zuschneiden: Verwenden Sie Image ROI Select oder Image ROI, um den Block auf relevante Bereiche zu konzentrieren.

  • Hintergrund reduzieren: Nutzen Sie Background Removal (RMBG-1.4) oder Background Removal (BiRefNet), wenn Text auf unruhigem Hintergrund liegt.

  • Kontrast und Lesbarkeit: Verbessern Sie die Eingabe mit Auto Contrast, Adjust Colors, Denoising oder Image Threshold.

  • Vorschau: Leiten Sie Result an Show Image, um erkannte Bereiche live zu prüfen.

  • Speicherung: Speichern Sie Erkennungsbilder oder Protokolle mit Image Logger, Image Write oder exportieren Sie Text mit Data to JSON bzw. CSV Export.

  • Alternative OCR: Vergleichen Sie bei Bedarf mit dem generischen OCR-Block oder kombinieren Sie mit Draw Detections für eigene Visualisierungen.

🛠️ Fehlersuche

  • Kein Text erkannt: Senken Sie den Threshold und prüfen Sie, ob das Eingangsbild zu klein ist — probieren Sie Image Resizer oder Super Resolution.

  • Falscher Text oder wirre Ergebnisse: Erhöhen Sie den Threshold und wenden Sie Denoising oder Auto Contrast an.

  • Gedrehener Text nicht erkannt: Aktivieren Sie Use auto rotation oder richten Sie mit Auto Alignment vorab aus, falls Sie eine Referenz haben.

  • Zu viele kleine Treffer: Zuschneiden mit Image ROI Select und nachträglich nach Box-Größe filtern.

Zuletzt aktualisiert