tesseractuzneditor

vorhergehende Artikel in: Java Komponenten OpenSource
10.06.2022

Ich habe hier bereits verschiedentlich davon berichtet, wie ich versucht habe, mich dem Thema Optical Character Regognition (OCR) zu nähern. Nach einigen interessanten Diskussionen in den vergangenen Monaten habe ich jetzt ein damit in Verbindung stehendes Projekt aufgesetzt

Für meine Experimente benutze ich Tesseract. Diese Lösung existiert als fertige Anwendung und als Framework mit API, das man in eigene Projekte einbinden kann. NAchdem ich bereits einige Experimente mit der Anwendung gemacht habe, habe ich in den vergangenen Monaten mit dem Framework experimentiert. Dieses bietet die Möglichkeit, eingescannte Vorlagen zu analysieren und zum Beispiel zusätzlich zum erkannten Text auch die Koordinaten auszugeben, an denen der Text erkannt wurde - ergänzt um die Konfidenz.

Die Anwendung Tesseract kann .uzn-Dateien verarbeiten: Wird eine solche Datei gefunden, wird nicht das gesamte Bild verarbeitet, sondern nur die darin angegebenen Bereiche und Regionen.

Das neue Projekt basiert auf dem Tesseract-Framework ist ein Editor zur Erstellung solcher Dateien: Ein Bild wird geladen und anschließend kann man auf dem Bild Regionen markieren, die in ihrer Gesamtheit als .uzn-Dateien gespeichert werden können.

Die eigentliche Idee war, dass damit Templates erzeugt werden können, die dann in einer Batchverarbeitung auf gescannte Dokumente angewendet werden - Anhand der Tatsache, für welche .uzn-Datei die meisten Regionen mit gefundenem und erkannten Text gefüllt werden könnte man dann eine KLassifikation nach Dokumentarten vornehmen und sie entsprechend in ein Dokumentenmanagementsystem (DMS) einfügen.

Man kann aber natürlich noch weitergehen und den aktuell vorhandenen Editor um eine direkte Anbindung zu einem DMS wie etwa Mayan erweitern. So könnte man sich dann einen Arbeitsablauf vorstellen, dass verschiedene .uzn-Dateien vorhanden sind - ein gescanntes Dokument wird geladen, die entsprechend korrekte .uzn-Datei ausgewählt und OCR dafür durchgeführt - die Regionen entsprechen den einzelnen Metadaten-Feldern und die gefundenen Inhalte werden als Metadaten zum archivierten Dokument direkt ins DMS abgelegt, indem entsprechende Funktionen der API des DMS benutzt werden.

Artikel, die hierher verlinken

sQLshell Version 7.9pre1 build 11189

30.11.2025

Eine neue Version der sQLshell ist verfügbar!

Alle Artikel rss Wochenübersicht Monatsübersicht Codeberg Repositories Mastodon Über mich home xmpp


Vor 5 Jahren hier im Blog

  • Demonstration und Beispiele für die Nutzung eines RFC3161-Servers aus Java heraus

    15.05.2021

    Ich habe ein Begleitprojekt zu meiner Implementierung meines Timestamping Server Projekts erstellt: eine Demonstration und ein Beispiel dafür, wie man einen solchen Timestamping-Server von Java aus nutzen kann.

    Weiterlesen

Neueste Artikel

  • Asymmetrische Kryptographie

    Ich habe mich mit der Idee schon länger getragen: Nochmal einen Rundumschlag zu asymmetrischer Kryptographie zu machen. Dabei werde ich mich auf Demonstrationen der einzelnen Konzepte und Operationen mit Beispielcode konzentrieren und zu jedem der vorgestellten Konzepte mehr oder weniger ausführlich bezüglich der Einsatzszenarien und Vor- und Nachteile Stellung beziehen

    Weiterlesen
  • Absichern von Truststores und Keystores

    Hin und wieder erlebe ich es persönlich oder lese davon, dass jemand die Frage stellt, wie kryptographische Geheimnisse gesichert werden können. Ich gebe hier mal einen Anstoß, darüber aus der Sicht der Software-Architektur auf Systemebene nachzudenken...

    Weiterlesen
  • Futro-Thin-Clients und PCI Express Mini Cards

    Ich habe mich von einigen Artikeln anderer Besitzer und Upcycler von Futro-Thin-Clients inspirieren lassen - das hat dazu geführt, dass ich von meinem eigentlichen Projekt (Bauen eines kleinen Clusters) abgekommen bin und die Hardware ein wenig genauer unter die Lupe genommen habe...

    Weiterlesen

Manche nennen es Blog, manche Web-Seite - ich schreibe hier hin und wieder über meine Erlebnisse, Rückschläge und Erleuchtungen bei meinen Hobbies.

Wer daran teilhaben und eventuell sogar davon profitieren möchte, muss damit leben, daß ich hin und wieder kleine Ausflüge in Bereiche mache, die nichts mit IT, Administration oder Softwareentwicklung zu tun haben.

Ich wünsche allen Lesern viel Spaß und hin und wieder einen kleinen AHA!-Effekt...

PS: Meine öffentlichen Codeberg-Repositories findet man hier.