Altdeutsche Schrift wird zu durchsuchbaren, strukturierten Daten.

Unsere Engine verbindet automatische Seitentypanalyse, OCR für Fraktur und Antiqua sowie HTR für Kurrent und historische Handschriften. Testen Sie eine einzelne TIFF-Seite und wählen Sie TXT, ALTO-XML oder PDF/A-2b als Ergebnis.

Fraktur & AntiquaKurrent & HandschriftALTO v3PDF/A-2b

Eigene TIFF-Datei verarbeiten

01E-Mail bestätigen

Wir senden Ihnen einen einmaligen Bestätigungscode. Erst nach der erfolgreichen Bestätigung wird der TIFF-Upload freigeschaltet.

Drei kostenfreie Testläufe je bestätigter E-Mail-Adresse.
02Testdatei und Ausgabe

Upload noch gesperrtBestätigen Sie zuerst Ihre E-Mail-Adresse mit dem zugesandten Code.

Datenschutz: Testdateien werden ausschließlich für den gewählten OCR-Lauf verwendet und nicht zum Training eingesetzt. Kontaktdaten und Testanzahl werden im geschützten Monitoring gespeichert. Einzelheiten stehen in der Datenschutzerklärung.

Keine Standard-OCR, sondern eine projekterprobte Verarbeitungskette.

Historische Quellen unterscheiden sich in Schrift, Papier, Druckbild, Spaltenaufbau und Erhaltungszustand. Deshalb entscheidet die Engine nicht nur, welche Zeichen erkannt werden, sondern auch wie Text, Koordinaten, Lesereihenfolge und Ausgabeform zusammengehören.

01

Analysieren

Druck, Handschrift oder Mischseite erkennen, Bildmerkmale auswerten und den passenden OCR-/HTR-Weg wählen.

02

Erkennen & strukturieren

Textblöcke, Zeilen und Wörter erfassen, Lesereihenfolgen erhalten und ALTO-Koordinaten mit dem Bild verbinden.

03

Ausgeben & prüfen

TXT, ALTO-XML oder PDF/A-2b erzeugen, Unicode-Textlayer einbetten und technische Eigenschaften kontrollieren.

Entwickelt aus Beständen, nicht aus einer Demo.

Unsere OCR-Kompetenz basiert auf Zeitungs-, Buch-, Akten- und Polizeibeständen mit Fraktur, Antiqua, Kurrent, komplexen Seitenlayouts und strukturierten Lieferformaten.