Leistungsfähige Dokumentenverarbeitung mit docTR und t2k
Textextraktion, die in Ihrer Infrastruktur bleibt. Performant, datenschutzkonform und vollständig anpassbar.
Was ist docTR?
docTR (Document Text Recognition) ist eine moderne Open-Source-Bibliothek für OCR (Optical Character Recognition), die Dokumente zuverlässig analysiert und Text aus Bildern und PDFs extrahiert. Die Lösung kombiniert Deep Learning mit einer modularen OCR-Pipeline. Sie eignet sich sowohl für klassische Texterkennung als auch für komplexe Dokumentenverarbeitung.
docTR basiert auf modernen Deep-Learning-Verfahren. Im Gegensatz zu klassischen OCR-Systemen erkennt docTR nicht nur Zeichen, sondern versteht auch die Struktur eines Dokuments. Die OCR-Pipeline lokalisiert zunächst Textbereiche, erkennt anschließend den Inhalt und rekonstruiert daraus die logische Dokumentstruktur.
End-to-End-OCR in docTR folgt einem zweistufigen Ansatz: Zuerst Text Detection (Lokalisierung einzelner Wörter), anschließend Text Recognition (Erkennung aller Zeichen). Optional ergänzt eine Layout-Analyse (detect_layout=True) die Pipeline um strukturelle Regionen wie Titel, Fließtext, Tabellen, Bildunterschriften, Listenelemente und Formeln.
Das Ergebnis ist ein hierarchisches Document-Objekt (Page → Block → Line → Word), exportierbar als JSON – und interaktiv visualisierbar mit result.show().
Die Software unterstützt Bilder, Scans und PDFs und kann sowohl auf CPUs als auch GPUs effizient betrieben werden. Dank verschiedener vortrainierter Modelle sowie der Möglichkeit zur individuellen Anpassung eignet sich docTR für unterschiedlichste Dokumenttypen, z. B. Rechnungen, Formulare, technische Dokumentationen oder wissenschaftliche Publikationen.
Detaillierte technische Informationen können hier nachgelesen werden.
Wer entwickelt docTR?
docTR wurde von Mindee entwickelt und kontinuierlich von einer internationalen Open-Source-Community erweitert. Inzwischen wird docTR aktiv von t2k weiterentwickelt und vorangetrieben. Wir bringen vertiefte Expertise in Informationsextraktion aus Dokumenten ein und wenden diese Kenntnisse in der Zusammenarbeit mit internationalen Kunden an. Wir verstehen docTR nicht als isoliertes Softwareprojekt, sondern als fundierte OCR-Infrastruktur, die in echten IT-Landschaften zuverlässig funktioniert.
Warum docTR mit t2k?
Cloud-OCR ist schnell gestartet – aber sobald Spezialfälle, Datenschutz oder Kostenkontrolle ins Spiel kommen, ändert sich das Bild.
docTR ist eine modulare, ressourceneffiziente OCR-Pipeline für Unternehmen und Institutionen, die Dokumente vollständig in-house verarbeiten müssen. Durch die Kombination aus docTR (OCR-Pipeline) und OnnxTR (hardwareoptimierte Inferenz) erhalten Sie präzise Textextraktion auf minimaler Hardware. Ohne Cloud-Abhängigkeit, ohne Datenabfluss und ohne unplanbare API-Kosten.
Statt OCR als „einen weiteren externen Service“ zu betreiben, bauen Sie mit docTR eine kontrollierbare, effiziente OCR-Infrastruktur auf: transparent in der Pipeline, reproduzierbar im Ergebnis und so ausgelegt, dass sie in regulierten Umgebungen zuverlässig funktioniert.
Als t2k GmbH (Text2Knowledge) verbinden wir docTR mit langjähriger Expertise in Künstlicher Intelligenz und automatischer Sprachverarbeitung (NLP): Unser interdisziplinäres Team aus zahlreichen hochqualifizierten KI-Experten, Software-Entwicklern und DevOps-Spezialisten entwickelt Automatisierungslösungen mit KI, generativer KI und multimodalen Technologien – von der Dokumentenanalyse über Textintelligenz bis zur individuellen NLP-Entwicklung.
Zu unserem Team gehören zudem zahlreiche Kolleginnen und Kollegen mit einschlägigem Hochschulabschluss in KI, NLP und Computerlinguistik, darunter drei qualifizierte NLP-Experten mit fachlich relevanter Promotion.
Warum wir der richtige Partner sind:
- Wir entwickeln docTR, niemand kennt die Technologie besser
- Wir denken OCR als Infrastruktur, nicht als isoliertes Tool
- Wir bauen keine Blackbox, sondern nachvollziehbare, kontrollierbare Lösungen
- Wir begleiten Sie vom Piloten über den Rollout bis zum laufenden Betrieb
- Wir verstehen die Anforderungen regulierter Branchen und setzen sie technisch um
Mehr zu docTR
Vertiefen Sie einzelne Themen auf eigenen Seiten:
Use Cases und Leistungen – Typische Branchen, Einsatzszenarien und was t2k für Sie umsetzt.
Beispiele aus der Praxis – Layout-Erkennung, Tabellen, Szenen-OCR und Live-Demo.
Bereit für OCR in Ihrer Infrastruktur?
Starten Sie mit einem Pilot in Ihrer Umgebung: Wir evaluieren die Performance auf Ihren Dokumenten und zeigen, was docTR On-Prem konkret für Ihren Use Case leistet – datenschutzkonform, kostenkontrolliert und vollständig unter Ihrer Kontrolle.
Oder rufen Sie uns direkt an: +49 (0) 351 27 51 97 74 · Mo.–Fr. 9–18 Uhr