Apple Vision oder OCR?

Wenn Sie in DEVONthink Pro oder Server durchsuchbare Dokumente aus Bildern oder PDFs erstellen, können Sie zwei unterschiedliche Optionen nutzen: das Vision-Framework von Apple oder herkömmliche OCR. Auch wenn die Ergebnisse auf den ersten Blick ähnlich erscheinen, gibt es doch wichtige Unterschiede zwischen beiden Verfahren.
Vision
Apples Vision-Framework analysiert ein Bild und erkennt darin enthaltenen Text. Es speichert diesen in einem Index, wodurch Sie das Dokument anhand seines Textes finden können, ohne die eigentliche Datei zu verändern. Dies gilt sowohl für einzelne Bilder als auch für Seiten innerhalb eines PDF-Dokuments. Allerdings speichert Vision den Text lokal. Wenn Sie das Dokument weitergeben, erhält der Empfänger eine Datei ohne Textdaten.
DEVONthink nutzt Vision z. B. in der Funktion Einstellungen > Dateien > Import > Erkennung: Text in PDF-Dokumenten durchsuchbar machen, um bildbasierte PDF-Dokumente (etwa gescannte Seiten) nach dem Import durchsuchbar zu machen. DEVONthink speichert den Text in seinem Index, dementsprechend ist das PDF nicht mehr durchsuchbar, sobald Sie es aus DEVONthink exportieren. Sie können Vision auch in KI > Transkription > Bilder wählen, um etwa die Aktion Daten > Erkennung > Text & Notizen transkribieren auszuführen.
Herkömmliche OCR
Klassische Texterkennung (Optical Character Recognition, OCR) erzeugt eine Textebene und fügt sie zum Dokument hinzu oder, was häufiger vorkommt, erzeugt ein neues Dokument. Ein Dokument mit Textebene lässt sich beliebig bewegen und teilen und bleibt durchsuchbar, da die Textebene Teil des eigentlichen Dokuments ist. Das ist deutlich robuster und macht diese Funktion vielseitiger einsetzbar.
Wählen Sie Daten > OCR, um ein Dokument mit OCR durchsuchbar zu machen. DEVONthink wendet OCR nicht automatisch beim Import an, Sie können allerdings eine einfache intelligente Regel hierfür verwenden. In Einstellungen > OCR legen Sie die Optionen für OCR fest.
Welche Dokumente benötigen OCR?
In beiden Fällen, OCR und Vision, kann ein Dokument anzeigen, dass es Wörter enthält, z. B. in Werkzeuge > Inspektoren > Konkordanz. Bei Dokumenten, die durch Vision bearbeitet worden sind, stammen diese Informationen aus dem Index und nicht aus dem Dokument selbst. Um also Dokumente zu suchen, die keine richtige Textebene enthalten, können Sie eine Suche in DEVONthink durchführen und dabei die Kriterien Art ist PDF/PS und Wortanzahl ist 0 verwenden, die die Anzahl an real im Dokument enthaltenen Worten verwenden.
In einem älteren Blogartikel haben wir auch ausführlich besprochen, wie Sie prüfen, ob ein PDF durchsuchbar ist.