Skip to main content

📝 Tesseract OCR (2026-07-23)

Manjaro [Stable Update] 2026-07-23


Für die OCR-Funktion von Spectacle wird unter Plasma nun Tesseract benötigt, um Text aus Screenshots zu extrahieren.

Offenbar wurde bei Pacman häufig tesseract-data-afr als Anbieter der virtuellen Abhängigkeit gewählt, da die Voreinstellung 1 übernommen wurde. Für ein deutsches System sollte stattdessen 25 (tesseract-data-deu) ausgewählt werden.

Ist mir ebenfalls passiert. Ich habe anschließend die Sprachdaten deu und eng installiert.

📦 Deutsch und Englisch installieren

sudo pacman -S tesseract-data-deu tesseract-data-eng

📋 Installierte Tesseract-Daten kontrollieren

pacman -Qq | grep '^tesseract-data'

Erwartete Ausgabe:

tesseract-data-deu
tesseract-data-eng
tesseract-data-osd

⚠️ tesseract-data-osd solltest du behalten. Es enthält allgemeine Erkennungsdaten.


Falls beispielsweise tesseract-data-afr (Afrika) installiert ist und du es nicht benötigst, kannst du es entfernen:

sudo pacman -R tesseract-data-afr