📝 Tesseract OCR (2026-07-23)
Manjaro [Stable Update] 2026-07-23
Für die OCR-Funktion von Spectacle wird unter Plasma nun Tesseract benötigt, um Text aus Screenshots zu extrahieren.
Offenbar wurde bei Pacman häufig tesseract-data-afr als Anbieter der virtuellen Abhängigkeit gewählt, da die Voreinstellung 1 übernommen wurde. Für ein deutsches System sollte stattdessen 25 (tesseract-data-deu) ausgewählt werden.
Ist mir ebenfalls passiert. Ich habe anschließend die Sprachdaten deu und eng installiert.
📦 Deutsch und Englisch installieren
sudo pacman -S tesseract-data-deu tesseract-data-eng
📋 Installierte Tesseract-Daten kontrollieren
pacman -Qq | grep '^tesseract-data'
Erwartete Ausgabe:
tesseract-data-deu
tesseract-data-eng
tesseract-data-osd
⚠️ tesseract-data-osd solltest du behalten. Es enthält allgemeine Erkennungsdaten.
Falls beispielsweise tesseract-data-afr (Afrika) installiert ist und du es nicht benötigst, kannst du es entfernen:
sudo pacman -R tesseract-data-afr