Tips en Trucs 2026

Tekst uit schermafdrukken en afbeeldingen te halen

Als je vaak schermafbeeldingen maakt en je wenst dat je de tekst eruit kunt halen, dan zul je het volgende van spectacle-ocr waarderen. Het maakt het proces snel, lokaal en privé. Met spectacle-ocr kun je in één stap van afbeelding naar tekst gaan.

Hoewel vanaf versie 25.12.0 (Plasma 6.6) de OCR (Optical Character Recognition) functie in Spectacle is ingebakken, loont het nog steeds de moeite om er hier dieper op in te gaan. Ten eerste gebruiken de meeste distributies versie 25.12.0 nog niet. Daarenboven kan spectacle-ocr niet alleen schermafbeeldingen verwerken, maar kun je tekst uit bijna elke afbeelding halen. Voor spectacle-ocr maakt het niet uit of de tekst afkomstig is van een schermafbeelding, foto of gescand document. Het enige dat telt is hoe duidelijk en leesbaar de tekst in de afbeelding is. Er wordt in KDE ook gewerkt aan het integreren van OCR in alle programma's waarin dit nuttig kan zijn. We kijken er naar uit.

Spectacle-ocr verbindt twee dingen:

Als je een schermafbeelding maakt met Spectacle, kun je kiezen voor Extract Text (of met de rechtermuisknop op een afbeelding klikken en Extract Text selecteren). Het script doet dan het volgende:

  1. Het voert OCR uit met Tesseract om tekst in de afbeelding te detecteren.
  2. De herkende tekst wordt direct naar het klembord gekopieerd.
  3. Er wordt een melding op het bureaublad weergegeven om het succes te bevestigen of een fout te melden.

Dit betekent dat je snel tekst uit schermafbeeldingen kunt halen, bijvoorbeeld uit een foutmelding, een PDF-viewer of een webafbeelding, zonder dat je de tekst handmatig hoeft in te typen of de afbeelding naar een online OCR-tool hoeft te uploaden.

Zo gaat tesseract-ocr te werk:

Spectacle-ocr kenmerken:

Tesseract-ocr installeren

Je kunt het eenvoudig installeren via een installatiescript. We beginnen met het downloaden van de broncode met de volgende terminal opdracht:

dany@pindabook:~$ git clone https://github.com/kbkozlev/spectacle-ocr
Cloning into 'spectacle-ocr'...
remote: Enumerating objects: 36, done.
remote: Counting objects: 100% (36/36), done.
remote: Compressing objects: 100% (29/29), done.
remote: Total 36 (delta 16), reused 19 (delta 7), pack-reused 0 (from 0)
Receiving objects: 100% (36/36), 23.66 KiB | 7.88 MiB/s, done.
Resolving deltas: 100% (16/16), done.

Openen daarna de map met de gedownloade broncode:

dany@pindabook:~$ cd spectacle-ocr

En voeren het installatiescript uit:

dany@pindabook:~/spectacle-ocr$ bash setup.sh

----------------------------------------
OCR Setup for ocr.sh

----------------------------------------

----------------------------------------
The script needs to install the following packages:
 tesseract-ocr imagemagick xclip libnotify-bin desktop-file-utils

This will use 'apt' and may download packages from your configured repositories.

Proceed with installation? [Y/n]:  

Het installatiescript vraagt toestemming om de afhankelijkheden (tesseract-ocr, imagemagick, wl-clipboard of xclip, libnotify-bin, desktop-file-utils) te installeren. Bevestig dit door Return te drukken.

----------------------------------------
Installing dependencies using package manager: apt
Packages: tesseract-ocr imagemagick xclip libnotify-bin desktop-file-utils

----------------------------------------
[sudo] wachtwoord voor dany:  
Geraakt:1 http://deb.debian.org/debian trixie InRelease
Ophalen:2 http://deb.debian.org/debian trixie-updates InRelease [47,3 kB]
Geraakt:3 http://security.debian.org/debian-security trixie-security InRelease
47,3 kB opgehaald in 0s (396 kB/s)
Pakketlijsten worden ingelezen... Klaar
Pakketlijsten worden ingelezen... Klaar
Boom van vereisten wordt opgebouwd... Klaar
De statusinformatie wordt gelezen... Klaar  
imagemagick is reeds de nieuwste versie (8:7.1.1.43+dfsg1-1+deb13u9).
imagemagick staat ingesteld op handmatig geïnstalleerd.
desktop-file-utils is reeds de nieuwste versie (0.28-1).
desktop-file-utils staat ingesteld op handmatig geïnstalleerd.
De volgende extra pakketten zullen geïnstalleerd worden:
 libgif7 libleptonica6 libtesseract5 tesseract-ocr-eng tesseract-ocr-osd
De volgende NIEUWE pakketten zullen geïnstalleerd worden:
 libgif7 libleptonica6 libnotify-bin libtesseract5 tesseract-ocr tesseract-ocr-eng tesseract-ocr-osd xclip
0 opgewaardeerd, 8 nieuw geïnstalleerd, 0 te verwijderen en 0 niet opgewaardeerd.
Er moeten 7.586 kB aan archieven opgehaald worden.
Na deze bewerking zal er 24,2 MB extra schijfruimte gebruikt worden.
Ophalen:1 http://deb.debian.org/debian trixie/main amd64 libgif7 amd64 5.2.2-1+b1 [44,2 kB]
Ophalen:2 http://deb.debian.org/debian trixie/main amd64 libleptonica6 amd64 1.84.1-4 [1.066 kB]
Ophalen:3 http://deb.debian.org/debian trixie/main amd64 libnotify-bin amd64 0.8.6-1 [12,8 kB]
Ophalen:4 http://deb.debian.org/debian trixie/main amd64 libtesseract5 amd64 5.5.0-1+b1 [1.417 kB]
Ophalen:5 http://deb.debian.org/debian trixie/main amd64 tesseract-ocr-eng all 1:4.1.0-2 [1.594 kB]
Ophalen:6 http://deb.debian.org/debian trixie/main amd64 tesseract-ocr-osd all 1:4.1.0-2 [2.992 kB]
Ophalen:7 http://deb.debian.org/debian trixie/main amd64 tesseract-ocr amd64 5.5.0-1+b1 [439 kB]
Ophalen:8 http://deb.debian.org/debian trixie/main amd64 xclip amd64 0.13-4 [21,3 kB]
7.586 kB opgehaald in 0s (39,0 MB/s)
Voorheen niet geselecteerd pakket libgif7:amd64 wordt geselecteerd.
(Database wordt ingelezen ... 206602 bestanden en mappen momenteel geïnstalleerd.)
Uitpakken van .../0-libgif7_5.2.2-1+b1_amd64.deb wordt voorbereid...
Bezig met uitpakken van libgif7:amd64 (5.2.2-1+b1) ...
Voorheen niet geselecteerd pakket libleptonica6:amd64 wordt geselecteerd.
Uitpakken van .../1-libleptonica6_1.84.1-4_amd64.deb wordt voorbereid...
Bezig met uitpakken van libleptonica6:amd64 (1.84.1-4) ...
Voorheen niet geselecteerd pakket libnotify-bin wordt geselecteerd.
Uitpakken van .../2-libnotify-bin_0.8.6-1_amd64.deb wordt voorbereid...
Bezig met uitpakken van libnotify-bin (0.8.6-1) ...
Voorheen niet geselecteerd pakket libtesseract5:amd64 wordt geselecteerd.
Uitpakken van .../3-libtesseract5_5.5.0-1+b1_amd64.deb wordt voorbereid...
Bezig met uitpakken van libtesseract5:amd64 (5.5.0-1+b1) ...
Voorheen niet geselecteerd pakket tesseract-ocr-eng wordt geselecteerd.
Uitpakken van .../4-tesseract-ocr-eng_1%3a4.1.0-2_all.deb wordt voorbereid...
Bezig met uitpakken van tesseract-ocr-eng (1:4.1.0-2) ...
Voorheen niet geselecteerd pakket tesseract-ocr-osd wordt geselecteerd.
Uitpakken van .../5-tesseract-ocr-osd_1%3a4.1.0-2_all.deb wordt voorbereid...
Bezig met uitpakken van tesseract-ocr-osd (1:4.1.0-2) ...
Voorheen niet geselecteerd pakket tesseract-ocr wordt geselecteerd.
Uitpakken van .../6-tesseract-ocr_5.5.0-1+b1_amd64.deb wordt voorbereid...
Bezig met uitpakken van tesseract-ocr (5.5.0-1+b1) ...
Voorheen niet geselecteerd pakket xclip wordt geselecteerd.
Uitpakken van .../7-xclip_0.13-4_amd64.deb wordt voorbereid...
Bezig met uitpakken van xclip (0.13-4) ...
Instellen van tesseract-ocr-eng (1:4.1.0-2) ...
Instellen van xclip (0.13-4) ...
Instellen van libnotify-bin (0.8.6-1) ...
Instellen van libgif7:amd64 (5.2.2-1+b1) ...
Instellen van tesseract-ocr-osd (1:4.1.0-2) ...
Instellen van libleptonica6:amd64 (1.84.1-4) ...
Instellen van libtesseract5:amd64 (5.5.0-1+b1) ...
Instellen van tesseract-ocr (5.5.0-1+b1) ...
Bezig met afhandelen van triggers voor man-db (2.13.1-1) ...
Bezig met afhandelen van triggers voor libc-bin (2.41-12+deb13u3) ...
Dependencies installed.
Installation directory [default: /home/dany/.local/bin]:  
Installed: /home/dany/.local/bin/ocr.sh
Make sure '/home/dany/.local/bin' is in your PATH.
Wrote desktop entry: /home/dany/.local/share/applications/spectacle-ocr.desktop
Updated desktop database for: /home/dany/.local/share/applications

----------------------------------------
All set!

----------------------------------------

Herstart de computer de computer om tesseract-ocr op te nemen in de KDE (Plasma) omgeving.

Test tesseract-ocr door de volgende terminal opdracht uit te voeren:

dany@pindabook:~$ ocr.sh  

De test mag enkel een melding No image file received op het scherm tonen, er verschijnt verder niets in te terminal.

Spectacle tekst extractie

  1. Maak een schermafbeelding met Spectacle.
  2. Kies ExporterenExtract Text.
  3. De herkende tekst verschijnt op het klembord en een bureaubladmelding bevestigt dat het gelukt is.

Spectacle OCR

Spectacle-ocr configureren

Standaard werkt Tesseract met de Engelse taal. In Debian en alle afgeleide distributies kan je een lijst met door Tesseract ondersteunde talen weergeven met:

dany@pindabook:~$ apt search tesseract-ocr-
tesseract-ocr-afr/stable 1:4.1.0-2 all
 tesseract-ocr language files for Afrikaans

tesseract-ocr-all/stable 5.5.0-1 all
 Tesseract OCR with all language and script packages

tesseract-ocr-amh/stable 1:4.1.0-2 all
 tesseract-ocr language files for Amharic

...

tesseract-ocr-nld/stable 1:4.1.0-2 all
 tesseract-ocr language files for Dutch

...

tesseract-ocr-vie/stable 1:4.1.0-2 all
 tesseract-ocr language files for Vietnamese

tesseract-ocr-yid/stable 1:4.1.0-2 all
 tesseract-ocr language files for Yiddish

tesseract-ocr-yor/stable 1:4.1.0-2 all
 tesseract-ocr language files for Yoruba

M.a.w. om de Nederlandse trainingsdata voor Tesseract te installeren, voer je de volgende opdracht uit:

dany@pindabook:~$ sudo apt install tesseract-ocr-nld
[sudo] wachtwoord voor dany:  
Installeren:                               
 tesseract-ocr-nld

Samenvatting:
 Opwaarderen: 0, Installeren: 1, Verwijderen: 0, Niet opwaarderen: 0
 Downloadgrootte: 2.310 kB
 Benodigde ruimte: 6.066 kB / 84,5 GB beschikbaar

Ophalen:1 http://deb.debian.org/debian trixie/main amd64 tesseract-ocr-nld all 1:4.1.0-2 [2.310 kB]
2.310 kB opgehaald in 0s (18,3 MB/s)     
Voorheen niet geselecteerd pakket tesseract-ocr-nld wordt geselecteerd.
(Database wordt ingelezen ... 206731 bestanden en mappen momenteel geïnstalleerd.)
Uitpakken van .../tesseract-ocr-nld_1%3a4.1.0-2_all.deb wordt voorbereid...
Bezig met uitpakken van tesseract-ocr-nld (1:4.1.0-2) ...
Instellen van tesseract-ocr-nld (1:4.1.0-2) ...

En pas je het tesseract-ocr script met een teksteditor (bijv. nano) aan:

dany@pindabook:~$ nano .local/bin/ocr.sh  

Vul de regel met de taalinstelling aan van:

LANG="eng" # Default language is English, you can modify this line like "eng+deu" for English and German etc.

naar:

LANG="eng+nld" # Default language is English, you can modify this line like "eng+deu" for English and German etc.

Sla de aanpassing op met de sneltoets Ctrl+s en sluit nano af met Ctrl+x.

Tekst uit afbeeldingen halen

We testen de Nederlandstalige Tesseract ondersteuning deze keer met Firefox schermafbeeldingen. Surf daarvoor met Firefox naar een Nederlandstalige site en klik met de rechter muisknop op de webpagina.

Firefox schermafbeelding

Start de opdracht Schermafbeelding maken.

Firefox schermafbeelding

Je kunt nu van elk onderdeel van de webpagina een schermafbeelding maken door het onderdeel met de muis aan te wijzen en erop te klikken.

Firefox schermafbeelding

Klik op de knop om de schermafbeelding op te slaan. Het afbeeldingsbestand komt standaard terecht in de map Downloads, juist alsof je het van het internet downloadt.

Voor we verder gaan moeten we nog een veel gemaakte fout in spectacle-ocr verbeteren. De opdracht in het snelmenu kan namelijk geen bestandsnamen met spaties verwerken en Firefox gebruikt bij het opslaan van de schermafbeelding een bestandsnaam met spaties (vb: Screenshot 2026-06-13 at 15-20-28 Kritieke batterijniveau's melden.png). Open met een teksteditor (hier nano) het bestand met de definitie van de snelmenu opdracht:

dany@pindabook:~$ nano ~/.local/share/applications/spectacle-ocr.desktop

Pas de regel voor het opstarten van spectacle-ocr aan van:

Exec=sh -c "nohup '/home/dany/.local/bin/ocr.sh' %f >/dev/null 2>&1 &"

Naar:

Exec=sh -c nohup /home/dany/.local/bin/ocr.sh "%f" >/dev/null 2>&1 &  

Sla de aanpassing op met de sneltoets Ctrl+s en sluit nano af met Ctrl+x.

Je kunt nu in de bestandsbeheerder (Dolphin) in het snelmenu (rechtermuisknop) van de schermafbeelding in het submenu Openen met > de opdracht Extract Text starten.

Bestandsbeheer OCR

Spectacle-ocr gaat op de achtergrond aan het werk. Afhankelijk van de schermafbeelding en de rekenkracht van de computer kan dit wat tijd in beslag nemen. Wees dus geduldig en wacht tot je de volgende melding op het scherm ziet verschijnen.

Melding OCR

Spectacle-ocr heeft op het einde de gevonden tekst op het klmebord geplaatst, maar ook het bestand met de schermafbeelding verwijderd. Dit is vanzelfsprekend indien spectacle-ocr vanuit Spectacle wordt gebruikt (opruimen), maar zeer onaangenaam als je het afbeeldings- of foto-bestand nog nodig hebt. Zorg dus dat je werkt met een kopie of pas het spectacle-ocr script aan.

Klembord OCR

Spectacle-ocr verwijderen