Bild till text (OCR)

Gratis OCR online: extrahera text från bilder, skärmbilder, foton och skannade PDF-filer på 24 språk. Allt körs i webbläsaren och inget laddas upp.

Du kan också dra filer hit eller klistra in en skärmbild med Ctrl+V (⌘+V på Mac). Texten känns igen av din webbläsare. Filerna skickas ingenstans: ingen uppladdning, ingen lagring.
Varje språk laddas ner en gång (1 till 3 MB) och sparas sedan i webbläsaren. Lägg till engelska som andra språk när texten blandar in ord med latinska bokstäver.

Vad den gör


Det här verktyget använder OCR (optisk teckenigenkänning) för att göra om texten i en bild till text som du kan kopiera, redigera och söka i. Det fungerar med skärmbilder, foton av dokument, skannade sidor och PDF-filer som bara består av bilder. Igenkänningen görs av Tesseract, en OCR-motor med öppen källkod som körs i din egen webbläsare, så filerna lämnar aldrig din enhet. Liten text förstoras automatiskt innan den läses, vilket märkbart minskar antalet fel.

Så använder du den


  1. Välj en eller flera bilder eller en PDF, dra dem hit eller klistra in en skärmbild.
  2. Kontrollera textens språk. Läsningen startar av sig själv; om du byter språk trycker du på Extrahera text igen.
  3. Granska resultatet, rätta det som lästs fel och kopiera det sedan eller ladda ner det som en .txt-fil.

Vanliga frågor


Laddas mina bilder upp?
Nej. Igenkänningsmotorn och språkdata laddas ner till din webbläsare, och bilderna och PDF-filerna bearbetas där. Inget skickas till en server, så det är säkert att använda med privata dokument.

Hur exakt är det?
På tydlig tryckt text får språk med latinska bokstäver oftast mer än 99 % av tecknen rätt, och andra skriftsystem vanligtvis mellan 93 % och 99 %. Precisionen sjunker med suddiga foton, låg kontrast, böjda sidor, dekorativa typsnitt och handskrift. För bästa resultat bör du använda en skarp, väl belyst och rak bild och välja rätt språk.

Vilka språk stöds?
24 språk: engelska, portugisiska, spanska, franska, tyska, italienska, svenska, afrikaans, turkiska, indonesiska, malajiska, filippinska, vietnamesiska, ryska, arabiska, urdu, hindi, tamil, thailändska, khmer, japanska, koreanska samt förenklad och traditionell kinesiska. Du kan kombinera två språk när en text blandar dem.

Kan den läsa handskrift?
Bara dåligt. Motorn är tränad på tryckt text: prydliga tryckbokstäver fungerar ibland, men sammanhängande skrivstil blir oftast fel.

Fungerar det med skannade PDF-filer?
Ja. Varje sida renderas i hög upplösning och läses i tur och ordning, och du kan markera var varje sida börjar. Om PDF-filen redan innehåller text som går att markera är verktyget PDF till text snabbare och exakt.

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)