Så gör du en inskannad PDF sökbar (OCR)

Senast uppdaterad: 7 juli 2026

Du trycker Ctrl+F, skriver in fakturanumret som du vet finns där någonstans och får ingenting. Dokumentet ligger framför dig, numret syns tydligt på sidan 3, men för din dator innehåller PDF:en ingen text alls. Det är den vardagliga frustrationen med inskannade PDF:er: de ser ut som dokument men beter sig som fotografier.

Lösningen är OCR, och numera behöver du varken Acrobat, en skannerprogramvara eller ett abonnemang för att köra den. Du kan göra det i webbläsaren på ett par minuter och, med rätt verktyg, utan att dokumentet någonsin lämnar din dator. Så här går det till, samt vad OCR realistiskt kan och inte kan göra för dig.

Varför inskannade PDF:er är döda dokument

En PDF som skapats från en Word-fil eller en webbsida bär på riktig text: varje bokstav lagras som ett tecken, och det är därför du kan söka i den, markera och kopiera. En PDF som skapats av en skanner eller en mobilkamera bär inte på ett enda tecken. Varje sida är en enda stor bild, ett foto av texten snarare än texten själv. Sökningen hittar ingenting, kopiera och klistra in fångar ingenting, skärmläsare läser ingenting, och filindexerare som Windows Search eller Spotlight går rakt förbi.

OCR, förkortning för optisk teckenigenkänning, är tekniken som överbryggar klyftan. En OCR-motor granskar bilden, känner igen bokstävernas och ordens former och skapar riktig maskinläsbar text med varje ords position på sidan. Moderna motorer är anmärkningsvärt bra på rena tryckta sidor: den öppna Tesseract-motorn, ursprungligen utvecklad på HP och sedan underhållen av Google, ligger bakom många OCR-program för skrivbordet och läser rutinmässigt en hyfsad kontorsskanning med väldigt få fel.

Gör en inskannad PDF sökbar, steg för steg

robinpdfs OCR-verktyg kör en WebAssembly-version av samma Tesseract-motor direkt inne i din webbläsare. Processen tar några klick:

  1. Öppna sidan OCR PDF.
  2. Klicka på rutan och välj din inskannade PDF, eller dra in filen.
  3. Välj dokumentets språk: engelska, spanska, eller båda om dokumentet blandar dem. Att välja rätt språk spelar roll, eftersom motorn använder det för att tyda tvetydiga bokstavsformer.
  4. Tryck på Kör OCR och låt den arbeta sig igenom sidorna. Igenkänningen sker på din egen processor, så ett långt dokument tar längre tid på en äldre laptop, precis som ett OCR-program för skrivbordet skulle göra.
  5. Ladda ner resultatet. Det ser pixel för pixel identiskt ut med din ursprungliga skanning, men nu fungerar Ctrl+F och du kan markera och kopiera texten.

En detalj värd att stanna upp vid: ingenting laddas upp. Trafiken går faktiskt åt andra hållet. Det är själva OCR-motorn som laddas ner till din webbläsare första gången du använder verktyget, och som sedan läser ditt dokument lokalt. För ett inskannat avtal, en läkarrapport eller en låda med gamla kontoutdrag är det en verklig skillnad mot tjänster som ber dig lämna över filen först. Vill du ha det längre resonemanget om vad som händer med filer på vanliga uppladdningsbaserade sajter har vi skrivit om det i Är PDF-verktyg online säkra?

Så fungerar det osynliga textlagret

En vanlig oro är att OCR ska förstöra dokumentets utseende, och med vissa verktyg som bygger om sidan utifrån den igenkända texten kan det faktiskt hända. Det här verktyget tar den säkrare vägen som professionell arkiveringsprogramvara använder: det behåller den ursprungliga inskannade bilden exakt som den är och placerar den igenkända texten under den, osynligt, med varje ord placerat där det syns i bilden.

Resultatet kallas ofta en sandwich-PDF. Det du ser är fortfarande den ursprungliga skanningen, med stämplar, signaturer och kaffefläckar och allt. Det datorn ser är ett helt textlager i linje med bilden. När du söker hittas träffen i det dolda lagret och markeras på bilden ovanför. När du markerar och kopierar kopierar du också från det lagret. Ingenting på den synliga sidan ändras, vilket också betyder att OCR aldrig försämrar skanningens kvalitet: bilden passerar orörd.

Det är också därför en nyss OCR-behandlad fil kan bli något större än originalet: den rymmer nu bilden plus texten. Om storleken spelar roll, kör resultatet genom Komprimera PDF efteråt; skanningar krymper oftast rejält.

Där sökbara skanningar verkligen lönar sig

Få ut det bästa av dina skanningar

OCR-noggrannheten beror långt mer på indata än på motorn. Några vanor gör stor skillnad:

Ärliga gränser: vad OCR inte klarar

Det är värt att vara rak om kanterna. OCR-motorer är byggda för tryckt text, så handstil ligger till stor del utom räckhåll: ett handskrivet brev eller ett ifyllt formulärfält kommer ut som rappakalja eller ingenting alls, och ingen mängd omskanning fixar det. Lågkvalitativa skanningar, faxade dokument, suddiga mobilfoton och pytteliten stil ger fel, ibland många. Och även om orden i en tabell känns igen så gör tabellens struktur det inte: kopiera en tabell ur en OCR-behandlad sida och du får en ström av cellvärden, inte rader och kolumner som du kan klistra in i ett kalkylark.

Inget av detta gör OCR mindre användbart för sitt huvudsyfte. Även ett ofullständigt textlager med några felavlästa tecken låter dig fortfarande hitta sidan du behöver på några sekunder, vilket oftast är hela poängen.

Vanliga frågor

Ser min PDF annorlunda ut efter OCR?

Nej. De synliga sidorna är dina ursprungliga skanningsbilder, oförändrade. Den igenkända texten läggs till som ett osynligt lager under dem.

Laddas mitt dokument upp någonstans?

Nej. Igenkänningen körs inne i din webbläsare på din egen enhet. Motorn laddas ner till dig; din fil lämnar aldrig din dator.

Vilka språk stöds?

Engelska, spanska, eller båda tillsammans för dokument som blandar de två.

Kan den läsa handstil?

Inte tillförlitligt. OCR-motorer är tränade på tryckta typsnitt. Prydliga versaler kommer ibland igenom; skrivstil gör det inte.

Varför är OCR långsam på min dator?

För att arbetet sker på din processor i stället för på en server. En modern laptop hanterar ett vanligt dokument snabbt; en lång skanning på en gammal maskin tar en stund. Det behöver bara göras en gång per fil.

Utdatafilen blev större. Är det normalt?

Ja, en aning: den innehåller nu bilderna plus textlagret. Kör den genom Komprimera PDF om du behöver den mindre.

Gör din inskannade PDF sökbar →