Kör OCR på en skannad PDF privat – känn igen text i din webbläsare

Välj en skannad PDF och ett språk; varje sida renderas och känns igen lokalt av Tesseract (kompilerad till WebAssembly), och den igenkända texten visas och kan laddas ner som en .txt-fil.

Quick answer

What it does
Välj en skannad PDF och ett språk; varje sida renderas och känns igen lokalt av Tesseract (kompilerad till WebAssembly), och den igenkända texten visas och kan laddas ner som en .txt-fil.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
En revisor kör OCR på en inskannad faktura för att kopiera radbelopp till ett kalkylblad utan att skriva om dem.
Good to know
Engelska och traditionell kinesiska stöds i den här versionen.

How it works

  1. Välj en skannad PDF från din enhet och välj dokumentets språk.
  2. Filen läses in i webbläsarens minne – ingen data lämnar din webbläsare.
  3. pdf.js renderar varje sida till en bild i en Web Worker.
  4. Tesseract OCR – kompilerad till WebAssembly och levererad från den här webbplatsen – känner igen texten på varje sida lokalt; språkmodellen laddas också från den här webbplatsen, inte från ett tredjeparts-CDN.
  5. Den igenkända texten visas per sida och erbjuds som en .txt-nedladdning.

When to use this tool

  • En revisor kör OCR på en inskannad faktura för att kopiera radbelopp till ett kalkylblad utan att skriva om dem.
  • En student kör OCR på ett inskannat kursutdelningsblad för att få sökbar, kopierbar text för sina anteckningar.
  • En arkivarie konverterar inskannade traditionella kinesiska dokument till sökbar text för ett digitalt bibliotek.
  • OCR-noggrannheten beror på skanningskvaliteten — suddiga, sneda eller lågupplösta sidor kan ge fel; behandla utdata som ett bästa-möjliga-utkast.

Frequently asked questions

Hur skiljer sig det här från andra PDF-verktyg online?
De flesta PDF-verktyg online skickar dina filer till en fjärrserver för bearbetning. Det här verktyget bearbetar allt lokalt i din webbläsare med JavaScript på klientsidan. Dina filer överförs inte till någon server, vilket innebär att innehållet i dina dokument förblir under din kontroll.
Laddas mina PDF-filer upp?
Nej. Dina filer läses direkt av din webbläsare. Dina filer överförs aldrig via nätverket. Verktyget fungerar helt och hållet inuti den webbläsarflik du har öppen.
Kan jag kontrollera att filerna inte laddas upp?
Ja. Öppna webbläsarens utvecklarverktyg (F12), gå till fliken Nätverk (Network) och håll utkik efter utgående anrop medan du använder verktyget. Du kommer inte att se någon fildata lämna din webbläsare. Webbplatsen kan registrera ett anonymt sidvisningsantal, vilket aldrig inkluderar dina filer och kan inaktiveras.
Fungerar verktyget offline?
Ja, när sidan väl har laddats bearbetar verktyget dina filer helt i din webbläsare; verktygsfunktionaliteten behöver ingen nätverksanslutning. Du kan koppla bort dig från internet och fortsätta att använda det.
Vad händer när jag laddar om sidan?
Eftersom ingenting lagras på en server rensas din nuvarande session när sidan laddas om. De filer du hade valt måste väljas på nytt.
Lagrar verktyget mina filer?
Nej. Filerna hålls bara i webbläsarens minne så länge sidan är öppen. När du stänger eller laddar om sidan kasseras de. Verktyget skriver ingenting till disk och skickar ingenting till en server.
Kan det här verktyget låsa upp lösenordsskyddade PDF-filer?
Nej. Det här verktyget försöker inte ta bort eller kringgå lösenordsskyddet i en PDF. Om du kan lösenordet kan verktyget Lås upp PDF på den här webbplatsen ta bort det lokalt; därefter kan det här verktyget bearbeta filen.
Vilken teknik använder verktyget?
Det här verktyget använder pdf.js för att rendera sidor och Tesseract OCR-motorn kompilerad till WebAssembly (tesseract.js) som körs i en Web Worker på samma ursprung – dina filer lämnar aldrig din webbläsare.
Använder verktyget WebAssembly?
Ja – det här är ett av de få verktygen här som gör det. Tesseract OCR-motorn är C++ kompilerad till WebAssembly och körs inuti din webbläsare; .wasm-binären levereras från den här webbplatsen och ingenting skickas någonstans.
Varför är den första körningen långsammare än de följande?
Vid första användningen laddar din webbläsare ner OCR-motorn och språkmodellen från den här webbplatsen (några megabyte) och kompilerar dem. De cachas sedan, så senare körningar startar mycket snabbare.
Hur kör jag OCR på en inskannad PDF här?
Välj en inskannad PDF från din enhet, välj dokumentets språk (engelska eller traditionell kinesiska) och välj sedan Känn igen. Varje sida renderas och läses lokalt, och när det är klart kan du förhandsgranska texten och spara den som en .txt-fil.
Varför är den igenkända texten bara en .txt-fil i stället för en sökbar PDF?
Det här verktyget matar ut de igenkända orden som ren text i stället för att skriva tillbaka ett osynligt textlager in i PDF:en, så din ursprungliga inskannade PDF förblir oförändrad. Om du behöver orden inuti sidan kopierar du dem från den sparade .txt-filen eller förhandsvisningen på skärmen, som listar texten sida för sida.
Kan jag köra två språk i samma dokument, och vad händer om jag väljer fel?
Du väljer ett enda språk för hela dokumentet innan igenkänningen, så en fil som blandar engelska och traditionell kinesiska kommer att gynna det du valde. Igenkänningskvaliteten beror också på själva skanningen, så sneda, lågupplösta eller handskrivna sidor tenderar att bli dåliga oavsett språk.
Kostar det något att använda verktyget OCR PDF?
Verktyget OCR PDF är helt gratis — inget konto, ingen registrering och ingen begränsning på hur många skannade PDF-filer du kör igenom det, och det kommer alltid att vara så. Varje sida känns igen direkt i din webbläsare med Tesseract OCR-motorn kompilerad till WebAssembly, så dina skannade dokument — oavsett om de innehåller avtal, ID-handlingar eller medicinska journaler — skickas aldrig någonstans.

Related tools

  • Extrahera text
  • Ordräkning
  • PDF till bilder
  • Komprimera PDF
  • Allt-i-ett-PDF-redigerare
  • Hem
  • Allt-i-ett-PDF-redigerare
  • Sammanfoga PDF
  • Dela PDF
  • Rotera PDF
  • Lägg till vattenstämpel
  • Bilder till PDF
  • PDF till bilder
  • Sidnummer
  • Komprimera PDF
  • Extrahera text
  • Redigera metadata
  • Ordna sidor
  • Infoga tomma sidor
  • Extrahera sidor
  • N-up (sidor per ark)
  • Gråskala-PDF
  • Beskär PDF
  • Vänd sidor
  • Ändra storlek (A4/Letter)
  • Lägg till sidhuvud och sidfot
  • Platta till formulär
  • Dela var N:e sida
  • PDF-info och metadata
  • Stämpla bild/signatur
  • Ta bort sidor
  • Upprepad vattenstämpel
  • Häfte
  • Duplicera sidor
  • Bifoga fil
  • Skala med procent
  • Ta bort tomma sidor
  • Varvad sammanfogning
  • Lägg till sidram
  • Extrahera udda/jämna sidor
  • PDF till lång bild
  • Dela sidor på mitten
  • Lägg till marginaler
  • Signera PDF
  • Jämför PDF:er
  • Affischuppdelning
  • Ordräkning
  • Reparera PDF
  • Fyll i PDF-formulär
  • Dela efter bokmärken
  • Sök och markera
  • Extrahera bilder
  • Maskera PDF
  • OCR (skannat till text)
  • Skydda PDF
  • Lås upp PDF
  • Om oss
  • Integritetspolicy
  • Kontakt
  • Så här fungerar det
  • Lokala vs onlinebaserade PDF-verktyg
  • Är onlinebaserade PDF-verktyg säkra?