Kør OCR på en scannet PDF privat — genkend tekst i din browser

Vælg en scannet PDF og et sprog; hver side gengives og genkendes lokalt af Tesseract (kompileret til WebAssembly), og den genkendte tekst vises og kan hentes som en .txt-fil.

Quick answer

What it does
Vælg en scannet PDF og et sprog; hver side gengives og genkendes lokalt af Tesseract (kompileret til WebAssembly), og den genkendte tekst vises og kan hentes som en .txt-fil.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
En revisor anvender OCR på en scannet faktura for at kopiere linjebeløb til et regneark uden at genindtaste.
Good to know
Engelsk og traditionelt kinesisk understøttes i denne version.

How it works

  1. Vælg en scannet PDF fra din enhed, og vælg dokumentets sprog.
  2. Filen læses ind i browserens hukommelse — ingen data forlader din browser.
  3. pdf.js gengiver hver side til et billede i en Web Worker.
  4. Tesseract OCR — kompileret til WebAssembly og leveret fra dette websted — genkender teksten på hver side lokalt; sprogmodellen indlæses også fra dette websted, ikke et tredjeparts-CDN.
  5. Den genkendte tekst vises per side og tilbydes som en .txt-download.

When to use this tool

  • En revisor anvender OCR på en scannet faktura for at kopiere linjebeløb til et regneark uden at genindtaste.
  • En studerende anvender OCR på et scannet kursusuddelingsark for at få søgbar, kopierbar tekst til sine noter.
  • En arkivar konverterer scannede traditionelle kinesiske dokumenter til søgbar tekst til et digitalt bibliotek.
  • OCR-nøjagtighed afhænger af scannekvaliteten — slørede, skæve eller lavopløsningssider kan producere fejl; behandl output som et best-effort-udkast.

Frequently asked questions

Hvordan adskiller dette sig fra andre online PDF-værktøjer?
De fleste online PDF-værktøjer sender dine filer til en ekstern server for at behandle dem. Dette værktøj behandler alt lokalt i din browser med JavaScript på klientsiden. Dine filer sendes ikke til nogen server, så indholdet af dine dokumenter forbliver under din kontrol.
Bliver mine PDF-filer uploadet?
Nej. Dine filer læses direkte af din browser. Dine filer overføres aldrig over netværket. Værktøjet arbejder udelukkende i den browserfane, du har åben.
Kan jeg kontrollere, at filerne ikke uploades?
Ja. Åbn din browsers udviklerværktøjer (F12), gå til fanen Netværk, og hold øje med eventuelle udgående anmodninger, mens du bruger værktøjet. Du vil ikke se nogen fildata forlade din browser. Siden registrerer muligvis et anonymt sidevisningsantal, som aldrig inkluderer dine filer og kan deaktiveres.
Virker værktøjet offline?
Ja. Når siden først er indlæst, behandler værktøjet dine filer helt i din browser; værktøjets funktionalitet kræver ingen netværksforbindelse. Du kan koble dig fra internettet og fortsætte med at bruge det.
Hvad sker der, når jeg genindlæser siden?
Da intet gemmes på en server, rydder en genindlæsning af siden din aktuelle session. Filer, du havde valgt, skal vælges igen.
Gemmer værktøjet mine filer?
Nej. Filerne ligger kun i browserens hukommelse, så længe siden er åben. Når du lukker eller genindlæser siden, kasseres de. Værktøjet skriver intet til disken, og intet sendes til en server.
Kan dette værktøj låse adgangskodebeskyttede PDF-filer op?
Nej. Dette værktøj forsøger ikke at fjerne eller omgå adgangskodebeskyttelse i PDF-filer. Hvis du kender adgangskoden, kan værktøjet Lås PDF op her på siden fjerne den lokalt, hvorefter dette værktøj kan behandle filen.
Hvilke teknologier bruger værktøjet?
Dette værktøj bruger pdf.js til at gengive sider og Tesseract OCR-motoren kompileret til WebAssembly (tesseract.js), der kører i en Web Worker med samme oprindelse — dine filer forlader aldrig din browser.
Bruger værktøjet WebAssembly?
Ja — dette er et af de få værktøjer her, der gør. Tesseract OCR-motoren er C++ kompileret til WebAssembly og kører inde i din browser; .wasm-binærfilen leveres fra dette websted, og intet sendes nogen steder hen.
Hvorfor er den første kørsel langsommere end de efterfølgende?
Ved første brug downloader din browser OCR-motoren og sprogmodellen fra dette websted (nogle få megabyte) og kompilerer dem. De caches bagefter, så senere kørsler starter meget hurtigere.
Hvordan kører jeg OCR på en scannet PDF her?
Vælg en scannet PDF fra din enhed, vælg dokumentsproget (engelsk eller traditionelt kinesisk), og vælg derefter Genkend. Hver side gengives og læses lokalt, og når det er færdigt, kan du forhåndsvise teksten og gemme den som en .txt-fil.
Hvorfor er den genkendte tekst bare en .txt-fil i stedet for en søgbar PDF?
Dette værktøj udsender de genkendte ord som almindelig tekst frem for at skrive et usynligt tekstlag tilbage i PDF-en, så din oprindelige scannede PDF forbliver uændret. Hvis du har brug for ordene inde i siden, kopierer du dem fra den gemte .txt eller fra forhåndsvisningen på skærmen, som viser teksten side for side.
Kan jeg køre to sprog i det samme dokument, og hvad hvis jeg vælger det forkerte?
Du vælger et enkelt sprog for hele dokumentet, inden du genkender, så en fil, der blander engelsk og traditionelt kinesisk, vil favorisere det, du valgte. Genkendelseskvaliteten afhænger også af selve scanningen, så skæve sider, sider med lav opløsning eller håndskrevne sider har tendens til at blive dårlige uanset sprog.
Koster OCR PDF-værktøjet noget at bruge?
OCR PDF-værktøjet er fuldstændig gratis — ingen konto, ingen tilmelding og ingen grænse for, hvor mange scannede PDF-filer du kører igennem, og det vil altid forblive sådan. Hver side genkendes direkte inde i din browser ved hjælp af Tesseract OCR-motoren, der er kompileret til WebAssembly, så dine scannede dokumenter — uanset om de indeholder kontrakter, ID-kort eller lægejournaler — aldrig sendes nogen steder.

Related tools

  • Udtræk tekst
  • Ordtælling
  • PDF til billeder
  • Komprimer PDF
  • Alt-i-én PDF-editor
  • Hjem
  • Alt-i-én PDF-editor
  • Flet PDF
  • Opdel PDF
  • Roter PDF
  • Tilføj vandmærke
  • Billeder til PDF
  • PDF til billeder
  • Sidenumre
  • Komprimer PDF
  • Udtræk tekst
  • Rediger metadata
  • Organiser sider
  • Indsæt tomme sider
  • Udtræk sider
  • N-up (sider pr. ark)
  • Gråtone-PDF
  • Beskær PDF
  • Vend sider om
  • Tilpas størrelse (A4/Letter)
  • Tilføj sidehoved og sidefod
  • Fladgør formular
  • Opdel for hver N sider
  • PDF-info og metadata
  • Stempel billede/signatur
  • Fjern sider
  • Fliselagt vandmærke
  • Hæfte
  • Dupliker sider
  • Vedhæft fil
  • Skaler efter procent
  • Fjern tomme sider
  • Sammenflet ved fletning
  • Tilføj sidekant
  • Udtræk ulige/lige sider
  • PDF til langt billede
  • Opdel sider på midten
  • Tilføj margener
  • Underskriv PDF
  • Sammenlign PDF'er
  • Plakatopdeling
  • Ordtælling
  • Reparer PDF
  • Udfyld PDF-formular
  • Opdel efter bogmærker
  • Søg og fremhæv
  • Udtræk billeder
  • Censurer PDF
  • OCR (scannet til tekst)
  • Beskyt PDF
  • Lås PDF op
  • Om os
  • Privatlivspolitik
  • Kontakt
  • Sådan fungerer det
  • Lokale vs. online PDF-værktøjer
  • Er online PDF-værktøjer sikre?