Aplică OCR unui PDF scanat în mod privat — recunoaște textul în browserul tău

Selectează un PDF scanat și o limbă; fiecare pagină este redată și recunoscută local de Tesseract (compilat în WebAssembly), iar textul recunoscut este afișat și descărcabil ca fișier .txt.

Quick answer

What it does
Selectează un PDF scanat și o limbă; fiecare pagină este redată și recunoscută local de Tesseract (compilat în WebAssembly), iar textul recunoscut este afișat și descărcabil ca fișier .txt.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Un contabil aplică OCR pe o factură scanată pentru a copia sumele din rânduri într-o foaie de calcul fără a retasta.
Good to know
În această versiune sunt acceptate engleza și chineza tradițională.

How it works

  1. Selectează un PDF scanat de pe dispozitivul tău și alege limba documentului.
  2. Fișierul este citit în memoria browserului — niciun fel de date nu părăsesc browserul.
  3. pdf.js redă fiecare pagină ca imagine într-un Web Worker.
  4. Tesseract OCR — compilat în WebAssembly și servit de pe acest site — recunoaște local textul fiecărei pagini; modelul de limbă este, de asemenea, încărcat de pe acest site, nu de pe un CDN terț.
  5. Textul recunoscut este afișat pentru fiecare pagină și oferit ca descărcare .txt.

When to use this tool

  • Un contabil aplică OCR pe o factură scanată pentru a copia sumele din rânduri într-o foaie de calcul fără a retasta.
  • Un student aplică OCR pe un material de curs scanat pentru a obține text căutabil și copiabil pentru notițele sale.
  • Un arhivar convertește documente în chineză tradițională scanate în text căutabil pentru o bibliotecă digitală.
  • Acuratețea OCR depinde de calitatea scanării — paginile neclare, înclinate sau cu rezoluție scăzută pot produce erori; tratați rezultatul ca un draft de cel mai bun efort.

Frequently asked questions

Prin ce se deosebește de alte instrumente PDF online?
Majoritatea instrumentelor PDF online trimit fișierele tale către un server la distanță pentru prelucrare. Acest instrument prelucrează totul local, în browserul tău, folosind JavaScript pe partea de client. Fișierele tale nu sunt transmise către niciun server, ceea ce înseamnă că conținutul documentului rămâne sub controlul tău.
Fișierele mele PDF sunt încărcate undeva?
Nu. Fișierele tale sunt citite direct de browser. Fișierele tale nu sunt niciodată transmise prin rețea. Instrumentul funcționează integral în fila de browser pe care o ai deschisă.
Pot verifica faptul că fișierele nu sunt încărcate?
Da. Deschide instrumentele pentru dezvoltatori din browser (F12), accesează fila Network și urmărește dacă apar cereri de ieșire în timp ce folosești instrumentul. Vei vedea că niciun fișier nu părăsește browserul. Site-ul poate înregistra un număr anonim de vizualizări de pagină, care nu include niciodată fișierele tale și poate fi dezactivat.
Funcționează acest instrument offline?
Da, odată ce pagina s-a încărcat, instrumentul procesează fișierele tale integral în browser; funcționalitatea instrumentului nu necesită nicio conexiune la rețea. Te poți deconecta de la internet și poți continua să îl folosești.
Ce se întâmplă când reîncarc pagina?
Deoarece nimic nu este stocat pe un server, reîncărcarea paginii îți șterge sesiunea curentă. Va trebui să selectezi din nou fișierele pe care le aveai alese.
Acest instrument îmi stochează fișierele?
Nu. Fișierele sunt păstrate în memoria browserului doar cât timp pagina este deschisă. Închiderea sau reîncărcarea paginii le elimină. Instrumentul nu scrie nimic pe disc și nu trimite nimic către un server.
Poate acest instrument să deblocheze PDF-uri protejate prin parolă?
Nu. Acest instrument nu încearcă să elimine sau să ocolească protecția prin parolă a PDF-ului. Dacă știi parola, instrumentul Unlock PDF de pe acest site o poate elimina local, iar apoi acest instrument poate prelucra fișierul.
Ce tehnologii folosește acest instrument?
Acest instrument folosește pdf.js pentru a reda paginile și motorul OCR Tesseract compilat în WebAssembly (tesseract.js), care rulează într-un Web Worker de aceeași origine — fișierele tale nu părăsesc niciodată browserul.
Folosește acest instrument WebAssembly?
Da — este unul dintre puținele instrumente de aici care îl folosește. Motorul OCR Tesseract este cod C++ compilat în WebAssembly și rulează în interiorul browserului tău; binarul .wasm este servit de pe acest site și nimic nu este trimis nicăieri.
De ce prima rulare este mai lentă decât cele următoare?
La prima utilizare, browserul tău descarcă de pe acest site motorul OCR și modelul de limbă (câțiva megabytes) și le compilează. Ulterior sunt păstrate în cache, astfel încât rulările următoare pornesc mult mai rapid.
Cum aplic OCR pe un PDF scanat aici?
Alege un PDF scanat de pe dispozitivul tău, alege limba documentului (engleză sau chineză tradițională), apoi selectează Recunoaște. Fiecare pagină este randată și citită local, iar după finalizare poți previzualiza textul și îl poți salva ca fișier .txt.
De ce textul recunoscut este doar un fișier .txt în loc de un PDF în care se poate căuta?
Acest instrument scoate cuvintele recunoscute ca text simplu, în loc să scrie un strat de text invizibil înapoi în PDF, așa că PDF-ul tău scanat original rămâne neschimbat. Dacă ai nevoie de cuvinte în interiorul paginii, le-ai copia din fișierul .txt salvat sau din previzualizarea de pe ecran, care listează textul pagină cu pagină.
Pot rula două limbi în același document și ce se întâmplă dacă o aleg pe cea greșită?
Selectezi o singură limbă pentru întregul document înainte de recunoaștere, așa că un fișier care amestecă engleza și chineza tradițională o va favoriza pe cea pe care ai ales-o. Calitatea recunoașterii depinde și de scanarea în sine, așa că paginile înclinate, cu rezoluție mică sau scrise de mână tind să iasă slab, indiferent de limbă.
Este gratuit instrumentul OCR PDF?
Instrumentul OCR PDF este complet gratuit — fără cont, fără înregistrare și fără limită privind numărul de fișiere PDF scanate procesate, și va rămâne întotdeauna așa. Fiecare pagină este recunoscută direct în browserul tău folosind motorul Tesseract OCR compilat în WebAssembly, astfel că documentele tale scanate — fie că conțin contracte, acte de identitate sau fișe medicale — nu sunt trimise niciodată nicăieri.

Related tools

  • Extrage text
  • Numără cuvinte
  • PDF în imagini
  • Comprimă PDF
  • Editor PDF all-in-one
  • Acasă
  • Editor PDF all-in-one
  • Combină PDF
  • Împarte PDF
  • Rotește PDF
  • Adaugă filigran
  • Imagini în PDF
  • PDF în imagini
  • Numere de pagină
  • Comprimă PDF
  • Extrage text
  • Editează metadate
  • Organizează pagini
  • Inserează pagini goale
  • Extrage pagini
  • N-up (pagini pe coală)
  • PDF în tonuri de gri
  • Decupează PDF
  • Inversează pagini
  • Redimensionează (A4/Letter)
  • Adaugă antet și subsol
  • Aplatizează formular
  • Împarte la fiecare N pagini
  • Informații și metadate PDF
  • Ștampilează imagine / semnătură
  • Elimină pagini
  • Filigran în mozaic
  • Broșură
  • Duplică pagini
  • Atașează fișier
  • Scalează în procente
  • Elimină pagini goale
  • Combinare intercalată
  • Adaugă chenar de pagină
  • Extrage pagini impare / pare
  • PDF în imagine lungă
  • Împarte paginile în jumătate
  • Adaugă margini
  • Semnează PDF
  • Compară PDF-uri
  • Împărțire în poster
  • Numără cuvinte
  • Repară PDF
  • Completează formular PDF
  • Împarte după marcaje
  • Caută și evidențiază
  • Extrage imagini
  • Redactează PDF
  • OCR (scanat în text)
  • Protejează PDF
  • Deblochează PDF
  • Despre
  • Politica de confidențialitate
  • Contact
  • Cum funcționează
  • Instrumente PDF locale vs. online
  • Instrumentele PDF online sunt sigure?