Extrage text din PDF în mod privat — rulează integral în browserul tău

Selectează un PDF, iar stratul de text din fiecare pagină este extras local, în browser, și oferit ca fișier text descărcabil — fără încărcare.

Quick answer

What it does
Selectează un PDF, iar stratul de text din fiecare pagină este extras local, în browser, și oferit ca fișier text descărcabil — fără încărcare.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Copierea termenilor contractuali dintr-un PDF cu aspect fix într-un editor de text pentru revizuire sau comparare.
Good to know
Acest instrument poate extrage doar textul care este încorporat ca strat de text în PDF. PDF-urile scanate și cele formate doar din imagini nu au un strat de text, așa că nu va fi extras niciun text.

How it works

  1. Selectează un fișier PDF de pe dispozitivul tău folosind selectorul de fișiere.
  2. Fișierul este citit în memoria browserului — niciun fel de date nu părăsesc browserul.
  3. pdf.js încarcă documentul într-un Web Worker și apelează getTextContent() pentru fiecare pagină pentru a prelua stratul de text încorporat.
  4. Textul extras din toate paginile este combinat în ordine și oferit ca fișier .txt descărcabil.
  5. Toate datele temporare sunt eliberate din memorie după ce descărcarea este finalizată.

When to use this tool

  • Copierea termenilor contractuali dintr-un PDF cu aspect fix într-un editor de text pentru revizuire sau comparare.
  • Extragerea textului principal dintr-un PDF de lucrare de cercetare pentru a-l lipi într-un instrument de traducere sau rezumare.
  • Extragerea datelor din rândurile de factură dintr-un PDF ca prim pas înainte de importul într-o foaie de calcul.
  • Notă: funcționează doar pe PDF-uri cu un strat de text încorporat — PDF-urile scanate sau cu imagini exclusiv nu au text de extras.

Frequently asked questions

Prin ce se deosebește de alte instrumente PDF online?
Majoritatea instrumentelor PDF online trimit fișierele tale către un server la distanță pentru prelucrare. Acest instrument prelucrează totul local, în browserul tău, folosind JavaScript pe partea de client. Fișierele tale nu sunt transmise către niciun server, ceea ce înseamnă că conținutul documentului rămâne sub controlul tău.
Fișierele mele PDF sunt încărcate undeva?
Nu. Fișierele tale sunt citite direct de browser. Fișierele tale nu sunt niciodată transmise prin rețea. Instrumentul funcționează integral în fila de browser pe care o ai deschisă.
Pot verifica faptul că fișierele nu sunt încărcate?
Da. Deschide instrumentele pentru dezvoltatori din browser (F12), accesează fila Network și urmărește dacă apar cereri de ieșire în timp ce folosești instrumentul. Vei vedea că niciun fișier nu părăsește browserul. Site-ul poate înregistra un număr anonim de vizualizări de pagină, care nu include niciodată fișierele tale și poate fi dezactivat.
Funcționează acest instrument offline?
Da, odată ce pagina s-a încărcat, instrumentul procesează fișierele tale integral în browser; funcționalitatea instrumentului nu necesită nicio conexiune la rețea. Te poți deconecta de la internet și poți continua să îl folosești.
Ce se întâmplă când reîncarc pagina?
Deoarece nimic nu este stocat pe un server, reîncărcarea paginii îți șterge sesiunea curentă. Va trebui să selectezi din nou fișierele pe care le aveai alese.
Acest instrument îmi stochează fișierele?
Nu. Fișierele sunt păstrate în memoria browserului doar cât timp pagina este deschisă. Închiderea sau reîncărcarea paginii le elimină. Instrumentul nu scrie nimic pe disc și nu trimite nimic către un server.
Poate acest instrument să deblocheze PDF-uri protejate prin parolă?
Nu. Acest instrument nu încearcă să elimine sau să ocolească protecția prin parolă a PDF-ului. Dacă știi parola, instrumentul Unlock PDF de pe acest site o poate elimina local, iar apoi acest instrument poate prelucra fișierul.
Ce tehnologii folosește acest instrument?
Acest instrument folosește pdf.js (motorul PDF pe partea de client al Mozilla) într-un Web Worker pentru a citi stratul de text încorporat din fiecare pagină PDF, în browserul tău. Fișierele tale nu părăsesc niciodată browserul.
Folosește acest instrument WebAssembly?
Nu. pdf.js este o bibliotecă JavaScript obișnuită — nu folosește WebAssembly. Toată extragerea textului PDF are loc în JavaScript pe partea de client, în browserul tău.
Cum extrag textul din PDF-ul meu?
Alege un PDF cu selectorul de fișiere, apoi apasă butonul de extragere. Textul din fiecare pagină este citit local, în browserul tău, este afișat într-o casetă de previzualizare și îl poți salva ca fișier .txt.
De ce PDF-ul meu scanat a venit înapoi fără text?
Acest instrument citește stratul de text încorporat pe care îl stochează un PDF, iar documentele scanate sau formate doar din imagini nu au un astfel de strat, așa că nu se poate extrage nimic. Când se întâmplă asta, vei vedea o notificare și nu este oferit niciun fișier text, deoarece nu există date de caractere de recuperat fără OCR.
De ce textul extras nu se potrivește cu aspectul vizual al paginii?
Instrumentul parcurge elementele de text pe care pdf.js le raportează pentru fiecare pagină și le păstrează întreruperile de rând, dar nu reașează coloanele, așa că paginile cu mai multe coloane, tabelele și aspectele complexe pot să nu se alinieze cu ceea ce vezi pe ecran. Paginile sunt unite cu rânduri goale, iar PDF-urile cu codificări de font neobișnuite sau personalizate pot produce, de asemenea, caractere ilizibile chiar și atunci când pagina arată în regulă.
Extract Text from PDF costă ceva?
Extract Text from PDF este complet gratuit — fără cont, fără înregistrare și fără limită privind numărul de PDF-uri procesate, și așa va fi întotdeauna. PDF-ul tău este citit direct de browser folosind pdf.js, care extrage stratul de text înglobat pagină cu pagină și îți înmânează un fișier .txt simplu; fișierul în sine rămâne în memoria browserului pe toată durata și nu este transmis nicăieri.

Related tools

  • PDF în imagini
  • Împarte PDF
  • Organizează pagini
  • Imagini în PDF
  • Editor PDF all-in-one
  • Acasă
  • Editor PDF all-in-one
  • Combină PDF
  • Împarte PDF
  • Rotește PDF
  • Adaugă filigran
  • Imagini în PDF
  • PDF în imagini
  • Numere de pagină
  • Comprimă PDF
  • Extrage text
  • Editează metadate
  • Organizează pagini
  • Inserează pagini goale
  • Extrage pagini
  • N-up (pagini pe coală)
  • PDF în tonuri de gri
  • Decupează PDF
  • Inversează pagini
  • Redimensionează (A4/Letter)
  • Adaugă antet și subsol
  • Aplatizează formular
  • Împarte la fiecare N pagini
  • Informații și metadate PDF
  • Ștampilează imagine / semnătură
  • Elimină pagini
  • Filigran în mozaic
  • Broșură
  • Duplică pagini
  • Atașează fișier
  • Scalează în procente
  • Elimină pagini goale
  • Combinare intercalată
  • Adaugă chenar de pagină
  • Extrage pagini impare / pare
  • PDF în imagine lungă
  • Împarte paginile în jumătate
  • Adaugă margini
  • Semnează PDF
  • Compară PDF-uri
  • Împărțire în poster
  • Numără cuvinte
  • Repară PDF
  • Completează formular PDF
  • Împarte după marcaje
  • Caută și evidențiază
  • Extrage imagini
  • Redactează PDF
  • OCR (scanat în text)
  • Protejează PDF
  • Deblochează PDF
  • Despre
  • Politica de confidențialitate
  • Contact
  • Cum funcționează
  • Instrumente PDF locale vs. online
  • Instrumentele PDF online sunt sigure?