Pura teksti PDF:stä yksityisesti – toimii kokonaan selaimessasi
Valitse PDF, ja kunkin sivun tekstikerros puretaan paikallisesti selaimessasi ja tarjotaan ladattavana tekstitiedostona – ilman lähetystä.
Quick answer
What it does
Valitse PDF, ja kunkin sivun tekstikerros puretaan paikallisesti selaimessasi ja tarjotaan ladattavana tekstitiedostona – ilman lähetystä.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Sopimusehtojen kopioiminen kiinteäasetteisesta PDF:stä tekstieditoriin tarkistamista tai vertailua varten.
Good to know
Tämä työkalu voi purkaa vain tekstin, joka on upotettu PDF:ään tekstikerroksena. Skannatuilla ja vain kuvia sisältävillä PDF-tiedostoilla ei ole tekstikerrosta, joten tekstiä ei pureta.
Tiedosto luetaan selaimen muistiin – mitään dataa ei poistu selaimestasi.
pdf.js lataa asiakirjan Web Workerissa ja kutsuu jokaiselle sivulle getTextContent()-funktiota upotetun tekstikerroksen hakemiseksi.
Kaikkien sivujen purettu teksti yhdistetään järjestyksessä ja tarjotaan ladattavana .txt-tiedostona.
Kaikki väliaikainen data vapautetaan muistista, kun lataus on valmis.
When to use this tool
Sopimusehtojen kopioiminen kiinteäasetteisesta PDF:stä tekstieditoriin tarkistamista tai vertailua varten.
Tutkimuspaperin PDF:n leipätekstin irrottaminen käännös- tai tiivistystyökaluun liittämistä varten.
Laskun rivikohtaisten tietojen poimiminen PDF:stä ensimmäiseksi vaiheeksi ennen taulukkolaskentaan tuontia.
Huom.: toimii vain upotetun tekstikerroksen sisältävissä PDF:issä — skannatut tai vain kuvia sisältävät PDF:t eivät sisällä poimittavaa tekstiä.
Frequently asked questions
Miten tämä eroaa muista online-PDF-työkaluista?
Useimmat online-PDF-työkalut lähettävät tiedostosi etäpalvelimelle käsiteltäväksi. Tämä työkalu käsittelee kaiken paikallisesti selaimessasi selainpuolen JavaScriptillä. Tiedostojasi ei koskaan lähetetä mihinkään palvelimelle, joten asiakirjojesi sisältö pysyy kokonaan sinun hallinnassasi.
Lähetetäänkö PDF-tiedostoni palvelimelle?
Ei. Tiedostosi luetaan suoraan selaimessasi. Tiedostojasi ei koskaan lähetetä verkon yli. Työkalu toimii kokonaan avaamassasi selainvälilehdessä.
Voinko varmistaa, ettei tiedostoja lähetetä?
Kyllä. Avaa selaimesi kehittäjätyökalut (F12), siirry Network-välilehdelle ja tarkkaile lähteviä pyyntöjä työkalua käyttäessäsi. Et näe minkään tiedostodatan poistuvan selaimestasi. Sivusto saattaa tallentaa anonyymin sivunäyttömäärän, joka ei koskaan sisällä tiedostojasi ja jonka voi poistaa käytöstä.
Toimiiko tämä työkalu offline-tilassa?
Kyllä, kun sivu on kerran latautunut, työkalu käsittelee tiedostosi kokonaan selaimessasi; työkalun toiminnallisuus ei tarvitse verkkoyhteyttä. Voit katkaista internetyhteyden ja jatkaa sen käyttöä.
Mitä tapahtuu, kun päivitän sivun?
Koska mitään ei tallenneta palvelimelle, sivun päivittäminen tyhjentää nykyisen istuntosi. Mahdolliset valitsemasi tiedostot on valittava uudelleen.
Tallentaako tämä työkalu tiedostoni?
Ei. Tiedostot säilyvät selaimen muistissa vain niin kauan kuin sivu on auki. Sivun sulkeminen tai päivittäminen hävittää ne. Työkalu ei kirjoita mitään levylle, eikä mitään lähetetä palvelimelle.
Voiko tämä työkalu avata salasanalla suojattuja PDF-tiedostoja?
Ei. Tämä työkalu ei yritä poistaa tai ohittaa PDF-tiedoston salasanasuojausta. Jos tiedät salasanan, tämän sivuston Avaa PDF -työkalu voi poistaa sen paikallisesti; sen jälkeen tämä työkalu voi käsitellä tiedoston.
Mitä tekniikoita tämä työkalu käyttää?
Tämä työkalu käyttää pdf.js:ää (Mozillan selainpuolen PDF-moottori) Web Workerissa kunkin PDF-sivun upotetun tekstikerroksen lukemiseen selaimessasi. Tiedostosi eivät koskaan poistu selaimestasi.
Käyttääkö tämä työkalu WebAssemblya?
Ei. pdf.js on tavallinen JavaScript-kirjasto – se ei käytä WebAssemblya. Kaikki PDF-tekstinpurku tapahtuu selainpuolen JavaScriptillä selaimessasi.
Miten poimin tekstin PDF:stäni?
Valitse PDF tiedostonvalitsimella ja paina sitten poimi-painiketta. Kunkin sivun teksti luetaan paikallisesti selaimessasi, näytetään esikatselulaatikossa, ja voit tallentaa sen .txt-tiedostona.
Miksi skannattu PDF:ni palautui ilman tekstiä?
Tämä työkalu lukee upotetun tekstikerroksen, jonka PDF tallentaa, ja skannatuissa tai pelkkiä kuvia sisältävissä asiakirjoissa ei ole tällaista kerrosta, joten mitään ei voida poimia. Kun näin käy, näet ilmoituksen eikä tekstitiedostoa tarjota, koska ilman OCR:ää ei ole merkkidataa palautettavaksi.
Miksi poimittu teksti ei vastaa sivun visuaalista asettelua?
Työkalu käy läpi pdf.js:n kullekin sivulle raportoimat tekstikohteet ja säilyttää niiden rivinvaihdot, mutta se ei muotoile palstoja uudelleen, joten monipalstaiset sivut, taulukot ja monimutkaiset asettelut eivät välttämättä asetu kohdalleen sen kanssa, mitä näet ruudulla. Sivut yhdistetään tyhjillä riveillä, ja PDF:t, joissa on epätavallisia tai mukautettuja fonttikoodauksia, voivat myös tuottaa sotkuisia merkkejä, vaikka sivu näyttäisi hyvältä.
Maksaako Extract Text from PDF mitään?
Extract Text from PDF on täysin ilmainen — ei tiliä, ei rekisteröitymistä eikä rajoituksia käsiteltyjen PDF-tiedostojen määrässä, eikä se muutu koskaan maksulliseksi. Selaimesi lukee PDF:n suoraan pdf.js-kirjaston avulla, joka poimii upotetun tekstikerroksen sivu kerrallaan ja palauttaa sinulle tavallisen .txt-tiedoston; itse tiedosto pysyy selaimen muistissa koko ajan eikä sitä lähetetä minnekään.