OCR naskenovaného PDF soukromě — rozpoznejte text ve svém prohlížeči

Vyberte naskenované PDF a jazyk; každá stránka se vykreslí a rozpozná lokálně pomocí Tesseract (zkompilovaného do WebAssembly) a rozpoznaný text se zobrazí a lze jej stáhnout jako soubor .txt.

Quick answer

What it does
Vyberte naskenované PDF a jazyk; každá stránka se vykreslí a rozpozná lokálně pomocí Tesseract (zkompilovaného do WebAssembly) a rozpoznaný text se zobrazí a lze jej stáhnout jako soubor .txt.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Účetní provede OCR na naskenované faktuře pro kopírování částek řádkových položek do tabulkového procesoru bez přepisování.
Good to know
V této verzi jsou podporovány angličtina a tradiční čínština.

How it works

  1. Vyberte naskenované PDF ze svého zařízení a zvolte jazyk dokumentu.
  2. Soubor se načte do paměti prohlížeče — žádná data neopouštějí váš prohlížeč.
  3. pdf.js vykreslí každou stránku do obrázku ve Web Workeru.
  4. Tesseract OCR — zkompilovaný do WebAssembly a poskytovaný z tohoto webu — rozpozná text každé stránky lokálně; jazykový model se rovněž načítá z tohoto webu, nikoli z CDN třetí strany.
  5. Rozpoznaný text se zobrazí pro každou stránku a nabídne se ke stažení jako .txt.

When to use this tool

  • Účetní provede OCR na naskenované faktuře pro kopírování částek řádkových položek do tabulkového procesoru bez přepisování.
  • Student provede OCR na naskenovaném materiálu z kurzu pro získání prohledávatelného, kopírovatelného textu pro své poznámky.
  • Archivář převede naskenované dokumenty v tradiční čínštině do prohledávatelného textu pro digitální knihovnu.
  • Přesnost OCR závisí na kvalitě skenování – rozmazané, zkosené nebo nízkorozlišovací stránky mohou způsobovat chyby; považujte výstup za nejlepší možný návrh.

Frequently asked questions

Čím se to liší od jiných online PDF nástrojů?
Většina online PDF nástrojů posílá vaše soubory ke zpracování na vzdálený server. Tento nástroj zpracovává vše lokálně ve vašem prohlížeči pomocí JavaScriptu na straně klienta. Vaše soubory se nikdy nepřenášejí na žádný server, takže obsah dokumentů zůstává plně pod vaší kontrolou.
Nahrávají se moje PDF soubory?
Ne. Vaše soubory čte přímo váš prohlížeč. Vaše soubory se po síti nikdy nepřenášejí. Nástroj pracuje výhradně v otevřené záložce prohlížeče.
Mohu si ověřit, že se soubory nenahrávají?
Ano. Otevřete vývojářské nástroje prohlížeče (F12), přejděte na záložku Network a sledujte případné odchozí požadavky během práce s nástrojem. Uvidíte, že váš prohlížeč neopouštějí žádná data souborů. Web může zaznamenávat anonymní počet zobrazení stránky, který nikdy nezahrnuje vaše soubory a lze jej zakázat.
Funguje tento nástroj offline?
Ano, jakmile se stránka načte, nástroj zpracovává vaše soubory zcela ve vašem prohlížeči; funkce nástroje nepotřebuje síťové připojení. Můžete se odpojit od internetu a dál jej používat.
Co se stane, když stránku obnovím?
Protože se na serveru nic neukládá, obnovení stránky vymaže vaši aktuální relaci. Soubory, které jste měli vybrané, bude nutné vybrat znovu.
Ukládá tento nástroj moje soubory?
Ne. Soubory jsou drženy v paměti prohlížeče jen po dobu, kdy je stránka otevřená. Zavřením nebo obnovením stránky se zahodí. Nástroj nic nezapisuje na disk a nic neodesílá na server.
Umí tento nástroj odemknout heslem chráněná PDF?
Ne. Tento nástroj se nepokouší odstranit ani obejít ochranu PDF heslem. Pokud heslo znáte, nástroj Odemknout PDF na tomto webu jej dokáže odstranit lokálně; poté může tento nástroj soubor zpracovat.
Jaké technologie tento nástroj využívá?
Tento nástroj používá pdf.js k vykreslení stránek a OCR jádro Tesseract zkompilované do WebAssembly (tesseract.js) běžící ve Web Workeru se stejným původem — vaše soubory nikdy neopustí váš prohlížeč.
Používá tento nástroj WebAssembly?
Ano — je to jeden z mála zdejších nástrojů, který jej používá. OCR jádro Tesseract je C++ zkompilované do WebAssembly a běží uvnitř vašeho prohlížeče; binární soubor .wasm se poskytuje z tohoto webu a nic se nikam neodesílá.
Proč je první spuštění pomalejší než následující?
Při prvním použití váš prohlížeč stáhne OCR jádro a jazykový model z tohoto webu (několik megabajtů) a zkompiluje je. Poté se uloží do mezipaměti, takže pozdější spuštění začínají mnohem rychleji.
Jak zde provedu OCR naskenovaného PDF?
Vyberte naskenované PDF ze svého zařízení, zvolte jazyk dokumentu (angličtina nebo tradiční čínština) a poté zvolte Rozpoznat. Každá stránka se vykreslí a přečte lokálně, a jakmile je hotovo, můžete si text prohlédnout a uložit jej jako .txt soubor.
Proč je rozpoznaný text jen .txt soubor místo prohledávatelného PDF?
Tento nástroj vypisuje rozpoznaná slova jako prostý text, místo aby zpět do PDF zapisoval neviditelnou textovou vrstvu, takže vaše původní naskenované PDF zůstává nezměněno. Pokud potřebujete mít slova uvnitř stránky, zkopírovali byste je z uloženého .txt souboru nebo z náhledu na obrazovce, který text vypisuje stránku po stránce.
Mohu v jednom dokumentu použít dva jazyky, a co když vyberu špatný?
Před rozpoznáváním vybíráte pro celý dokument jediný jazyk, takže soubor kombinující angličtinu a tradiční čínštinu bude upřednostňovat ten, který jste zvolili. Kvalita rozpoznávání závisí také na samotném skenu, takže šikmé, málo rozlišené nebo ručně psané stránky bývají rozpoznány špatně bez ohledu na jazyk.
Je nástroj OCR PDF zdarma?
Nástroj OCR PDF je zcela zdarma — bez účtu, bez registrace a bez omezení počtu naskenovaných PDF, které zpracujete, a vždy tak bude. Každá stránka je rozpoznána přímo ve vašem prohlížeči pomocí engine Tesseract OCR zkompilovaného do WebAssembly, takže vaše naskenované dokumenty — ať obsahují smlouvy, průkazy totožnosti, nebo zdravotní záznamy — nejsou nikdy nikam odesílány.

Related tools

  • Extrahovat text
  • Počet slov
  • PDF do obrázků
  • Komprimovat PDF
  • Univerzální editor PDF
  • Domů
  • Univerzální editor PDF
  • Sloučit PDF
  • Rozdělit PDF
  • Otočit PDF
  • Přidat vodoznak
  • Obrázky do PDF
  • PDF do obrázků
  • Čísla stránek
  • Komprimovat PDF
  • Extrahovat text
  • Upravit metadata
  • Uspořádat stránky
  • Vložit prázdné stránky
  • Extrahovat stránky
  • N-up (stránek na list)
  • PDF do stupňů šedi
  • Oříznout PDF
  • Obrátit stránky
  • Změnit velikost (A4/Letter)
  • Přidat záhlaví a zápatí
  • Sloučit formulář
  • Rozdělit po N stránkách
  • Informace a metadata PDF
  • Vyrazit obrázek / podpis
  • Odstranit stránky
  • Dlaždicový vodoznak
  • Brožura
  • Duplikovat stránky
  • Připojit soubor
  • Změnit měřítko v procentech
  • Odstranit prázdné stránky
  • Prokládané sloučení
  • Přidat okraj stránky
  • Extrahovat liché / sudé stránky
  • PDF do dlouhého obrázku
  • Rozdělit stránky napůl
  • Přidat okraje
  • Podepsat PDF
  • Porovnat PDF
  • Rozdělení na plakát
  • Počet slov
  • Opravit PDF
  • Vyplnit PDF formulář
  • Rozdělit podle záložek
  • Hledat a zvýraznit
  • Extrahovat obrázky
  • Redigovat PDF
  • OCR (naskenované do textu)
  • Chránit PDF
  • Odemknout PDF
  • O nás
  • Zásady ochrany osobních údajů
  • Kontakt
  • Jak to funguje
  • Místní vs. online nástroje pro PDF
  • Jsou online nástroje pro PDF bezpečné?