Taranmış Bir PDF'e Gizlilikle OCR Uygula — Metni Tarayıcınızda Tanı

Taranmış bir PDF ve bir dil seçin; her sayfa, Tesseract (WebAssembly'ye derlenmiş) tarafından yerel olarak işlenip tanınır ve tanınan metin gösterilip .txt dosyası olarak indirilebilir.

Quick answer

What it does
Taranmış bir PDF ve bir dil seçin; her sayfa, Tesseract (WebAssembly'ye derlenmiş) tarafından yerel olarak işlenip tanınır ve tanınan metin gösterilip .txt dosyası olarak indirilebilir.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Bir muhasebeci, yeniden yazmadan satır öğesi tutarlarını elektronik tabloya kopyalamak için taranmış faturaya OCR uygular.
Good to know
Bu sürümde İngilizce ve Geleneksel Çince desteklenir.

How it works

  1. Cihazınızdan taranmış bir PDF seçin ve belge dilini belirleyin.
  2. Dosya tarayıcı belleğine okunur — hiçbir veri tarayıcınızdan çıkmaz.
  3. pdf.js her sayfayı bir Web Worker içinde bir görüntüye işler.
  4. WebAssembly'ye derlenmiş ve bu siteden sunulan Tesseract OCR, her sayfanın metnini yerel olarak tanır; dil modeli de üçüncü taraf bir CDN'den değil, bu siteden yüklenir.
  5. Tanınan metin sayfa sayfa gösterilir ve bir .txt indirmesi olarak sunulur.

When to use this tool

  • Bir muhasebeci, yeniden yazmadan satır öğesi tutarlarını elektronik tabloya kopyalamak için taranmış faturaya OCR uygular.
  • Bir öğrenci, notlar için aranabilir, kopyalanabilir metin elde etmek amacıyla taranmış ders el ilanına OCR uygular.
  • Bir arşivci, dijital kütüphane için taranmış Geleneksel Çince belgeleri aranabilir metne dönüştürür.
  • OCR doğruluğu tarama kalitesine bağlıdır — bulanık, eğik veya düşük çözünürlüklü sayfalar hatalara yol açabilir; çıktıyı en iyi çabaya dayalı taslak olarak değerlendirin.

Frequently asked questions

Diğer çevrimiçi PDF araçlarından farkı nedir?
Çoğu çevrimiçi PDF aracı, dosyalarınızı işlemek için uzak bir sunucuya gönderir. Bu araç ise her şeyi istemci tarafı JavaScript ile tarayıcınızın içinde, yerel olarak işler. Dosyalarınız hiçbir sunucuya iletilmez; böylece belge içeriğiniz tamamen sizin denetiminizde kalır.
PDF dosyalarım sunucuya yükleniyor mu?
Hayır. Dosyalarınız doğrudan tarayıcınız tarafından okunur. Dosyalarınız ağ üzerinden hiçbir zaman iletilmez. Araç, tamamen açık olan tarayıcı sekmesinin içinde çalışır.
Dosyaların yüklenmediğini kendim doğrulayabilir miyim?
Evet. Tarayıcınızın geliştirici araçlarını (F12) açın, Network (Ağ) sekmesine geçin ve aracı kullanırken giden istekleri izleyin. Hiçbir dosya verisinin tarayıcınızdan çıkmadığını görürsünüz. Site, anonim bir sayfa görüntüleme sayısı kaydedebilir; bu sayım dosyalarınızı hiçbir zaman içermez ve devre dışı bırakılabilir.
Bu araç çevrimdışı çalışır mı?
Evet, sayfa bir kez yüklendikten sonra araç dosyalarınızı tamamen tarayıcınızda işler; araç işlevselliği için ağ bağlantısı gerekmez. İnternet bağlantınızı kesip kullanmaya devam edebilirsiniz.
Sayfayı yenilediğimde ne olur?
Sunucuda hiçbir şey saklanmadığı için sayfayı yenilemek geçerli oturumunuzu temizler. Seçtiğiniz dosyaları yeniden seçmeniz gerekir.
Bu araç dosyalarımı saklıyor mu?
Hayır. Dosyalar yalnızca sayfa açık kaldığı sürece tarayıcı belleğinde tutulur. Sayfayı kapatmak veya yenilemek bunları siler. Araç diske hiçbir şey yazmaz ve sunucuya hiçbir şey göndermez.
Bu araç parola korumalı PDF'lerin kilidini açabilir mi?
Hayır. Bu araç PDF parola korumasını kaldırmaya veya aşmaya çalışmaz. Parolayı biliyorsanız, bu sitedeki Kilit Açma (Unlock PDF) aracı parolayı yerel olarak kaldırabilir; ardından bu araç dosyayı işleyebilir.
Bu araç hangi teknolojileri kullanıyor?
Bu araç, sayfaları işlemek için pdf.js ve aynı kaynaklı bir Web Worker içinde çalışan, WebAssembly'ye derlenmiş Tesseract OCR motorunu (tesseract.js) kullanır — dosyalarınız tarayıcınızdan asla çıkmaz.
Bu araç WebAssembly kullanıyor mu?
Evet — bunu yapan az sayıdaki araçtan biri budur. Tesseract OCR motoru, WebAssembly'ye derlenmiş C++ kodudur ve tarayıcınızın içinde çalışır; .wasm ikili dosyası bu siteden sunulur ve hiçbir şey hiçbir yere gönderilmez.
İlk çalıştırma neden sonrakilerden daha yavaş?
İlk kullanımda tarayıcınız OCR motorunu ve dil modelini bu siteden (birkaç megabayt) indirir ve derler. Bunlar sonrasında önbelleğe alınır; bu yüzden sonraki çalıştırmalar çok daha hızlı başlar.
Burada taranmış bir PDF'e nasıl OCR uygularım?
Cihazınızdan taranmış bir PDF seçin, belge dilini seçin (İngilizce veya Geleneksel Çince), ardından Tanı'yı seçin. Her sayfa yerel olarak işlenir ve okunur; işlem bittiğinde metni önizleyebilir ve bir .txt dosyası olarak kaydedebilirsiniz.
Tanınan metin neden aranabilir bir PDF yerine yalnızca bir .txt dosyası?
Bu araç, tanınan kelimeleri PDF'in içine görünmez bir metin katmanı olarak geri yazmak yerine düz metin olarak çıkarır; böylece orijinal taranmış PDF'iniz değişmeden kalır. Kelimelere sayfanın içinde ihtiyacınız varsa, onları kaydedilen .txt dosyasından veya metni sayfa sayfa listeleyen ekrandaki önizlemeden kopyalarsınız.
Aynı belgede iki dil çalıştırabilir miyim ve yanlışını seçersem ne olur?
Tanımadan önce tüm belge için tek bir dil seçersiniz; bu yüzden İngilizce ile Geleneksel Çince'yi karıştıran bir dosya, hangisini seçtiyseniz onu tercih eder. Tanıma kalitesi taramanın kendisine de bağlıdır; bu yüzden eğri, düşük çözünürlüklü veya el yazısı sayfalar dilden bağımsız olarak genellikle kötü çıkar.
OCR PDF aracını kullanmak ücretli mi?
OCR PDF aracı tamamen ücretsizdir — hesap, kayıt ve çalıştırabileceğiniz taranmış PDF sayısı üzerinde herhangi bir sınır yoktur; her zaman da öyle olacaktır. Her sayfa, WebAssembly olarak derlenmiş Tesseract OCR motoru kullanılarak doğrudan tarayıcınızın içinde tanınır; bu sayede taranmış belgeleriniz — sözleşmeler, kimlikler veya tıbbi kayıtlar içerse bile — asla hiçbir yere gönderilmez.

Related tools

  • Metni Çıkar
  • Sözcük Sayımı
  • PDF'den Görüntülere
  • PDF'yi Sıkıştır
  • Hepsi bir arada PDF düzenleyici
  • Ana Sayfa
  • Hepsi bir arada PDF düzenleyici
  • PDF Birleştir
  • PDF Böl
  • PDF'yi Döndür
  • Filigran Ekle
  • Görüntülerden PDF
  • PDF'den Görüntülere
  • Sayfa Numaraları
  • PDF'yi Sıkıştır
  • Metni Çıkar
  • Meta Verileri Düzenle
  • Sayfaları Düzenle
  • Boş Sayfa Ekle
  • Sayfaları Çıkar
  • N-up (Yaprak Başına Sayfa)
  • PDF Gri Tonlama
  • PDF'yi Kırp
  • Sayfaları Tersine Çevir
  • Yeniden Boyutlandır (A4/Letter)
  • Üst ve Alt Bilgi Ekle
  • Formu Düzleştir
  • Her N Sayfada Böl
  • PDF Bilgisi ve Meta Veriler
  • Görüntü / İmza Damgala
  • Sayfaları Kaldır
  • Döşeli Filigran
  • Kitapçık
  • Sayfaları Çoğalt
  • Dosya Ekle
  • Yüzdeyle Ölçekle
  • Boş Sayfaları Kaldır
  • İç İçe Birleştir
  • Sayfa Kenarlığı Ekle
  • Tek / Çift Sayfaları Çıkar
  • PDF'den Uzun Görüntüye
  • Sayfaları İkiye Böl
  • Kenar Boşluğu Ekle
  • PDF İmzala
  • PDF'leri Karşılaştır
  • Poster Bölme
  • Sözcük Sayımı
  • PDF'yi Onar
  • PDF Formu Doldur
  • Yer İmlerine Göre Böl
  • Ara ve Vurgula
  • Görüntüleri Çıkar
  • PDF'yi Karart
  • OCR (Taramadan Metne)
  • PDF'yi Koru
  • PDF Kilidini Aç
  • Hakkımızda
  • Gizlilik Politikası
  • İletişim
  • Nasıl Çalışır
  • Yerel ve Çevrimiçi PDF Araçları
  • Çevrimiçi PDF Araçları Güvenli mi?