ทำ OCR กับ PDF ที่สแกนอย่างเป็นส่วนตัว — รู้จำข้อความในเบราว์เซอร์ของคุณ

เลือก PDF ที่สแกนและภาษา แต่ละหน้าจะถูกเรนเดอร์และรู้จำในเครื่องโดย Tesseract (คอมไพล์เป็น WebAssembly) และข้อความที่รู้จำได้จะถูกแสดงและดาวน์โหลดเป็นไฟล์ .txt ได้

Quick answer

What it does
เลือก PDF ที่สแกนและภาษา แต่ละหน้าจะถูกเรนเดอร์และรู้จำในเครื่องโดย Tesseract (คอมไพล์เป็น WebAssembly) และข้อความที่รู้จำได้จะถูกแสดงและดาวน์โหลดเป็นไฟล์ .txt ได้
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
นักบัญชีรัน OCR ใบแจ้งหนี้ที่สแกนเพื่อคัดลอกจำนวนเงินรายการเข้าสเปรดชีตโดยไม่ต้องพิมพ์ใหม่
Good to know
เวอร์ชันนี้รองรับภาษาอังกฤษและจีนตัวเต็ม

How it works

  1. เลือก PDF ที่สแกนจากอุปกรณ์ของคุณและเลือกภาษาของเอกสาร
  2. ไฟล์จะถูกอ่านเข้าหน่วยความจำของเบราว์เซอร์ — ไม่มีข้อมูลออกจากเบราว์เซอร์ของคุณ
  3. pdf.js จะเรนเดอร์แต่ละหน้าเป็นรูปภาพใน Web Worker
  4. Tesseract OCR — คอมไพล์เป็น WebAssembly และเสิร์ฟจากเว็บไซต์นี้ — จะรู้จำข้อความของแต่ละหน้าในเครื่อง โมเดลภาษาก็โหลดจากเว็บไซต์นี้เช่นกัน ไม่ใช่ CDN ของบุคคลที่สาม
  5. ข้อความที่รู้จำได้จะถูกแสดงทีละหน้าและเสนอเป็นไฟล์ .txt ให้ดาวน์โหลด

When to use this tool

  • นักบัญชีรัน OCR ใบแจ้งหนี้ที่สแกนเพื่อคัดลอกจำนวนเงินรายการเข้าสเปรดชีตโดยไม่ต้องพิมพ์ใหม่
  • นักเรียนรัน OCR เอกสารแจกจ่ายที่สแกนเพื่อรับข้อความที่ค้นหาและคัดลอกได้สำหรับบันทึก
  • นักจดหมายเหตุแปลงเอกสารอักษรจีนดั้งเดิมที่สแกนเป็นข้อความที่ค้นหาได้สำหรับห้องสมุดดิจิทัล
  • ความแม่นยำของ OCR ขึ้นอยู่กับคุณภาพการสแกน — หน้าที่เบลอ เอียง หรือความละเอียดต่ำอาจเกิดข้อผิดพลาด ถือว่าผลลัพธ์เป็นร่างที่พยายามอย่างดีที่สุด

Frequently asked questions

เครื่องมือนี้ต่างจากเครื่องมือ PDF ออนไลน์อื่นอย่างไร
เครื่องมือ PDF ออนไลน์ส่วนใหญ่จะส่งไฟล์ของคุณไปประมวลผลที่เซิร์ฟเวอร์ระยะไกล แต่เครื่องมือนี้ประมวลผลทุกอย่างในเบราว์เซอร์ของคุณด้วย JavaScript ที่ทำงานฝั่งไคลเอนต์ ไฟล์ของคุณจะไม่ถูกส่งไปยังเซิร์ฟเวอร์ใด ๆ ซึ่งหมายความว่าเนื้อหาเอกสารยังคงอยู่ในการควบคุมของคุณทั้งหมด
ไฟล์ PDF ของฉันถูกอัปโหลดไหม
ไม่ เบราว์เซอร์ของคุณอ่านไฟล์โดยตรง ไฟล์ของคุณไม่เคยถูกส่งผ่านเครือข่าย เครื่องมือนี้ทำงานภายในแท็บเบราว์เซอร์ที่คุณเปิดอยู่ทั้งหมด
ฉันตรวจสอบได้ไหมว่าไฟล์ไม่ได้ถูกอัปโหลด
ได้ เปิดเครื่องมือสำหรับนักพัฒนาในเบราว์เซอร์ (F12) ไปที่แท็บ Network แล้วเฝ้าดูคำขอที่ส่งออกใด ๆ ระหว่างที่ใช้งานเครื่องมือ คุณจะเห็นว่าไม่มีข้อมูลไฟล์ออกจากเบราว์เซอร์ เว็บไซต์อาจบันทึกจำนวนการเข้าชมหน้าแบบไม่ระบุตัวตน ซึ่งไม่มีไฟล์ของคุณรวมอยู่ด้วยและสามารถปิดใช้งานได้
เครื่องมือนี้ใช้งานแบบออฟไลน์ได้ไหม
ได้ เมื่อหน้าเว็บโหลดเสร็จแล้ว เครื่องมือจะประมวลผลไฟล์ของคุณในเบราว์เซอร์ของคุณทั้งหมด การทำงานของเครื่องมือไม่จำเป็นต้องเชื่อมต่อเครือข่าย คุณสามารถตัดการเชื่อมต่ออินเทอร์เน็ตแล้วใช้งานต่อได้
เกิดอะไรขึ้นเมื่อฉันรีเฟรชหน้าเว็บ
เนื่องจากไม่มีการเก็บข้อมูลไว้บนเซิร์ฟเวอร์ การรีเฟรชหน้าเว็บจะล้างเซสชันปัจจุบันของคุณ ไฟล์ที่คุณเลือกไว้จะต้องเลือกใหม่อีกครั้ง
เครื่องมือนี้เก็บไฟล์ของฉันไว้ไหม
ไม่ ไฟล์จะถูกเก็บอยู่ในหน่วยความจำของเบราว์เซอร์เฉพาะตราบเท่าที่หน้าเว็บยังเปิดอยู่ การปิดหรือรีเฟรชหน้าจะลบไฟล์เหล่านั้นทิ้ง เครื่องมือไม่ได้เขียนอะไรลงดิสก์ และไม่มีการส่งสิ่งใดไปยังเซิร์ฟเวอร์
เครื่องมือนี้ปลดล็อกไฟล์ PDF ที่มีรหัสผ่านได้ไหม
ไม่ เครื่องมือนี้ไม่พยายามลบหรือข้ามการป้องกันด้วยรหัสผ่านของ PDF หากคุณทราบรหัสผ่าน เครื่องมือ Unlock PDF บนเว็บไซต์นี้สามารถลบรหัสผ่านได้ในเครื่องของคุณ จากนั้นเครื่องมือนี้จึงจะประมวลผลไฟล์ได้
เครื่องมือนี้ใช้เทคโนโลยีอะไร
เครื่องมือนี้ใช้ pdf.js เพื่อเรนเดอร์หน้า และเอนจิน Tesseract OCR ที่คอมไพล์เป็น WebAssembly (tesseract.js) ทำงานใน Web Worker แบบ same-origin — ไฟล์ของคุณไม่เคยออกจากเบราว์เซอร์
เครื่องมือนี้ใช้ WebAssembly ไหม
ใช่ — นี่เป็นหนึ่งในไม่กี่เครื่องมือที่นี่ที่ใช้ เอนจิน Tesseract OCR เป็น C++ ที่คอมไพล์เป็น WebAssembly และทำงานภายในเบราว์เซอร์ของคุณ ไฟล์ไบนารี .wasm เสิร์ฟจากเว็บไซต์นี้และไม่มีการส่งสิ่งใดไปที่ใด
ทำไมการใช้งานครั้งแรกจึงช้ากว่าครั้งต่อ ๆ ไป
ในการใช้งานครั้งแรก เบราว์เซอร์ของคุณจะดาวน์โหลดเอนจิน OCR และโมเดลภาษาจากเว็บไซต์นี้ (ไม่กี่เมกะไบต์) และคอมไพล์ จากนั้นจะถูกแคชไว้ ครั้งต่อ ๆ ไปจึงเริ่มทำงานเร็วขึ้นมาก
ฉันจะทำ OCR ไฟล์ PDF ที่สแกนมาที่นี่ได้อย่างไร
เลือกไฟล์ PDF ที่สแกนมาจากอุปกรณ์ของคุณ เลือกภาษาของเอกสาร (อังกฤษหรือจีนตัวเต็ม) แล้วเลือกรู้จำข้อความ แต่ละหน้าจะถูกเรนเดอร์และอ่านในเครื่อง และเมื่อเสร็จแล้วคุณสามารถดูตัวอย่างข้อความและบันทึกเป็นไฟล์ .txt ได้
ทำไมข้อความที่รู้จำได้จึงเป็นเพียงไฟล์ .txt แทนที่จะเป็น PDF ที่ค้นหาได้
เครื่องมือนี้ส่งออกคำที่รู้จำได้เป็นข้อความธรรมดาแทนที่จะเขียนชั้นข้อความที่มองไม่เห็นกลับเข้าไปใน PDF ดังนั้น PDF ที่สแกนมาต้นฉบับของคุณจึงยังคงไม่เปลี่ยนแปลง หากคุณต้องการให้คำอยู่ภายในหน้า คุณต้องคัดลอกจากไฟล์ .txt ที่บันทึกไว้หรือจากภาพตัวอย่างบนหน้าจอ ซึ่งแสดงข้อความทีละหน้า
ฉันรันสองภาษาในเอกสารเดียวกันได้ไหม และถ้าฉันเลือกผิดจะเป็นอย่างไร
คุณจะเลือกภาษาเดียวสำหรับทั้งเอกสารก่อนรู้จำข้อความ ดังนั้นไฟล์ที่ผสมภาษาอังกฤษและจีนตัวเต็มจะให้น้ำหนักกับภาษาที่คุณเลือกไว้ คุณภาพการรู้จำยังขึ้นอยู่กับตัวสแกนเอง ดังนั้นหน้าที่เอียง ความละเอียดต่ำ หรือเขียนด้วยลายมือมักจะออกมาไม่ดีไม่ว่าจะเป็นภาษาใดก็ตาม
เครื่องมือ OCR PDF ใช้งานฟรีหรือไม่?
เครื่องมือ OCR PDF ฟรีโดยสมบูรณ์ — ไม่ต้องสร้างบัญชี ไม่ต้องลงทะเบียน และไม่จำกัดจำนวน PDF ที่สแกนที่คุณประมวลผล และจะเป็นเช่นนี้ตลอดไป ทุกหน้าถูกรู้จำภายในเบราว์เซอร์ของคุณโดยใช้ Tesseract OCR engine ที่คอมไพล์เป็น WebAssembly เอกสารที่สแกนของคุณ — ไม่ว่าจะเป็นสัญญา บัตรประชาชน หรือบันทึกทางการแพทย์ — จึงไม่เคยถูกส่งไปที่ใดเลย

Related tools

  • ดึงข้อความ
  • นับคำ
  • PDF เป็นรูปภาพ
  • บีบอัด PDF
  • ตัวแก้ไข PDF ครบวงจร
  • หน้าแรก
  • ตัวแก้ไข PDF ครบวงจร
  • รวม PDF
  • แยก PDF
  • หมุน PDF
  • เพิ่มลายน้ำ
  • รูปภาพเป็น PDF
  • PDF เป็นรูปภาพ
  • หมายเลขหน้า
  • บีบอัด PDF
  • ดึงข้อความ
  • แก้ไขข้อมูลเมตา
  • จัดระเบียบหน้า
  • แทรกหน้าว่าง
  • ดึงหน้า
  • N-up (หน้าต่อแผ่น)
  • PDF โทนสีเทา
  • ครอบตัด PDF
  • กลับลำดับหน้า
  • ปรับขนาด (A4/Letter)
  • เพิ่มหัวกระดาษและท้ายกระดาษ
  • รวมเลเยอร์ฟอร์ม
  • แยกทุก N หน้า
  • ข้อมูล PDF และข้อมูลเมตา
  • ประทับรูปภาพ / ลายเซ็น
  • ลบหน้า
  • ลายน้ำแบบเรียงต่อ
  • หนังสือเล่มเล็ก
  • ทำซ้ำหน้า
  • แนบไฟล์
  • ปรับขนาดตามเปอร์เซ็นต์
  • ลบหน้าว่าง
  • รวมแบบสลับหน้า
  • เพิ่มเส้นขอบหน้า
  • ดึงหน้าคี่ / คู่
  • PDF เป็นภาพยาว
  • แยกหน้าครึ่งหน้า
  • เพิ่มขอบกระดาษ
  • เซ็น PDF
  • เปรียบเทียบ PDF
  • ตัดเป็นโปสเตอร์
  • นับคำ
  • ซ่อม PDF
  • กรอกฟอร์ม PDF
  • แยกตามบุ๊กมาร์ก
  • ค้นหาและไฮไลต์
  • ดึงรูปภาพ
  • ปกปิดข้อมูล PDF
  • OCR (สแกนเป็นข้อความ)
  • ป้องกัน PDF
  • ปลดล็อก PDF
  • เกี่ยวกับเรา
  • นโยบายความเป็นส่วนตัว
  • ติดต่อเรา
  • วิธีการทำงาน
  • เครื่องมือ PDF แบบโลคอลกับออนไลน์
  • เครื่องมือ PDF ออนไลน์ปลอดภัยหรือไม่?