ทำ OCR กับ PDF ที่สแกนอย่างเป็นส่วนตัว — รู้จำข้อความในเบราว์เซอร์ของคุณ
เลือก PDF ที่สแกนและภาษา แต่ละหน้าจะถูกเรนเดอร์และรู้จำในเครื่องโดย Tesseract (คอมไพล์เป็น WebAssembly) และข้อความที่รู้จำได้จะถูกแสดงและดาวน์โหลดเป็นไฟล์ .txt ได้
Quick answer
What it does เลือก PDF ที่สแกนและภาษา แต่ละหน้าจะถูกเรนเดอร์และรู้จำในเครื่องโดย Tesseract (คอมไพล์เป็น WebAssembly) และข้อความที่รู้จำได้จะถูกแสดงและดาวน์โหลดเป็นไฟล์ .txt ได้
Free? Yes — 100% free, no account or sign-up.
Files uploaded? No — everything is processed in your browser.
Works offline? Yes — once the page has loaded.
Best for นักบัญชีรัน OCR ใบแจ้งหนี้ที่สแกนเพื่อคัดลอกจำนวนเงินรายการเข้าสเปรดชีตโดยไม่ต้องพิมพ์ใหม่
Good to know เวอร์ชันนี้รองรับภาษาอังกฤษและจีนตัวเต็ม
How it works
เลือก PDF ที่สแกนจากอุปกรณ์ของคุณและเลือกภาษาของเอกสาร
ไฟล์จะถูกอ่านเข้าหน่วยความจำของเบราว์เซอร์ — ไม่มีข้อมูลออกจากเบราว์เซอร์ของคุณ
pdf.js จะเรนเดอร์แต่ละหน้าเป็นรูปภาพใน Web Worker
Tesseract OCR — คอมไพล์เป็น WebAssembly และเสิร์ฟจากเว็บไซต์นี้ — จะรู้จำข้อความของแต่ละหน้าในเครื่อง โมเดลภาษาก็โหลดจากเว็บไซต์นี้เช่นกัน ไม่ใช่ CDN ของบุคคลที่สาม
ข้อความที่รู้จำได้จะถูกแสดงทีละหน้าและเสนอเป็นไฟล์ .txt ให้ดาวน์โหลด
When to use this tool
นักบัญชีรัน OCR ใบแจ้งหนี้ที่สแกนเพื่อคัดลอกจำนวนเงินรายการเข้าสเปรดชีตโดยไม่ต้องพิมพ์ใหม่
นักเรียนรัน OCR เอกสารแจกจ่ายที่สแกนเพื่อรับข้อความที่ค้นหาและคัดลอกได้สำหรับบันทึก
นักจดหมายเหตุแปลงเอกสารอักษรจีนดั้งเดิมที่สแกนเป็นข้อความที่ค้นหาได้สำหรับห้องสมุดดิจิทัล
ความแม่นยำของ OCR ขึ้นอยู่กับคุณภาพการสแกน — หน้าที่เบลอ เอียง หรือความละเอียดต่ำอาจเกิดข้อผิดพลาด ถือว่าผลลัพธ์เป็นร่างที่พยายามอย่างดีที่สุด
Frequently asked questions
เครื่องมือนี้ต่างจากเครื่องมือ PDF ออนไลน์อื่นอย่างไร
เครื่องมือ PDF ออนไลน์ส่วนใหญ่จะส่งไฟล์ของคุณไปประมวลผลที่เซิร์ฟเวอร์ระยะไกล แต่เครื่องมือนี้ประมวลผลทุกอย่างในเบราว์เซอร์ของคุณด้วย JavaScript ที่ทำงานฝั่งไคลเอนต์ ไฟล์ของคุณจะไม่ถูกส่งไปยังเซิร์ฟเวอร์ใด ๆ ซึ่งหมายความว่าเนื้อหาเอกสารยังคงอยู่ในการควบคุมของคุณทั้งหมด
ไฟล์ PDF ของฉันถูกอัปโหลดไหม
ไม่ เบราว์เซอร์ของคุณอ่านไฟล์โดยตรง ไฟล์ของคุณไม่เคยถูกส่งผ่านเครือข่าย เครื่องมือนี้ทำงานภายในแท็บเบราว์เซอร์ที่คุณเปิดอยู่ทั้งหมด
ฉันตรวจสอบได้ไหมว่าไฟล์ไม่ได้ถูกอัปโหลด
ได้ เปิดเครื่องมือสำหรับนักพัฒนาในเบราว์เซอร์ (F12) ไปที่แท็บ Network แล้วเฝ้าดูคำขอที่ส่งออกใด ๆ ระหว่างที่ใช้งานเครื่องมือ คุณจะเห็นว่าไม่มีข้อมูลไฟล์ออกจากเบราว์เซอร์ เว็บไซต์อาจบันทึกจำนวนการเข้าชมหน้าแบบไม่ระบุตัวตน ซึ่งไม่มีไฟล์ของคุณรวมอยู่ด้วยและสามารถปิดใช้งานได้
เครื่องมือนี้ใช้งานแบบออฟไลน์ได้ไหม
ได้ เมื่อหน้าเว็บโหลดเสร็จแล้ว เครื่องมือจะประมวลผลไฟล์ของคุณในเบราว์เซอร์ของคุณทั้งหมด การทำงานของเครื่องมือไม่จำเป็นต้องเชื่อมต่อเครือข่าย คุณสามารถตัดการเชื่อมต่ออินเทอร์เน็ตแล้วใช้งานต่อได้
เกิดอะไรขึ้นเมื่อฉันรีเฟรชหน้าเว็บ
เนื่องจากไม่มีการเก็บข้อมูลไว้บนเซิร์ฟเวอร์ การรีเฟรชหน้าเว็บจะล้างเซสชันปัจจุบันของคุณ ไฟล์ที่คุณเลือกไว้จะต้องเลือกใหม่อีกครั้ง
เครื่องมือนี้เก็บไฟล์ของฉันไว้ไหม
ไม่ ไฟล์จะถูกเก็บอยู่ในหน่วยความจำของเบราว์เซอร์เฉพาะตราบเท่าที่หน้าเว็บยังเปิดอยู่ การปิดหรือรีเฟรชหน้าจะลบไฟล์เหล่านั้นทิ้ง เครื่องมือไม่ได้เขียนอะไรลงดิสก์ และไม่มีการส่งสิ่งใดไปยังเซิร์ฟเวอร์
เครื่องมือนี้ปลดล็อกไฟล์ PDF ที่มีรหัสผ่านได้ไหม
ไม่ เครื่องมือนี้ไม่พยายามลบหรือข้ามการป้องกันด้วยรหัสผ่านของ PDF หากคุณทราบรหัสผ่าน เครื่องมือ Unlock PDF บนเว็บไซต์นี้สามารถลบรหัสผ่านได้ในเครื่องของคุณ จากนั้นเครื่องมือนี้จึงจะประมวลผลไฟล์ได้
เครื่องมือนี้ใช้เทคโนโลยีอะไร
เครื่องมือนี้ใช้ pdf.js เพื่อเรนเดอร์หน้า และเอนจิน Tesseract OCR ที่คอมไพล์เป็น WebAssembly (tesseract.js) ทำงานใน Web Worker แบบ same-origin — ไฟล์ของคุณไม่เคยออกจากเบราว์เซอร์
เครื่องมือนี้ใช้ WebAssembly ไหม
ใช่ — นี่เป็นหนึ่งในไม่กี่เครื่องมือที่นี่ที่ใช้ เอนจิน Tesseract OCR เป็น C++ ที่คอมไพล์เป็น WebAssembly และทำงานภายในเบราว์เซอร์ของคุณ ไฟล์ไบนารี .wasm เสิร์ฟจากเว็บไซต์นี้และไม่มีการส่งสิ่งใดไปที่ใด
ทำไมการใช้งานครั้งแรกจึงช้ากว่าครั้งต่อ ๆ ไป
ในการใช้งานครั้งแรก เบราว์เซอร์ของคุณจะดาวน์โหลดเอนจิน OCR และโมเดลภาษาจากเว็บไซต์นี้ (ไม่กี่เมกะไบต์) และคอมไพล์ จากนั้นจะถูกแคชไว้ ครั้งต่อ ๆ ไปจึงเริ่มทำงานเร็วขึ้นมาก
ฉันจะทำ OCR ไฟล์ PDF ที่สแกนมาที่นี่ได้อย่างไร
เลือกไฟล์ PDF ที่สแกนมาจากอุปกรณ์ของคุณ เลือกภาษาของเอกสาร (อังกฤษหรือจีนตัวเต็ม) แล้วเลือกรู้จำข้อความ แต่ละหน้าจะถูกเรนเดอร์และอ่านในเครื่อง และเมื่อเสร็จแล้วคุณสามารถดูตัวอย่างข้อความและบันทึกเป็นไฟล์ .txt ได้
ทำไมข้อความที่รู้จำได้จึงเป็นเพียงไฟล์ .txt แทนที่จะเป็น PDF ที่ค้นหาได้
เครื่องมือนี้ส่งออกคำที่รู้จำได้เป็นข้อความธรรมดาแทนที่จะเขียนชั้นข้อความที่มองไม่เห็นกลับเข้าไปใน PDF ดังนั้น PDF ที่สแกนมาต้นฉบับของคุณจึงยังคงไม่เปลี่ยนแปลง หากคุณต้องการให้คำอยู่ภายในหน้า คุณต้องคัดลอกจากไฟล์ .txt ที่บันทึกไว้หรือจากภาพตัวอย่างบนหน้าจอ ซึ่งแสดงข้อความทีละหน้า
ฉันรันสองภาษาในเอกสารเดียวกันได้ไหม และถ้าฉันเลือกผิดจะเป็นอย่างไร
คุณจะเลือกภาษาเดียวสำหรับทั้งเอกสารก่อนรู้จำข้อความ ดังนั้นไฟล์ที่ผสมภาษาอังกฤษและจีนตัวเต็มจะให้น้ำหนักกับภาษาที่คุณเลือกไว้ คุณภาพการรู้จำยังขึ้นอยู่กับตัวสแกนเอง ดังนั้นหน้าที่เอียง ความละเอียดต่ำ หรือเขียนด้วยลายมือมักจะออกมาไม่ดีไม่ว่าจะเป็นภาษาใดก็ตาม
เครื่องมือ OCR PDF ใช้งานฟรีหรือไม่?
เครื่องมือ OCR PDF ฟรีโดยสมบูรณ์ — ไม่ต้องสร้างบัญชี ไม่ต้องลงทะเบียน และไม่จำกัดจำนวน PDF ที่สแกนที่คุณประมวลผล และจะเป็นเช่นนี้ตลอดไป ทุกหน้าถูกรู้จำภายในเบราว์เซอร์ของคุณโดยใช้ Tesseract OCR engine ที่คอมไพล์เป็น WebAssembly เอกสารที่สแกนของคุณ — ไม่ว่าจะเป็นสัญญา บัตรประชาชน หรือบันทึกทางการแพทย์ — จึงไม่เคยถูกส่งไปที่ใดเลย
Related tools