mousePDF · การรู้จำข้อความใน PDF (OCR)
pdf ocr · การรู้จำข้อความ · ไม่ต้องอัปโหลด

การรู้จำข้อความใน PDF (OCR) — โดยไม่ต้องอัปโหลด

วางชั้นข้อความที่มองไม่เห็นและค้นหาได้ทับหน้า PDF ที่สแกนมาหรือเป็นรูปภาพ การรู้จำทำงานในเบราว์เซอร์ของคุณทั้งหมด ไฟล์ของคุณจะไม่ถูกอัปโหลดเลย

✓ ไม่มีการอัปโหลดใด ๆ ✓ ฟรีทั้งหมด ✓ ไม่ต้องมีบัญชี
โฆษณา
ภาพหน้าจอของโปรแกรมแก้ไข mousePDF
วิธีใช้งาน

ใน 3 ขั้นตอน

01

เปิด PDF

ลาก PDF ที่สแกนมาหรือเป็นรูปภาพมาวางในหน้าต่าง หรือเลือกไฟล์

02

เลือกภาษาและขอบเขต

กำหนดภาษาที่ต้องการรู้จำ และเลือกว่าจะรู้จำเฉพาะหน้าปัจจุบันหรือทั้งเอกสาร

03

ส่งออกไฟล์

บันทึก PDF ที่มีชั้นข้อความที่ค้นหาได้และมองไม่เห็น — ภาพของหน้าจะยังคงเหมือนเดิมทุกประการ

กรณีที่พบบ่อย: ทำให้เอกสารที่สแกนมาค้นหาได้

สัญญา ใบแจ้งหนี้ หรือหนังสือที่สแกนมามักมีแค่ภาพของหน้า ไม่มีข้อความจริง — ค้นหาหรือคัดลอกข้อความในนั้นไม่ได้ mousePDF รู้จำข้อความในเบราว์เซอร์และวางไว้แบบมองไม่เห็นทับภาพ ทำให้การค้นหาและคัดลอกใช้งานได้ โดยที่รูปลักษณ์ของหน้าไม่เปลี่ยนแปลงเลย

โฆษณา

การรู้จำข้อความในเบราว์เซอร์ — และสิ่งที่พิเศษ

OCR เป็นหนึ่งในงานที่ปกติแทบจะหลีกเลี่ยงการอัปโหลดไม่ได้: การรู้จำต้องใช้โมเดลภาษา ซึ่งโดยทั่วไปจะอยู่บนเซิร์ฟเวอร์ แต่ที่นี่ทำงานในเบราว์เซอร์ของคุณ สิ่งที่โหลดมามีเพียงโมเดลเท่านั้น ไม่ใช่ไฟล์ของคุณ

สิ่งนี้สำคัญมากสำหรับเอกสารที่มักถูกสแกน: สัญญา สลิปเงินเดือน จดหมายจากแพทย์ สำเนาบัตรประชาชน ภาพสแกนคือรูปภาพ — และก่อนที่มันจะค้นหาได้ ต้องมีบางอย่างอ่านมันก่อน สิ่งที่ต่างออกไปจริง ๆ คือสิ่งนั้นทำงานอยู่บนอุปกรณ์ของคุณเองในเบราว์เซอร์ของคุณ

มี28 ภาษาให้เลือกใช้สำหรับ OCR โมเดลของภาษาที่เลือกจะถูกโหลดก็ต่อเมื่อเริ่มใช้งานจริงเท่านั้น — หน้าเว็บจึงยังคงเบา และคุณโหลดเฉพาะสิ่งที่ต้องใช้

ขีดจำกัดของการรู้จำข้อความ

ตัวอักษรที่ไม่ใช่ละตินไม่รวมอยู่ในนี้โดยตั้งใจ ไม่มีซีริลลิก ไม่มีจีน ญี่ปุ่น หรือเกาหลี ไม่มีอาหรับ ฮีบรู เทวนาครี หรือไทย โมเดลสำหรับตัวอักษรเหล่านี้มีขนาดใหญ่กว่ามากและมีอัตราความแม่นยำต่ำกว่าอย่างเห็นได้ชัด — ผลลัพธ์ที่ต้องแก้ไขทีละตัวอักษรไม่ช่วยใครเลย กรีกรวมอยู่ในรายการเพราะไม่ได้อยู่ในระดับปัญหาเดียวกันในแง่นี้

การรู้จำไม่มีทางไร้ข้อผิดพลาดโดยสิ้นเชิง มันอ่านย้อนกลับจากพิกเซลว่าครั้งหนึ่งเคยเป็นข้อความอะไร ภาพสแกนที่สะอาดและวางแนวตรงจะให้ผลลัพธ์ที่ดีมาก ส่วนภาพถ่ายมือถือที่เอียงในแสงไม่ดี ลายมือที่อ่านยาก หรือฟอนต์ประดับที่แปลกจะให้ผลลัพธ์ที่แย่กว่าอย่างชัดเจน ผู้ที่นำข้อความไปใช้ต่อควรตรวจทานอีกครั้ง — กฎนี้ใช้กับ OCR ทุกเวอร์ชัน ไม่ใช่แค่ที่นี่

รูปลักษณ์ของหน้าไม่เปลี่ยนแปลง ข้อความที่รู้จำได้จะถูกวางเป็นชั้นที่มองไม่เห็นทับภาพ: คุณยังคงเห็นภาพสแกนของคุณ แต่สามารถค้นหาและไฮไลต์ในนั้นได้ ข้อผิดพลาดในการรู้จำจึงไม่ปรากฏในภาพ — จะเห็นได้ก็ต่อเมื่อคุณคัดลอกข้อความออกมา

OCR ยังมีประโยชน์หลังจากบีบอัด PDFด้วย: เพราะขั้นตอนนั้นจะเปลี่ยนหน้าเป็นรูปภาพและทำให้สูญเสียชั้นข้อความไป — การรู้จำข้อความจะสร้างชั้นนั้นขึ้นมาใหม่

คำถามที่พบบ่อย

คำถามที่พบบ่อย

เอกสารของฉันจะถูกอัปโหลดเพื่อรู้จำข้อความหรือไม่? +

ไม่ การรู้จำทำงานในเบราว์เซอร์ทั้งหมดผ่านเอนจิน OCR ที่โหลดไว้ในเครื่อง — ไฟล์จะไม่ออกจากอุปกรณ์ของคุณเลย

รองรับภาษาอะไรบ้าง? +

ภาษายุโรปจำนวนมากที่ใช้ตัวอักษรละตินหรือกรีก ตัวอักษรอย่างจีน อาหรับ ซีริลลิก หรือเทวนาครี ยังไม่รองรับสำหรับ OCR ในขณะนี้ (รวมถึงไทยด้วย)

การรู้จำใช้เวลานานแค่ไหน? +

ขึ้นอยู่กับจำนวนหน้าและประสิทธิภาพของอุปกรณ์ ตั้งแต่ไม่กี่วินาทีจนถึงไม่กี่นาที

การรู้จำข้อความเปลี่ยนรูปลักษณ์ของหน้าหรือไม่? +

ไม่เปลี่ยน ภาพของหน้าจะยังคงเดิมทุกประการ ชั้นข้อความที่รู้จำได้จะอยู่ทับแบบมองไม่เห็น — ทำให้แค่การค้นหาและคัดลอกใช้งานได้

การรู้จำแม่นยำแค่ไหนกับเอกสารที่สแกนมาไม่ดีหรือลายมือ? +

การรู้จำทำงานได้ดีที่สุดกับข้อความที่พิมพ์ชัดเจนและอ่านง่าย สำหรับบันทึกลายมือหรือภาพสแกนที่มีสัญญาณรบกวนมาก ความแม่นยำจะลดลง — ตัวอักษรบางตัวอาจถูกอ่านผิดหรือหายไป

รองรับภาษาอะไรบ้าง? +

28 ภาษา ทั้งหมดใช้ตัวอักษรละตินบวกกับภาษากรีก ตัวอักษรที่ไม่ใช่ละติน เช่น ซีริลลิก จีน อาหรับ ฮีบรู หรือไทย ยังไม่รวมอยู่ในนี้โดยตั้งใจ — เพราะอัตราความแม่นยำจะแย่กว่าอย่างชัดเจน

การรู้จำแม่นยำแค่ไหน? +

แม่นยำมากสำหรับภาพสแกนที่สะอาดและตรง แต่แย่ลงอย่างเห็นได้ชัดสำหรับภาพถ่ายมือถือที่เอียง แสงไม่ดี หรือลายมือ ผู้ที่นำข้อความไปใช้ต่อควรตรวจทานอีกครั้ง

เอกสารของฉันจะดูต่างไปหลังการรู้จำข้อความไหม? +

ไม่ ข้อความที่รู้จำได้จะมาเป็นชั้นที่มองไม่เห็นทับภาพ — หน้าตายังเหมือนเดิม แต่ค้นหาได้แล้ว

เครื่องมืออื่น ๆ

อาจเป็นประโยชน์ด้วย

บีบอัด PDF

ลดขนาด PDF ที่มีรูปภาพจำนวนมากอย่างเห็นได้ชัด — โดยหน้าต่าง ๆ จะถูกแปลงเป็นรูปภาพ

แปลง PDF เป็น PDF/A

แปลงเป็นรูปแบบ PDF/A ที่เหมาะสำหรับการเก็บถาวร — สำหรับหน่วยงานราชการและการจัดเก็บระยะยาว

แปลง PDF เป็น Word

ส่งออกข้อความ PDF เป็นไฟล์ Word ที่แก้ไขได้ — ไม่ต้องอัปโหลด

แก้ไขข้อความใน PDF

คลิกข้อความที่มีอยู่ใน PDF แล้วแทนที่ด้วยข้อความใหม่

โฆษณา

เปิดโปรแกรมแก้ไข →