วิธีแปลงรูปถ่ายเป็น PDF ที่ค้นหาได้
- เพิ่มรูปภาพของคุณ. ลากรูป JPG, PNG หรือ WebP มาวางบนเครื่องมือ หรือแตะเพื่อเลือกไฟล์ แต่ละหน้าจะปรากฏเป็นการ์ด — ลากที่จุดจับเพื่อจัดลำดับใหม่ หรือลบหน้าที่ไม่ต้องการออก
- เลือกภาษา. เลือกภาษาที่เอกสารของคุณเขียนไว้ ข้อมูลสำหรับรู้จำภาษานั้นจะดาวน์โหลดครั้งเดียว (ขนาดไฟล์แสดงอยู่ข้างตัวเลือก) — รูปภาพของคุณยังคงไม่ออกจากอุปกรณ์เลย
- รู้จำข้อความ. กด Recognize text แล้วดูการ์ดแต่ละหน้าเปลี่ยนสถานะจากรอไปจนถึงเสร็จ พร้อมจำนวนคำแบบเรียลไทม์ คุณยกเลิกระหว่างทำงานได้ โดยไม่มีการเก็บข้อมูลใดไว้
- ตรวจสอบและดาวน์โหลด. ข้อความที่รู้จำได้จะแสดงทีละหน้า ให้คุณตรวจสอบก่อนนำไปใช้จริง ตั้งชื่อไฟล์ผลลัพธ์ แล้วดาวน์โหลด PDF ที่ค้นหาได้ เก็บไฟล์ .txt ธรรมดา หรือคัดลอกข้อความทั้งหมดไปยังคลิปบอร์ด
เครื่องมือนี้ทำอะไรได้บ้าง
- OCR จริงในเบราว์เซอร์ของคุณ — ไฟล์ไม่ถูกอัปโหลดไปที่ไหนเลย
- รวมรูปถ่ายหลายรูปเป็น PDF หลายหน้าไฟล์เดียว ตามลำดับที่คุณเลือก
- ชั้นข้อความที่มองไม่เห็น: PDF หน้าตาเหมือนรูปถ่ายของคุณ แต่ค้นหาและคัดลอกได้
- รองรับ 15 ภาษาในการรู้จำข้อความ ดาวน์โหลดตามที่ใช้งาน
- ส่งออกข้อความที่รู้จำได้เป็นไฟล์ .txt ธรรมดาด้วย
PDF ที่ค้นหาได้คืออะไรกันแน่
รูปถ่ายใบเสร็จเป็นแค่พิกเซล — คุณค้นหาไม่ได้ เลือกยอดรวมไม่ได้ หรือคัดลอกชื่อร้านค้าไม่ได้ PDF ที่ค้นหาได้จะเพิ่มชั้นที่สองซึ่งมองไม่เห็นทับบนภาพ นั่นคือข้อความที่รู้จำได้ วางอยู่ในตำแหน่งเดียวกับที่ปรากฏในรูป หน้าเอกสารยังคงหน้าตาเหมือนรูปถ่ายของคุณทุกประการ แต่ตอนนี้ Preview, Adobe Reader, Spotlight และระบบจัดการเอกสารทุกตัวอ่านมันได้แล้ว
เครื่องมือนี้สร้างไฟล์ดังกล่าวในเบราว์เซอร์ของคุณ โดยถอดรหัสรูปภาพ รันเอนจินรู้จำข้อความโอเพนซอร์สอย่าง Tesseract ที่คอมไพล์เป็น WebAssembly แล้วประกอบเป็น PDF ด้วย pdf-lib — ทั้งหมดเกิดขึ้นในหน้าเว็บที่คุณกำลังดูอยู่นี้เอง ไม่มีอะไรถูกส่งออกไปไหน นั่นคือประเด็นสำคัญ: ใบเสร็จ สัญญา จดหมายทางการแพทย์ และเอกสารประจำตัว คือไฟล์ประเภทที่คุณไม่ควรส่งให้เว็บไซต์แปลงไฟล์แปลกหน้าเพื่อแลกกับ OCR ฟรี
ควรใช้เมื่อไหร่
- รูปถ่ายเอกสารกระดาษที่คุณอยากค้นหาเจอในภายหลัง — ใบเสร็จ ใบรับประกัน จดหมาย แบบฟอร์ม
- เอกสารที่สแกนออกมาเป็นรูปภาพธรรมดา
- สิ่งใดก็ตามที่คุณไม่อยากวางลงในเว็บไซต์ของคนแปลกหน้า
ทำไมตำแหน่งในชั้นข้อความจึงสำคัญ
คำที่รู้จำได้ไม่ได้ถูกแนบต่อท้ายไฟล์เฉยๆ — แต่ละคำถูกวางแบบมองไม่เห็นไว้ที่พิกัดตำแหน่งเดียวกับที่ปรากฏในรูปถ่าย นี่คือสิ่งที่ทำให้การเลือกข้อความรู้สึกเป็นธรรมชาติ: ลากผ่านรูปภาพแล้วไฮไลต์จะตามแนวบรรทัดที่พิมพ์ไว้ ค้นหาคำแล้วตัวแสดงผลจะกระโดดไปยังจุดที่ถูกต้องบนหน้า ตำแหน่งอาจไม่แม่นยำเป๊ะ เหมือนกับไฟล์ที่ผลิตจากเครื่องสแกนสำนักงาน และนั่นก็เพียงพอสำหรับการค้นหาและคัดลอก
ข้อจำกัดที่ต้องบอกตรงๆ
OCR บนอุปกรณ์ช้ากว่าฟาร์มเซิร์ฟเวอร์ และมันอ่านตัวพิมพ์ ไม่ใช่ลายมือ ข้อความที่เล็กมากหรือเบลอมากอาจอ่านผิดพลาด — การส่งออกเป็น .txt ช่วยให้ตรวจสอบได้ง่าย รูปภาพจะถูกลดขนาดลงเหลือประมาณ 2,500 พิกเซลด้านยาวเพื่อความเร็วในการรู้จำข้อความ ส่วนรูปภาพที่ฝังในหน้าเอกสารยังคงความละเอียดสูงสุด 4,000 พิกเซล ซึ่งพิมพ์ออกมาได้คมชัดในขนาดกระดาษ letter
ถ้าคุณต้องทำแบบนี้บ่อยๆ
เครื่องมือนี้เป็นตัวแปลงไฟล์แบบครั้งเดียว ถ้าม้วนฟิล์มกล้องของคุณคือที่ที่เอกสารหายไป นั่นคือปัญหาที่ Paperlock เกิดมาเพื่อแก้: มันสแกน อ่าน และจัดเก็บเอกสารของคุณบน iPhone — ด้วยกฎเดียวกันคือไม่มีอะไรออกจากอุปกรณ์ของคุณโดยไม่เข้ารหัส