ส่งผลการค้นหาไปที่:
ไฟล์สแกนคือภาพถ่ายของหน้ากระดาษ เครื่องมือส่วนใหญ่ปล่อยไว้แบบนั้น คือรู้จำคำแล้วซ่อนไว้ในชั้นที่มองไม่เห็นใต้รูปภาพ ทำให้ค้นหาในไฟล์ได้แต่แก้อะไรไม่ได้ แอปนี้เลือกสร้างเอกสารขึ้นใหม่แทน คำและตำแหน่งของคำมาจากการรู้จำข้อความ ส่วนโครงสร้างของหน้า ทั้งหัวเรื่อง คอลัมน์ ตาราง และคำบรรยายภาพ ถูกหาแยกต่างหาก จากนั้นหน้าเอกสารจะถูกเขียนใหม่เป็นข้อความจริง ตารางจริง และรูปภาพจริงในไฟล์ Word (.docx)
เพราะโครงสร้างถูกหาก่อนจะวางข้อความ ตารางบนไฟล์สแกนจึงกลับมาเป็นตารางที่มีคอลัมน์ของตัวเอง ไม่ใช่กำแพงบรรทัดที่หลุดจากกัน แบบฟอร์มกลับมาพร้อมป้ายกำกับและค่าที่จัดเรียงเป็นคู่ เหมือนตอนที่พิมพ์ไว้ หัวเรื่องยังเป็นหัวเรื่อง และทุกหน้าของไฟล์สแกนยังเป็นหน้าของเอกสาร
ภาษาของเอกสารถูกอ่านจากตัวหน้าเอง ไฟล์สแกนภาษาเยอรมันหรืออิตาลีจึงไม่ต้องตั้งค่าด้วยมือ คำที่ระบบไม่มั่นใจจะถูกอ่านซ้ำจากไฟล์สแกนแทนการเดา ส่วนตัวเลขและรหัสต่าง ๆ จะไม่ถูกเขียนใหม่เด็ดขาด เมื่อไฟล์เสร็จ จะมีข้อความบรรทัดเดียวบอกว่าสร้างใหม่กี่หน้า แก้คำไปกี่คำ และเหลือคำที่ยังไม่แน่ใจกี่คำ
สิ่งที่คุณได้คือไฟล์ .docx ที่เปิดใน Word, Google Docs หรือ Pages และแก้ไขได้เหมือนเอกสารทั่วไป รูปภาพจากไฟล์สแกนถูกย้ายมาพร้อมข้อความแทนภาพ และหัวเรื่องถูกกำกับเป็นหัวเรื่อง โปรแกรมอ่านหน้าจอจึงอ่านเอกสารตามลำดับได้ ซึ่งไฟล์สแกนที่มีชั้นข้อความซ่อนอยู่ไม่เคยทำได้
มีข้อจำกัดที่ควรรู้ ข้อความถูกเขียนใหม่ด้วยฟอนต์มาตรฐานเพียงแบบเดียว หน้าที่สร้างใหม่จึงไม่ตรงกับไฟล์สแกนทุกตัวอักษร เลย์เอาต์ถูกรักษาไว้ แต่งานตัวอักษรไม่ ลายมือเขียนไม่ใช่สิ่งที่การรู้จำข้อความถูกสร้างมาเพื่อรองรับ บันทึกที่เขียนด้วยมืออาจกลับมาเป็นคำที่ผิดเพี้ยน ไฟล์สแกนที่จาง เอียง หรือความละเอียดต่ำ ทำให้ความแม่นยำลดลงในทุกขั้นตอน ควรตรวจผลลัพธ์ก่อนนำไปใช้จริง และเก็บไฟล์ต้นฉบับไว้
ถ้าคุณไม่ต้องแก้ไขอะไรและอยากให้หน้าตาเหมือนเดิมทุกพิกเซล เครื่องมือที่ถูกต้องคือ «PDF ค้นหาได้» ซึ่งเก็บรูปภาพไว้และวางชั้นข้อความที่มองไม่เห็นทับไว้ ส่วนเครื่องมือนี้แลกหน้าตาที่ตรงเป๊ะกับเอกสารที่คุณแก้ไขได้
ทุกอย่างทำงานในเบราว์เซอร์บนเซิร์ฟเวอร์ของเรา ไม่ต้องติดตั้ง ไม่ต้องสมัคร ไม่มี CAPTCHA สูงสุดครั้งละ 10 ไฟล์ ไฟล์ละ 10 MB ไฟล์ที่อัปโหลดและลิงก์ดาวน์โหลดจะถูกลบหลังผ่านไป 24 ชั่วโมง
ระบบรู้จำอักขระ (OCR) อ่านคำและตำแหน่งของคำ โครงสร้างของหน้าถูกหาแยกต่างหาก แล้วเอกสารจะถูกเขียนใหม่เป็นข้อความ ตาราง และรูปภาพจริงในไฟล์ .docx
ไฟล์จะถูกลบจากเซิร์ฟเวอร์ของเราหลังผ่านไป 24 ชั่วโมง และลิงก์ดาวน์โหลดจะใช้ไม่ได้อีก
ลาก PDF ที่สแกนมาวางในพื้นที่สีขาว หรือคลิกเพื่อเลือกไฟล์ แล้วกดแปลงไฟล์ เมื่อสร้างหน้าใหม่เสร็จ ให้ดาวน์โหลดไฟล์ .docx สูงสุดครั้งละ 10 ไฟล์ ไฟล์ละ 10 MB
เลย์เอาต์ถูกรักษาไว้ ทั้งหัวเรื่อง คอลัมน์ ตาราง และรูปภาพยังอยู่ที่เดิม แต่ข้อความถูกเขียนใหม่ด้วยฟอนต์มาตรฐานแบบเดียว จึงไม่ตรงกันทุกตัวอักษร ถ้าต้องการหน้าตาเหมือนเดิมทุกพิกเซล ให้ใช้ «PDF ค้นหาได้» ซึ่งเก็บรูปภาพไว้และเพิ่มชั้นข้อความที่มองไม่เห็น
OCR ถูกสร้างมาสำหรับตัวพิมพ์ บันทึกลายมือและลายเซ็นอาจกลับมาเป็นคำที่ผิดเพี้ยน จึงควรตรวจก่อนนำเอกสารไปใช้
ได้เอกสาร Word (.docx) หนึ่งไฟล์ต่อไฟล์ที่อัปโหลด โดยข้อความ ตาราง และรูปภาพจากไฟล์สแกนถูกสร้างใหม่เป็นวัตถุจริง
ไฟล์จะถูกลบจากเซิร์ฟเวอร์ของเราหลังผ่านไป 24 ชั่วโมง และลิงก์ดาวน์โหลดจะใช้ไม่ได้ ไม่มีใครอื่นเข้าถึงไฟล์ได้
ได้ ทุกอย่างประมวลผลบนเซิร์ฟเวอร์ของเรา จึงใช้เบราว์เซอร์สมัยใหม่ใดก็ได้ ทั้ง Chrome, Firefox, Safari หรือ Opera บนระบบปฏิบัติการใดก็ตาม