PDF การแยกข้อความ

ใช้ PDF runtime ในเครื่องที่มีอยู่เพื่อแยกเลเยอร์ข้อความ PDF สามารถดูและค้นหาตามหน้า และส่งออกเป็นข้อความหรือ JSON ได้

ประมวลผลภายในเครื่องผ่านเบราว์เซอร์
หน้านี้ผ่านการตรวจสอบไดเรกทอรีสาธารณะแล้ว; เมื่อเปิดใช้JavaScript จะใช้ฟังก์ชันครบถ้วนได้
คู่มือการใช้งาน

วิธีใช้ PDF การแยกข้อความ

การแยกข้อความ PDF จะประมวลผลข้อมูลที่ป้อนในเบราว์เซอร์ปัจจุบันเท่านั้น โดยจะไม่อัปโหลด เชื่อมต่อเครือข่าย หรือบันทึกข้อมูลผู้ใช้

  1. ป้อนเนื้อหา

    เลือก PDF ในเครื่อง แล้วระบุช่วงหมายเลขหน้าหรือคำค้นหา

  2. เลือกวิธีดำเนินการ

    อ่านเลเยอร์ข้อความของ PDF และแสดงแยกตามหน้า โดยไม่ใช้ OCR

  3. ตรวจสอบและส่งออก

    คัดลอกหรือดาวน์โหลด TXT/JSON หลังจากตรวจสอบหมายเลขหน้าและลำดับข้อความแล้ว

ข้อจำกัดและข้อควรระวัง

  • จะไม่มีการรู้จำอัตโนมัติเมื่อเอกสารสแกนและหน้าที่เป็นรูปภาพไม่มีเลเยอร์ข้อความ
  • การเข้ารหัสแบบอักษร ลำดับการอ่าน และเค้าโครงที่ซับซ้อนอาจส่งผลต่อลำดับข้อความ ควรตรวจสอบเนื้อหาสำคัญทีละหน้า
  • เครื่องมือนี้ให้เฉพาะผลการประมวลผลเบื้องต้นภายในเครื่องเท่านั้น ส่วนการกำหนดค่าที่สำคัญ คีย์ เอกสาร และเนื้อหาที่เผยแพร่ยังคงต้องตรวจสอบในสภาพแวดล้อมเป้าหมาย

คำถามที่พบบ่อย

อินพุตจะถูกอัปโหลดไปยังเซิร์ฟเวอร์หรือไม่?

ไม่ หน้าเว็บใช้เฉพาะหน่วยความจำของเบราว์เซอร์ ไฟล์ในเครื่อง API และทรัพยากรภายในเครื่องที่มีให้พร้อมกับเว็บไซต์เท่านั้น

ทำไมการสแกน PDF จึงดึงข้อความออกมาไม่ได้

เครื่องมือนี้อ่านเฉพาะเลเยอร์ข้อความ ไม่ดำเนินการ OCR ส่วนเอกสารสแกนต้องใช้กระบวนการ OCR แยกต่างหาก

เหตุใดผลลัพธ์จึงยังต้องตรวจสอบด้วยตนเอง

ไวยากรณ์ในกรณีขอบเขต ข้อกำหนดเฉพาะภูมิภาค โปรแกรมอ่านของบุคคลที่สาม และสภาพแวดล้อมเป้าหมายที่ใช้ทำงานอาจแตกต่างกัน เครื่องมือนี้ไม่สามารถทดแทนการตรวจสอบขั้นสุดท้ายได้

ข้อเสนอแนะของหน้าพบปัญหาหรือมีข้อเสนอแนะในการปรับปรุงหรือไม่?
ฟังก์ชันข้อเสนอแนะจำเป็นต้องใช้งานในเวอร์ชันออนไลน์

โปรดเปิดใช้ JavaScript ในเวอร์ชันออนไลน์แล้วส่ง; ฟังก์ชันในเครื่องของเครื่องมือหรือกรณีใช้งานปัจจุบันไม่ได้รับผลกระทบ

ไปยังรุ่นออนไลน์เพื่อส่งความคิดเห็น