PDF การแยกข้อความ
ใช้ PDF runtime ในเครื่องที่มีอยู่เพื่อแยกเลเยอร์ข้อความ PDF สามารถดูและค้นหาตามหน้า และส่งออกเป็นข้อความหรือ JSON ได้
วิธีใช้ PDF การแยกข้อความ
การแยกข้อความ PDF จะประมวลผลข้อมูลที่ป้อนในเบราว์เซอร์ปัจจุบันเท่านั้น โดยจะไม่อัปโหลด เชื่อมต่อเครือข่าย หรือบันทึกข้อมูลผู้ใช้
ป้อนเนื้อหา
เลือก PDF ในเครื่อง แล้วระบุช่วงหมายเลขหน้าหรือคำค้นหา
เลือกวิธีดำเนินการ
อ่านเลเยอร์ข้อความของ PDF และแสดงแยกตามหน้า โดยไม่ใช้ OCR
ตรวจสอบและส่งออก
คัดลอกหรือดาวน์โหลด TXT/JSON หลังจากตรวจสอบหมายเลขหน้าและลำดับข้อความแล้ว
ข้อจำกัดและข้อควรระวัง
- จะไม่มีการรู้จำอัตโนมัติเมื่อเอกสารสแกนและหน้าที่เป็นรูปภาพไม่มีเลเยอร์ข้อความ
- การเข้ารหัสแบบอักษร ลำดับการอ่าน และเค้าโครงที่ซับซ้อนอาจส่งผลต่อลำดับข้อความ ควรตรวจสอบเนื้อหาสำคัญทีละหน้า
- เครื่องมือนี้ให้เฉพาะผลการประมวลผลเบื้องต้นภายในเครื่องเท่านั้น ส่วนการกำหนดค่าที่สำคัญ คีย์ เอกสาร และเนื้อหาที่เผยแพร่ยังคงต้องตรวจสอบในสภาพแวดล้อมเป้าหมาย
คำถามที่พบบ่อย
อินพุตจะถูกอัปโหลดไปยังเซิร์ฟเวอร์หรือไม่?
ไม่ หน้าเว็บใช้เฉพาะหน่วยความจำของเบราว์เซอร์ ไฟล์ในเครื่อง API และทรัพยากรภายในเครื่องที่มีให้พร้อมกับเว็บไซต์เท่านั้น
ทำไมการสแกน PDF จึงดึงข้อความออกมาไม่ได้
เครื่องมือนี้อ่านเฉพาะเลเยอร์ข้อความ ไม่ดำเนินการ OCR ส่วนเอกสารสแกนต้องใช้กระบวนการ OCR แยกต่างหาก
เหตุใดผลลัพธ์จึงยังต้องตรวจสอบด้วยตนเอง
ไวยากรณ์ในกรณีขอบเขต ข้อกำหนดเฉพาะภูมิภาค โปรแกรมอ่านของบุคคลที่สาม และสภาพแวดล้อมเป้าหมายที่ใช้ทำงานอาจแตกต่างกัน เครื่องมือนี้ไม่สามารถทดแทนการตรวจสอบขั้นสุดท้ายได้