โหลด PDF
การดึงข้อความเท่านั้น—การสแกนเฉพาะรูปภาพจะไม่สร้างข้อความ
โหมดการสกัด
ผลลัพธ์
หมายเหตุ
- PDF ที่สแกนโดยไม่มีข้อความฝังจะต้องใช้ OCR (ไม่รวมอยู่ที่นี่)
- โหมดย่อหน้าจะลบการลงท้ายบรรทัดเพื่อให้นำข้อความกลับมาใช้ใหม่ได้ง่ายขึ้น
- ใช้ช่วงหน้าเพื่อแยกเฉพาะส่วนที่คุณต้องการ
ดึงข้อความจาก PDF ที่มีเลเยอร์ข้อความอยู่แล้ว
เครื่องมือนี้อ่านข้อความที่เลือกได้ซึ่งฝังอยู่ใน PDF มีไว้สำหรับรายงาน สัญญา แบบฟอร์ม และเอกสารที่คุณสามารถเลือกหรือคัดลอกข้อความในโปรแกรมดู PDF ได้แล้ว
ไม่รวม OCR
หาก PDF เป็นไฟล์สแกนหรือภาพถ่ายเท่านั้น ให้รัน OCR ก่อน จากนั้นดึงข้อความที่รู้จัก เพจที่มีแต่รูปภาพเท่านั้นอาจให้ผลลัพธ์เพียงเล็กน้อยหรือไม่มีเลยที่นี่
เลือกเอาต์พุตแบบรวมหรือต่อหน้า
- รวมข้อความ: ดีที่สุดสำหรับการคัดลอก ค้นหา บันทึก และแก้ไขอย่างรวดเร็วในไฟล์ TXT ไฟล์เดียวที่ต่อเนื่องกัน
- ข้อความแยกตามหน้า: ดีกว่าสำหรับการทบทวน การอ้างอิง การอ้างอิงหน้า และการเปรียบเทียบส่วนต่างๆ กับ PDF ดั้งเดิม
ความคาดหวังของเค้าโครง
การดึงข้อความ PDF จะรักษาเลเยอร์ข้อความที่อ่านได้ ไม่ใช่เค้าโครงภาพที่แน่นอน คอลัมน์ ตาราง ส่วนหัว ส่วนท้าย และข้อความที่จัดตำแหน่งอาจจำเป็นต้องล้างข้อมูลด้วยตนเองหลังจากส่งออก
ดูเพิ่มเติม
คำถามที่พบบ่อย
เครื่องมือนี้ทำงาน OCR หรือไม่
ไม่ มันจะดึงข้อความที่ฝังอยู่ใน PDF แล้ว หากหน้าต่างๆ เป็นรูปภาพที่สแกน ให้ใช้เครื่องมือ OCR ก่อน
ฉันสามารถดึงข้อความโดยแยกหน้าได้หรือไม่
ใช้โหมดหน้าเมื่อการอ้างอิง การอ้างอิงหน้า หรือบันทึกการทบทวนมีความสำคัญ ใช้เอาต์พุตที่รวมเมื่อคุณต้องการหนึ่งบล็อกต่อเนื่องสำหรับการแก้ไขหรือค้นหา
เหตุใดการเรียงลำดับข้อความจึงแตกต่างจากเค้าโครงหน้า
ข้อความ PDF จะจัดเก็บตำแหน่งที่มองเห็น ไม่ใช่ย่อหน้าเสมอไป โหมดย่อหน้าจะลบตัวแบ่งบรรทัดจำนวนมาก แต่เค้าโครง ตาราง และคอลัมน์ที่ซับซ้อนอาจยังต้องล้างข้อมูลด้วยตนเอง
ฉันสามารถแยกเฉพาะหน้าที่เลือกได้หรือไม่?
ใช่. ป้อนช่วงหน้า เช่น 1-3,5 ก่อนแยกออก เพื่อให้เบราว์เซอร์อ่านเฉพาะหน้าที่คุณต้องการ
มีการอัปโหลดไฟล์ PDF ของฉันหรือไม่
ไม่ การดึงข้อความทำงานในเบราว์เซอร์ของคุณ ไฟล์จะไม่ถูกอัปโหลดไปยังเซิร์ฟเวอร์ในขณะที่คุณใช้เครื่องมือ