PDF เป็นรูปภาพ
เลือก DPI และรูปแบบเพื่อแยกได้สูงสุด 30 หน้า จากนั้นดาวน์โหลดหนึ่งภาพหรือ ZIP ตามลำดับแหล่งที่มา
แปลงหน้า PDF เป็น JPG/PNG/WebP ทำพื้นกระดาษให้ขาว ปรับภาพเอียงและมุมมอง ปกปิดข้อมูล แยกลายเซ็นหรือตราประทับ และสร้าง PDF ที่ค้นหาได้บนอุปกรณ์ของคุณ
เครื่องมือชุดเดียวครอบคลุมตั้งแต่แยกหน้า ทำความสะอาด แก้รูปทรง ปกป้องข้อมูล ทำ OCR ไปจนถึงจัดชุดไฟล์ผลลัพธ์
เริ่มจากเอาต์พุตที่ต้องการ อย่าเรียกใช้ OCR เมื่อรูปภาพหน้าเพียงพอ และตรวจสอบการแก้ไขไฟล์ที่ส่งออก แทนที่จะอาศัยเพียงการแสดงตัวอย่างเท่านั้น
เลือก DPI และรูปแบบเพื่อแยกได้สูงสุด 30 หน้า จากนั้นดาวน์โหลดหนึ่งภาพหรือ ZIP ตามลำดับแหล่งที่มา
ใช้ระดับสีเทา การกำหนดเกณฑ์ การลบพื้นหลังสีเทา การหมุน การแก้ไขเดสก์ และเปอร์สเปคทีฟ ก่อน OCR หรือการเก็บถาวร
ปิดข้อมูลที่มองเห็น รู้จำหนึ่งใน 12 ภาษาที่รองรับ และส่งออกข้อความ TSV หรือ PDF ที่ค้นหาได้
PDF.js เรนเดอร์เพจด้วย DPI ที่เลือก แทนที่จะจับภาพหน้าจอ
การกรองเอกสารแยกกระดาษออกจากหมึก แต่สามารถลบลายเส้นที่ละเอียดมากได้
มุมแหล่งที่มาสี่มุมถูกแมปกับรูปภาพสี่เหลี่ยมใหม่
การปกปิดจะสร้างไฟล์ภาพใหม่โดยปิดทับบริเวณที่เลือกไว้
โหมดลายเซ็นใช้ความมืด โหมดแสตมป์ระบุหมึกสีแดงที่โดดเด่นและสร้างอัลฟ่า
หน้า PDF จะถูกเรนเดอร์ก่อน จากนั้น OCR Worker ในเบราว์เซอร์จะอ่านข้อความจากแต่ละ Canvas
PDF/รูปภาพอ่านได้เฉพาะโดย PDF.js, Canvas และ OCR Worker บนอุปกรณ์ ไลบรารีและโมเดลจำนวนมากโหลดเฉพาะสำหรับเวิร์กโฟลว์ที่เลือกเท่านั้น
ไม่มี API ที่ส่งเอกสารไปยังเซิร์ฟเวอร์ Tool Office ผลลัพธ์จะถูกสร้างขึ้นเป็น Blobs ท้องถิ่น
การเรนเดอร์ การกรอง การครอบตัด การแก้ไข และ OCR เปิดเผยการแสดงตัวอย่าง/เอาท์พุตเพื่อให้ผู้ใช้ตรวจสอบ
สูงสุด 30 หน้า/รูปภาพ, 25 MB ต่อไฟล์ และขีดจำกัด Canvas ที่ใช้ร่วมกันช่วยลดความเสี่ยงที่แท็บจะขัดข้อง
ไม่ ไฟล์ได้รับการประมวลผลในเบราว์เซอร์ Tesseract อาจดาวน์โหลดโมเดลโค้ด/ภาษาจาก CDN แต่จะไม่ส่งรูปภาพของคุณไปยังบริการ OCR
ใช้ 150 DPI สำหรับการแสดงตัวอย่างแบบ light, 200 DPI สำหรับความสมดุล และ 300 DPI สำหรับการพิมพ์หรือ OCR ข้อความขนาดเล็ก DPI ที่สูงกว่าจะใช้หน่วยความจำมากขึ้นและสร้างไฟล์ที่ใหญ่ขึ้น
Deskew หมุนสองสามองศาเพื่อปรับระดับบรรทัดข้อความ การแก้ไขเปอร์สเปคทีฟจะจับคู่มุมทั้งสี่เพื่อทำให้รูปสี่เหลี่ยมคางหมูหรือหน้ามุมที่ถ่ายเรียบขึ้น
อย่าถือว่าการเบลอนั้นเพียงพอสำหรับข้อมูลที่ละเอียดอ่อน กล่องดำทึบแบบแรสเตอร์จะชัดเจนกว่า แต่ต้องเปิดใหม่และตรวจสอบไฟล์ที่ส่งออกเสมอ
ไม่ ความแม่นยำขึ้นอยู่กับความละเอียด แบบอักษร ส่วนเน้น แสง ความเอียง และคุณภาพการสแกน ตรวจสอบชื่อ ตัวเลข วันที่ และจำนวนเงินเสมอ
PDF.js แสดงผลแต่ละหน้าเป็น Canvas จากนั้น Tesseract Worker จะจดจำรูปภาพของหน้านั้น Tesseract.js ไม่ได้อ่าน PDF โดยตรง
จะรักษารูปภาพของหน้าและเพิ่มเลเยอร์ข้อความ OCR สำหรับการค้นหา/การเลือก เลเยอร์อาจมีข้อผิดพลาดในการจดจำเช่นเดียวกับข้อความ OCR
ไม่น่าเชื่อถือ PDF ที่เข้ารหัสอาจขอรหัสผ่านหรือไม่แสดงผล เครื่องมือนี้ไม่ถอดรหัสหรือลบรหัสผ่าน PDF