PDF a imagen
Elige DPI y formato para extraer hasta 30 páginas; descarga una imagen o un ZIP en el orden original.
Renderiza páginas PDF como JPG/PNG/WEBP, elimina el gris del papel, endereza, corrige perspectiva, oculta datos, extrae firmas/sellos y crea PDF buscables en tu dispositivo.
Un único motor cubre el ciclo del escaneo: extracción, limpieza, corrección geométrica, privacidad, OCR y empaquetado de resultados, sin páginas distintas para cada filtro o idioma.
Empieza por el resultado que necesitas. No ejecutes OCR si bastan imágenes de las páginas y comprueba la ocultación en el archivo exportado, no solo en la vista previa.
Elige DPI y formato para extraer hasta 30 páginas; descarga una imagen o un ZIP en el orden original.
Usa escala de grises, umbral, eliminación del fondo gris, rotación, enderezado y perspectiva antes del OCR o archivo.
Oculta datos visibles, reconoce uno de 12 idiomas compatibles y exporta texto, TSV básico o PDF buscable.
PDF.js renderiza las páginas con los DPI elegidos en lugar de hacer capturas de pantalla.
El filtro de documentos separa el papel de la tinta, pero puede eliminar trazos muy finos.
Las cuatro esquinas de origen se transforman en una nueva imagen rectangular.
La ocultación crea un archivo rasterizado nuevo con la zona seleccionada cubierta.
El modo firma detecta oscuridad; el modo sello identifica tinta roja dominante y crea transparencia.
Primero se renderizan las páginas del PDF y después un Worker local reconoce cada Canvas.
PDF.js, Canvas y un Worker de OCR leen los PDF/imágenes en el dispositivo; las bibliotecas y modelos pesados solo se cargan para el flujo elegido.
Ninguna API envía documentos a los servidores de Tool Office; los resultados se crean como Blobs locales.
Renderizado, filtros, recorte, ocultación y OCR ofrecen vistas previas y salidas que puedes revisar.
Un máximo de 30 páginas/imágenes, 25 MB por archivo y límites de Canvas compartidos reducen el riesgo de bloquear la pestaña.
No. Los archivos se procesan en el navegador. Tesseract puede descargar código y modelos de idioma desde un CDN, pero no envía tus imágenes a ningún servicio de OCR.
Usa 150 DPI para vistas previas ligeras, 200 DPI como equilibrio y 300 DPI para impresión u OCR de texto pequeño. Más DPI consumen más memoria y crean archivos mayores.
El enderezado gira unos grados para nivelar las líneas. La perspectiva transforma cuatro esquinas para aplanar una página fotografiada en ángulo o con forma trapezoidal.
No des por hecho que basta para información sensible. Un rectángulo negro rasterizado es más claro, pero siempre debes volver a abrir y comprobar el archivo exportado.
No. La precisión depende de resolución, fuente, tildes, iluminación, inclinación y calidad del escaneo. Revisa nombres, números, fechas e importes.
PDF.js renderiza cada página en Canvas y un Worker de Tesseract reconoce después la imagen. Tesseract.js no lee PDF directamente.
Conserva la imagen de la página y añade una capa OCR que permite buscar o seleccionar texto. Esa capa puede contener los mismos errores del reconocimiento.
No de forma fiable. Un PDF cifrado puede pedir contraseña o no renderizarse; la herramienta no descifra ni elimina contraseñas.