Extraé todo lo que hay dentro de un PDF

Reconoce si tu documento es una lista de precios, un catálogo, una factura o un texto corrido, y te devuelve la información ordenada y lista para descargar.

100% en tu navegador Sin subir archivos Excel · CSV · JSON · Word Ilimitado
🧠

El modo más potente de la aplicación

El OCR no lee el PDF: lo mira. Dibuja cada página como imagen y reconoce los caracteres uno por uno, así que funciona justo donde los demás modos fallan: escaneos, fotos de documentos, PDFs bloqueados contra copia, fuentes rotas o texto que sale desordenado. Es más lento, pero si tu PDF es complicado o los otros modos te devolvieron algo sucio, pasalo por acá.

📎
Arrastrá tu PDF acá o hacé clic para elegirlo
Analiza la estructura del documento y extrae el contenido ordenado.
📕

Espacio publicitario

Cómo funciona

Tres pasos y ningún registro. Todo el trabajo pesado lo hace tu propio navegador.

1
Elegí qué querés extraer: texto inteligente, tablas, imágenes embebidas u OCR si el PDF es una foto o un escaneo.
2
Soltá el PDF. El analizador mide la posición, el tamaño y el peso de cada palabra para reconstruir la estructura real: títulos, columnas, categorías, códigos y precios.
3
Descargá el resultado en el formato que necesites: Excel, CSV, JSON, Word, Markdown o texto plano.

Entiende qué tipo de PDF le diste

No vuelca palabras sueltas: identifica el documento y adapta la salida a lo que ese documento es.

🏷️

Listas de precios

Separa código, descripción y precio de cada renglón, respeta las categorías y numera los productos en orden. Sale directo a Excel.

📚

Catálogos

Agrupa los bloques de cada producto: título, descripción, referencia y precio, aunque estén repartidos en varias líneas o en dos columnas.

🧾

Facturas y remitos

Reconoce los datos de cabecera (número, fecha, identificación fiscal, totales) y el detalle de ítems por separado.

📄

Documentos de texto

Detecta títulos por tamaño de fuente, arma los párrafos correctamente, une las palabras cortadas con guion y lee bien las páginas a dos columnas.

🧹

Limpieza automática

Elimina los encabezados y pies de página repetidos y los números de página sueltos que ensucian cualquier extracción.

⬇️

Seis formatos de salida

.xlsx, .csv, .json, .doc, .md y .txt. Elegís el que mejor le sirva a tu flujo de trabajo.

Espacio publicitario

Preguntas frecuentes

Lo que más nos consultan sobre la herramienta.

¿Se suben mis archivos a algún servidor?

No. Todo el procesamiento ocurre dentro de tu navegador usando JavaScript. Podés comprobarlo: desconectá internet después de cargar la página y la extracción sigue funcionando igual (la única excepción es el OCR, que descarga una vez el modelo de idioma).

¿Cómo sabe si es una lista de precios o un catálogo?

Analiza señales medibles del documento: qué proporción de renglones termina en un importe, si hay códigos de artículo al comienzo de línea, el largo promedio de las líneas, el tamaño y el peso tipográfico de cada bloque y la separación vertical entre ellos. Si se equivoca, podés forzar el tipo correcto desde el selector y se vuelve a procesar al instante.

¿Cuándo conviene usar el OCR?

Siempre que el PDF sea difícil: escaneos, fotos, documentos bloqueados contra copia, fuentes dañadas o cualquier archivo del que los otros modos devuelvan texto vacío o desordenado. El OCR trabaja sobre la imagen de la página, así que no depende de cómo esté construido el PDF por dentro.

¿Qué tan precisa es la extracción de precios?

Reconoce los formatos usados en América Latina y Europa (1.234,56) y en inglés (1,234.56), con o sin símbolo de moneda, y también renglones con dos importes, como precio de lista y precio con descuento. El importe se exporta a Excel como número real, no como texto, así podés sumar y filtrar sin convertir nada.

¿Hay límite de tamaño o de páginas?

No imponemos ninguno. El límite real es la memoria de tu dispositivo. Para documentos de cientos de páginas conviene usar el campo de rango de páginas y procesar por partes, sobre todo en el modo OCR, que es el más pesado.

¿Funciona en el celular?

Sí, en cualquier navegador moderno. Los modos de texto y tablas van fluidos; el OCR de muchas páginas puede tardar bastante más en un teléfono.

Privacidad

Esta herramienta no tiene servidor propio. No se guardan archivos, no se crean cuentas y no se registra el contenido de los documentos que procesás. El sitio se financia con publicidad: los proveedores de anuncios pueden usar cookies para mostrar avisos relevantes, y podés gestionar esas preferencias desde la configuración de tu navegador.