Espacio local de texto incrustado
Extraer texto de PDF
Extrae texto incrustado de las páginas PDF elegidas.
- Procesamiento
- Solo en el navegador
- Cuenta
- No necesaria
- Límite actual
- Un PDF · 100 MB · 250 páginas
- Resultado
- Archivo de texto UTF-8
Sin subida de archivos, analítica, anuncios ni scripts externos en este espacio.
Extracción local de texto incrustado
Elige un PDF
PigPDF lee la capa de texto incrustada en el orden original y crea un archivo UTF-8 separado.
o elige un archivo de este dispositivo
Compatibilidad actual
Qué admite esta beta
PigPDF lee el flujo de texto incrustado sin OCR. La salida es texto plano, no una reconstrucción del diseño.
| Característica de entrada | Comportamiento actual | Motivo |
|---|---|---|
| Texto incrustado de página | Extraído | Las páginas elegidas se leen en orden original. |
| Escaneos solo con imágenes | Sin texto | OCR es una función separada y planificada. |
| Columnas y diseños complejos | Pueden cambiar | El orden del flujo PDF puede diferir del orden semántico de lectura. |
| Contraseña o daño | Rechazados | La beta no incluye contraseña ni reparación. |
Antes de usar la herramienta
Preguntas y límites
¿Mi archivo sale de este dispositivo?
No. La herramienta no envía el contenido. El procesamiento activo se ejecuta en este navegador y pasa una prueba automatizada de salida de red.
¿PigPDF cambia el archivo original?
No. El original queda intacto y PigPDF crea un archivo de salida separado.
¿Qué límites actuales se aplican?
Un PDF de hasta 100 MB y 250 páginas. Solo se extrae texto incrustado; los escaneos requieren OCR y el orden de lectura puede ser ambiguo.