Espacio local de OCR
Extraer texto escaneado
Devuelve texto OCR sin reconstruir el documento.
- Procesamiento
- Solo en el navegador
- Cuenta
- No necesaria
- Límite actual
- PDF · 10 páginas · 60 MP · modelo inglés
- Resultado
- Archivo de texto OCR UTF-8
Sin subida de archivos, analítica, anuncios ni scripts externos en este espacio.
Espacio local en el navegador
Elegir archivos de origen
Ejecuta esta operación en el navegador y crea un archivo de resultado separado.
o elige archivos de este dispositivo
Espacio local en el navegador
Los archivos originales no se cambian ni se suben.Compatibilidad actual
Qué admite esta beta
Las páginas se rasterizan localmente y se reconocen con el modelo OCR inglés incluido.
| Característica de entrada | Comportamiento actual | Motivo |
|---|---|---|
| Páginas PDF | Rasterizadas y reconocidas | PDF.js renderiza cada página localmente antes de que la lea el worker OCR. |
| Texto inglés impreso | Reconocido | El modelo inglés incluido produce texto y posiciones de palabras. |
| Manuscrita, otros idiomas o diseño complejo | Requiere revisión | La precisión varía y no se selecciona ningún modelo de idioma silenciosamente. |
| Formularios, anotaciones y firmas | Rasterizados | La salida con búsqueda es un nuevo PDF basado en imágenes sin semántica interactiva. |
Antes de usar la herramienta
Preguntas y límites
¿Mi archivo sale de este dispositivo?
No. La herramienta no envía el contenido. El procesamiento activo se ejecuta en este navegador y pasa una prueba automatizada de salida de red.
¿PigPDF cambia el archivo original?
No. El original queda intacto y PigPDF crea un archivo de salida separado.
¿Qué límites actuales se aplican?
Un PDF de hasta 50 MB y 10 páginas. La salida UTF-8 procede del modelo inglés incluido y no es una transcripción ni un orden de lectura certificado.