Espacio local de OCR
Extraer texto escaneado
Devuelve texto OCR sin reconstruir el documento.
- Procesamiento
- Solo en el navegador
- Cuenta
- No necesaria
- Límite actual
- PDF · 10 páginas · 60 MP · modelo inglés
- Resultado
- Archivo de texto OCR UTF-8
Sin subida de archivos, anuncios ni scripts externos en este espacio. La analítica pública no recibe bytes del documento.
Espacio local en el navegador
Elegir archivos de origen
Ejecuta esta operación en el navegador y crea un archivo de resultado separado.
o elige archivos de este dispositivo
Espacio local en el navegador
Los archivos originales no se cambian ni se suben.Compatibilidad actual
Qué admite esta beta
Las páginas se rasterizan localmente y se reconocen con el modelo OCR inglés incluido.
| Característica de entrada | Comportamiento actual | Motivo |
|---|---|---|
| Páginas PDF | Rasterizadas y reconocidas | PDF.js renderiza cada página localmente antes de que la lea el worker OCR. |
| Texto inglés impreso | Reconocido | El modelo inglés incluido produce texto y posiciones de palabras. |
| Manuscrita, otros idiomas o diseño complejo | Requiere revisión | La precisión varía y no se selecciona ningún modelo de idioma silenciosamente. |
| Formularios, anotaciones y firmas | Rasterizados | La salida con búsqueda es un nuevo PDF basado en imágenes sin semántica interactiva. |
Antes de usar la herramienta
Preguntas y límites
¿Mi archivo sale de este dispositivo?
No. La herramienta no envía el contenido. El procesamiento activo se ejecuta en este navegador y pasa una prueba automatizada de salida de red.
¿PigPDF cambia el archivo original?
No. El original queda intacto y PigPDF crea un archivo de salida separado.
¿Qué límites actuales se aplican?
Un PDF de hasta 50 MB y 10 páginas. La salida UTF-8 procede del modelo inglés incluido y no es una transcripción ni un orden de lectura certificado.