Área local de OCR
Extrair texto digitalizado
Retorne texto OCR sem reconstruir o documento.
- Processamento
- Somente no navegador
- Conta
- Não necessária
- Limite atual
- PDF · 10 páginas · 60 MP · modelo inglês
- Resultado
- Arquivo de texto OCR UTF-8
Sem envio de arquivos, análise, anúncios ou scripts externos nesta área.
Área local no navegador
Escolha os arquivos de origem
Execute esta operação no navegador e crie um arquivo de resultado separado.
ou escolha arquivos deste dispositivo
Área local no navegador
Os arquivos de origem não são alterados nem enviados.Compatibilidade atual
O que esta beta aceita
As páginas são rasterizadas localmente e reconhecidas pelo modelo OCR em inglês incluído.
| Recurso de entrada | Comportamento atual | Motivo |
|---|---|---|
| Páginas PDF | Rasterizadas e reconhecidas | O PDF.js renderiza cada página localmente antes de o worker OCR lê-la. |
| Texto impresso em inglês | Reconhecido | O modelo em inglês incluído retorna texto e posições das palavras. |
| Manuscrito, outros idiomas ou layout complexo | Revisão necessária | A precisão varia e nenhum modelo de idioma é escolhido silenciosamente. |
| Formulários, anotações e assinaturas | Rasterizados | A saída pesquisável é um novo PDF baseado em imagens sem semântica interativa. |
Antes de usar a ferramenta
Perguntas e limites
Meu arquivo sai deste dispositivo?
Não. A ferramenta não envia o conteúdo. O processamento ativo roda neste navegador e passa por teste automatizado de saída de rede.
O PigPDF altera o arquivo original?
Não. O original permanece intacto e o PigPDF cria um arquivo separado.
Quais limites atuais se aplicam?
Um PDF de até 50 MB e 10 páginas. A saída UTF-8 vem do modelo em inglês incluído e não é uma transcrição ou ordem de leitura certificada.