BETA

Área local de OCR

Extrair texto digitalizado

Retorne texto OCR sem reconstruir o documento.

Processamento
Somente no navegador
Conta
Não necessária
Limite atual
PDF · 10 páginas · 60 MP · modelo inglês
Resultado
Arquivo de texto OCR UTF-8
Processamento somente no navegador

Sem envio de arquivos, análise, anúncios ou scripts externos nesta área.

OCIOSO

Área local no navegador

Escolha os arquivos de origem

Execute esta operação no navegador e crie um arquivo de resultado separado.

Solte os arquivos de origem aqui

ou escolha arquivos deste dispositivo

Até 100 MB por PDF e 250 páginas nesta beta

Área local no navegador

Os arquivos de origem não são alterados nem enviados.

Compatibilidade atual

O que esta beta aceita

As páginas são rasterizadas localmente e reconhecidas pelo modelo OCR em inglês incluído.

Extrair texto digitalizadoCompatibilidade atual
Recurso de entradaComportamento atualMotivo
Páginas PDFRasterizadas e reconhecidasO PDF.js renderiza cada página localmente antes de o worker OCR lê-la.
Texto impresso em inglêsReconhecidoO modelo em inglês incluído retorna texto e posições das palavras.
Manuscrito, outros idiomas ou layout complexoRevisão necessáriaA precisão varia e nenhum modelo de idioma é escolhido silenciosamente.
Formulários, anotações e assinaturasRasterizadosA saída pesquisável é um novo PDF baseado em imagens sem semântica interativa.

Antes de usar a ferramenta

Perguntas e limites

Meu arquivo sai deste dispositivo?

Não. A ferramenta não envia o conteúdo. O processamento ativo roda neste navegador e passa por teste automatizado de saída de rede.

O PigPDF altera o arquivo original?

Não. O original permanece intacto e o PigPDF cria um arquivo separado.

Quais limites atuais se aplicam?

Um PDF de até 50 MB e 10 páginas. A saída UTF-8 vem do modelo em inglês incluído e não é uma transcrição ou ordem de leitura certificada.