BETA

Área local de texto incorporado

Extrair texto de PDF

Extraia texto incorporado das páginas escolhidas do PDF.

Processamento
Somente no navegador
Conta
Não necessária
Limite atual
Um PDF · 100 MB · 250 páginas
Resultado
Arquivo de texto UTF-8
Processamento somente no navegador

Sem envio de arquivos, análise, anúncios ou scripts externos nesta área.

OCIOSO

Extração local de texto incorporado

Escolha um PDF

O PigPDF lê a camada de texto incorporada na ordem original e cria um arquivo UTF-8 separado.

Solte um PDF aqui

ou escolha um arquivo deste dispositivo

Um PDF de até 100 MB e 250 páginas · digitalizações exigem OCR

Compatibilidade atual

O que esta beta aceita

O PigPDF lê o fluxo de texto incorporado sem OCR. A saída é texto simples, não uma reconstrução do layout.

PDF para textoCompatibilidade atual
Recurso de entradaComportamento atualMotivo
Texto incorporado da páginaExtraídoAs páginas escolhidas são lidas na ordem original.
Digitalizações somente com imagensSem textoOCR é uma função separada e planejada.
Colunas e layouts complexosPodem mudarA ordem do fluxo PDF pode diferir da ordem semântica de leitura.
Senha ou danoRejeitadosA beta não inclui senha nem reparo.

Antes de usar a ferramenta

Perguntas e limites

Meu arquivo sai deste dispositivo?

Não. A ferramenta não envia o conteúdo. O processamento ativo roda neste navegador e passa por teste automatizado de saída de rede.

O PigPDF altera o arquivo original?

Não. O original permanece intacto e o PigPDF cria um arquivo separado.

Quais limites atuais se aplicam?

Um PDF de até 100 MB e 250 páginas. Somente texto incorporado é extraído; digitalizações exigem OCR e a ordem de leitura pode ser ambígua.