Área local de texto incorporado
Extrair texto de PDF
Extraia texto incorporado das páginas escolhidas do PDF.
- Processamento
- Somente no navegador
- Conta
- Não necessária
- Limite atual
- Um PDF · 100 MB · 250 páginas
- Resultado
- Arquivo de texto UTF-8
Sem envio de arquivos, análise, anúncios ou scripts externos nesta área.
Extração local de texto incorporado
Escolha um PDF
O PigPDF lê a camada de texto incorporada na ordem original e cria um arquivo UTF-8 separado.
ou escolha um arquivo deste dispositivo
Compatibilidade atual
O que esta beta aceita
O PigPDF lê o fluxo de texto incorporado sem OCR. A saída é texto simples, não uma reconstrução do layout.
| Recurso de entrada | Comportamento atual | Motivo |
|---|---|---|
| Texto incorporado da página | Extraído | As páginas escolhidas são lidas na ordem original. |
| Digitalizações somente com imagens | Sem texto | OCR é uma função separada e planejada. |
| Colunas e layouts complexos | Podem mudar | A ordem do fluxo PDF pode diferir da ordem semântica de leitura. |
| Senha ou dano | Rejeitados | A beta não inclui senha nem reparo. |
Antes de usar a ferramenta
Perguntas e limites
Meu arquivo sai deste dispositivo?
Não. A ferramenta não envia o conteúdo. O processamento ativo roda neste navegador e passa por teste automatizado de saída de rede.
O PigPDF altera o arquivo original?
Não. O original permanece intacto e o PigPDF cria um arquivo separado.
Quais limites atuais se aplicam?
Um PDF de até 100 MB e 250 páginas. Somente texto incorporado é extraído; digitalizações exigem OCR e a ordem de leitura pode ser ambígua.