Lokalny workspace osadzonego tekstu
Wydobądź tekst z PDF
Wydobywaj osadzony tekst z wybranych stron PDF.
- Przetwarzanie
- Tylko w przeglądarce
- Konto
- Niewymagane
- Aktualny limit
- Jeden PDF · 100 MB · 250 stron
- Wynik
- Plik tekstowy UTF-8
Bez wysyłania pliku, analityki, reklam i zewnętrznych skryptów przetwarzających w tym workspace.
Lokalne wydobywanie osadzonego tekstu
Wybierz jeden PDF
PigPDF odczytuje osadzoną warstwę tekstową w kolejności stron i tworzy osobny plik tekstowy UTF-8.
lub wybierz plik z tego urządzenia
Aktualna kompatybilność
Co obsługuje ta wersja beta
PigPDF odczytuje osadzony strumień tekstu bez OCR. Wynik jest zwykłym tekstem, a nie rekonstrukcją układu strony.
| Cecha pliku | Obecne działanie | Powód |
|---|---|---|
| Osadzony tekst stron | Wydobywany | Wybrane strony są czytane w kolejności źródłowej. |
| Skany zawierające tylko obrazy | Brak tekstu | OCR jest osobną planowaną funkcją. |
| Złożone kolumny i układ wizualny | Mogą się zmienić | Kolejność strumienia PDF nie musi odpowiadać semantycznej kolejności czytania. |
| Hasło lub uszkodzenie | Odrzucone | Ta beta nie obsługuje haseł ani naprawy. |
Przed użyciem narzędzia
Pytania i ograniczenia
Czy mój plik opuszcza to urządzenie?
Nie. To narzędzie nie wysyła zawartości pliku. Aktywna ścieżka przetwarzania działa w tej przeglądarce i przechodzi automatyczny test transmisji wychodzącej.
Czy PigPDF zmienia plik źródłowy?
Nie. Źródło pozostaje bez zmian, a PigPDF tworzy osobny plik wynikowy.
Jakie aktualne limity obowiązują?
Jeden PDF do 100 MB i 250 stron. Wydobywany jest tylko osadzony tekst; skany wymagają OCR, a kolejność czytania może być niejednoznaczna.