Lokaler OCR-Arbeitsbereich
PDF per OCR erkennen
Text auf gescannten PDF-Seiten erkennen.
- Verarbeitung
- Nur im Browser
- Konto
- Nicht erforderlich
- Aktuelle Grenze
- PDF · 10 Seiten · 60 MP · englisches Modell
- Ausgabe
- Neue durchsuchbare PDF
Keine Dateiübertragung, Analyse, Werbung oder externen Verarbeitungsskripte in diesem Arbeitsbereich.
Lokaler Browser-Arbeitsbereich
Quelldateien auswählen
Führe diese Operation im Browser aus und erstelle eine separate Ergebnisdatei.
oder Dateien von diesem Gerät wählen
Lokaler Browser-Arbeitsbereich
Quelldateien werden nicht geändert oder hochgeladen.Aktuelle Kompatibilität
Was diese Beta unterstützt
Seiten werden lokal gerastert und mit dem gebündelten englischen OCR-Modell erkannt.
| Eingabemerkmal | Aktuelles Verhalten | Grund |
|---|---|---|
| PDF-Seiten | Gerastert und erkannt | PDF.js rendert jede Seite lokal, bevor der OCR-Worker sie liest. |
| Gedruckter englischer Text | Erkannt | Das gebündelte englische Modell liefert Text und Wortpositionen. |
| Handschrift, andere Sprachen oder komplexes Layout | Prüfung erforderlich | Die Genauigkeit variiert und kein Sprachmodell wird stillschweigend gewählt. |
| Formulare, Anmerkungen und Signaturen | Gerastert | Die durchsuchbare Ausgabe ist eine neue bildbasierte PDF ohne interaktive Semantik. |
Vor der Nutzung
Fragen und Grenzen
Verlässt meine Datei dieses Gerät?
Nein. Dieses Tool sendet keine Dateiinhalte. Die aktive Verarbeitung läuft in diesem Browser und wird durch einen automatisierten Egress-Test geprüft.
Verändert PigPDF meine Quelldatei?
Nein. Die Quelle bleibt unverändert und PigPDF erstellt eine separate Ausgabedatei.
Welche aktuellen Grenzen gelten?
Eine PDF bis 50 MB und 10 Seiten. Seiten werden mit 144 DPI und dem englischen Modell gerastert; Handschrift, andere Sprachen, komplexe Lesereihenfolge und interaktive Strukturen erfordern Prüfung.