Inhalte wiederverwenden
Den Text eines alten Berichts zurückzuholen erspart das komplette Abtippen.
Extrahiere den Text aus einem PDF.
🔒 Diese Datei wird in deinem Browser verarbeitet. Sie wird nie hochgeladen.
…
Den Text aus einem PDF zu holen gibt dir seinen Inhalt als reinen Text zurück, fertig zum Kopieren, Suchen, Übersetzen oder Weiterverwenden. Das erspart das seitenweise Markieren von Hand, das bei langen Dokumenten langsam ist und meist seltsame Zeilenumbrüche mitschleppt.
Wichtig ist der Unterschied zwischen den beiden PDF-Arten. Aus einem Textprogramm erzeugte PDFs tragen den Text als Text in sich, daraus lässt er sich einwandfrei extrahieren. Vom Scanner stammende sind in Wahrheit Fotos von Papier: Sie zu lesen erforderte Texterkennung, die dieses Werkzeug nicht enthält.
Schnell herausfinden lässt sich das so: Öffne das PDF und versuche, ein Wort mit der Maus zu markieren. Klappt das, funktioniert die Extraktion. Zieht der Cursor nur ein Rechteck auf, ist es ein Scan.
Den Text eines alten Berichts zurückzuholen erspart das komplette Abtippen.
Maschinelle Übersetzer kommen mit reinem Text weit besser zurecht als mit einem gesetzten PDF.
Mit dem losen Text kannst du Begriffe suchen, Nennungen zählen oder ihn in eine Tabelle überführen.
Nein. Dieses Werkzeug extrahiert echten, im PDF eingebetteten Text; ist das Dokument ein Scan ohne Textebene, bräuchte es OCR, das hier nicht verfügbar ist.
Nein, das Ergebnis ist reiner Text ohne Fettschrift, Tabellen oder Spalten: Die Leserichtung bleibt erhalten, das Layout nicht.