PDF in Text
Der ausgelesene Text erscheint mit sichtbaren Seitentrennern, sodass du erkennst, wo eine PDF-Seite endet. Bei Spalten oder verschachtelten Layouts kann die Reihenfolge vom gedruckten Bild abweichen.
PDF in Text umwandeln und den Inhalt ohne Zusatzprogramm kopieren
FuchsPDF liest die vorhandene durchsuchbare Textebene jeder PDF-Seite aus und zeigt das Ergebnis mit klaren Seitentrennern an. Du kannst den gesamten Text kopieren oder als Textdatei in UTF-8 speichern. Text aus einem PDF rauskopieren geht so auch dann, wenn die Auswahl im Betrachter hakt. Lässt sich Text daraus nicht markieren und kopieren, hilft dieses Tool oft weiter, weil es die Textebene direkt ausliest statt den Umweg über das Markieren zu nehmen. Wieso kann ich keinen Text aus einem schreibgeschützten PDF kopieren, und wieso erscheinen nur Fragezeichen, ist die Kodierung im Dokument defekt; daran ändert auch Adobe nichts.
Das Werkzeug führt keine optische Zeichenerkennung durch. Besteht das PDF nur aus gescannten Seiten oder Bildern, enthält es keine auslesbare Textebene und liefert ohne OCR keinen Text. den Inhalt einer Datei zu kopieren ist kostenlos und online möglich, ganz ohne Konto. Das Kopieren geht in zwei Schritten, wie das Ergebnis aussieht hängt aber am PDF: Der ausgelesene Text übernimmt den Zeilenumbruch des Layouts, sodass Absätze eines Fließtexts als einzelne Zeilen ankommen können – zum Einfügen in ein anderes Programm musst du sie eventuell nachbearbeiten. Erscheinen statt Buchstaben Hieroglyphen oder wirre Zeichen, liegt das an einer defekten Zeichenkodierung im Dokument und nicht am Werkzeug. Bei PDFs, die aus gescannter Vorlage stammen, bleibt die Ausgabe leer. Eine Übernahme nach Excel mit sauberen Spalten funktioniert nicht, ausgegeben wird reiner Text. Geöffnet wird alles im Browser – am Mac, unter Windows, ohne eigenen PDF-Viewer. Von einem reinen Scan bleibt ohne Texterkennung nur das Bild – dafür gibt es die Umwandlung der Seiten in Bilddateien.
In drei Schritten
So funktioniert PDF in Text
-
PDF auswählen
Öffne das Dokument, aus dem vorhandener durchsuchbarer Text gelesen werden soll.
-
Text prüfen
Warte auf die Extraktion und kontrolliere den seitenweise gegliederten Text im Vorschaufeld.
-
Kopieren oder speichern
Übernimm den Text in die Zwischenablage oder lade ihn als TXT-Datei herunter.
Was das Tool kann
- Vorhandenen PDF-Text seitenweise extrahieren
- Seitengrenzen im Ergebnis kennzeichnen
- Gesamten Text direkt in die Zwischenablage kopieren
- Text als Textdatei in UTF-8 herunterladen
- Am Handy genauso nutzbar wie am Rechner – Android, iPhone und iPad eingeschlossen
Wichtig zu wissen
- Gescannte oder bildbasierte PDFs werden nicht per OCR erkannt.
- Schriftarten, Bilder, Tabellenformatierung und exakte Positionen werden nicht übernommen.
- Bei Spalten oder komplexem Seitenaufbau kann die ausgelesene Reihenfolge vom visuellen Layout abweichen.
- Wenn das Kopieren von Text daraus nicht mehr geht, fehlt fast immer die Textebene: Ein Scan enthält ein Bild der Seite, keine Buchstaben.
Häufige Fragen zu PDF in Text
Warum findet das Werkzeug keinen Text?
Das PDF besteht vermutlich aus Bildern oder Scans und besitzt keine durchsuchbare Textebene. Dafür wäre eine OCR-Texterkennung erforderlich, die dieses Werkzeug nicht enthält.
Bleiben Tabellen und Formatierungen erhalten?
Nein. Die Ausgabe enthält reinen Text mit Seitentrennern. Gestaltung, Bilder und die genaue Tabellenstruktur werden nicht rekonstruiert.
Was ist der Unterschied zu PDF in Word?
PDF in Text erzeugt eine einfache TXT-Datei und bietet direktes Kopieren. PDF in Word schreibt denselben auslesbaren Text in eine bearbeitbare DOCX-Datei.
Bekommt jemand den Text meines Dokuments zu sehen?
Nein. Das Werkzeug „PDF in Text“ von FuchsPDF öffnet die PDF-Datei im Browser, liest die vorhandene Textebene dort Seite für Seite aus und hält das Ergebnis nur im Speicher deines Geräts, bis du es kopierst oder als TXT speicherst. Weder die Datei noch der extrahierte Text werden an FuchsPDF oder Dritte übertragen.
Brauche ich Acrobat, um den Inhalt einer Datei zu kopieren?
Nein. Für das Auslesen genügt ein aktueller Browser – Acrobat Reader oder ein anderes Desktop-Programm musst du nicht installieren. Das ist vor allem an fremden oder verwalteten Rechnern nützlich, auf denen du keine Software einrichten darfst. Vorausgesetzt bleibt eine im PDF vorhandene Textebene.
Warum stehen im kopierten Text Zeilenumbrüche oder Leerzeichen an falschen Stellen?
Weil ein PDF keine Sätze speichert, sondern einzelne Textstücke mit Koordinaten. Wo im Layout eine Zeile endet, entsteht beim Auslesen ein Umbruch, und bei Blocksatz oder gesperrter Schrift landen zusätzliche Leerzeichen im Ergebnis. Für die Weiterverarbeitung in Word hilft es, den Text dort einzufügen und die Umbrüche per Suchen-und-Ersetzen zu bereinigen.
Lässt sich die Formatierung beim Kopieren beibehalten?
Nein. Herauskommt reiner Text ohne Fettdruck, Schriftgrößen, Spalten und Tabellen – Absätze übernehmen den Zeilenumbruch des Layouts. Zum Rauskopieren einzelner Stellen genügt oft auch die Tastenkombination Strg+C direkt im Betrachter; dieses Werkzeug ist für ganze Dokumente gedacht, in Microsoft Edge genauso wie in Chrome oder Firefox.
Warum erscheinen nur Sonderzeichen oder komische Zeichen?
Dann ist im PDF eine defekte Zuordnung zwischen Schriftzeichen und Buchstaben hinterlegt. Der Betrachter zeigt die richtige Form an, weil er die Zeichnung der Zeichen benutzt; beim Auslesen kommt aber die hinterlegte Nummer zum Vorschein, und daraus werden komische Zeichen. Das liegt am Dokument, nicht am Werkzeug – abhelfen kann nur eine neu erzeugte Datei oder eine Texterkennung, die es hier nicht gibt.