Kategorie: PDF

PDF zu Text

Eigene IdeeTool fehlt?

Auswählbaren Text aus einer PDF Seite für Seite lokal extrahieren

Extrahiere die Textebene aus einer PDF, seitenweise oder über einen gewählten Seitenbereich, vollständig in deinem Browser. Kopiere das Ergebnis oder lade es als reine Textdatei herunter.

Keine Datei ausgewählt.

Wähle eine PDF-Datei, um ihren Text zu extrahieren.

Die Extraktion funktioniert nur bei PDFs, die bereits echten Text enthalten. Gescannte, als Bild gespeicherte Seiten haben keine Textebene und benötigen eine Texterkennung (OCR), die dieses Werkzeug nicht durchführt. Passwortgeschützte PDFs können hier ebenfalls nicht geöffnet werden.

Alles auf dieser Seite wird in Ihrem Browser verarbeitet. Nichts wird hochgeladen.

Alles auf dieser Seite wird in Ihrem Browser verarbeitet. Nichts wird hochgeladen.

Wozu dieses Werkzeug dient

Dieses Werkzeug öffnet deine PDF mit einer browserbasierten PDF-Engine und liest die bereits eingebettete Textebene jeder ausgewählten Seite aus, die zu einem einzigen Klartext-Ergebnis mit optionalem Trenner zwischen den Seiten zusammengefügt wird. Es wird nichts hochgeladen: Die Datei wird vollständig auf deinem Gerät geöffnet und gelesen. Es wird nur Text wiederhergestellt, der bereits als Text in der PDF gespeichert ist — es findet keine Texterkennung (OCR) statt, sodass gescannte, als Bild gespeicherte Seiten leer bleiben.

So funktioniert es

  1. Wähle eine PDF-Datei von deinem Gerät.
  2. Gib optional an, welche Seiten extrahiert werden sollen, und wähle, ob ein Trenner zwischen den Seiten eingefügt werden soll.
  3. Drücke Text extrahieren und kopiere dann das Ergebnis oder lade es als .txt-Datei herunter.

Datenschutz

Dieses Werkzeug läuft vollständig in Ihrem Browser. Ihre Eingabe wird nie hochgeladen, gespeichert oder weitergegeben – beim Schließen des Tabs ist sie weg.

Häufig gestellte Fragen

Wird meine PDF hochgeladen, um ihren Text zu extrahieren?
Nein. Die Datei wird geöffnet und ihre Textebene vollständig in deinem Browser gelesen; es wird nichts irgendwohin gesendet.
Warum ist das Ergebnis für manche Seiten leer?
Diese Seiten haben wahrscheinlich keine Textebene — meist, weil es sich um gescannte Bilder statt um getippten oder erzeugten Text handelt. Dieses Werkzeug liest vorhandenen Text; es erkennt keinen Text in Bildern (OCR).
Kann ich Text aus einer passwortgeschützten PDF extrahieren?
Nein. Passwortgeschützte PDFs können von diesem Werkzeug nicht geöffnet werden.