DevToolPal
DE

HTML-Tags entfernen

Entferne HTML-Tags, Skripte und Styles und behalte sauberen, lesbaren Text samt Absätzen.

Läuft lokal, wird nie hochgeladen

Optionen

Eingabe

0 Zeichen · 0 B

Ausgabe

0 Zeichen · 0 B

Was das Tool macht

HTML-Tags entfernen macht aus einer Seite, einer E-Mail-Vorlage oder einem Rich-Text-Schnipsel sauberen reinen Text. Es entfernt jedes Tag, verwirft Skripte, Styles und Kommentare, dekodiert Entitäten wie & und   und behält die Struktur, auf die es ankommt: Überschriften und Absätze bleiben getrennt, Listeneinträge stehen in eigenen Zeilen, und Tabellenzellen bleiben in Zeilen.

Praktisch, wenn du die Wörter ohne das Markup brauchst: um Text aus einem CMS in eine reine Text-E-Mail einzufügen, Inhalte an einen Suchindex oder ein Sprachmodell zu übergeben, Wörter in einem Artikel zu zählen oder zu prüfen, was ein Screenreader oder ein reiner Text-Client anzeigen würde.

So benutzt du es

  1. Füge HTML in die Eingabe ein oder öffne eine .html-Datei.
  2. Passe bei Bedarf die Optionen an:
    • Absätze und Zeilenumbrüche beibehalten macht aus Block-Elementen Leerzeilen oder Zeilenumbrüche. Schalte es aus für eine einzige Textzeile.
    • Überflüssige Leerzeichen zusammenfassen führt Leerzeichen, Tabs und Leerzeilen aus der Einrückung des Quelltexts zusammen, so wie ein Browser es tut.
    • Entitäten dekodieren macht aus <, é, ' und Co. echte Zeichen.
    • Link-URLs beibehalten schreibt jeden Link als text (https://…), damit die Ziele nicht verloren gehen.
  3. Kopier den Text oder lade ihn als Datei herunter.

Beispiel

Die Beispieleingabe ist eine kleine Release-Notes-Seite mit Titel, Style-Block, Skript, Überschrift, einem Absatz mit Link, einer Liste und einem Zeilenumbruch. Die Ausgabe behält nur, was ein Leser sehen würde:

Release notes

Version 2.0 – what's new

Faster builds, a dark theme and better documentation.

Search with Ctrl + K
Prices from €5 / month

Wie es funktioniert

Das HTML wird mit sorgfältigen Mustern als Text verarbeitet, statt in eine Seite geladen zu werden – so läuft nichts davon, und es werden keine Bilder oder Skripte abgerufen. Attributwerte, die ein >-Zeichen enthalten, werden korrekt behandelt, und nicht geschlossene Kommentare oder Skripte werden bis zum Ende der Eingabe entfernt, statt in die Ausgabe durchzusickern.

Weil das Tool keinen vollständigen Dokumentbaum aufbaut, kann sehr kaputtes HTML leicht andere Zeilenumbrüche ergeben, als ein Browser anzeigen würde, der Text selbst bleibt aber immer erhalten.

FAQ

› Werden auch Skripte und Styles entfernt?

Ja. Der Inhalt von script-, style-, noscript- und template-Elementen wird komplett verworfen, ebenso HTML-Kommentare und der Doctype – so landet kein Code in deinem Text.

› Bleiben Absätze und Listen erhalten?

Wenn Absätze und Zeilenumbrüche beibehalten aktiv ist, werden Überschriften, Absätze und Listen durch Leerzeilen getrennt, Listeneinträge und divs beginnen eine neue Zeile, und br wird zum Zeilenumbruch. Schalte die Option aus, um eine durchgehende Zeile zu erhalten.

› Was passiert mit Entitäten wie   und &?

Sie werden in die Zeichen dekodiert, für die sie stehen: & wird zu &, und ein geschütztes Leerzeichen wird zu einem normalen Leerzeichen. Schalte Entitäten dekodieren aus, um sie so zu lassen, wie sie geschrieben sind.

› Wird mein HTML hochgeladen?

Nein. Alles läuft in deinem Browser – und das bedeutet auch, dass nichts aus dem HTML geladen oder ausgeführt wird.