HTML-Entity-Kodierung

Fügen Sie HTML oder Text unten ein und klicken Sie auf Kodieren, um Sonderzeichen als HTML-Entities zu escapen. Die gesamte Verarbeitung erfolgt lokal in Ihrem Browser.

Kopiert!

Was ist HTML-Entity-Kodierung?

HTML-Entity-Kodierung wandelt Sonderzeichen in ihre HTML-Entity-Entsprechungen um, damit sie nicht als HTML-Markup interpretiert werden. Zum Beispiel:

  • <&lt;
  • >&gt;
  • &&amp;
  • "&quot;
  • '&#39;

Dies verhindert XSS-Angriffe und stellt sicher, dass Text in HTML-Dokumenten korrekt angezeigt wird.

Entscheidend ist die Einstellung zum Umfang. Nur zu kodieren, was HTML zerbricht, hält den Text lesbar und ist richtig für alles, was ein Mensch wieder bearbeitet. Alles oberhalb von ASCII zu kodieren liefert Ausgabe, die eine auf einen Einbyte-Zeichensatz festgelegte Kette übersteht, um den Preis einer viel größeren Datei. Die Option für unsichtbare Zeichen lohnt sich immer dann, wenn eine Überschrift ohne Grund falsch aussieht: ein geschütztes Leerzeichen oder ein Zero-Width-Joiner aus einem Copy-and-paste erscheint als benannte Referenz, die Sie tatsächlich sehen.

Kämpft das Markup gegen Sie?

Escapte Entities, verstümmelte Kodierungen und Inhalte, die im CMS anders aussehen als auf der Seite, heißen meist, dass irgendetwas in der Kette rät. Wir bauen Frontends und den Publishing-Weg dahinter, damit Besucher sehen, was Sie geschrieben haben.

Sprechen Sie mit uns über Ihre Website

Häufig gestellte Fragen

Was ist eine HTML-Entity?
Eine Schreibweise für ein Zeichen, damit ein Browser es als Text liest und nicht als Markup. &amp; steht für ein kaufmännisches Und, &lt; für ein Kleiner-als-Zeichen, und genau das verhindert, dass eine verirrte spitze Klammer als Tag-Anfang gilt.
Welche Zeichen müssen wirklich kodiert werden?
In gewöhnlichem Text sind streng genommen nur das kaufmännische Und und das Kleiner-als-Zeichen nötig, das Größer-als-Zeichen aus Gewohnheit. In einem Attribut kommt das Anführungszeichen dazu, das es schließt. Alles andere ist optional, deshalb kodiert die Voreinstellung hier genau diese Menge und lässt den Rest lesbar.
Benannt oder numerisch?
Benannte sind leichter zu lesen und werden von jedem erkannt, der die Datei bearbeitet. Numerische funktionieren für jedes Zeichen, auch die vielen ohne Namen, und hängen nie davon ab, dass ein Parser einen Namen kennt. Hexadezimal ist die Form, die Sie in Spezifikationen und in generierter Ausgabe sehen.
Warum sollte ich alles oberhalb von ASCII kodieren?
Weil einem Glied in der Kette nichts anderes zuzutrauen ist: ein alter Export, ein Mail-Template, ein System, das einen Zeichensatz deklariert und einen anderen sendet. Kodieren oberhalb von ASCII lässt die Datei das überstehen, auf Kosten der Größe, und ist die falsche Wahl für alles, was ein Mensch wieder bearbeitet.
Was findet die Option für unsichtbare Zeichen?
Geschützte Leerzeichen, Zero-Width-Joiner, weiche Trennstriche und die übrigen Zeichen, die mit einem Copy-and-paste ankommen und dann ohne sichtbaren Grund ein Layout zerlegen. Eingeschaltet erscheinen sie als Referenzen, die Sie sehen, und das ist meist der schnellste Weg zu dem einen, das Ärger macht.