Du debuggst, warum ein Textabschnitt auf einer Webseite als & statt als einfaches Kaufmanns-Und angezeigt wird. Oder du schreibst HTML von Hand und musst ein Kleiner-als-Zeichen escapen, damit der Browser es nicht als Anfang eines Tags interpretiert. In beiden Fällen hast du es mit HTML-Entitäten zu tun — dem kleinen Satz von Zeichen, die eine spezielle Kodierung brauchen, um korrekt angezeigt zu werden oder um Markup nicht zu brechen.
Die gängigen sind leicht zu merken: & wird zu &, < wird zu <, > wird zu >. Aber sobald du bei typografischen Anführungszeichen, Geviertstrichen, geschützten Leerzeichen und Sonderzeichen ankommst, hören die Entity-Namen auf, intuitiv zu sein, und du suchst jedes Mal eine Referenztabelle.
Ein Sicherheitsaspekt, nicht nur ein Formatierungsaspekt
HTML-Entity-Kodierung ist nicht rein kosmetisch. Nutzer-eingereichten Inhalt nicht zu kodieren, bevor er auf einer Webseite gerendert wird, ist ein klassischer Vektor für Cross-Site-Scripting. Wenn deine Anwendung jemals Rohtext — Kommentare, Nutzernamen, Formulareingaben — innerhalb von HTML anzeigen muss, gehört das Verständnis, was genau wie kodiert wird, zum Schreiben von sicherem Code, nicht nur hübsch aussehendem Output.
Umgekehrt ist Dekodierung genauso häufig nötig: Beim Scrapen einer Webseite, Parsen eines RSS-Feeds oder Lesen eines exportierten CMS-Dokuments bleibt oft entity-kodierter Text übrig, der zurück in normale Zeichen konvertiert werden muss, bevor du ihn anderswo verwenden kannst.
In einem Schritt kodieren und dekodieren
Bellows enthält einen HTML-Entity-Kodierer und -Dekodierer unter seinen 41 Entwickler-Tools. Füge Rohtext ein, um korrekt escapte HTML-Entitäten zu erhalten, oder füge kodiertes Markup ein, um den lesbaren Text zu sehen. Beide Richtungen funktionieren sofort und komplett offline.
Gescrapten Content bereinigen
Text, der aus RSS-Feeds, exportierten Blogposts oder gescraptem HTML stammt, kommt häufig voller Entity-Codes an, wo normale Satzzeichen stehen sollten. Ihn vor dem Speichern oder Anzeigen an anderer Stelle in einem Rutsch zu dekodieren, vermeidet eine Seite voller verstreuter ’, wo ein Apostroph stehen sollte.
Markup von Hand schreiben
Wenn du ein HTML-Template oder einen E-Mail-Newsletter von Hand bearbeitest und ein wörtliches Winkelklammer-Zeichen oder Kaufmanns-Und im sichtbaren Text einfügen musst, spart dir die korrekte Kodierung gleich beim ersten Mal einen Rendering-Bug, der erst nach dem Versenden der E-Mail auffällt.