HTML entitás kódolás

Illessze be a HTML-t vagy szöveget alább, és kattintson a Kódolás gombra a speciális karakterek HTML entitásokká való escape-eléséhez. Az összes feldolgozás helyben, a böngészőjében történik.

Másolva!

Mi az a HTML entitás kódolás?

A HTML entitás kódolás a speciális karaktereket HTML entitás megfelelőikké alakítja, hogy megakadályozza azok HTML jelölésként való értelmezését. Például:

  • <&lt;
  • >&gt;
  • &&amp;
  • "&quot;
  • '&#39;

Ez megakadályozza az XSS támadásokat és biztosítja, hogy a szöveg helyesen jelenjen meg a HTML dokumentumokban.

A hatókör beállítása a lényeg. Ha csak azt kódolja, ami elrontja a HTML-t, a szöveg olvasható marad, és ez a helyes minden olyan tartalomnál, amit ember fog újra szerkeszteni. Ha mindent kódol az ASCII fölött, olyan kimenetet kap, ami túléli az egybájtos karakterkészletre ragadt folyamatot, sokkal nagyobb fájl árán. A láthatatlan karakterek beállítását akkor érdemes lefuttatni, amikor egy cím ok nélkül néz ki rosszul: a másolással érkezett nem törő szóköz vagy nulla szélességű kötő nevesített hivatkozásként végre látszik.

Ellenáll a jelölés?

Az escape-elt entitások, az elrontott kódolások és a tartalom, ami a CMS-ben így, az oldalon úgy jelenik meg, általában azt jelentik, hogy valami a folyamatban találgat. Frontendet építünk és a mögötte lévő publikálási utat, hogy a látogató azt lássa, amit leírt.

Beszéljünk a webhelyéről

Gyakran ismételt kérdések

Mi az a HTML entitás?
Egy karakter leírásának módja, hogy a böngésző szövegként olvassa, ne jelölésként. Az &amp; az és jelet, a &lt; a kisebb mint jelet jelenti, és éppen ez akadályozza meg, hogy egy elkóborolt hegyes zárójel egy címke kezdetének számítson.
Mely karaktereket kell tényleg kódolni?
Sima szövegben szigorúan véve csak az és jel és a kisebb mint jel kell, a nagyobb mint jel megszokásból. Attribútumon belül jön még az azt lezáró idézőjel. A többi választható, ezért kódolja itt az alapbeállítás pontosan ezt a halmazt, és hagyja a többit olvashatóan.
Nevesített vagy számos hivatkozás?
A nevesítettek jobban olvashatók, és felismeri őket, aki a fájlt szerkeszti. A számosak minden karakterre működnek, azokra a sokakra is, amelyeknek nincs nevük, és soha nem függenek attól, hogy az elemző ismer-e egy nevet. A tizenhatos alapú alak az, amit a specifikációkban és a legtöbb generált kimenetben lát.
Miért kódolnék mindent az ASCII fölött?
Mert a lánc egyik eleme semmi másra nem megbízható: egy régi export, egy levélsablon, egy rendszer, ami egy karakterkészletet hirdet és mást küld. Az ASCII fölötti kódolás túléleti ezt a fájllal, méret árán, és rossz választás mindenhez, amit ember szerkeszt újra.
Mit talál meg a láthatatlan karakterek beállítása?
Nem törő szóközöket, nulla szélességű kötőket, lágy elválasztójeleket és a többi karaktert, ami másolással érkezik, majd látható ok nélkül elrontja az elrendezést. Bekapcsolva látható hivatkozásként jelennek meg, és ez általában a leggyorsabb út ahhoz az egyhez, ami gondot okoz.