Konberter ng entity ng HTML
Ang Konberter ng entity ng HTML ay isang libreng tool na nagpapalit sa pagitan ng mga HTML character reference at mga na-decode na character para magamit sa mga web page, content system, at iba pang text-based na format.
Ano ang mga HTML entity at bakit ginagamit ang mga ito?
Kinakatawan ng mga HTML entity ang mga character sa paraang nakikilala ng HTML bilang text at hindi bilang bahagi ng sarili nitong markup. Karaniwang nagsisimula sa ampersand at nagtatapos sa semicolon ang isang HTML character reference. Maaari itong named character reference, gaya ng & para sa ampersand, o numeric character reference, gaya ng £ para sa pound sign.
Kapaki-pakinabang ang mga ito kapag may espesyal na kahulugan sa HTML ang isang character. Halimbawa, maaaring mapagkamalang simula ng tag ang literal na less-than sign, kaya maaari itong isulat bilang <. Nagagamit din ang mga character reference upang kumatawan sa mga partikular na character sa HTML o katugmang markup nang hindi napagkakamalang markup o control syntax.
Hindi encryption ang entity encoding at wala itong ibinibigay na pagiging lihim. Mababasa o made-decode ng sinuman ang isang entity reference, kaya hindi ito dapat gamitin kailanman upang itago ang mga password, personal na data, o kumpidensyal na nilalaman.
Paano gamitin ang konberter ng HTML entity?
Ilagay ang naaangkop na text sa field na may label na Encode o Decode, pagkatapos ay tingnan ang katumbas na resultang HTML entity encoded o HTML entity decoded. Gamitin ang encoded output kapag kailangang lumabas ang text sa angkop na HTML text o attribute context. Gamitin naman ang decoded output kapag kailangan mo ang mga character na kinakatawan ng mga kasalukuyang entity.
Sa server isinasagawa ang conversion. Ipinapadala ang input mo sa server sa pamamagitan ng HTTPS at hindi ito iniimbak.
Tiyakin muna kung HTML entities nga ang kailangan mo bago mag-convert. Karaniwang URL percent-encoding ang kailangan ng value sa query string, samantalang Punycode ang ginagamit para sa internationalised domain. Para sa mga format na iyon, gamitin ang Decoder ng URL at IDN Punycode konwerter.
Ano ang hitsura ng encoded o decoded na resulta?
Sa decoded na resulta, pinapalitan ang mga kinikilalang entity reference ng mga character na kinakatawan ng mga ito. Sa encoded na anyo naman, kinakatawan ang mga character gamit ang entity syntax.
Input: <p>Tea & cake</p>
Decoded output: <p>Tea & cake</p>
Ang mga angle bracket sa decoded output ay mga character na maaaring maging HTML markup kapag ipinasok sa isang page bilang HTML. Hindi nililinis ng pag-decode ang nilalaman, hindi nito inaalis ang mga script, at hindi nito ginagawang ligtas ang hindi pinagkakatiwalaang HTML. Pangasiwaan ang decoded na materyal ayon sa konteksto kung saan ito gagamitin.
Mga halimbawa at input na mahirap pangasiwaan
Maaaring katawanin ng named entity at numeric character reference ang iisang character sa magkaibang paraan. Halimbawa, ang & ay named reference para sa ampersand, samantalang ang & ang decimal numeric reference nito at ang & ang hexadecimal na anyo.
- Ang mga karaniwang space at literal na numero ay hindi entity reference at karaniwang nananatiling ordinaryong text.
- Nagbabago lamang ang bantas kapag lumilitaw ito bilang kinikilalang entity reference o sadyang ini-encode.
- Maaaring katawanin ng mga numeric character reference ang mga letrang may accent, mga sulat na hindi Latin, at emoji. Tinutukoy ng mga ito ang mga Unicode code point nang hiwalay sa encoding ng HTML source. Nakadepende sa suporta ng font ang wastong pagpapakita, habang mahalaga naman ang character encoding kung iimbakin o ipapadala ang decoded output.
Isama ang pangwakas na semicolon kapag gumagawa ng mga entity. Tinatanggap ng mga browser ang ilang reference na walang semicolon sa limitadong konteksto, ngunit maaaring maging malabo ang pinaikling anyong iyon at hindi ito gaanong portable sa iba't ibang parser.
Saan karaniwang nakikita ang mga HTML entity?
Karaniwang lumilitaw ang mga HTML entity sa HTML source, content management system, rich-text editor, at HTML email. Halimbawa, maaaring maglaman ang code view ng WordPress ng para sa non-breaking space o & kapag kailangang mapanatili ang ampersand sa markup.
Maaari din itong lumitaw sa loob ng data na dinadala ng ibang format. Nagkakaroon tuloy ng ilang layer ng encoding na kailangang pangasiwaan sa tamang pagkakasunod-sunod.
- Maaaring maglaman ang isang JSON payload ng HTML fragment na may mga entity sa text nito. Magkahiwalay na proseso ang JSON escaping at HTML entity decoding.
- Maaaring maglaman ang query string ng percent-encoded na HTML. I-decode muna ang URL layer bago alamin kung may mga entity rin ang resultang text.
- Maaaring maglaman ang data URI ng HTML o iba pang text na may mga entity, bagaman maaaring gumamit mismo ang URI ng percent-encoding o Base64.
- Maaaring i-encode ng HTML email ang nakikitang bantas habang gumagamit din ng MIME transfer encoding para sa pagpapadala.
- Maaaring lumitaw ang internationalised domain katabi ng entity-encoded na HTML, ngunit karaniwang Punycode ang ginagamit upang katawanin ang domain mismo, hindi mga HTML entity.
Bakit hindi gumagana ang HTML entity decoding o bakit magulo ang resulta?
Karaniwang pumapalya ang decoding dahil mali ang pagkakabuo ng input, ibang encoding scheme ang gamit nito, o mahigit sa isang encoding layer ang nilalaman nito. Suriin ang orihinal na text para sa named o numeric HTML character reference sa halip na paulit-ulit na mag-convert nang hindi sinusuri ang resulta.
- Maling pagkakabuo ng reference: Maaaring hindi makilala ang reference kapag nawawala ang ampersand, number sign, o semicolon. Ihambing ang text sa mga anyong gaya ng & o &.
- Double-encoded na input: Ang text na gaya ng &lt; ay maaaring ma-decode muna bilang < at mangailangan ng isa pang sinasadyang pag-decode upang maging less-than sign.
- Hindi tugmang character set: Kapag binasa ang text gamit ang maling character encoding, maaaring lumitaw ang mga replacement symbol o sirang character na may accent.
- Maling format: Maaaring URL-encoded ang text na may mga percent sign. Posibleng Base64 naman ang mahabang string na gumagamit ng mga letra, digit, plus sign, slash, o equals sign sa dulo.
- Kung Base64 ang input, maling variant o alphabet ang gamit: Iba ang mga character na ginagamit ng URL-safe Base64 kumpara sa karaniwang Base64. Maaari ding hindi gumana ang ilang decoder kapag kulang ang padding. Hindi bahagi ng HTML entity syntax ang mga problemang ito at kailangan ng Base64 decoder.
Mga madalas itanong
Bakit parang ordinaryong space lang ang ?
Kumakatawan ito sa non-breaking space, na karaniwang mukhang normal na space ngunit pinipigilan ang line break sa posisyong iyon. Maaaring panatilihin ito ng mga editor nang hindi nakikita, kaya tingnan ang source view o suriin ang mismong character kapag inaalam ang sanhi ng problema sa spacing.
Case-sensitive ba ang mga pangalan ng HTML entity?
Oo. May itinakdang spelling ang mga named character reference, at maaaring matukoy ng paggamit ng uppercase o lowercase kung makikilala ang isang reference. Gamitin ang eksaktong naka-publish na pangalan at isama ang semicolon nito sa halip na umasa sa pagwawasto ng browser sa mga error.
Kailangan ko bang gumamit ng entity sa bawat letrang may accent?
Hindi. Maaaring direktang maglaman ang isang wastong idineklarang UTF-8 HTML document ng mga character gaya ng é, £ at 中文. Kapaki-pakinabang pa rin ang mga entity kapag kailangan ang mga ito dahil sa markup syntax, mas lumang system, o partikular na tuntunin sa pag-publish.
Magagamit ba ang mga HTML entity sa XML?
Kaunting named entity lamang ang paunang tinukoy sa XML, kabilang ang &, <, >, " at '. Maraming pangalang valid sa HTML ang invalid sa XML maliban kung tinukoy ang mga ito ng document type, kaya madalas na mas ligtas piliin ang mga numeric character reference.
Maaayos ba ng entity converter ang sirang HTML?
Hindi. Kaya nitong mag-convert ng mga entity reference, ngunit hindi nito binabalanse ang mga tag, itinatama ang nesting, o bina-validate ang document. Pagkatapos mag-convert, suriin ang nakapaligid na markup at gumamit ng HTML validator kung hindi pa rin umaasal ang page gaya ng inaasahan.
Mga huling dapat suriin
Tiyakin kung gumagamit ang source ng named o numeric HTML character reference, i-convert lamang ang kinakailangang layer ng character reference, at ihambing ang resulta sa text na dapat makita. Bago ilagay ang decoded na nilalaman sa isang live na page, suriin sa aktuwal na HTML context ang anumang resultang angle bracket, quotation mark, at ampersand.
Mga sikat na tool
Madaling bumuo ng sarili mong pasadyang pirma at i-download ito nang madali.
Kunin ang laki ng isang teksto sa Bytes (B), Kilobytes (KB) o Megabytes (MB).
Kumuha ng isang IP at subukang hanapin ang domain/host na nauugnay dito.
Gamitin ang aming ping tool upang mabilis na suriin ang katayuan at oras ng pagtugon ng anumang website, server o port.
Nagbibigay ang IP lookup tool ng Digily Link ng detalyadong impormasyon tungkol sa anumang IP address. Gamitin ang libreng online na serbisyong ito para sa komprehensibong datos ng IP.
Bumuo agad ng libreng WhatsApp link. Magdagdag ng pasadyang mensahe at magsimula ng chat sa isang click, nang walang login o coding.