Referensi Karakter HTML

Mengetik © lalu bertanya-tanya apakah benar-benar akan tampil sebagai simbol ©, atau mencari entitas untuk en dash, spasi tanpa pemutus baris, atau huruf Yunani, selalu memakan waktu beberapa menit setiap kali. Referensi yang dapat dicari ini memuat semua entitas bernama dan numerik HTML yang ditetapkan oleh standar WHATWG HTML, lengkap dengan pencarian instan dan salin satu ketukan.

Cara menemukan entitas HTML

  1. 1

    Cari berdasarkan nama atau karakter

    Ketik `copy`, `©`, `8212`, atau `em dash`, semuanya cocok dengan entitas yang sama.

  2. 2

    Pilih dari kisi

    Setiap entitas menampilkan bentuk bernama, kode desimal, dan kode heksadesimalnya.

  3. 3

    Salin dengan satu sentuhan

    Tekan untuk menyalin karakter, entitas bernama, atau entitas numerik.

  4. 4

    Filter berdasarkan kategori

    Kurangi pilihan berdasarkan mata uang, matematika, panah, tambahan bahasa Latin, bahasa Yunani, atau tanda baca.

Tiga cara menulis karakter yang sama

HTML memungkinkan Anda menulis karakter khusus dengan tiga cara berbeda. Pilihlah cara yang paling mudah dibaca dan pasti dapat ditampilkan dengan benar.

Tiga bentuk

Karakter Entitas bernama Angka desimal Angka heksadesimal
© © © ©
® ® ® ®
™ ™ ™
€ € €
- — — —
– – –
… … …
       
< &lt; &#60; &#x3C;
> &gt; &#62; &#x3E;
& &amp; &#38; &#x26;
&quot; &#34; &#x22;

Kapan menggunakan masing-masing bentuk

  • Entitas bernama mudah dibaca di kode sumber (&mdash; jelas merupakan em dash), tetapi hanya ada sekitar 250 entitas bernama; karakter yang lebih langka harus menggunakan bentuk numerik.
  • Angka desimal berlaku untuk setiap titik kode Unicode; gunakan ketika Anda mengetahui nilai desimalnya (biasanya dari kartu referensi).
  • Angka heksadesimal sesuai dengan notasi yang digunakan Unicode itu sendiri (U+2014). Konversikan nilai U+NNNN dengan menambahkan prefiks &#x di depannya.

Karakter yang harus di-escape

Kelima karakter ini akan merusak HTML jika dibiarkan mentah di dalam konten:

  • <, escape menjadi &lt;, atau jadikan data karakter di dalam <pre>.
  • >, escape menjadi &gt; (hanya diperlukan di dalam atribut).
  • &, escape menjadi &amp; dalam setiap konteks.
  • ", escape menjadi &quot; di dalam nilai atribut.
  • ', escape menjadi &#39; atau &apos; di dalam atribut yang ditulis dengan tanda kutip tunggal.

Semua hal lainnya bersifat opsional dalam UTF-8 HTML5; karakter Unicode mentah juga diperbolehkan digunakan.

Pertanyaan yang Sering Diajukan

Ya, karena karakter tersebut tidak terlihat dalam kode sumber. Penggunaan &nbsp; bersifat dokumentasi otomatis; pengembang lain yang membaca kode Anda langsung akan memahami maksud Anda untuk mencegah terjadinya pemisahan baris di bagian tersebut.

Tidak, &apos; didefinisikan dalam XML dan HTML5, tetapi tidak dalam HTML4. Gunakan &#39; jika Anda memerlukan tanda kutip dalam dokumen HTML4 yang sepenuhnya sesuai standar; meskipun demikian, semua peramban modern tetap mampu menampilkan keduanya dengan benar.

U+0020 adalah spasi biasa yang bisa dijadikan titik pemutus baris oleh peramban. U+00A0 (spasi tanpa pemutus baris, &nbsp;) mencegah pemutusan baris dan tidak digabung dengan spasi di sebelahnya; gunakan untuk “10 km” agar nilai dan satuannya tetap menyatu.

Emoji memiliki titik kode Unicode dan dapat ditulis sebagai entitas numerik (&#128512; = 😀). Namun, dalam file HTML modern yang menggunakan format UTF-8, emoji dapat langsung dilekatkan. Bentuk entitas hanya berguna untuk surel atau sistem yang memiliki batasan pengkodean.

Alat Terkait