Konverter Unicode ke UTF-8
Ubah teks Unicode literal menjadi sintaks escape \u00E9, \u{1F600} yang disematkan bahasa pemrograman dalam kode sumber, atau tempel string ber-escape dan dekode kembali ke karakter aslinya. Berfungsi untuk karakter BMP (escape 4 digit) dan plane suplementer seperti emoji (\u{...} panjang variabel).
Cara mengonversi antara escape Unicode dan UTF-8
-
1
Pilih arah
Kodekan karakter menjadi escape `\u`, atau dekode string ber-escape kembali menjadi teks.
-
2
Tempel input Anda
Teks polos untuk pengodean; string dengan sekuens `\uXXXX` atau `\u{XXXXX}` untuk pendekodean.
-
3
Baca output
Karakter BMP menghasilkan escape empat digit gaya `\u0041`; karakter di atas U+FFFF memakai bentuk ES6 `\u{...}`.
-
4
Salin ke kode Anda
Jatuhkan hasilnya ke string JavaScript, literal JSON, file config, atau test fixture.
Sintaks escape lintas bahasa
Bahasa berbeda mengeja gagasan yang sama secara berbeda. Konverter menghasilkan bentuk JavaScript/JSON umum, tetapi inilah yang Anda terjemahkan saat menulis karakter yang sama di tempat lain.
Sintaks escape menurut bahasa
| Bahasa | BMP (<= U+FFFF) | Suplementer (> U+FFFF) |
|---|---|---|
| JavaScript | \u00E9 |
\u{1F600} (ES6+) |
| JSON | \u00E9 |
Surrogate pair \uD83D\uDE00 |
| Python | \u00e9 |
\U0001F600 |
| Java | \u00e9 |
Surrogate pair |
| C / C++ | \u00e9 |
\U0001F600 |
| Ruby | \u00e9 |
\u{1F600} |
| Rust | \u{00e9} |
\u{1F600} |
| Entitas HTML | é |
😀 |
| CSS | \0000e9 |
\1F600 |
Mengapa emoji butuh bentuk panjang
Basic multilingual plane (BMP) mencakup U+0000 sampai U+FFFF, semuanya muat dalam satu unit 16-bit, yang menjadi tujuan sintaks lama \uXXXX. Emoji sebagian besar hidup di plane 1 (U+1F000 ke atas), yang tidak muat dalam empat digit heksadesimal. Dua opsi:
- Kurung kurawal ES6,
\u{1F600}menerima panjang apa pun. - Surrogate pair UTF-16, dua escape
\uXXXXuntuk satu karakter. Parser JSON menerima ini, dan itulah yang biasa dipancarkan encoder JSON.
Keduanya didekode ke string yang sama, tetapi surrogate pair rapuh: memotong string di antara surrogate tinggi dan rendah memberi Anda UTF-16 tidak valid.
Pertanyaan yang Sering Diajukan
Empat digit heksadesimal mentok di U+FFFF. Emoji mulai di U+1F000, jadi mereka butuh bentuk kurung ES6 \u{...}, atau surrogate pair UTF-16 jika Anda terjebak pada target lama. Alat ini memakai kurung untuk apa pun di atas U+FFFF.
Tidak sebagai pasangan. Dekoder memahami bentuk kurung \u{1F600} dan escape empat digit \uXXXX, tetapi ia tidak menggabungkan kembali surrogate pair UTF-16 (bentuk dua-escape yang dipakai JSON) menjadi satu emoji: setiap paruh didekode sendiri dan tidak dapat direkonstruksi. Untuk apa pun di atas U+FFFF, tempel bentuk kurung \u{...}, yang persis dihasilkan oleh encoder.
Tidak. Escape seperti \u00E9 mewakili titik kode U+00E9, bukan sekuens byte UTF-8 (yang akan menjadi C3 A9). Untuk tampilan byte mentah, gunakan alat Unicode Lookup yang menunjukkan byte UTF-8 dalam HEX.
Konversi terjadi di sisi server dalam request ini, tetapi tidak ada yang disimpan: tanpa pencatatan, tanpa penyimpanan string yang Anda konversi.
Alat Terkait
Referensi Tabel ASCII
Tabel ASCII lengkap dari 0 sampai 127 dengan desimal, heksadesimal, oktal, biner, dan referensi karakter numerik HTML untuk setiap karakter, termasuk kode kontrol seperti NUL, LF, dan DEL.
Referensi Karakter HTML
Daftar entitas HTML yang dapat dicari, beserta kode bernama dan kode numeriknya, serta fitur salin dengan satu klik untuk karakter khusus dan simbol.
Referensi pintasan papan ketik
Cari pintasan bawaan terdokumentasi untuk VS Code, Chrome, dan Bash dengan GNU Readline di macOS, Windows, dan Linux.
JSON ke YAML
Konversi JSON ke YAML dengan penjelajaran yang tepat, penutupan string yang aman, skalar blok berbaris ganda, serta kunci yang tersortir untuk konfigurasi yang lebih rapi.
Decoder JWT
Dekode header dan payload JWT, tampilkan klaim beserta pemeriksaan masa kedaluwarsa dan algoritma tanda tangan, lalu verifikasi menggunakan rahasia bersama atau kunci publik.
Konverter Ukuran File
Konversi antara byte, KB, MB, GB, TB, dan satuan biner IEC (KiB, MiB, GiB, TiB) dengan kombinasi desimal dan biner apa pun yang Anda inginkan.
Alat ini tersedia dalam bahasa lain
- Unicode zu UTF-8 Konverter [DE]
- Conversor de Unicode para UTF-8 [PT]
- Chuyển đổi từ Unicode sang UTF-8 [VI]
- Unicode till UTF-8-omvandlare [SV]
- เครื่องแปลง Unicode เป็น UTF-8 [TH]
- 유니코드-UTF-8 변환기 [KO]
- Convertidor de Unicode a UTF-8 [ES]
- UnicodeからUTF-8への変換ツール [JA]
- مُحوّل يونيكود إلى UTF-8 [AR]
- Convertisseur Unicode en UTF-8 [FR]
- Unicode naar UTF-8 converter [NL]
- Konwerter Unicode na UTF-8 [PL]
- Convertitore da Unicode a UTF-8 [IT]
- Конвертер Unicode в UTF-8 [RU]
- Unicode'dan UTF-8'e Dönüştürücü [TR]
- Unicode 到 UTF-8 转换器 [ZH]
- Unicode to UTF-8 Converter [EN]