Alat teks / 03
Penghitung Karakter
Hitung karakter Unicode, karakter non-spasi, kata, baris, dan byte UTF-8 secara langsung.
Penghitung Karakter: TOEA menghitung kode poin Unicode yang dipersepsi pengguna, whitespace, bentuk kata praktis, baris, dan byte UTF-8 yang terenkode. Berjalan 100% lokal di browser Anda tanpa upload file ke server.
- Kategori
- Tools teks
- Dijalankan
- Di browser Anda
- Biaya
- Gratis · tanpa daftar
- Ketersediaan
- Siap digunakan
Berjalan sepenuhnya di browser Anda
Batas yang menghitung karakter
Sebuah post di X mengizinkan 280 karakter, dan menghitung setiap karakter Tionghoa, Jepang, atau Korea sebagai dua. Satu SMS menampung 160 karakter alfabet dasar, tetapi hanya 70 begitu berisi emoji atau karakter apa pun di luar alfabet itu, dan pesan yang lebih panjang dipecah menjadi beberapa bagian. Hasil pencarian menampilkan judul halaman sekitar 50–60 karakter dan deskripsi sekitar 150–160 sebelum memotongnya, meski batas sebenarnya diukur dalam piksel.
Karakter, byte, dan unit kode
Tiga angka berbeda sering disebut panjang. Karakter adalah yang Anda lihat. Byte adalah yang disimpan UTF-8, satu untuk huruf Inggris biasa dan hingga empat untuk emoji, dan kolom basis data serta beberapa API membatasi byte. .length JavaScript menghitung unit kode UTF-16, jadi sebagian besar emoji dihitung dua. Ketika sebuah form menolak teks yang tampaknya cukup pendek, biasanya ia menghitung salah satu dari dua yang lain.
Cara menggunakannya
- Ketik atau tempel teks.
- Lihat hitungan langsung.
- Ubah teks dan bandingkan seketika.
Privasi & batasan
Teks tetap di browser. Hitungan bersifat mekanis dan mungkin berbeda dari batas khusus platform.
Alat terkait
Pertanyaan umum
Apakah input saya diupload?
Tidak. Pemrosesan terjadi di tab browser Anda saat ini.
Mengapa jumlah byte bisa lebih banyak daripada karakter?
Banyak karakter Unicode membutuhkan lebih dari satu byte di UTF-8.
Bagaimana huruf beraksen dan emoji dihitung?
Karakter adalah kode poin Unicode, jadi á, ñ, ü, dan ¿ masing-masing dihitung satu karakter. Byte memakai UTF-8: huruf yang sama masing-masing memakan dua byte dan kebanyakan emoji empat byte. Bendera dan beberapa emoji tersusun dari beberapa kode poin dan dihitung lebih dari satu karakter.
Alat gratis · berjalan di browser anda · tanpa perlu akun