Công cụ văn bản / 03
Bộ đếm ký tự
Đếm ký tự Unicode, ký tự không tính khoảng trắng, từ, dòng và byte UTF-8 theo thời gian thực.
Bộ đếm ký tự: TOEA đếm các điểm mã Unicode theo cách người dùng cảm nhận, khoảng trắng, các cụm từ theo cách sử dụng thực tế, dòng và số byte UTF-8 sau khi mã hóa. Chạy 100% cục bộ trong trình duyệt của bạn, không có tệp nào được tải lên máy chủ.
- Danh mục
- Công cụ văn bản
- Lượt chạy
- Trong trình duyệt của bạn
- Chi phí
- Miễn phí · không cần đăng ký
- Trạng thái khả dụng
- Sẵn sàng sử dụng
Chạy hoàn toàn trong trình duyệt của bạn
Các giới hạn tính theo ký tự
Một bài đăng trên X cho phép 280 ký tự và tính mỗi ký tự tiếng Trung, tiếng Nhật hoặc tiếng Hàn là hai ký tự. Một tin nhắn SMS chứa được 160 ký tự thuộc bảng chữ cái cơ bản, nhưng chỉ còn 70 ký tự khi có emoji hoặc bất kỳ ký tự nào ngoài bảng chữ cái đó; tin nhắn dài hơn sẽ được chia thành nhiều phần. Kết quả tìm kiếm thường hiển thị tiêu đề trang dài khoảng 50–60 ký tự và phần mô tả khoảng 150–160 ký tự trước khi cắt bớt, dù giới hạn thực tế được đo bằng pixel.
Ký tự, byte và đơn vị mã
Có ba con số khác nhau thường được gọi là độ dài. Ký tự là những gì bạn nhìn thấy. Byte là cách UTF-8 lưu trữ dữ liệu, với một byte cho chữ cái tiếng Anh thông thường và tối đa bốn byte cho emoji; các cột cơ sở dữ liệu và một số API giới hạn số byte. .length của JavaScript đếm các đơn vị mã UTF-16, nên hầu hết emoji được tính là hai. Khi một biểu mẫu từ chối văn bản trông có vẻ đủ ngắn, thường là biểu mẫu đang đếm một trong hai loại còn lại.
Cách sử dụng
- Nhập hoặc dán văn bản.
- Xem các số liệu được cập nhật liên tục.
- Chỉnh sửa văn bản và so sánh ngay lập tức.
Quyền riêng tư và giới hạn
Văn bản vẫn nằm trong trình duyệt. Việc đếm được thực hiện theo quy tắc máy móc và có thể khác với các giới hạn riêng của từng nền tảng.
Công cụ liên quan
Câu hỏi thường gặp
Công cụ có tải dữ liệu tôi nhập lên không?
Không. Mọi thao tác diễn ra trong tab trình duyệt hiện tại của bạn.
Tại sao số byte có thể lớn hơn số ký tự?
Nhiều ký tự Unicode cần nhiều hơn một byte khi được mã hóa bằng UTF-8.
Các chữ cái có dấu và emoji được đếm như thế nào?
Ký tự được tính theo điểm mã Unicode, vì vậy á, ñ, ü và ¿ đều được tính là một ký tự. Byte được tính theo UTF-8: mỗi chữ cái đó chiếm hai byte, còn hầu hết emoji chiếm bốn byte. Cờ và một số emoji được tạo thành từ nhiều điểm mã, nên được tính là nhiều hơn một ký tự.
Công cụ miễn phí · trong trình duyệt của bạn lượt chạy · không cần tài khoản