UTF-8 mã hóa và giải mã
Chuyển đổi cục bộ giữa văn bản và biểu diễn byte UTF-8, hỗ trợ hệ thập lục phân, BOM, vị trí byte không hợp lệ và thông báo lỗi.
Xử lý cục bộ trên trình duyệt
Trang này đã vượt qua kiểm tra thư mục công khai; bật JavaScript để sử dụng đầy đủ tính năng.
Hướng dẫn sử dụng
Cách sử dụng UTF-8 để mã hóa và giải mã
UTF-8 chỉ xử lý dữ liệu nhập trong bộ nhớ của trình duyệt hiện tại, không kết nối mạng, tải lên hoặc ghi vào bộ nhớ lâu dài.
Nội dung nhập vào
Nhập văn bản Unicode hoặc byte thập lục phân UTF-8.
Chọn hướng
Chọn mã hóa văn bản hoặc giải mã byte, đồng thời thiết lập định dạng dấu phân cách hệ thập lục phân.
Kết quả kiểm tra
Xem BOM, vị trí byte và thông tin lỗi, sau đó sao chép hoặc tải xuống.
Các hạn chế và lưu ý
- Mỗi lần nhập tối đa 1 MiB; khi đầu ra vượt quá 2 MiB, hệ thống sẽ từ chối tạo kết quả đầy đủ.
- Giải mã chỉ chấp nhận văn bản UTF-8 hợp lệ, không ngụy trang dữ liệu nhị phân tùy ý thành ký tự có thể đọc.
- Các byte không hợp lệ sẽ báo cáo vị trí; kết quả không thể thay thế việc kiểm tra cấu hình bộ ký tự của hệ thống đích.
Câu hỏi thường gặp
Tại sao tiếng Trung chiếm nhiều byte?
UTF-8 sử dụng mã hóa độ dài biến đổi, tiếng Trung thường được biểu diễn bằng nhiều byte.
BOM có tự động bị xóa không?
Công cụ sẽ hiển thị và xử lý riêng BOM, không âm thầm loại bỏ dữ liệu người dùng nhập.
Có tải văn bản lên không?
Không, quá trình xử lý chỉ diễn ra trong trình duyệt hiện tại.