TanodTools
VI

Chuyển văn bản sang nhị phân

Biến văn bản thành mã nhị phân, hoặc giải mã nhị phân về văn bản dễ đọc. Hoạt động với mọi ngôn ngữ và emoji.

Chạy hoàn toàn trong trình duyệt của bạn

Chuyển đổi

Gõ văn bản để bắt đầu.

Văn bản tối đa 1 MB để mã hóa; nhị phân tối đa 5 MB để giải mã. Kết quả cập nhật khi bạn gõ.

Cách chuyển văn bản sang nhị phân

  1. Chọn Văn bản sang nhị phân hoặc Nhị phân sang văn bản.
  2. Gõ hoặc dán vào ô. Kết quả hiện ra khi bạn gõ.
  3. Sao chép kết quả hoặc tải xuống dưới dạng tệp .txt. Dùng Đổi chỗ để chuyển kết quả ngược lại.

Văn bản trở thành số 1 và số 0 như thế nào

Máy tính lưu văn bản dưới dạng số. Bảng mã quyết định mỗi ký tự nhận số nào; công cụ này dùng UTF-8, bảng mã mà hầu như mọi trang web, email và tệp hiện đại đều sử dụng. UTF-8 lưu 128 ký tự đầu tiên (bảng chữ cái tiếng Anh, chữ số và dấu câu thông dụng) trong một byte mỗi ký tự, với cùng giá trị như mã ASCII cũ hơn. Các ký tự khác chiếm từ hai đến bốn byte: é là 11000011 10101001 và emoji 😀 là bốn byte.

Một byte là tám bit, nên mỗi byte được hiển thị thành tám chữ số nhị phân, giữ lại các số 0 đứng đầu để mọi nhóm đều cùng độ rộng. Điều đó giúp kết quả dễ đọc lại: mỗi nhóm tám là một byte.

Để giải mã, công cụ đọc mỗi nhóm như một byte, rồi đọc các byte như văn bản UTF-8. Nếu các byte không tạo thành UTF-8 hợp lệ, công cụ cho biết vấn đề bắt đầu từ đâu thay vì hiển thị các ký tự lỗi.

Mẹo

Câu hỏi thường gặp

Văn bản được chuyển thành nhị phân như thế nào?

Trước tiên mỗi ký tự được chuyển thành các byte bằng UTF-8, bảng mã mà web sử dụng, rồi mỗi byte được viết thành tám chữ số nhị phân. Chữ A là byte 65, tức 01000001. Các chữ cái tiếng Anh thông thường chiếm một byte mỗi chữ; chữ có dấu chiếm hai byte, còn hầu hết emoji chiếm bốn byte.

Cái này có giống chuyển ASCII sang nhị phân không?

Với chữ cái tiếng Anh, chữ số và dấu câu thông thường thì có: UTF-8 cho các ký tự đó cùng giá trị byte như ASCII. Sự khác biệt chỉ hiện ra với các ký tự khác, những ký tự mà ASCII hoàn toàn không biểu diễn được.

Công cụ giải mã được loại nhị phân nào?

Các nhóm tối đa tám chữ số 0 và 1 ngăn cách bằng dấu cách, dấu phẩy hoặc dấu xuống dòng, mỗi nhóm một byte, hoặc một chuỗi chữ số liền nhau có độ dài là bội số của tám. Bất cứ thứ gì khác, như số 2 hoặc một chữ cái, đều được báo kèm vị trí để bạn sửa.

Tại sao khi giải mã lại báo các byte không phải UTF-8 hợp lệ?

Không phải chuỗi byte nào cũng là văn bản hợp lệ. Có thể thiếu hoặc thừa một byte, hoặc nhị phân đến từ một bảng mã cũ hơn hay từ tệp không phải văn bản. Thông báo chỉ ra byte đầu tiên không đọc được. Hãy kiểm tra xem có nhóm nào bị mất khi sao chép nhị phân không.

Các tùy chọn hex, thập phân và bát phân là gì?

Chúng viết cùng các byte đó ở một hệ cơ số khác: hex dùng hai chữ số 0-9 và a-f cho mỗi byte (A là 41), thập phân dùng từ 0 đến 255 (A là 65) và bát phân dùng từ 0 đến 377 (A là 101). Giải mã chấp nhận đúng hệ cơ số bạn chọn.

Văn bản của tôi có bị tải lên không?

Không. Việc chuyển đổi chạy trong trình duyệt của bạn, văn bản không được tải lên hay lưu trữ.