Ảnh sang văn bản (OCR)
Lấy chữ ra khỏi ảnh chụp, trang giấy đã quét hoặc ảnh màn hình, sẵn sàng để sao chép, chỉnh sửa hoặc lưu.
Được xử lý trên máy chủ của chúng tôi, rồi xóa
Thả ảnh vào đây
JPG, PNG hoặc WebP. Hoặc kéo thả vào đây, hoặc dán ảnh màn hình (Ctrl+V).
Chỉ gửi đến máy chủ của chúng tôi cho tác vụ này, rồi xóa. Không bao giờ lưu trữ hay ghi log.
Mỗi lần một ảnh: JPG, PNG, WebP và các định dạng khác mà trình duyệt của bạn mở được, ban đầu tối đa 40 MB (ảnh được chuẩn bị trên thiết bị của bạn, rồi gửi đi với dung lượng tối đa 10 MB). Văn bản tiếng Anh. Được xử lý trên máy chủ của chúng tôi, rồi xóa. 10 lượt xử lý miễn phí trên máy chủ mỗi ngày cho mỗi người, dùng chung cho mọi công cụ chạy trên máy chủ. Muốn nhiều hơn: OCR API (tính phí theo lượt gọi).
Cách lấy văn bản từ ảnh
- Chọn một ảnh, kéo thả vào trang, hoặc dán ảnh màn hình bằng Ctrl+V (Cmd+V trên máy Mac).
- Kiểm tra bản xem trước: chữ phải ở đúng chiều.
- Nhấn Trích xuất văn bản, rồi sao chép văn bản hoặc lưu thành tệp .txt.
Từ hình ảnh thành văn bản
Với máy tính, ảnh chụp một trang giấy chỉ là những chấm màu. OCR, tức nhận dạng ký tự quang học, tìm hình dạng của các chữ cái trong những chấm đó và biến chúng trở lại thành văn bản mà bạn có thể tìm kiếm, chỉnh sửa và dán. Công cụ này gửi một bản sao đã chuẩn bị của ảnh đến máy chủ của chúng tôi, nơi công cụ Tesseract đọc nó, và hiển thị các từ cho bạn trong vài giây.
Mẹo để có kết quả tốt hơn
Câu hỏi thường gặp
Ảnh của tôi có bị tải lên không?
Có. Không như hầu hết công cụ khác trên trang này, công cụ này chạy trên máy chủ của chúng tôi. Trước tiên trình duyệt của bạn chuẩn bị một bản sao của ảnh (xoay thẳng và đổi kích thước để đọc), rồi gửi bản sao đó qua HTTPS. Máy chủ đọc văn bản và gửi trả lại ngay. Ảnh chỉ tồn tại trên máy chủ trong lúc tác vụ chạy, trong bộ nhớ và trong một thư mục tạm riêng được xóa ngay khi tác vụ kết thúc. Chúng tôi không lưu ảnh hay văn bản, và không bao giờ ghi log nội dung tệp.
Công cụ đọc chữ bằng cách nào?
Bằng công cụ OCR mã nguồn mở Tesseract. Trình duyệt của bạn co giãn ảnh để chữ có kích cỡ mà Tesseract đọc tốt (cạnh dài nhất từ 1.600 đến 3.200 điểm ảnh), máy chủ của chúng tôi đọc ảnh và trả về các từ theo thứ tự đọc, từng dòng một.
Hỗ trợ những ngôn ngữ nào?
Tiếng Anh, và các ngôn ngữ khác viết bằng cùng các chữ cái Latin không dấu, với độ chính xác thấp hơn. Chữ có dấu, các hệ chữ viết khác và chữ viết tay hiện chưa được nhận dạng đáng tin cậy.
Vì sao một số từ bị sai?
OCR hoạt động tốt nhất với chữ sắc nét, thẳng và đủ sáng. Ảnh bị mờ, chữ nghiêng, phông chữ cách điệu, độ tương phản thấp và chữ nằm trên hình ảnh đều gây lỗi. Kết quả có thể chỉnh sửa trước khi sao chép, nên bạn có thể sửa một hai từ.
Tôi có thể dán ảnh màn hình không?
Có. Sao chép ảnh màn hình vào bộ nhớ tạm rồi nhấn Ctrl+V (Cmd+V trên máy Mac) ở bất kỳ đâu trên trang này.
Có giới hạn không?
Một ảnh mỗi tác vụ, 10 lượt xử lý miễn phí trên máy chủ mỗi ngày cho mỗi người, dùng chung cho mọi công cụ chạy trên máy chủ của chúng tôi. Chỉ những tác vụ thành công mới được tính, và bộ đếm đặt lại vào 00:00 UTC. Muốn nhiều hơn, OCR API tính phí theo lượt gọi.
Xác minh người dùng là gì?
Trước khi một tác vụ chạy, Cloudflare Turnstile kiểm tra rằng người thật, không phải bot, đang dùng công cụ. Thường thì bạn không thấy gì; đôi khi nó yêu cầu bạn đánh dấu vào một ô.