Obraz na tekst (OCR)
Wydobądź słowa ze zdjęcia, zeskanowanej strony lub zrzutu ekranu, gotowe do skopiowania, edycji lub zapisania.
Przetwarzane na naszym serwerze, potem usuwane
Upuść obraz tutaj
JPG, PNG lub WebP. Możesz też przeciągnąć obraz tutaj albo wkleić zrzut ekranu (Ctrl+V).
Wysyłane na nasz serwer tylko do tego jednego zadania, potem usuwane. Nigdy nie jest zapisywane ani rejestrowane w logach.
Jeden obraz naraz: JPG, PNG, WebP i inne formaty otwierane przez przeglądarkę, na początek do 40 MB (jest przygotowywany na Twoim urządzeniu, a potem wysyłany w rozmiarze do 10 MB). Tekst angielski. Przetwarzane na naszym serwerze, potem usuwane. 10 bezpłatnych zadań na serwerze dziennie na osobę, wspólnych dla wszystkich narzędzi serwerowych. Więcej: API OCR (płatne za wywołanie).
Jak uzyskać tekst z obrazu
- Wybierz obraz, przeciągnij go na stronę albo wklej zrzut ekranu skrótem Ctrl+V (Cmd+V na Macu).
- Sprawdź podgląd: tekst powinien być ustawiony we właściwą stronę.
- Kliknij Wyodrębnij tekst, a potem skopiuj tekst lub zapisz go jako plik .txt.
Od obrazu do tekstu
Dla komputera zdjęcie strony to tylko kolorowe kropki. OCR, czyli optyczne rozpoznawanie znaków, znajduje w tych kropkach kształty liter i zamienia je z powrotem w tekst, który można przeszukiwać, edytować i wklejać. To narzędzie wysyła jedną przygotowaną kopię obrazu na nasz serwer, gdzie odczytuje ją silnik Tesseract, i w kilka sekund pokazuje słowa.
Wskazówki dla lepszych wyników
- Trzymaj telefon prosto nad stroną, w dobrym świetle, i wypełnij kadr tekstem.
- Odetnij wszystko, co nie jest tekstem, narzędziem Przytnij obraz, a zdjęcia obrócone bokiem obróć narzędziem Obróć obraz. Oba działają w przeglądarce.
- Masz cały zeskanowany dokument? OCR dla PDF sprawia, że sam plik PDF można przeszukiwać.
Najczęstsze pytania
Czy mój obraz jest przesyłany?
Tak. W przeciwieństwie do większości narzędzi na tej stronie, to działa na naszym serwerze. Przeglądarka najpierw przygotowuje kopię obrazu (obróconą do pionu i przeskalowaną do odczytu), a potem wysyła ją przez HTTPS. Serwer odczytuje tekst i od razu odsyła go z powrotem. Obraz istnieje na serwerze tylko podczas wykonywania zadania, w pamięci i w prywatnym folderze tymczasowym, który jest usuwany z chwilą zakończenia zadania. Nie zapisujemy obrazu ani tekstu i nigdy nie rejestrujemy w logach zawartości plików.
Jak odczytywany jest tekst?
Za pomocą silnika OCR Tesseract o otwartym kodzie źródłowym. Przeglądarka skaluje obraz tak, aby litery miały rozmiar dobrze odczytywany przez Tesseract (dłuższy bok od 1600 do 3200 pikseli), nasz serwer go odczytuje i zwraca słowa w kolejności czytania, wiersz po wierszu.
Jakie języki działają?
Angielski oraz inne języki zapisywane tymi samymi literami łacińskimi bez znaków diakrytycznych, z niższą dokładnością. Litery z akcentami, inne alfabety i pismo odręczne nie są jeszcze rozpoznawane wiarygodnie.
Dlaczego niektóre słowa są błędne?
OCR działa najlepiej na ostrym, prostym, dobrze oświetlonym tekście. Rozmyte zdjęcia, tekst pod kątem, ozdobne czcionki, niski kontrast i tekst na tle obrazów powodują błędy. Wynik można edytować przed skopiowaniem, więc możesz poprawić słowo czy dwa.
Czy mogę wkleić zrzut ekranu?
Tak. Skopiuj zrzut ekranu do schowka i naciśnij Ctrl+V (Cmd+V na Macu) w dowolnym miejscu tej strony.
Czy jest jakiś limit?
Jeden obraz na zadanie, 10 bezpłatnych zadań na serwerze dziennie na osobę, wspólnych dla wszystkich naszych narzędzi serwerowych. Liczą się tylko zadania zakończone sukcesem, a licznik odnawia się o północy UTC. Jeśli potrzebujesz więcej, API OCR jest płatne za wywołanie.
Czym jest weryfikacja, że nie jesteś botem?
Przed uruchomieniem zadania Cloudflare Turnstile sprawdza, czy z narzędzia korzysta człowiek, a nie bot. Zwykle jest niewidoczna; czasem prosi o zaznaczenie pola.