TanodTools
RU

Изображение в текст (OCR)

Извлеките слова с фото, отсканированной страницы или скриншота: их можно скопировать, отредактировать или сохранить.

Обрабатывается на нашем сервере, затем удаляется

Перетащите сюда изображение

JPG, PNG или WebP. Или перетащите его сюда либо вставьте скриншот (Ctrl+V).

Отправляется на наш сервер только для этой задачи, затем удаляется. Никогда не хранится и не записывается в журналы.

Проверяем, сколько бесплатных серверных задач осталось на сегодня…

Одно изображение за раз: JPG, PNG, WebP и другие форматы, которые открывает ваш браузер, до 40 МБ на входе (оно подготавливается на вашем устройстве, затем отправляется размером до 10 МБ). Текст на английском языке. Обрабатывается на нашем сервере, затем удаляется. 10 бесплатных серверных задач в день на человека, общих для всех серверных инструментов. Больше: OCR API (оплата за вызов).

Как получить текст из изображения

  1. Выберите изображение, перетащите его на страницу или вставьте скриншот сочетанием Ctrl+V (Cmd+V на Mac).
  2. Проверьте предпросмотр: текст должен быть расположен правильно, не вверх ногами и не боком.
  3. Нажмите Извлечь текст, затем скопируйте текст или сохраните его файлом .txt.

От картинки к тексту

Для компьютера фотография страницы — это просто разноцветные точки. OCR, оптическое распознавание символов, находит в этих точках формы букв и превращает их обратно в текст, который можно искать, редактировать и вставлять. Этот инструмент отправляет на наш сервер одну подготовленную копию вашего изображения, где её считывает движок Tesseract, и за несколько секунд показывает вам слова.

Советы для лучшего результата

  • Держите телефон ровно над страницей при хорошем освещении и заполните кадр текстом.
  • Уберите всё, что не является текстом, с помощью «Обрезать изображение», а боковые снимки поверните инструментом «Повернуть изображение». Оба работают в вашем браузере.
  • Есть целый отсканированный документ? Инструмент «Распознавание текста в PDF (OCR)» сделает поиск по самому PDF возможным.

Вопросы и ответы

Моё изображение загружается на сервер?

Да. В отличие от большинства инструментов на этом сайте, этот работает на нашем сервере. Сначала ваш браузер готовит копию изображения (поворачивает как нужно и меняет размер для распознавания), затем отправляет эту копию по HTTPS. Сервер считывает текст и сразу возвращает его. Изображение существует на сервере только пока выполняется задача, в памяти и во временной закрытой папке, которая удаляется сразу после завершения задачи. Мы не храним ни изображение, ни текст и никогда не записываем содержимое файлов в журналы.

Как он считывает текст?

С помощью OCR-движка Tesseract с открытым исходным кодом. Браузер масштабирует изображение так, чтобы буквы имели размер, который Tesseract хорошо читает (длинная сторона от 1600 до 3200 пикселей), а наш сервер распознаёт его и возвращает слова в порядке чтения, строка за строкой.

Какие языки поддерживаются?

Английский, а также другие языки, которые пишутся теми же латинскими буквами без диакритических знаков, но с меньшей точностью. Буквы с диакритикой, другие письменности и рукописный текст пока распознаются ненадёжно.

Почему некоторые слова распознаны неверно?

OCR лучше всего работает с чётким, ровным и хорошо освещённым текстом. Размытые фото, текст под углом, декоративные шрифты, низкий контраст и текст поверх картинок приводят к ошибкам. Результат можно править перед копированием, так что одно-два слова легко исправить.

Можно ли вставить скриншот?

Да. Скопируйте скриншот в буфер обмена и нажмите Ctrl+V (Cmd+V на Mac) в любом месте этой страницы.

Есть ли ограничение?

Одно изображение на задачу, 10 бесплатных серверных задач в день на человека, общих для всех наших серверных инструментов. Учитываются только успешные задачи, а счётчик сбрасывается в полночь по UTC. Для большего объёма есть OCR API с оплатой за вызов.

Что это за проверка, что я не робот?

Перед выполнением задачи Cloudflare Turnstile проверяет, что инструментом пользуется человек, а не бот. Обычно она незаметна; иногда просит поставить флажок.