Imagem para texto (OCR)
Extraia as palavras de uma foto, de uma página digitalizada ou de um print, prontas para copiar, editar ou salvar.
Processado no nosso servidor e depois excluído
Solte uma imagem aqui
JPG, PNG ou WebP. Ou arraste para cá, ou cole um print (Ctrl+V).
Enviado ao nosso servidor só para esta tarefa e depois excluído. Nunca é armazenado nem registrado.
Uma imagem por vez: JPG, PNG, WebP e outros formatos que o seu navegador abre, até 40 MB no início (ela é preparada no seu dispositivo e depois enviada com até 10 MB). Texto em inglês. Processado no nosso servidor e depois excluído. 10 tarefas gratuitas no servidor por dia por pessoa, compartilhadas entre todas as ferramentas de servidor. Para mais: a API de OCR (em inglês, paga por chamada).
Como extrair texto de uma imagem
- Escolha uma imagem, arraste-a para a página ou cole um print com Ctrl+V (Cmd+V no Mac).
- Confira a prévia: o texto deve estar na posição certa, sem estar de lado ou de cabeça para baixo.
- Clique em Extrair texto e depois copie o texto ou salve como arquivo .txt.
Da imagem para o texto
Para um computador, a foto de uma página é só um monte de pontos coloridos. O OCR, reconhecimento óptico de caracteres, encontra o formato das letras nesses pontos e as transforma de volta em texto que você pode pesquisar, editar e colar. Esta ferramenta de imagem para texto envia uma cópia preparada da sua imagem para o nosso servidor, onde o mecanismo Tesseract faz a leitura, e mostra as palavras em segundos.
Dicas para resultados melhores
- Segure o celular reto acima da página, com boa luz, e deixe o texto ocupar todo o enquadramento.
- Corte tudo o que não for texto com Recortar imagem e endireite fotos de lado com Girar imagem. As duas funcionam no seu navegador.
- Tem um documento digitalizado inteiro? OCR de PDF deixa o próprio PDF pesquisável.
Perguntas frequentes
Minha imagem é enviada?
Sim. Diferente da maioria das ferramentas deste site, esta funciona no nosso servidor. Primeiro o seu navegador prepara uma cópia da imagem (na posição certa e redimensionada para leitura) e depois envia essa cópia por HTTPS. O servidor lê o texto e o devolve na hora. A imagem só existe no servidor enquanto a tarefa é executada, na memória e em uma pasta temporária privada que é excluída no momento em que a tarefa termina. Não armazenamos a imagem nem o texto, e nunca registramos o conteúdo dos arquivos.
Como o texto é lido?
Com o mecanismo de OCR de código aberto Tesseract. O seu navegador ajusta a escala da imagem para que as letras fiquem em um tamanho que o Tesseract lê bem (o lado maior entre 1.600 e 3.200 pixels), o nosso servidor faz a leitura e devolve as palavras na ordem de leitura, linha por linha.
Quais idiomas funcionam?
Inglês e, com menos precisão, outros idiomas escritos com as mesmas letras latinas sem acentos. Letras acentuadas, outros sistemas de escrita e letra manuscrita ainda não são reconhecidos de forma confiável.
Por que algumas palavras saem erradas?
O OCR funciona melhor com texto nítido, reto e bem iluminado. Fotos borradas, texto inclinado, fontes decorativas, pouco contraste e texto sobre imagens causam erros. O resultado pode ser editado antes de você copiá-lo, então dá para corrigir uma ou outra palavra.
Posso colar um print?
Sim. Copie um print para a área de transferência e aperte Ctrl+V (Cmd+V no Mac) em qualquer lugar desta página.
Existe algum limite?
Uma imagem por tarefa, 10 tarefas gratuitas no servidor por dia por pessoa, compartilhadas entre todas as nossas ferramentas de servidor. Só contam as tarefas concluídas com sucesso, e a contagem reinicia à meia-noite UTC. Para mais, a API de OCR é paga por chamada.
O que é a verificação humana?
Antes de uma tarefa ser executada, o Cloudflare Turnstile confere se é uma pessoa, e não um robô, que está usando a ferramenta. Geralmente ela é invisível; às vezes pede que você marque uma caixa.