Ferramenta de imagem / 28

Imagem para Texto (OCR)

Extraia o texto de uma foto ou captura de tela no seu navegador, em doze idiomas, sem fazer upload.

Imagem para Texto (OCR): TOEA executa um mecanismo completo de reconhecimento óptico de caracteres compilado para WebAssembly, lê os caracteres na imagem e reúne as linhas em parágrafos para que o resultado seja lido como texto corrido. Roda 100% localmente no seu navegador, sem enviar nenhum arquivo para o servidor.

Execuções
No seu navegador
Custo
Grátis · sem cadastro
Disponibilidade
Pronto para usar
Área imagem → textoProcessamento local

Roda inteiramente no seu navegador

↥
Escolha uma imagem

PNG, JPG, WebP, or BMP · até 30 MB, nunca enviado

Escolhendo o idioma

Escolha o idioma em que o texto está escrito antes de fazer a leitura. O modelo de linguagem fornece o alfabeto e o vocabulário usados pelo mecanismo para verificar suas suposições. Por isso, selecionar inglês para uma página em francês elimina ou distorce os acentos, e um modelo de escrita latina transforma textos em chinês, japonês, coreano, árabe ou russo em algo sem sentido. Em uma página que mistura idiomas, escolha o principal e espere erros no restante.

Verificando os parágrafos unidos

Com as linhas unidas em parágrafos, um hífen no fim da linha é interpretado como uma separação de palavra e removido. Assim, um composto real quebrado nesse ponto, como well- seguido de known, volta como wellknown. As linhas são unidas com um espaço, o que também insere um espaço a cada quebra de linha em textos em chinês ou japonês, onde ele não deveria existir. Desative a opção para esses idiomas e para tabelas, listas, endereços e código, nos quais as quebras de linha têm significado. Para um PDF digitalizado, use OCR de PDF.

Como usar

  1. Escolha uma imagem.
  2. Selecione o idioma do texto.
  3. Leia o resultado e copie ou baixe.

Privacidade e limitações

Seu arquivo nunca é enviado. O mecanismo de reconhecimento e o modelo de idioma são baixados uma vez — cerca de 10 MB — e armazenados em cache pelo seu navegador; depois, tudo roda na sua própria máquina. Serviços de OCR hospedados funcionam ao contrário: eles querem o documento.

Ferramentas relacionadas

Perguntas frequentes

Por que a primeira execução é lenta?

O mecanismo e o modelo de idioma precisam ser baixados na primeira vez, cerca de 10 MB. Depois disso, seu navegador os mantém em cache e as execuções seguintes começam imediatamente.

Qual é a precisão?

Uma captura de tela limpa costuma ficar quase perfeita. Uma foto de celular de uma página em ângulo, ou texto pequeno ou borrado, vai conter erros. A pontuação de confiança acima do resultado indica qual é o caso, e sempre vale conferir com o original.

Consegue ler escrita à mão?

Não. O mecanismo foi treinado em texto impresso; escrita à mão é outro problema e vai gerar resultados sem sentido.

O que melhora o resultado?

Mais pixels, texto mais reto e maior contraste. Recorte só o texto e fotografe a página plana, e não em ângulo.

Ferramenta grátis · no seu navegador execuções · não precisa de conta