Não. O reconhecimento acontece no seu navegador via WebAssembly; a imagem nunca sai do seu dispositivo. Apenas os arquivos do motor de OCR e do idioma escolhido são baixados de um CDN na primeira vez, e depois ficam em cache.
Extraia o texto de fotos, prints e documentos digitalizados com OCR em português e mais idiomas, direto no navegador, sem enviar a imagem.
OCR (Reconhecimento Óptico de Caracteres) é a tecnologia que identifica letras e palavras dentro de uma imagem e as transforma em texto que você pode copiar, buscar e editar. Esta ferramenta usa o Tesseract, um dos motores de OCR de código aberto mais conhecidos, compilado para WebAssembly e executado inteiramente no seu navegador. Você arrasta (ou cola) uma ou várias fotos, prints ou documentos digitalizados, escolhe um ou mais idiomas, incluindo português com acentuação, e o texto é extraído localmente, sem que a imagem saia do seu dispositivo. Na primeira execução, o navegador baixa o motor e os dados do idioma escolhido (cerca de 11 MB por idioma) de um CDN, e a interface diz exatamente o que está sendo baixado, em vez de deixar a barra parada perto de zero. O reconhecimento pode ser cancelado a qualquer momento. Antes da leitura, a imagem é automaticamente aumentada, contrastada e corrigida (você pode comparar o antes e depois), e é possível recortar ou girar a imagem e escolher um modo de conteúdo (parágrafo, linha única ou disperso/código) para melhorar textos difíceis, como placas, códigos e símbolos. Mostramos a confiança média do reconhecimento e a contagem de palavras, e o resultado pode ser copiado ou baixado como .txt, com a opção de juntar várias imagens em um único documento. Como o processamento é local, é ideal para documentos sensíveis.
Cole o código no seu HTML e a ferramenta aparece na sua página, sem a navegação e sem os anúncios do J-Kit. Ela continua rodando no navegador de quem visita o seu site.
<iframe
src="https://jkit.tools/embed/pt-BR/imagem-para-texto-ocr"
width="100%"
height="600"
style="border:0"
loading="lazy"
title="Imagem para Texto (OCR)"
></iframe>Não. O reconhecimento acontece no seu navegador via WebAssembly; a imagem nunca sai do seu dispositivo. Apenas os arquivos do motor de OCR e do idioma escolhido são baixados de um CDN na primeira vez, e depois ficam em cache.
Na primeira execução, o navegador baixa os dados do idioma (~11 MB no total) de um CDN. Depois disso, ficam em cache.
Use “Disperso/Código” para placas, números de série, códigos ou textos curtos sem frases (como código Morse). No modo Automático, a ferramenta já tenta esse modo sozinha quando o resultado inicial tem confiança baixa.
O reconhecimento roda inteiramente no seu navegador (WebAssembly). A imagem nunca é enviada a servidores; apenas os arquivos do motor de OCR e dos idiomas são baixados de um CDN na primeira vez.