Transforme PDFs digitalizados e com apenas imagem em texto pesquisável e selecionável. Reconheça 10 idiomas, extraia texto para um arquivo .txt ou crie um PDF pesquisável com uma camada de texto invisível. Tudo é executado no seu navegador.
Reconheça inglês, chinês (simplificado e tradicional), japonês, coreano, espanhol, francês, alemão, português e árabe — ou combine vários de uma vez.
Crie um PDF com uma camada de texto invisível, para que páginas digitalizadas se tornem pesquisáveis e selecionáveis em qualquer leitor.
Extraia o texto reconhecido para um arquivo .txt simples, com separadores de página, pronto para editar ou copiar.
Escolha o formato de saída, a qualidade do OCR e um intervalo específico de páginas — sem precisar processar o documento inteiro.
Todo o processamento acontece localmente no seu navegador. Seus arquivos nunca são enviados a nenhum servidor.
Funciona em qualquer dispositivo com um navegador. Sem cadastro, sem marcas d'água e completamente grátis.
O OCR (Reconhecimento Óptico de Caracteres) converte imagens de texto em texto legível por máquina. PDFs digitalizados são, na prática, imagens de páginas — as palavras não podem ser pesquisadas, copiadas ou selecionadas. Esta ferramenta renderiza cada página e reconhece o texto com um mecanismo de OCR de rede neural, permitindo que você exporte o texto reconhecido ou o grave de volta no PDF como uma camada de texto invisível. O resultado é um documento onde você pode pesquisar palavras, selecionar e copiar frases e indexar o conteúdo automaticamente. Todo o processamento acontece localmente no seu navegador, então seus documentos nunca saem do seu dispositivo.
Executar OCR leva apenas alguns passos. Tudo acontece no seu navegador.
Arraste e solte um PDF digitalizado ou com apenas imagem, ou clique na área de upload para selecioná-lo.
Selecione o(s) idioma(s), o formato de saída (texto ou PDF pesquisável), a qualidade e um intervalo opcional de páginas. Os padrões funcionam para a maioria dos documentos.
Clique em Iniciar OCR. Cada página selecionada é renderizada e reconhecida automaticamente.
Baixe o arquivo .txt extraído ou o PDF pesquisável. Para saída de texto, uma pré-visualização mostra o conteúdo reconhecido.
Para obter os melhores resultados, use digitalizações claras e de alta resolução e selecione o(s) idioma(s) correto(s). Textos muito pequenos, borrados ou muito estilizados podem ser reconhecidos com menor precisão. PDFs protegidos por senha devem ser desbloqueados antes do OCR. A primeira execução do OCR carrega o mecanismo de reconhecimento e os dados de idioma, o que pode levar alguns segundos; as execuções seguintes são mais rápidas. Configurações de qualidade mais alta melhoram a precisão, mas desaceleram o processamento. O árabe e alguns alfabetos são reconhecidos melhor quando seu idioma é selecionado sozinho.