Skip to content
freeonlinefileconvert

OCR PDF

Adicione uma camada de texto invisível a um PDF escaneado para poder pesquisar nele e copiar o texto, sem mudar a aparência de nenhuma página.

ou arraste para cá · até 50 MB, grátis

Arquivos maiores? Com o Pro você converte arquivos de até 500 MB

Isso passa do limite da versão grátis

Você pode fazer mesmo assim: converta agora e pague € 1,99 só se quiser baixar o resultado.

A versão grátis aceita arquivos de até 50 MB e até 20 arquivos por vez.

Grátis · Sem cadastro · Sem marca d’água · Seus arquivos nunca saem do seu dispositivo

OCR PDF em 3 passos

  1. Selecione seu PDF escaneado ou arraste-o para a caixa.
  2. Escolha o idioma do texto (e um segundo, se o documento misturar dois) e clique em Aplicar OCR.
  3. Baixe o PDF pesquisável ou todo o texto reconhecido em um arquivo TXT.

Como o OCR transforma uma digitalização em PDF pesquisável

Uma página escaneada é só uma foto do papel: não dá para pesquisar nela, selecionar uma frase ou copiar um valor. O OCR (reconhecimento óptico de caracteres) lê as letras dessa imagem e as adiciona à página como uma camada de texto invisível, posicionada exatamente sobre cada palavra. A página continua igual, mas agora o Ctrl+F encontra palavras, você pode destacar e copiar texto no Acrobat, no Pré-Visualização, no Chrome ou no Edge, e o Windows, o macOS, o Google Drive ou seu sistema de documentos conseguem indexar o arquivo.

O texto é reconhecido no seu dispositivo pelo Tesseract, um mecanismo de OCR de código aberto. Cada página é lida em até 300 DPI; as páginas que já têm texto ficam como estão e as escaneadas de lado ou de cabeça para baixo são desviradas. Funciona melhor com texto impresso e nítido, como cartas, notas fiscais, contratos, livros e formulários. Letra de mão, letras muito pequenas, páginas desbotadas e fotos tiradas de ângulo geram mais erros, e as tabelas saem como texto, não como células. Na primeira vez que você usa um idioma, o modelo de leitura dele (de 1 a 3 MB) é baixado deste site e fica guardado no navegador.

Perguntas frequentes

Meu PDF muda de aparência depois do OCR?

Não. As páginas, imagens e desenhos originais não são alterados nem comprimidos de novo. O OCR só adiciona uma camada de texto invisível sobre cada página, então o arquivo fica igual e cresce poucos kilobytes por página. Páginas escaneadas de lado são desviradas para facilitar a leitura.

Quais idiomas ele consegue ler?

Vinte e quatro: português, inglês, espanhol, francês, alemão, italiano, holandês, polonês, turco, indonésio, vietnamita, japonês, chinês simplificado e tradicional, coreano, russo, ucraniano, árabe, hindi, catalão, tcheco, grego, romeno e sueco. Você pode escolher dois ao mesmo tempo para documentos que misturam idiomas, como português e inglês.

Qual é a precisão do reconhecimento de texto?

Em uma digitalização limpa de texto impresso, quase todas as palavras saem certas: nos nossos testes com digitalizações de escritório a 200 DPI, mais de 98% dos caracteres foram lidos corretamente. Letra de mão, fontes minúsculas ou decorativas, digitalizações borradas e fundos coloridos diminuem a precisão, então confira nomes e números importantes.

Quanto tempo o OCR demora?

Alguns segundos por página em um computador recente e mais ou menos o dobro no celular, além de um download rápido do modelo do idioma na primeira vez. Uma digitalização de 20 páginas costuma levar de um a três minutos. Deixe a aba aberta enquanto ele trabalha; páginas que já têm texto são puladas.

Posso receber o texto em um arquivo TXT?

Sim. Ao lado do PDF pesquisável, você pode baixar todo o texto reconhecido em um arquivo TXT, página por página, pronto para colar no Word, no Google Docs ou em um e-mail. Para fotos e capturas de tela, use nossa ferramenta Imagem para texto, que funciona do mesmo jeito.

Meu PDF é enviado para algum servidor?

Não. As páginas são lidas por um mecanismo de OCR que roda dentro do seu navegador, no seu próprio dispositivo, então contratos, laudos médicos e documentos de identidade nunca são enviados para nós nem guardados em lugar nenhum. Só o mecanismo de OCR e o modelo do idioma são baixados deste site, uma vez, e ficam no navegador.

Ferramentas relacionadas

Você está entre os primeiros

O FreeOnlineFileConvert acabou de ser lançado. Crie agora uma conta grátis e entre na nossa lista Family & Friends: o plano Pro completo, grátis para sempre.

Pro0 €6,99 €
Entrar de graça