OT OCR Tools

Imagem para PDF pesquisável

Transforme uma digitalização, captura de ecrã ou foto num PDF pesquisável no navegador com OCR Tesseract.js e pdf-lib. Sem envio de ficheiros.

🔒 Executa completamente no seu navegador — nada é enviado

Drop one image here or click to browse

The visible image and OCR text layer are assembled locally.

Choose an image to begin.

0%

Advertisement

Torne pesquisável uma imagem digitalizada

Uma foto ou captura de ecrã de um documento é fácil de partilhar, mas difícil de pesquisar. As palavras fazem parte da imagem, por isso um leitor de PDF não consegue encontrar um nome, um número de fatura ou um parágrafo dentro do ficheiro. Esta ferramenta de Imagem para PDF pesquisável mantém a sua imagem original como página visível e acrescenta ao PDF o texto OCR, para que os leitores possam pesquisar e selecionar o conteúdo reconhecido. É útil para digitalizações de uma só página, recibos, cartas, formulários, fotografias de quadros brancos e capturas de ecrã que pretende arquivar em PDF.

Tudo corre no navegador. O Tesseract.js lê a imagem carregada com OCR WebAssembly e o pdf-lib cria um novo documento PDF sem contactar qualquer servidor. A página tem o tamanho da imagem, pelo que o PDF fica igual ao ficheiro de origem. Sobre a imagem é desenhada uma pequena camada de texto com baixa opacidade, para que as palavras reconhecidas fiquem disponíveis na pesquisa do PDF e nas ferramentas de seleção de texto. A imagem, o resultado do OCR e o PDF final permanecem na memória local do navegador até transferir o ficheiro.

Como obter melhores PDF pesquisáveis

Comece com a imagem mais nítida que tiver. Digitalizações direitas e capturas de ecrã nítidas costumam funcionar melhor do que fotos de telemóvel tiradas na diagonal. Se fotografar papel, coloque o documento numa superfície plana, use iluminação uniforme e mantenha a câmara paralela à página. Sempre que possível, recorte secretárias, margens e sombras antes de carregar. Um bom contraste entre as letras e o fundo ajuda o OCR a separar os carateres, sobretudo em letra pequena.

Selecione o idioma que corresponde ao documento antes de criar o PDF. Na primeira vez que um idioma é usado, o navegador pode transferir o motor de OCR e o modelo, o que pode tornar a primeira tarefa mais lenta; as seguintes costumam ser mais rápidas porque os ficheiros ficam em cache. O OCR não é perfeito, por isso pesquise termos importantes no PDF final e compare-os com a imagem original antes de usar o ficheiro em registos, contratos, faturas ou outros fluxos de trabalho de alta precisão.

O que contém o PDF gerado

O PDF de saída contém uma página com a imagem original em tamanho real e uma camada de texto selecionável gerada por OCR. Isto torna o ficheiro prático para arquivos pessoais, aplicações de notas, pastas de documentos e anexos de e-mail em que se prefere PDF a uma imagem. A camada de texto foi concebida para facilitar a pesquisa e não para uma reconstrução visual perfeita, pelo que colunas complexas, tabelas ou escrita manual podem não ficar alinhadas exatamente. Para trabalhos com várias páginas, use as ferramentas de OCR de PDF ou de OCR em lote e combine os ficheiros com um editor de PDF dedicado, se necessário.

Como usar

  1. Adicione uma imagemArraste uma digitalização, captura de ecrã ou foto para a caixa de carregamento, ou clique para procurar.
  2. Escolha o idiomaSelecione o idioma que melhor corresponde ao texto da imagem.
  3. Crie o PDFExecute o OCR, incorpore a imagem numa página PDF e adicione uma camada de texto pesquisável.
  4. TransfiraGuarde o PDF pesquisável diretamente a partir do navegador.

Perguntas frequentes

A minha imagem é enviada para criar o PDF?
Não. O OCR é executado localmente com o Tesseract.js e o pdf-lib cria o PDF no seu navegador. A imagem e o PDF pesquisável ficam no seu dispositivo.
Porque é que o primeiro PDF pesquisável é mais lento?
Na primeira execução são transferidos o motor de OCR e o modelo do idioma selecionado. O navegador costuma guardá-los em cache para que as execuções seguintes sejam mais rápidas.
O texto ficará perfeitamente alinhado com a imagem?
O PDF mantém a imagem original como página visível e acrescenta uma pequena camada de texto de baixa opacidade para pesquisa e seleção. Não é um editor de OCR com layout perfeito.
Que formatos de imagem funcionam?
Use formatos de imagem comuns do navegador, como PNG, JPG, WebP ou capturas de ecrã. A ferramenta converte a imagem numa página PDF localmente.
Advertisement