OCR — PDF digitalizado em texto
Reconheça o texto de um PDF digitalizado e recupere-o em .txt ou .docx.
Sobre esta ferramenta
Um contrato assinado e depois digitalizado, um processo antigo escaneado, um comprovante fotografado no celular: esses PDF não têm camada de texto, então nada pode ser pesquisado nem copiado. O reconhecimento óptico de caracteres lê os pixels e devolve palavras. Solte o documento: cada página é renderizada em alta definição e analisada, com o progresso real página a página, e o texto reconhecido aparece página por página.
O motor roda no seu navegador, não em um servidor: um contrato ou um holerite nunca sai do seu aparelho, o que muda tudo em documentos confidenciais. O idioma do documento vem pré-selecionado conforme o idioma do site e muda com um clique, entre sete idiomas. O resultado é baixado em .txt puro ou em .docx pronto para editar no Word. A confiança média é mostrada sem maquiagem: uma digitalização pálida ou torta recebe nota baixa, e é melhor saber agora do que descobrir os erros depois.
Perguntas frequentes
Como sei se o meu PDF precisa de OCR?
A ferramenta verifica assim que você solta o arquivo. Se já encontrar texto selecionável, ela avisa e encaminha para PDF para Word: a extração direta é instantânea e totalmente fiel, enquanto o OCR precisa adivinhar caracteres. Se as páginas forem só imagens, o reconhecimento começa sozinho.
Meus documentos são enviados para algum lugar?
Não. O motor de reconhecimento e os dados do idioma escolhido são baixados uma vez para o seu navegador, e todo o cálculo acontece na sua máquina. Nenhuma página, nenhuma imagem e nenhum texto reconhecido vai para um servidor.
Por que o reconhecimento demora?
Conte alguns segundos por página: é o seu próprio aparelho que analisa cada caractere, sem fazenda de servidores por trás. Na primeira vez soma-se o download dos dados do idioma, alguns megabytes, que depois ficam em cache. Você pode parar no meio e guardar as páginas já processadas.
O resultado tem erros, o que fazer?
Confira primeiro se o idioma selecionado é o certo: um texto em português analisado como inglês sai incompreensível. Depois, a qualidade da digitalização decide tudo — um documento escaneado a 300 dpi, bem plano e com bom contraste, ganha quase sempre de uma foto tirada de lado.
É realmente grátis e sem cadastro?
Sim: a ferramenta é grátis, sem conta e sem limite de uso. O processamento acontece localmente no seu navegador — seus dados nunca saem do seu aparelho.