Como transformar fotos em um PDF pesquisável
- Adicione suas imagens. Solte fotos em JPG, PNG ou WebP na ferramenta, ou toque para escolhê-las. Cada página aparece como um cartão — arraste a alça para reordenar, ou remova as que você não quer.
- Escolha o idioma. Selecione o idioma em que os documentos estão escritos. Os dados de reconhecimento desse idioma são baixados uma vez (o tamanho aparece ao lado do seletor) — suas imagens continuam nunca saindo do seu dispositivo.
- Reconheça. Toque em Reconhecer texto e veja o cartão de cada página passar de aguardando para concluído, com uma contagem de palavras ao vivo. Você pode cancelar no meio; nada fica guardado.
- Confira e baixe. O texto reconhecido é mostrado por página, para você conferir antes de confiar nele. Dê um nome ao arquivo final, depois baixe o PDF pesquisável, pegue o .txt puro, ou copie tudo para a área de transferência.
O que faz
- OCR de verdade no seu navegador — os arquivos nunca são enviados a lugar nenhum
- Várias fotos viram um único PDF de várias páginas, na ordem que você escolher
- Camada de texto invisível: o PDF parece a sua foto, mas é pesquisável e o texto pode ser copiado
- 15 idiomas de reconhecimento, baixados sob demanda
- Também exporta o texto reconhecido puro como um arquivo .txt
O que é, de fato, um PDF pesquisável
A foto de um recibo é só pixels — você não consegue pesquisar nele, selecionar o total, ou copiar o nome do estabelecimento. Um PDF pesquisável adiciona uma segunda camada, invisível, por cima da imagem: o texto reconhecido, posicionado onde ele aparece na foto. A página continua parecendo exatamente com a sua foto, mas o Preview, o Adobe Reader, o Spotlight e qualquer sistema de documentos agora conseguem lê-la.
Esta ferramenta monta esse arquivo no seu navegador. Ela decodifica suas imagens, roda o mecanismo de reconhecimento de código aberto Tesseract compilado para WebAssembly, e monta um PDF com o pdf-lib — tudo dentro da página que você está vendo agora. Nada é transmitido. Esse é o ponto principal: recibos, contratos, cartas médicas e documentos de identidade são exatamente os arquivos que você não deveria entregar a um site conversor qualquer em troca de OCR grátis.
Quando usar
- Fotos de documentos em papel que você quer conseguir encontrar depois — recibos, garantias, cartas, formulários.
- Digitalizações que saíram de um scanner como imagens simples.
- Qualquer coisa que você não colaria no site de um desconhecido.
Por que a posição importa na camada de texto
As palavras reconhecidas não são simplesmente anexadas ao arquivo — cada uma é posicionada de forma invisível nas coordenadas em que aparece na foto. É isso que faz a seleção parecer natural: arraste sobre a imagem e o destaque acompanha as linhas impressas, procure uma palavra e o visualizador pula direto para o lugar certo na página. A geometria é aproximada, do mesmo jeito que é em arquivos produzidos por scanners de escritório, e isso é normal para encontrar e copiar texto.
Limitações, com honestidade
O OCR feito no dispositivo é mais lento que uma fazenda de servidores, e ele lê texto impresso, não letra manuscrita. Textos muito pequenos ou borrados podem sair errados — a exportação em .txt facilita a conferência. As imagens são reduzidas para cerca de 2.500 px no lado maior para acelerar o reconhecimento; a imagem embutida na página mantém até 4.000 px, o que imprime bem em tamanho carta.
Se você faz isso com frequência
Esta ferramenta é um conversor de uso único. Se o seu rolo de câmera é onde os documentos vão para desaparecer, esse é exatamente o problema que o Paperlock existe para resolver: ele digitaliza, lê e arquiva seus papéis no seu iPhone — com a mesma regra de que nada sai do seu dispositivo sem criptografia.