PDF para texto
Envie um arquivo PDF e o FileTinker lê o texto com OCR no dispositivo. Escolha seu idioma e copie ou baixe o resultado — o motor funciona no seu navegador, então seu arquivo nunca é enviado.
O mecanismo de OCR é baixado no primeiro uso (alguns MB) e fica armazenado em cache depois.
Mais predefinições
Vá para outra predefinição — cada uma abre na própria página, pronta para usar:
Como converter PDF para texto
- Escolha seu idioma e envie seu arquivo PDF.
- Aguarde enquanto o motor de OCR lê o texto (a primeira execução baixa o modelo).
- Copie o texto reconhecido ou baixe-o como um arquivo .txt.
Sobre PDF para texto (OCR)
Converter PDF para texto usa OCR — reconhecimento óptico de caracteres — para transformar imagens de texto em texto editável e pesquisável. O FileTinker executa o motor Tesseract como WebAssembly no seu navegador, então seu PDF é reconhecido no seu próprio dispositivo.
Funciona melhor com texto nítido, bem iluminado e com bom contraste. Como tudo funciona no seu navegador, seu PDF permanece privado — nada é enviado, e o motor fica em cache após o primeiro uso.
Isto renderiza cada página do PDF como imagem e roda OCR sobre ela — feito para PDFs digitalizados em que não há texto real por baixo dos pixels. PDFs nativos digitais com texto selecionável também funcionam, mas o OCR os relê a partir da página renderizada, então, quando o texto já é selecionável, copiá-lo diretamente é mais limpo. Para digitalizações, esta é exatamente a ferramenta certa.
Perguntas frequentes
Como converter PDF para texto?
Escolha seu idioma, envie seu arquivo PDF e o OCR do FileTinker, que funciona no navegador, lê o texto. Copie-o ou baixe-o como um arquivo .txt.
Quais idiomas são suportados?
Inglês, chinês tradicional e chinês simplificado, além de um modo combinado de inglês + chinês. Escolha o que corresponde ao seu PDF para a melhor precisão.
O OCR é preciso?
A precisão é melhor com texto nítido, em alta resolução e com bom contraste. Fontes estilizadas e escrita à mão são mais difíceis. Um PDF nítido gera o resultado mais limpo.
Meu PDF é enviado?
Não. Apenas o motor de OCR e o modelo de idioma são baixados; seu PDF é processado totalmente no seu navegador.
Como PDFs de várias páginas são tratados?
Cada página é renderizada com o dobro da escala para glifos mais nítidos, reconhecida em ordem, e o texto é combinado em uma única saída editável. Documentos longos simplesmente demoram proporcionalmente mais — tudo roda localmente, então nada é enviado, não importa a quantidade de páginas.