PDF para Texto
Obtenha texto limpo e editável dos seus PDFs, incluindo páginas escaneadas. Copie ou salve como arquivo .txt.
Por que não consigo copiar texto de alguns PDFs?
Alguns PDFs contêm uma imagem do texto, e não o texto propriamente dito. Uma página escaneada é apenas uma imagem, então não há nada para selecionar ou copiar. Este conversor lê o texto real direto do PDF sem OCR, o que é rápido e exato. O OCR é usado apenas nas páginas que são imagens.
Para que as pessoas usam PDF para texto
Trabalho
- Copiar cláusulas de um contrato ou uma carta escaneada
- Reaproveitar texto de um relatório ou apresentação salvos como PDF
- Obter os detalhes de uma fatura ou extrato bancário
- Colar o texto em um editor de texto ou planilha para editá-lo
Estudos e pesquisa
- Citar um artigo acadêmico sem precisar digitá-lo de novo
- Transformar páginas de livro escaneadas em anotações pesquisáveis
- Extrair o texto de slides de aula e apostilas
- Reunir citações de vários PDFs de uma só vez
Uso do dia a dia
- Colar um PDF em ferramentas de chat de IA para resumir ou fazer perguntas
- Copiar texto de um PDF que não deixa você selecionar
- Colar o texto em um tradutor
- Salvar um manual, formulário ou receita como arquivo de texto simples
Como converter um PDF para texto
- 1
Adicione seus PDFs
Arraste seus PDFs para a área no topo desta página, ou clique para escolhê-los. Você pode adicionar até 20 de uma vez.
- 2
Deixe as páginas serem lidas
Páginas com texto real são lidas na hora. Páginas escaneadas são identificadas automaticamente e lidas com OCR no idioma que você escolher. Não há modo para alternar.
- 3
Copie ou baixe
Edite o texto se quiser, depois copie-o ou salve-o como arquivo .txt. Com vários PDFs, baixe tudo em um único arquivo .txt ou em um ZIP.
Converta PDFs escaneados em texto com OCR
Um PDF escaneado é uma imagem de cada página, então seu texto precisa ser lido com OCR (reconhecimento óptico de caracteres). Este conversor verifica cada página individualmente e lê as escaneadas com OCR automaticamente.
- Cada página é marcada como texto, OCR ou em branco, para você ver quais foram escaneadas.
- Páginas cujo texto copia como caixas ou símbolos estranhos são tratadas como escaneadas e também lidas com OCR.
- Páginas escaneadas são lidas no idioma que você escolher. Selecione entre 18 idiomas, até 3 de uma vez.
- Se o texto de uma página parecer errado, clique no número da página e escolha Ler com OCR para lê-la novamente como escaneada.
PDFs mistos também funcionam. Páginas digitadas e escaneadas se juntam em um único texto, na ordem das páginas.
Tem uma foto ou captura de tela em vez de um PDF? Extraia o texto com o conversor de imagem para texto.
Copie texto de um PDF sem quebras de linha
O texto copiado de um PDF geralmente quebra no fim de cada linha. Unir linhas em parágrafos recompõe as frases quebradas, para que o texto seja colado de forma limpa em um documento, e-mail ou ferramenta de chat de IA. Vem ativado por padrão.
A limpeza também corrige outros problemas que deixam o texto de PDF bagunçado:
- Palavras divididas com hífen no fim de uma linha são reunidas em uma só palavra.
- Títulos, itens de lista e linhas de tabela permanecem em suas próprias linhas.
- Remover cabeçalhos, rodapés e números de página elimina os cabeçalhos, rodapés e numerações que se repetem nas páginas. Vem ativado por padrão.
- Marcadores de página como --- Página 3 --- mostram onde cada página começa. Desative-os para obter um bloco de texto único e limpo.
Cada opção atualiza o texto na hora, sem precisar ler o PDF novamente. Desative Unir linhas em parágrafos para manter cada quebra de linha exatamente como está no PDF.
Grátis, privado e ilimitado
Este conversor de PDF para texto é gratuito, sem cadastro e sem conta. Você também tem:
- Privacidade. Seu PDF fica no seu dispositivo. Ele é aberto e lido diretamente no seu celular ou computador, e o arquivo nunca é enviado a um servidor.
- Sem limite de páginas e sem limite diário. Cada PDF pode ter até 100 MB, e você pode adicionar até 20 de uma vez.
- Arquivos protegidos tratados com cuidado. Um PDF protegido por senha é aberto com sua senha no seu dispositivo, e a senha não é salva.
Na primeira vez que uma página escaneada é lida, o leitor de OCR é baixado uma vez (cerca de 4 MB para inglês). Ele fica salvo no seu navegador, então leituras futuras são mais rápidas. PDFs só com texto real não precisam dele.
Qual é a melhor forma de extrair texto de um PDF?
Ler o texto que o PDF já contém, e usar OCR apenas nas páginas escaneadas, no idioma correto. Isso mantém as páginas digitadas exatas e as escaneadas o mais precisas possível. Esta ferramenta faz essa escolha para você, página por página.
Estas dicas ajudam a obter um texto mais limpo:
- Escolha o idioma de OCR correto. Alemão lido como inglês perde os trema, por exemplo.
- Escolha até 3 idiomas para escaneamentos com idiomas misturados.
- Use um escaneamento nítido e reto. Páginas apagadas ou tortas geram mais erros.
- Se uma página sair bagunçada, clique no número da página e escolha Ler com OCR.
- Confira nomes, números e endereços de e-mail em páginas escaneadas. São os mais fáceis de ler errado.
Quanto tempo leva para fazer OCR de um PDF? Páginas com texto real são lidas quase instantaneamente, mesmo em um PDF longo. Cada página escaneada leva alguns segundos, e você pode acompanhar o progresso ou parar a qualquer momento.
O OCR é feito para texto impresso. Letras manuscritas e escaneamentos ruins costumam gerar erros. Layouts complexos, como revistas e formulários, também podem sair em ordem confusa, então revise o texto antes de usá-lo.
Ferramentas relacionadas
Mais ferramentas gratuitas para PDFs e imagens
Perguntas frequentes
Páginas escaneadas, idiomas, limites e privacidade