PDF para Word (DOCX) – extrair texto
Apenas o texto do PDF é extraído e guardado em .docx – o documento fica no seu dispositivo.
Importante: apenas o texto é convertido. A formatação, as tabelas e as imagens não são mantidas. Os PDF digitalizados (sem camada de texto) não são suportados.
Arraste um ficheiro PDF para aqui
Um ficheiro PDF
Como usar
- Escolha um PDF que contenha texto verdadeiro (em que consiga selecionar palavras com o rato).
- Clique em «Converter para Word» e aguarde – verá qual a página que está a ser processada.
- Verifique a pré-visualização do texto e transfira o ficheiro .docx. Abre-se no Word, no LibreOffice ou no Google Docs.
O que esta ferramenta faz e não faz
Transfere apenas texto: as linhas são unidas em parágrafos com base no espaçamento entre elas, e o texto de cada página começa numa nova página. A formatação original, os tipos de letra, as cores, as colunas, as tabelas, as imagens, os cabeçalhos e os rodapés não são mantidos – o conteúdo das tabelas pode acabar como parágrafos simples, pelo que deve contar com arrumar o documento à mão depois.
PDF digitalizados
Se um PDF for digitalizado ou composto por fotografias, não tem camada de texto, por isso não há nada para extrair e a ferramenta informa-o disso. Nesse caso, use uma ferramenta de OCR (reconhecimento de texto): primeiro converta as páginas em imagens e depois reconheça o texto a partir delas.
Privacidade e tamanho
O PDF é processado no seu navegador e não é enviado para lado nenhum. Os ficheiros protegidos por palavra-passe não são aceites. Os documentos muito grandes (mais de 100 páginas ou 30 MB) podem demorar mais tempo e usar muita memória.