Seus arquivos ficam no seu dispositivo

Os arquivos são processados no seu navegador e não são enviados aos nossos servidores. O site pode baixar mecanismos de processamento e enviar eventos de uso ou de feedback sem o conteúdo dos arquivos.

Como tratamos seus dados →

Converter PDF para HTML

Converta PDF em HTML: salve o texto de um guia doméstico como uma página web simples, uma seção por página de origem. Imagens e layout ficam de fora.

Exemplo sintético — confira as configurações da operação antes de executar.

Seus documentos ficam neste dispositivo. Os downloads das ferramentas e as estatísticas de uso não incluem o conteúdo dos arquivos.

Limites no seu dispositivo: Arquivo individual máx.: 10 MB

Os arquivos são processados no seu navegador. Eles não são enviados a este site.

Guia prático

Abra localmente uma cópia de texto organizada por página.

  1. Selecione um PDF com texto selecionável.
  2. Exporte o HTML e abra o arquivo baixado localmente.
  3. Confira as seções de página e o texto em relação ao original antes de reutilizar.

Experimente este exemplo

Exporte para HTML um PDF de perguntas frequentes pesquisável de duas páginas. Abra-o localmente e confirme que cada resposta aparece na seção da sua página de origem, sem ser tratada como marcação executável.

Antes

  • Páginas do PDF com texto

Depois

  • Seções de página em HTML
Entrada e resultado esperado desta tarefa. Exemplo ilustrativo.

Antes de começar: O HTML contém apenas texto com escape; fontes, imagens e layout originais não são preservados, e digitalizações não passam por OCR.

Continuar com o PDF de origem
Resultado

Exporte o texto incorporado para um documento HTML independente, com uma seção por página. O texto é escapado, não executado como HTML. Fontes, imagens, tabelas e layout originais não são preservados; sem OCR. Limites: 10 MiB de entrada, 200 páginas, 4 MiB de saída.

Limites e detalhes importantes

No máximo 10 MiB de entrada, 200 páginas e 4 MiB de saída de texto. Documentos digitalizados sem camada de texto geram um erro em vez de simular uma extração bem-sucedida. A ordem de leitura, as colunas e as fontes podem não corresponder ao layout visual. Isto não é OCR nem conversão de PDF para Word.

Exemplo

Exporte um relatório baseado em texto e abra o HTML baixado localmente. As seções seguem a ordem das páginas do PDF; páginas em branco ou digitalizadas são identificadas, em vez de tratadas em silêncio como texto reconhecido.