Seus arquivos ficam no seu dispositivo
Os arquivos são processados no seu navegador e não são enviados aos nossos servidores. O site pode baixar mecanismos de processamento e enviar eventos de uso ou de feedback sem o conteúdo dos arquivos.
Como tratamos seus dados →Converter PDF para HTML
Converta PDF em HTML: salve o texto de um guia doméstico como uma página web simples, uma seção por página de origem. Imagens e layout ficam de fora.
Exemplo sintético — confira as configurações da operação antes de executar.
Seus documentos ficam neste dispositivo. Os downloads das ferramentas e as estatísticas de uso não incluem o conteúdo dos arquivos.
Limites no seu dispositivo: Arquivo individual máx.: 10 MB
Os arquivos são processados no seu navegador. Eles não são enviados a este site.
Guia prático
Abra localmente uma cópia de texto organizada por página.
- Selecione um PDF com texto selecionável.
- Exporte o HTML e abra o arquivo baixado localmente.
- Confira as seções de página e o texto em relação ao original antes de reutilizar.
Experimente este exemplo
Exporte para HTML um PDF de perguntas frequentes pesquisável de duas páginas. Abra-o localmente e confirme que cada resposta aparece na seção da sua página de origem, sem ser tratada como marcação executável.
Antes
- Páginas do PDF com texto
Depois
- Seções de página em HTML
Antes de começar: O HTML contém apenas texto com escape; fontes, imagens e layout originais não são preservados, e digitalizações não passam por OCR.
Continuar com o PDF de origemResultado
Exporte o texto incorporado para um documento HTML independente, com uma seção por página. O texto é escapado, não executado como HTML. Fontes, imagens, tabelas e layout originais não são preservados; sem OCR. Limites: 10 MiB de entrada, 200 páginas, 4 MiB de saída.
Limites e detalhes importantes
No máximo 10 MiB de entrada, 200 páginas e 4 MiB de saída de texto. Documentos digitalizados sem camada de texto geram um erro em vez de simular uma extração bem-sucedida. A ordem de leitura, as colunas e as fontes podem não corresponder ao layout visual. Isto não é OCR nem conversão de PDF para Word.
Exemplo
Exporte um relatório baseado em texto e abra o HTML baixado localmente. As seções seguem a ordem das páginas do PDF; páginas em branco ou digitalizadas são identificadas, em vez de tratadas em silêncio como texto reconhecido.