Conversor de PDF para HTML
Transforme um PDF em HTML semântico e responsivo, com títulos, listas e parágrafos.
O conversor de PDF para HTML lê e reescreve o documento no seu dispositivo. Manuais internos e relatórios de cliente nunca são enviados.
Converta HTML de volta em PDF
Sobre PDF para HTML
Um PDF é material ruim para publicar na web: ele baixa em vez de abrir, não reflui num celular e buscadores o indexam a contragosto. Converter direito significa recuperar a estrutura que o layout sugere, não embrulhar cada linha numa div. Esta ferramenta agrupa trechos de texto em linhas, linhas em parágrafos e promove as linhas maiores a títulos, e então escreve marcação que diz o que cada bloco é. Você pode levar uma página completa — responsiva, com paleta clara e escura — ou só o fragmento do corpo para o seu modelo, com um id em cada quebra de página.
Recursos
- Marcação semântica: h1 a h6, p, ul, li, blockquote, pre e table
- Linhas quebradas reunidas em parágrafos reais em vez de uma linha cada
- Página completa autônoma, ou fragmento de corpo para o seu modelo
- A página completa é responsiva e respeita o modo claro ou escuro do leitor
- Id opcional em cada quebra de página para linkar dentro do documento
- Prévia renderizada ao lado da marcação, num quadro isolado
- Copie para a área de transferência ou baixe o arquivo .html
Como usar PDF para HTML
- Solte o PDF na página
- Escolha página completa ou fragmento de corpo
- Leia a prévia renderizada para conferir a estrutura
- Copie a marcação ou baixe o arquivo .html
Exemplo
Entrada
handbook.pdf — 24 pages
Saída
<h1>Staff handbook</h1>
<p>This handbook sets out…</p>
<h2>Working hours</h2>
Os níveis de título vêm do tamanho da letra em relação ao texto base de cada página.
Erros comuns e solução de problemas
- A marcação está vazia. — O PDF não tem camada de texto. Reconheça o texto primeiro e converta a versão pesquisável.
- Faltam as imagens do PDF. — Só o texto é convertido. Exporte as páginas como imagens à parte e referencie-as na marcação onde couberem.
- Todos os títulos estão no mesmo nível. — O documento compõe todos os títulos no mesmo tamanho, então não há o que distinga o nível 2 do 3. Ajuste os níveis à mão uma vez na marcação.
- O enfeite de página aparece no documento inteiro. — Títulos correntes e fólios são texto comum num PDF. Remova-os com uma passada de localizar e substituir na marcação gerada.
Perguntas frequentes
- Converter para HTML envia meu PDF?
- Não. A camada de texto é lida e a marcação é gerada nesta aba, então um manual interno ou um relatório de cliente nunca sai do seu dispositivo.
- O HTML vai ficar parecido com o PDF original?
- Não: ele é feito para ler bem numa tela, ou seja uma coluna, uma medida confortável e um layout responsivo. O conteúdo é o mesmo; o design não.
- Que saída usar num CMS?
- O fragmento de corpo. Ele não tem cabeça, estilo nem invólucro, então encaixa num modelo existente sem brigar com ele.
- A página gerada é acessível?
- Ela usa títulos, listas e células de cabeçalho reais, que é a maior parte do que um leitor de tela precisa. Confira a ordem dos títulos e descreva as imagens se acrescentar alguma.
- Posso converter vários PDFs numa página só?
- Junte os PDFs antes e converta uma vez: assim a hierarquia de títulos fica coerente no documento todo.
Ferramentas relacionadas
- HTML para PDF — Converte marcação HTML em um documento PDF limpo e paginado.
- PDF para texto — Extraia texto selecionável de um PDF como texto puro ou Markdown.
- PDF para Word — Reconstrói um PDF como documento .docx editável.
- PDF para EPUB — Converte um PDF em um EPUB que reflui em leitores.
- Formatador de HTML — Embeleze ou minifique HTML, formate CSS/JS inline e veja a prévia do resultado.
- HTML para Markdown — Converta HTML em Markdown limpo com tabelas GFM, listas e links.
- OCR de PDF — Reconhece o texto de um PDF escaneado e o torna pesquisável.
Todas as ferramentas de ArrayKit