Reduzir o tamanho de um PDF de forma eficiente começa entendendo o que de fato está ocupando o espaço — a abordagem certa é completamente diferente para um documento escaneado e para um relatório digitado, e aplicar a errada não faz nada ou danifica conteúdo que não precisava ser tocado.
Descubra primeiro o que realmente é grande
Antes de comprimir qualquer coisa, vale saber em qual das duas situações bem diferentes você está:
É majoritariamente (ou totalmente) páginas escaneadas ou fotografadas. Cada página é, na prática, um arquivo de imagem envolto num container PDF. É aqui que a compressão tem efeito dramático — uma redução de 80-95% no tamanho é completamente normal, porque você está recodificando dado de imagem de verdade de forma mais eficiente.
É um documento nativo (exportado de um editor de texto) com algumas imagens embutidas. O texto em si ocupa quase nada. Se o arquivo está inesperadamente grande, são as fotos, gráficos ou ilustrações embutidas fazendo isso, e a compressão vai mirar especificamente nelas — as páginas só de texto não vão encolher mais porque não há o que encolher.
Os dois ajustes que importam para páginas escaneadas: qualidade e DPI
Qualidade JPEG das imagens de página funciona exatamente como comprimir uma foto isolada — qualidade menor significa arquivo menor e artefatos mais visíveis, principalmente ao redor de bordas de texto (onde aparece o mesmo halo/blocking que afeta uma foto comprimida demais).
DPI (resolução) é a segunda alavanca, muitas vezes mais impactante. Scanners e apps de escaneamento do celular frequentemente usam por padrão 300, 400 ou até 600 DPI, o que é muito mais resolução do que a maioria dos documentos precisa para continuar totalmente legível. Como guia prático: 300 DPI é padrão para qualidade de arquivamento ou documentos que podem ser reimpressos, 200 DPI serve bem para leitura comum e para a maioria dos requisitos de upload, e 150 DPI é o piso antes que texto pequeno comece a amolecer visivelmente. Só reduzir de 400+ DPI para 200 DPI, antes mesmo de mexer na qualidade JPEG, costuma responder pela maior parte da redução de tamanho num documento escaneado com resolução excessiva.
Por que PDFs nativos (digitados) quase não encolhem
Se você comprime um PDF exportado direto do Word ou do Google Docs e vê quase nenhuma redução de tamanho, isso é esperado, não uma falha da ferramenta. Texto guardado como glifos de fonte e dados de posicionamento já é extremamente compacto — não há dado de imagem para um compressor recodificar. Se um documento desses está grande, é praticamente sempre por causa de imagens embutidas (fotos, gráficos em alta resolução, prints de tela colados no documento), e é nelas que um compressor realmente vai agir.
O que permanece intocado independente do nível de compressão
Uma camada de texto real — do tipo que dá para selecionar, pesquisar e copiar — fica guardada de forma completamente separada do dado de imagem na estrutura interna do PDF. Ferramentas de compressão que miram em dado de imagem não tocam nela de jeito nenhum, então integridade do texto, capacidade de pesquisa e seleção são preservadas não importa quão agressivamente você comprima as imagens embutidas. Essa é a diferença chave em relação a comprimir um documento escaneado, onde o “texto” é só pixel e é diretamente afetado pelos mesmos trade-offs de qualidade que uma foto.
Um checklist prático
- Confira se o seu PDF tem texto de verdade (tente selecionar algo) ou é um escaneamento.
- Para escaneamentos: confira o DPI atual se possível (muitas vezes nas configurações do scanner ou nas propriedades do arquivo) — se estiver acima de 300, só reduzir isso já ajuda muito.
- Comprima com um tamanho alvo em mente, e sempre amplie uma página representativa com texto pequeno depois, antes de confiar no resultado para algo importante.
- Para documentos nativos que ainda estão grandes, procure quais imagens estão embutidas — é nelas que está o alvo de verdade, não no texto.
Perguntas frequentes
- O que geralmente ocupa todo o espaço num PDF grande?
- Na grande maioria dos casos, são as imagens embutidas — páginas escaneadas, fotos ou gráficos e diagramas em alta resolução. O texto em si, guardado como glifos de fonte e coordenadas em vez de pixels, é extremamente compacto mesmo em centenas de páginas. Se um PDF está inesperadamente grande, a primeira coisa a checar é se ele contém páginas escaneadas ou fotografadas, ou imagens embutidas, já que é quase sempre daí que vem o tamanho.
- Qual DPI as páginas escaneadas deveriam ter, na prática?
- 150 DPI é o piso prático para texto legível num documento escaneado — abaixo disso, fontes pequenas começam a borrar visivelmente. 200-300 DPI é padrão para documentos que precisam ficar nítidos ou que podem ser reimpressos. Se o seu scanner (ou o app de escaneamento do celular) usa 400-600 DPI por padrão, é bem provável que você esteja capturando muito mais resolução do que o documento precisa, e reduzir para 200-300 DPI durante a compressão costuma cortar o tamanho do arquivo drasticamente sem perda visível para um documento de texto.
- Comprimir um PDF remove a capacidade de pesquisar ou selecionar o texto?
- Só se o PDF não tinha texto de verdade selecionável para começar. Um PDF nativo (exportado do Word, Google Docs etc.) guarda texto como texto de fato, separado de qualquer imagem, e a compressão que mira em dados de imagem não toca nele — continua pesquisável e selecionável em qualquer nível de compressão. Um PDF escaneado sem OCR não tem camada de texto real; o que parece texto é pixel dentro de uma imagem, e 'comprimir o texto' não é de fato possível ou faz sentido — a compressão ali é puramente um trade-off de qualidade de imagem.
- Dá para comprimir um PDF sem mudar o número de páginas ou o layout?
- Sim — a compressão padrão recodifica as imagens e as estruturas internas de dados dentro de cada página sem alterar o número de páginas, a ordem das páginas ou o layout. Se um resultado de compressão parece visualmente diferente no layout (e não só na qualidade de imagem), algo mais está acontecendo, como a ferramenta reorganizando ou regerando o documento em vez de só comprimi-lo.
- Meu PDF tem texto e imagens grandes (um relatório com fotos embutidas) — como a compressão lida com isso?
- Um compressor de PDF de verdade identifica e processa cada imagem embutida individualmente — recodificando fotos e reduzindo a resolução delas conforme necessário — enquanto deixa a camada de texto, as fontes e a estrutura do documento ao redor intocadas. O resultado é um arquivo em que o texto continua nítido em qualquer nível de compressão e só o tamanho das imagens embutidas de fato encolhe.