O Google atualizou sua documentação oficial para formalizar algo que poucos profissionais de SEO discutiam abertamente: o Googlebot, robô responsável por rastrear e indexar páginas da web, não processa arquivos de tamanho ilimitado. Existem tetos técnicos específicos por formato, e quando um arquivo os ultrapassa, o conteúdo excedente simplesmente não é indexado. Agora esses limites estão documentados com precisão.

Os três limites centrais são diretos. Páginas web convencionais têm teto de 15 MB: tudo que ultrapassar esse volume é ignorado durante o rastreamento. Arquivos em PDF recebem tratamento mais generoso, com limite de 64 MB. Os demais formatos suportados pelo Google, que incluem documentos Office e similares, têm restrição de apenas 2 MB. O comportamento em todos os casos é o mesmo: ao atingir o limite, o Googlebot interrompe o download e envia apenas a porção já baixada para análise de indexação. O restante é descartado sem aviso.

Por que a formalização importa além dos números

Conhecer os limites em si resolve apenas parte do problema. O detalhe técnico que muda a prática está em dois pontos que a documentação esclarece com mais precisão.

O primeiro é que cada recurso externo referenciado no HTML, como arquivos CSS, JavaScript e imagens, é rastreado separadamente e está sujeito aos mesmos limites aplicáveis ao seu tipo de arquivo. Isso significa que uma página aparentemente leve pode ter recursos individuais ultrapassando os tetos sem que o webmaster perceba. O segundo ponto é que os limites são aplicados sobre dados descompactados: arquivos comprimidos são descomprimidos primeiro, e só então o tamanho é verificado. Um PDF de 20 MB comprimido pode se expandir para além de 64 MB após descompressão e perder conteúdo na indexação.

Esse segundo detalhe é especialmente relevante para quem trabalha com documentação técnica, relatórios anuais ou materiais educacionais extensos em PDF, contextos onde arquivos grandes são norma e raramente passam por auditoria de tamanho antes da publicação.

Quem precisa se preocupar com isso na prática

A maioria dos sites não chegará perto desses limites. Uma página web de 15 MB é excepcionalmente pesada: páginas modernas bem otimizadas costumam pesar entre 1 MB e 3 MB. Para esse perfil, a notícia é apenas informação de contexto.

O cenário muda para operações específicas: portais de documentação técnica com páginas longas e muitos recursos embutidos, editoras e plataformas educacionais que publicam apostilas e relatórios extensos em PDF, repositórios de arquivos e bibliotecas digitais com documentos de múltiplos formatos, e sites que concentram grandes volumes de conteúdo em páginas únicas em vez de distribuir em estrutura paginada. Para esses casos, o risco não é hipotético. É um problema silencioso de indexação parcial que pode estar acontecendo agora sem gerar nenhum erro visível no Search Console.

O que fazer quando os limites são um problema real

A solução mais direta para páginas web que excedem 15 MB é distribuir o conteúdo em múltiplas páginas com navegação clara entre elas, em vez de concentrar tudo em uma única URL. Para PDFs próximos ao limite de 64 MB, compressão adequada do arquivo e revisão de imagens embutidas costumam resolver sem perda de qualidade perceptível. Em ambos os casos, a checagem de tamanho de arquivo antes da publicação, com as ferramentas de análise de desempenho já disponíveis no mercado, é suficiente para evitar o problema.

O princípio mais amplo que essa documentação reforça está alinhado ao que a série de artigos deste blog já explorou: conteúdo que não pode ser rastreado não pode ser indexado, e conteúdo que não é indexado não existe para o Google nem para as IAs que usam os dados do Google como fonte. Limites de rastreamento são, portanto, parte da mesma cadeia que começa na estrutura do site e termina na encontrabilidade da marca.

Perguntas e respostas

  • Quais são os limites oficiais de rastreamento do Googlebot por tipo de arquivo?
    • Páginas web convencionais: 15 MB. Arquivos PDF: 64 MB. Outros formatos suportados (como documentos Office): 2 MB. Ao atingir o limite, o Googlebot para de baixar e envia apenas a porção já rastreada para indexação.
  • O limite de tamanho se aplica ao arquivo comprimido ou descomprimido?
    • Ao arquivo descomprimido. O Googlebot descomprime o arquivo primeiro e só então verifica o tamanho. Um PDF aparentemente dentro do limite na forma comprimida pode ultrapassar 64 MB após descompressão e ter conteúdo descartado.
  • Como verificar se páginas do meu site estão próximas do limite de 15 MB?
    • Ferramentas como Google PageSpeed Insights, Chrome DevTools (aba Network) e Screaming Frog permitem visualizar o tamanho total de páginas e recursos individuais. O Google Search Console também reporta problemas de rastreamento, embora não indique explicitamente se a causa é o limite de tamanho.
  • Recursos externos como CSS e JavaScript têm limite próprio ou compartilham o da página?
    • Cada recurso externo é rastreado separadamente e está sujeito ao limite correspondente ao seu tipo de arquivo. Um arquivo JavaScript pesado pode ser truncado independentemente do tamanho da página HTML que o referencia.
  • A maioria dos sites precisa se preocupar com esses limites?
    • Para sites comuns, não. Páginas bem otimizadas costumam pesar entre 1 MB e 3 MB, bem abaixo do teto de 15 MB. O risco é real principalmente para portais de documentação técnica, plataformas educacionais, repositórios de arquivos e qualquer operação que publique PDFs extensos regularmente.
Aprovado não significa veiculado: o que mudou silenciosamente no Google AdsMarketingPlataformas

Aprovado não significa veiculado: o que mudou silenciosamente no Google Ads

Julia de AlmeidaJulia de Almeida14/09/2026
A graphic image featuring a human profile and hand in a complex, conceptual design. The main subject, a person of indeterminate ethnicity, is seen in a profile view from the right, with only the face and part of the forehead visible. The face and a portion of the background are overlaid with a network of interconnected lines and nodes, creating a cerebral or technological effect. The person's hand, positioned in the lower left, reaches towards the face, with a finger touching the lips. The hand is in sharp focus, while the face and the geometric overlay show a contrasting, halftone texture. The background is a solid, vibrant magenta, which provides a stark contrast. The lighting appears to be diffused, casting soft shadows. The overall style is modern and abstract, possibly illustrating themes of connection, technology, or the human mind. The composition is dynamic, with the hands and the network overlay overlapping, creating depth.
O conteúdo de criadores já está moldando o que a IA diz sobre a sua marcaAI SearchPlataformas

O conteúdo de criadores já está moldando o que a IA diz sobre a sua marca

Julia de AlmeidaJulia de Almeida04/08/2026
Uma mulher negra com tranças em foco está em uma grade de telas digitais, exibindo ícones de carrinho de compras coloridos e perfis de usuários desfocados.
Microsoft lança marketplace para licenciamento de conteúdo editorial em sistemas de IAPlataformas

Microsoft lança marketplace para licenciamento de conteúdo editorial em sistemas de IA

Julia de AlmeidaJulia de Almeida27/07/2026

Deixe uma resposta