Citado pela IA   Citado pela IA
ED 006

O GPTBot não roda JavaScript e vê a sua home vazia

Site que monta o texto no navegador entrega página em branco ao rastreador, e o código-fonte da própria home mostra a falha em um minuto.

Folha de papel em branco presa numa prancheta antiga sobre mesa escura, sem pessoas

O que o rastreador vê da sua home

▼
 

O responsável de marketing de uma fabricante de embalagens apertou Ctrl+U na home da própria empresa, o atalho que abre o código-fonte da página, e passou dois minutos rolando um arquivo que não trazia nenhuma frase do site. Nem o título da chamada principal, nem a descrição das linhas de produto, nem o telefone do comercial.

O que existia ali era uma casca. Uma div vazia, quatro arquivos de script e uma linha de carregamento. O texto que ele lia na tela todo dia aparecia depois, montado pelo navegador dele, e nunca chegava a existir dentro do arquivo que o servidor entrega.

O GPTBot, rastreador que a OpenAI usa para alimentar as respostas do ChatGPT, recebe exatamente esse arquivo. Ele não abre navegador, não espera script rodar, não rola a página, não clica em nada. Pega o HTML que o servidor mandou, lê o que estiver escrito e segue para o próximo endereço da fila.

Site montado no navegador entrega a casca. Não importa quantos artigos existam na área de conteúdo, quanta autoridade a marca tenha no setor ou quanto o time investiu em texto no último ano. Para o rastreador, a página tem meia dúzia de palavras e um botão de menu.

O detalhe que atrasa o diagnóstico é o Google ter acostumado o mercado a ignorar o problema. O Googlebot renderiza, com fila e atraso, mas renderiza. Quem olhou para o Search Console e viu a página indexada concluiu que estava tudo em ordem.

Os rastreadores de IA quebraram essa conclusão. GPTBot, ClaudeBot e PerplexityBot leem o HTML cru na maioria das visitas, e a página que dependia da renderização do buscador virou papel em branco na fila que hoje distribui as respostas.

A parte generosa da história é o diagnóstico ser gratuito e caber num intervalo de café. Dois atalhos de teclado e uma busca por uma frase da sua própria home respondem se o seu texto existe ou não para a máquina, sem instalar nada e sem abrir chamado com a agência.

O incômodo vem depois da resposta, quando o time descobre que o conserto mora no time de tecnologia e não no calendário editorial. Antes de mexer em qualquer linha de código, vale entender o que separa o arquivo que chega da tela que você enxerga.

Continue lendo ↓

 
 

I  Sinal da Semana

O robô lê o arquivo que chega, não a tela

Veja por que o rastreador de IA lê um arquivo diferente da tela que você enxerga.

Toda página existe em dois momentos, e quase todo time de conteúdo só conhece o segundo. O primeiro é o arquivo que o servidor envia. O segundo é a tela desenhada depois que o navegador executa os scripts.

Entre os dois momentos passa-se de um a três segundos, tempo que ninguém percebe navegando. É nesse intervalo que o conteúdo aparece, quando ele aparece, e é justamente nesse intervalo que o rastreador de IA já foi embora.

Quem escreve o texto convive só com o segundo momento. Abre o site, lê a chamada, confere a página de serviço e conclui que o conteúdo está publicado. A conclusão está correta para o leitor humano e errada para a fila que alimenta o ChatGPT.

"O poder da Web está em sua universalidade."

Tim Berners-Lee, Weaving the Web, 1999

A universalidade da frase depende de uma condição simples que o mercado abandonou por conveniência: o significado precisa estar no documento entregue, não numa instrução para montá-lo depois. Página que só faz sentido dentro de um navegador moderno saiu da parte universal da Web.

A regra curta

Se o seu texto não está no HTML que o servidor entrega, ele não existe para o rastreador de IA.

Três arranjos técnicos aparecem no mercado, e a diferença entre eles decide a resposta.

Renderização no servidor: HTML já vem com o texto pronto

Geração estática: HTML pronto e salvo antes da visita

Renderização no navegador: HTML vem vazio, o script monta

Os dois primeiros funcionam para qualquer rastreador. O terceiro é o padrão de boa parte dos sites feitos nos últimos anos com framework de aplicação, e é o único que produz página em branco na leitura crua.

Existe ainda o meio-termo cruel do carregamento por rolagem. Home com texto no HTML, mas com os blocos de produto, depoimento e FAQ carregados só quando o visitante desce a página. O rastreador não desce, e a metade mais útil da página nunca chega até ele.

A mesma armadilha pega abas, sanfonas e caixas de perguntas frequentes montadas por script. É comum o conteúdo mais citável do site, a resposta objetiva de uma dúvida comum, estar exatamente dentro de uma sanfona que só existe depois do clique.

 
 

II  Case Brasileiro

A imobiliária de Curitiba que sumiu do próprio bairro

Uma home inteira em branco no código explicava dois anos de ausência nas respostas de IA.

Uma imobiliária de Curitiba trabalha com locação em quatro bairros e mantém um site refeito em 2024, rápido, bonito no celular, com trezentos e quarenta imóveis publicados e uma área de conteúdo com guias de bairro escritos por uma jornalista contratada.

O sócio começou a perguntar ao ChatGPT quais imobiliárias atendiam locação nos bairros em que ele opera. Em nenhuma tentativa a empresa apareceu. Apareciam dois portais nacionais de anúncio e uma concorrente pequena, de site visivelmente mais simples.

A primeira hipótese foi tamanho. A imobiliária tem doze corretores e a concorrente citada tem quatro, o que derrubou a explicação em uma frase e deixou o time sem teoria.

A checagem veio de um estagiário de marketing que apertou Ctrl+U na home e usou Ctrl+F para procurar o nome de um dos bairros dentro do código. O navegador não encontrou nenhuma ocorrência, e o mesmo teste na página de um imóvel específico devolveu zero para o valor do aluguel.

A busca por uma frase inteira do guia de bairro também voltou vazia. O texto pelo qual a empresa tinha pago dois anos de produção não estava no arquivo, e nunca esteve.

O site havia sido construído como aplicação de página única. Todo o conteúdo vinha de uma consulta ao banco disparada pelo navegador depois do carregamento, decisão tomada pela agência por causa da velocidade de troca de tela entre um imóvel e outro.

O teste seguinte fechou o diagnóstico. Com o JavaScript desligado nas configurações do navegador, o site inteiro virava uma tela cinza com o logotipo no canto, sem uma linha de texto em nenhuma das páginas.

A concorrente de quatro corretores usava um site de construtor visual comum, mais lento, com HTML pronto no servidor. Feio pelo padrão de agência, e legível de ponta a ponta para qualquer rastreador que chegasse.

A correção não passou por reescrever o site. A agência ligou a renderização no servidor apenas nas rotas públicas de conteúdo, mantendo a área logada do proprietário do jeito que estava, num trabalho que levou nove dias úteis.

O texto dos guias de bairro e a ficha de cada imóvel passaram a sair prontos do servidor, com valor, metragem, bairro e condomínio em texto legível. A troca de tela ficou uma fração de segundo mais lenta, diferença que nenhum cliente comentou.

Os números da releitura, feita com as mesmas trinta perguntas escritas antes da correção, ficaram assim.

Antes da correção: 0 citações em 30 perguntas

30 dias depois: 7 citações em 30 perguntas

70 dias depois: 14 citações em 30 perguntas

Doze das quatorze citações da última medição traziam trecho dos guias de bairro, o conteúdo que já existia desde 2024 e que nenhum rastreador tinha conseguido ler até então. Nenhum artigo novo foi escrito no período.

O sócio ficou com uma conclusão amarga e útil para qualquer empresa que investe em texto. A empresa passou dois anos pagando por conteúdo que a máquina nunca leu, enquanto pagava também pela decisão técnica que impedia a leitura.

 
 

III  Checklist da Semana

Descubra em uma tarde o que o robô lê no seu site

1. Abra o código-fonte da sua home. Ctrl+U no Windows ou Option+Command+U no Mac. Você vai ver o arquivo exato que o servidor entrega, sem nenhuma interferência de script, que é o mesmo material que o rastreador recebe.

2. Procure uma frase real da sua página dentro do código. Use Ctrl+F e cole uma frase da chamada principal, com sete ou oito palavras. Encontrou, o texto existe para a máquina. Não encontrou, o problema está diagnosticado.

3. Repita o teste nas três páginas que mais importam. Uma página de produto ou serviço, o artigo de conteúdo mais forte do site e a página de perguntas frequentes. Home limpa e página interna vazia é um resultado comum e merece a mesma atenção.

4. Desligue o JavaScript e navegue por cinco minutos. Nas configurações de site do navegador, bloqueie JavaScript para o seu domínio e visite as mesmas páginas. O que sobrar na tela é uma aproximação honesta do que o rastreador enxerga.

5. Teste o conteúdo escondido em sanfona e aba. Procure no código-fonte uma resposta que só aparece depois do clique. Perguntas frequentes montadas por script costumam ser o material mais citável do site e o mais invisível.

6. Verifique o que carrega só com rolagem. Compare o começo e o fim da página. Bloco de depoimento, tabela de especificação e lista de unidades que aparecem ao descer a tela geralmente não estão no arquivo entregue.

7. Leve o resultado ao time técnico com a palavra certa. Peça renderização no servidor ou geração estática para as rotas públicas. Pedido genérico por site mais rápido não resolve, porque velocidade percebida e conteúdo legível são dois problemas diferentes.

8. Refaça o teste depois da entrega, com a mesma frase. Cole no Ctrl+F a mesma frase da primeira medição, nas mesmas páginas. Comparar frases diferentes em páginas diferentes não mede correção nenhuma.

A armadilha mais frequente mora na etapa sete. Time técnico costuma responder que o Google indexa a página normalmente, o que é verdade e não muda o resultado, porque o rastreador que alimenta a resposta de IA não faz o mesmo trabalho de renderização.

A segunda armadilha é a correção pela metade. Ligar renderização no servidor só na home deixa intactas as páginas internas, que são justamente as que respondem pergunta específica e as que o modelo prefere recortar.

A terceira aparece no prazo de resultado. Corrigir a renderização não coloca ninguém na resposta no dia seguinte, porque o rastreador precisa voltar, e a volta leva de três a oito semanas na maior parte dos domínios pequenos.

Conteúdo que só existe depois que o script roda é conteúdo que a máquina nunca leu, por melhor que ele seja.

"A frase da sua home aparece no código-fonte dela hoje?"

 
 
Quiz da edição

Na correção da imobiliária de Curitiba, quantos dias úteis a agência levou para ligar a renderização no servidor nas rotas públicas de conteúdo?

ATrês dias úteis
BNove dias úteis
CQuinze dias úteis
DUm mês inteiro
 
Sua avaliação

Como foi a edição de hoje?

✨✨✨✨✨  ótima ✨✨✨✨  boa ✨✨✨  ok ✨✨  ruim ✨  péssima
 
Recomendação de Newsletter
Engenharia da Escrita

Engenharia da Escrita

Todo dia, 09:09. Um texto real aberto na bancada, com a engrenagem que faz ele funcionar exposta pra você copiar.

Quero receber →

 
 
 
 

Até a próxima atualização.

Citado pela IA

CITADO PELA IA

Seu concorrente já aparece no ChatGPT. Agora é sua vez

💬 WhatsApp·📣 Anuncie·✍️ Newsletter