O Índice Incuca de Presença Digital mede como os sites de empresas brasileiras aparecem hoje para o Google e para os assistentes de inteligência artificial. É um estudo vivo, com metodologia aberta: esta página traz o retrato mais recente, o que medimos, como medimos e em que padrão público cada verificação se apoia.
Por que este estudo existe
Quem decide comprar deixou de começar sempre por uma busca. Parte das pesquisas hoje passa por um assistente de inteligência artificial que lê sites, resume o que encontrou e recomenda empresas, muitas vezes sem que ninguém clique em nada. Um site pode estar no ar, bonito e funcionando, e ainda assim não ser lido por quem faz essa leitura.
Há muita opinião sobre esse assunto e pouco número. O estudo existe para trocar a opinião por medição: verificações objetivas, aplicadas do mesmo jeito em todos os sites, com o critério declarado antes do resultado.
As três perguntas
Toda verificação do estudo responde a uma destas três perguntas. Elas são as mesmas que usamos no trabalho com clientes, e a ordem importa: não adianta melhorar a segunda se a primeira estiver quebrada.
| Pergunta | O que o estudo mede |
|---|---|
| Quem procura encontra você? | Sites que bloqueiam algum robô de inteligência artificial · sites sem dados estruturados · sites sem título ou descrição em alguma página |
| Quem chega consegue comprar? | Sites lentos no celular pelos limites do Core Web Vitals · sites sem HTTPS forçado |
| Você sabe o que funcionou? | Sites sem nenhuma ferramenta de medição visível no código |
Resultados da leitura de setembro de 2026
Em resumo: três em cada quatro sites não têm nenhum arquivo que oriente os assistentes de inteligência artificial, quase metade não tem nenhum dado estruturado, e um em cada quatro sites de empresas que anunciam na Meta não tem o pixel da Meta nem o Google Tag Manager. Ou seja, paga o anúncio sem conseguir medir o que ele trouxe.
A amostra desta leitura. Foram 8.118 empresas brasileiras, dos 27 estados, que tinham anúncio ativo na Biblioteca de Anúncios da Meta entre 15 e 29 de setembro de 2026, com o site lido por endereço público. Anunciar na Meta é o critério de entrada, e ele importa: a amostra fala de empresas que já investem em mídia, não do total das empresas do país. Cada indicador traz o próprio denominador, porque nem toda verificação respondeu em todo site.
| Pergunta | Indicador | Sites | % |
|---|---|---|---|
| Quem procura encontra você? | Sem llms.txt, o arquivo que orienta as IAs sobre o site | 5.762 de 7.652 | 75,3% |
| Quem procura encontra você? | Sem nenhum dado estruturado (Schema.org) | 3.321 de 7.217 | 46,0% |
| Quem procura encontra você? | Sem a marcação que diz quem é a empresa (Organization) | 4.603 de 7.217 | 63,8% |
| Quem procura encontra você? | Sem meta descrição na página inicial | 2.309 de 7.451 | 31,0% |
| Quem procura encontra você? | Sem título principal (H1) na página inicial | 2.455 de 7.451 | 32,9% |
| Quem procura encontra você? | Página inicial que chega quase vazia a quem lê sem rodar JavaScript | 1.028 de 7.217 | 14,2% |
| Quem procura encontra você? | Bloqueia algum robô de IA no robots.txt | 133 de 7.652 | 1,7% |
| Você sabe o que funcionou? | Sem nenhuma ferramenta de medição visível no código | 1.363 de 7.653 | 17,8% |
| Você sabe o que funcionou? | Anuncia na Meta sem pixel da Meta nem Google Tag Manager | 1.901 de 7.653 | 24,8% |
| Quem chega consegue comprar? | Site parado: até 3 mudanças em 24 meses e a última há mais de 12 meses | 358 de 1.442 | 24,8% |
Velocidade no celular e HTTPS estrito não foram medidos nesta leitura e ficam como não medidos, sem entrar na conta. O site parado foi medido pelo histórico público do Internet Archive, só nos 1.442 sites em que ele respondeu.
Por porte da empresa
O porte vem do cadastro público da Receita Federal. Quando o CNPJ não foi identificado, a empresa fica fora deste recorte, mas continua na tabela geral.
| Indicador | Microempresa | Pequeno porte | Demais portes |
|---|---|---|---|
| Sem llms.txt | 67,8% (1.010 de 1.489) | 64,6% (457 de 707) | 74,8% (1.476 de 1.972) |
| Sem nenhum dado estruturado | 43,6% (646 de 1.482) | 35,7% (247 de 691) | 36,4% (680 de 1.866) |
| Anuncia na Meta sem pixel da Meta nem GTM | 23,8% (355 de 1.489) | 15,1% (107 de 707) | 13,3% (262 de 1.972) |
| Sem nenhuma ferramenta de medição | 15,8% (236 de 1.489) | 8,9% (63 de 707) | 6,8% (134 de 1.972) |
| Site parado | 34,9% (103 de 295) | 23,1% (37 de 160) | 13,1% (81 de 619) |
O que os números dizem
- Para as IAs, o problema é de leitura, não de bloqueio. Só 1,7% dos sites bloqueia algum robô de IA. O que falta é orientação: quase ninguém diz à IA, em formato que ela lê, o que a empresa faz, para quem e onde. Sem isso, o assistente adivinha, ou recomenda outra empresa.
- Mídia sem medição cai com o porte, mas não some. Entre as microempresas que anunciam, quase uma em quatro não tem como saber o que o anúncio trouxe. Nas empresas de maior porte, ainda são 13,3%.
- O porte maior não resolve o GEO. Nas empresas de maior porte, o llms.txt falta tanto quanto nas pequenas, ou mais. É uma lacuna nova para todo mundo.
- Site parado é mais comum embaixo. Um em cada três sites de microempresa não muda há mais de um ano.
Para ver os mesmos indicadores no seu site, o teste grátis do Intelligence roda as mesmas verificações e mostra o resultado só para você. Para entender cada lacuna, veja o que é llms.txt, o que é GEO e como medir a visita e a venda que vêm da IA.
Em que padrão cada verificação se apoia
Nenhum limite do estudo é uma régua nossa. Cada verificação se apoia num padrão público, e o padrão está declarado ao lado dela. Assim, qualquer pessoa pode discordar do resultado olhando o critério, e não a nossa palavra.
| Verificação | Padrão |
|---|---|
| Regras de leitura para robôs (robots.txt) | RFC 9309, a norma do protocolo de exclusão de robôs, a mesma que os serviços de inteligência artificial dizem respeitar |
| Velocidade no celular | Limites do Core Web Vitals: LCP até 2,5 s, CLS até 0,1 e INP até 200 ms |
| Dados estruturados | Vocabulário Schema.org e as diretrizes de resultado rico do Google |
| Título e descrição | Diretrizes de indexação do Google para título e meta descrição |
| HTTPS e HSTS | RFC 6797, que define o transporte estrito por HTTPS |
| llms.txt | Proposta pública do formato llms.txt (llmstxt.org). É uma convenção em adoção, não uma norma: a ausência indica lacuna de orientação, não erro técnico |
| Página que chega vazia sem JavaScript | Documentação do Google sobre JavaScript e busca: conteúdo que só aparece depois de rodar JavaScript depende de uma segunda etapa de leitura, e parte dos robôs de IA não a faz |
| Ferramenta de medição e pixel | Presença, no código público da página, das etiquetas oficiais do Google Tag Manager, do Google Analytics ou Google Ads e do pixel da Meta. Etiqueta carregada só dentro do Tag Manager conta como Tag Manager |
| Site parado | Histórico público de capturas do Internet Archive (API CDX): até 3 mudanças relevantes em 24 meses e a última há 12 meses ou mais |
Como medimos
- Só o que é público. A leitura usa o endereço do site, do mesmo jeito que qualquer visitante ou robô o acessaria. Nenhum dado vem de ferramenta conectada, de conta de anúncio ou de sistema de vendas.
- Um site, um voto. Um endereço medido várias vezes conta uma vez no índice, pela leitura mais recente. Sem isso, os sites que acompanhamos há mais tempo decidiriam o resultado sozinhos.
- Só o site da própria empresa. Perfil em rede social, link encurtado e endereço de plataforma ficam fora da amostra: as regras de leitura desses endereços são da plataforma, e não da empresa que os informou.
- Cada indicador tem o próprio denominador. Quando uma verificação não pôde ser feita num site, aquele site não entra nem no numerador nem no denominador daquele indicador. O estudo publica sempre os dois números, quantos e de quantos, e não apenas o percentual.
- Ausência não é reprovação. Uma verificação que não respondeu é registrada como não medida, nunca como falha.
Como tratamos os dados
O estudo publica apenas resultados agregados. Nenhuma empresa, domínio, imagem de tela ou exemplo identificável aparece em qualquer leitura.
- Nenhum recorte é publicado abaixo de trinta sites. Se um corte por setor ou por porte não alcançar esse número, ele não sai, nem com ressalva.
- Os dados vêm exclusivamente de endereços públicos. Informação de ferramenta conectada de cliente nunca entra, em nenhuma forma.
- O texto do estudo fala em sites analisados, e não em clientes.
Quem faz
O estudo é produzido pela Incuca com as mesmas verificações que rodam no teste grátis do Intelligence, no Radar e na Saúde do site do Incuca Intelligence. O estudo é vivo: a cada trimestre sai um retrato fechado, com a variação em relação ao anterior. Para receber o próximo, ou para sugerir um recorte, escreva para [email protected].
FAQ
Perguntas frequentes sobre o Índice
O que costuma aparecer de quem lê a metodologia pela primeira vez.