← Voltar ao blog
TIDEX Research11 Ago 20268 min de leitura

Não existe "a IA": rodamos 30 consultas em 8 motores e eles discordam

Toda conversa sobre visibilidade em IA começa com a mesma frase errada: "o que a IA fala da minha marca". No singular. Rodamos 30 consultas de compra reais em 8 motores diferentes, cobrindo 15 segmentos da economia brasileira. Deu 240 combinações e 223 respostas válidas. O achado que mais importa não é quem ganhou: é que os motores quase não concordam entre si.

223

respostas válidas

8

motores de IA

15

segmentos

43,7%

concordância média

A concordância média entre dois motores é de 43,7%

Cruzamos as respostas de cada motor contra as de todos os outros, par a par. São 28 combinações possíveis entre ChatGPT, Gemini, Claude, Perplexity, DeepSeek, Grok, Copilot, Google AI Overview. A média dessas 28 comparações é de 43,7%.

A métrica é essa: em quantas das consultas dois motores citam ao menos uma marca em comum entre as três primeiras. Em português, se você pergunta a mesma coisa a dois motores de IA, na maioria das vezes as três primeiras marcas de um não têm nenhuma em comum com as do outro.

  • Par mais alinhado: ChatGPT e DeepSeek, com 68% de concordância.
  • Par mais divergente: Grok e Copilot, com 25%. Em três de cada quatro consultas, os dois não têm uma única marca em comum no topo.
  • Os dois motores do Google: Gemini e Google AI Overview concordam em 45% das consultas, acima da média do estudo. Quem otimiza para o ecossistema Google atinge os dois de uma vez.

Isso tem uma consequência comercial direta. Uma marca que mede visibilidade só no ChatGPT, que é o que quase todo mundo faz, está lendo um oitavo do jogo. E não é o mesmo oitavo para todo mundo: o motor onde sua marca vai bem raramente é o motor onde o concorrente vai bem.

O ranking bancário que a IA reescreveu

O Nubank lidera o índice geral com 27.2 pontos numa escala de 0 a 100, seguido de perto por Banco Inter (26) e Mercado Livre (25.4). É uma disputa apertada: o que separa o primeiro do segundo é menos de dois pontos. O Nubank ganha no critério mais duro, que é ser a primeira marca citada na resposta: 12 vezes, o maior número do estudo.

Mas o dado que deveria tirar o sono de um CMO é outro. Os únicos três bancos que entram no top 20 são digitais: Nubank em 1º, Banco Inter em 2º e C6 Bank em 8º. Nenhum banco tradicional aparece. O Itaú, maior banco do país, fica em 116º.

Não é que os bancos tradicionais sumiram da internet. É que décadas de construção de marca, agência e mídia não se traduzem automaticamente em uma linha na resposta gerada. A IA não cita por reputação. Ela cita por evidência que consegue ler, comparar e atribuir.

Onde há consenso e onde há caos

A divergência entre motores não é uniforme. Ela varia muito por segmento, e isso muda completamente o tipo de trabalho que cada setor precisa fazer.

Consenso. Em celular Android, os 6 motores que responderam apontaram todos a mesma fabricante: Samsung. Em cosmético anti-idade para empresa, os 6 apontaram Natura. No varejo B2B o Mercado Livre leva 6 dos 7 que responderam, e só o Copilot escapa, com Shein. Nesses mercados a IA já elegeu um favorito, e entrar na conversa é caro.

Dispersão. O oposto existe, mas é menos extremo do que a gente mesmo publicou antes. Apurando por marca, nenhum dos 30 recortes tem sobreposição zero: sempre há um par de motores que aponta a mesma empresa. O mais disperso é graduação, com 7 instituições diferentes em 8 motores. Nesses segmentos ninguém consolidou nada ainda, e a marca que organizar a própria evidência primeiro ocupa um espaço que hoje está vago.

A distinção que muda tudo. Fragmentação de modelo não é fragmentação de marca. Em TVs premium os motores citaram seis produtos diferentes, mas cinco eram LG. Em lava-e-seca, sete motores citaram seis modelos, e quatro deles são LG também. Contar a string que o motor escreveu faz um segmento com dono parecer um segmento em aberto, e foi assim que a primeira versão deste texto afirmou que educação tinha 7 motores e 7 instituições, quando eram 8 motores e o Estácio aparecia duas vezes, escrito de dois jeitos.

Para quem vende, a leitura é simples: fragmentação é oportunidade barata, consenso é fosso do concorrente. Antes de definir orçamento, vale saber em qual dos dois cenários seu setor está.

Como o estudo foi feito, e o que ele não é

São 30 consultas de compra reais, 2 por segmento, uma com intenção de consumidor e outra com intenção de empresa, rodadas nos 8 motores. Nenhuma consulta menciona o nome de uma marca: perguntamos "qual o melhor X", e não "o que você acha da marca Y". As marcas citadas foram extraídas por reconhecimento de entidades. Os seis modelos de linguagem rodaram com temperatura zero; Copilot e Google AI Overview vêm do resultado servido pela busca, que não é determinístico. Dados brutos em JSON auditável.

Copilot e Google AI Overview não servem uma resposta gerada em toda consulta. Quando não servem, a consulta não conta para eles: das 240 combinações, 223 produziram resposta. A página do índice publica a cobertura motor a motor, porque esconder isso inflaria a impressão de alcance.

E o que ele não é: um censo. São poucas respostas por setor, coletadas numa janela curta. Isso é sinal direcional, suficiente para mostrar padrões estruturais como a divergência entre motores, e insuficiente para cravar a posição exata de uma marca específica. Preferimos publicar a limitação a inflar o número.

Vale registrar uma outra limitação, mais desconfortável. Os modelos usados na coleta já foram atualizados ou substituídos pelos próprios fabricantes desde então. Isso não invalida os padrões estruturais, mas significa que o ranking de uma marca específica tem prazo de validade. Visibilidade em IA não é um certificado, é um estado que muda quando o modelo muda.

Este texto já foi publicado com outros números

A primeira versão deste índice saiu em Maio de 2026 com 6 motores e concordância média de 44%. Encontramos três erros na apuração: dois motores tinham ficado de fora por uma falha silenciosa de coleta, o score somava contagens em vez de usar taxas (o que fazia o número crescer só por ter mais motores) e variações do mesmo nome contavam como marcas diferentes. Corrigimos os três e republicamos como v2.

Os números da v1 não são comparáveis com os da v2, porque a escala mudou. O que a página do índice traz é o histórico das duas versões e a explicação de cada mudança. Publicar o erro junto com a correção é o mínimo que se pede de quem vende medição.

Dados completos

O ranking completo, a matriz de concordância entre os 8 motores, a cobertura por motor e a quebra por segmento estão publicados, abertos e sem cadastro.

Ver o IA Performance Index Brasil 2026

O que fazer com isso

Se a sua marca aparece bem em um motor, isso não é uma boa notícia ainda. É uma amostra de um. Com 43,7% de concordância média, a pergunta útil não é "a IA me cita?", e sim "quantos motores me citam, em quais consultas, e quem aparece no meu lugar nos outros".

É exatamente essa leitura que o IA Performance Index faz para o mercado brasileiro, e que o diagnóstico da TIDEX faz para uma marca específica.