Um estudo brasileiro com 552 marcas de 22 segmentos encontrou diferenças na frequência com que ChatGPT, Gemini, Claude e Perplexity mencionam empresas em respostas a consultas de consumidores. Foram consideradas 6.611 consultas válidas, realizadas com perguntas que não citavam previamente o nome das marcas.
O Gemini mencionou marcas em 21,6% das respostas analisadas, seguido por Claude, com 17,1%, Perplexity, com 16,4%, e ChatGPT, com 11,9%. A diferença de 9,7 pontos percentuais entre Gemini e ChatGPT equivale a uma taxa relativa 81,5% maior, mas não indica que um modelo seja superior ao outro.
Criada por Wilson Silva, professor da ESPM São Paulo, a Escala Will submeteu três perguntas neutras por marca a cada modelo. A pesquisa utilizou versões fixas dos sistemas, sementes registradas, invalidação de cache e hash das respostas para permitir auditoria.
A concordância entre os modelos variou de 0,47 a 0,64 quando medida por marca e caiu para 0,36 a 0,55 na análise consulta a consulta. O recorte mostra que a visibilidade é sensível ao modelo e ao tipo de pergunta, e não deve ser tratada como um ranking estático de reputação.
