O que a pesquisa de GEO permite afirmar?

O artigo GEO: Generative Engine Optimization introduz um framework e um benchmark para estudar visibilidade em respostas generativas. A primeira submissão é de 2023 e a versão aceita no KDD é de 2024. O ganho máximo relatado pertence ao ambiente experimental dos autores e não é uma previsão para um site em outubro de 2026.

Essa distinção muda a aplicação prática. Um trabalho acadêmico pode motivar uma hipótese editorial, como melhorar o suporte documental de uma afirmação. Para afirmar efeito em outro cenário, é necessário definir o cenário, a intervenção e a medição. Copiar um percentual do resumo do paper para uma proposta comercial elimina justamente as condições que tornam o resultado interpretável.

Na Quaerion, o protocolo abaixo é uma proposta operacional. Ele não reproduz o benchmark original e não recebeu validação independente. Seu objetivo é tornar a coleta legível e repetível, para que outra pessoa possa conferir o que foi observado e contestar classificações.

Como definir o universo e a unidade de observação?

Escolha primeiro a decisão que a pesquisa pretende informar. Depois delimite setor, público, localidade, idioma, plataformas e intervalo. Uma unidade de observação pode ser uma consulta executada em uma plataforma e rodada específicas. Preserve essa chave para não misturar respostas diferentes ou duplicar registros.

Separe intenção informacional, comparação de alternativas e escolha de fornecedor. Uma marca pode ser relevante para uma delas e inadequada para outra. Diferencie consultas sem marca, que ajudam a observar descoberta, de consultas com marca, que avaliam representação. Agregar os dois grupos em uma taxa única pode esconder a dificuldade real de ser encontrado.

Uma amostra escolhida pela equipe é intencional, não representativa de todas as buscas do mercado. Informe como cada pergunta entrou na lista e por que continua nela. Não retire uma consulta apenas porque produziu um resultado desfavorável. Quando o objetivo ou o catálogo mudar, versione a amostra e apresente a quebra de comparabilidade.

  • ID estável da pergunta e redação literal.
  • Intenção, idioma, localidade e presença ou ausência da marca no texto.
  • Produto e interface consultados; modelo quando a plataforma o informa.
  • Busca na web ativada, fontes permitidas e estado da sessão quando conhecidos.
  • Data, fuso, rodada, resposta bruta e URLs apresentadas.

Como classificar menção, citação e recomendação?

Defina regras antes de ler os resultados. Menção é a ocorrência identificável da entidade. Citação inclui uma fonte associada à resposta. Recomendação expressa uma escolha ou avaliação favorável no contexto da pergunta. O mesmo registro pode ter uma citação sem recomendar a marca, ou recomendar sem apresentar uma fonte que sustente a conclusão.

Para citações, guarde a URL original e uma versão normalizada para contagem, conservando a regra de normalização. Remover parâmetros de rastreamento pode unir referências equivalentes; retirar qualquer parâmetro indiscriminadamente pode unir páginas diferentes. Conte separadamente domínios, URLs e execuções com pelo menos uma citação, pois respondem a perguntas diferentes.

Faça também uma avaliação de suporte. Abra a fonte indicada e verifique se ela sustenta a frase à qual foi associada. Uma URL real pode acompanhar uma afirmação incorreta. Registre precisão factual, contexto e eventuais ambiguidades de entidade sem transformar toda aparição em um resultado positivo.

  • Mencionada: o nome corresponde à entidade avaliada?
  • Citada: há fonte identificável e qual domínio ou URL ela usa?
  • Sustentada: a fonte apoia a afirmação feita na resposta?
  • Recomendada: há preferência explícita e para qual necessidade?
  • Visitada: existe evento de acesso mensurado, com origem observável?

Como calcular uma taxa sem esconder falhas?

Informe o total planejado, o executado, o válido e o numerador observado. Defina se uma resposta sem busca ou sem fontes é válida para a pergunta de pesquisa. Erro técnico, bloqueio e execução ausente devem ter estados próprios. Uma falha de coleta não demonstra ausência da marca.

Exemplo inteiramente hipotético: de 24 execuções planejadas, 20 produziram respostas válidas e 5 citaram o domínio. A proporção observada entre válidas seria 5/20, ou 25%; a cobertura da coleta seria 20/24. Esse exemplo ensina o denominador e não descreve desempenho da Quaerion ou de um cliente. Publicar apenas 25% esconderia as quatro observações indisponíveis.

Quando há várias repetições da mesma consulta, as observações podem ser dependentes. Não apresente um intervalo estatístico calculado como se todas fossem amostras independentes de uma população de usuários. Em um relatório operacional pequeno, contagens por pergunta, plataforma e rodada frequentemente explicam a variação melhor que uma média única.

O que os relatórios de Google e Bing medem hoje?

Use as métricas de cada fornecedor com seus nomes, escopos e regras. O relatório generativo do Google trata impressões nos recursos cobertos. O AI Performance do Bing apresenta atividade de citação em suas experiências participantes. Nenhum dos dois representa, sozinho, toda a presença de uma marca em todos os modelos.

A ajuda atual do Google alerta que valores indisponíveis mostrados como '~' ou '-' viram zeros no arquivo exportado. Preserve uma evidência da disponibilidade na interface antes de interpretar esses zeros. Também registre agregação por propriedade ou página e janela de comparação; diferenças de soma podem vir dessas regras.

O Bing anunciou AI Performance em fevereiro de 2026 e, em junho, Citation Share, Intents, Topics e Compare em preview. Citation Share usa o espaço de citações de uma grounding query como denominador. Não é participação de tráfego nem uma nota de autoridade. A taxa de uma amostra própria de prompts tem outro universo e não deve receber o mesmo significado.

Como desenhar uma intervenção editorial observável?

Escreva uma hipótese específica, registre o estado anterior e escolha quais páginas serão alteradas. Documente o conteúdo da mudança, a data de publicação e os eventos de descoberta disponíveis. Mantenha constantes as condições de coleta que estiverem sob seu controle e explique as que mudaram.

Exemplo de hipótese: uma página mistura duas versões do produto e pode induzir respostas inconsistentes. A intervenção separa condições e identifica a versão vigente, mantendo a história acessível. A medição verifica precisão de representação em perguntas registradas. Esse desenho testa um problema editorial concreto, sem prometer que acrescentar palavras ou schema produzirá mais citações.

Quando possível, use páginas comparáveis sem intervenção para ajudar a interpretar mudanças gerais. Ainda assim, modelos, concorrentes, demanda e fontes externas podem mudar. Um antes e depois observacional sustenta uma associação temporal; para atribuir causalidade com confiança, o desenho precisa enfrentar essas explicações alternativas.

  • Hipótese e desfecho definidos antes da alteração.
  • Versão anterior e versão publicada preservadas.
  • Amostra e classificações documentadas.
  • Eventos de acesso ou atualização registrados sem confundir recibo com indexação.
  • Condições externas e perdas de coleta explicitadas.

Como conectar visibilidade e resultado comercial?

Defina um evento comercial e a regra de atribuição antes de relacioná-lo às observações. Uma citação pode não gerar clique; uma visita pode não trazer referrer identificável; um lead pode ter conhecido a marca em vários canais. Preserve essas limitações em vez de preencher lacunas com atribuição automática à IA.

No relatório, mantenha três tabelas relacionadas quando houver dados: observações de respostas, eventos de acesso e eventos comerciais. Cada uma terá sua fonte, janela e disponibilidade. Uma análise de jornada pode sugerir relações, mas não permite inventar a pergunta feita em um assistente por uma pessoa que chegou ao site sem essa informação.

Perguntas voluntárias no atendimento, como 'onde nos conheceu?', acrescentam contexto quando tratadas como autodeclaração. Não são rastreamento completo. Evite transferir dados pessoais ou conversas de clientes para um conjunto público de pesquisa. O resumo público pode preservar método e contagens agregadas enquanto os registros autorizados permanecem protegidos.

O que deve acompanhar um relatório publicável?

Publique método, universo, janela, critérios, resultados e limites no mesmo lugar. Inclua uma trilha para os registros que podem ser compartilhados e identifique quem realizou a análise. Uma conclusão deve ser estreita o suficiente para continuar verdadeira quando o leitor examina os dados.

Uma boa conclusão pode dizer que determinada fonte foi citada em um conjunto identificado de execuções. Uma conclusão excessiva diria que a marca domina todo o mercado ou que um mecanismo passou a preferi-la. O relatório deve mostrar a distância entre essas duas afirmações e manter como pendência aquilo que a amostra não resolve.

A atualização seguinte deve registrar a nova rodada sem apagar a anterior. Se a plataforma muda de interface, modelo ou disponibilidade, trate isso como parte do resultado. Reproduzir o protocolo não significa obter respostas idênticas; significa conseguir entender por que os resultados são ou não comparáveis.

Perguntas frequentes

Share of Answer e Citation Share do Bing são intercambiáveis?

Não automaticamente. Uma métrica própria pode usar execuções válidas de prompts como denominador; o Bing define Citation Share pelo conjunto de citações associado a uma grounding query. O relatório precisa mostrar a fórmula e a unidade de cada métrica antes de compará-las ou usar o mesmo rótulo.

Uma resposta da API representa a experiência do aplicativo?

Não necessariamente. Ferramentas, modelo, busca, contexto e políticas podem diferir. Identifique a interface testada e preserve a configuração conhecida. Uma coleta de API pode ser útil e reproduzível dentro de seu escopo, mas não deve ser apresentada como observação direta da conta de um usuário no aplicativo.

Posso usar um único prompt para avaliar minha presença?

Pode usá-lo como observação pontual, com data e resposta preservadas. Ele não representa todas as intenções, idiomas ou públicos. Para acompanhar uma estratégia, selecione perguntas relevantes, explique a seleção e repita um protocolo estável, registrando também respostas inválidas e alterações de configuração.

O paper de GEO garante ganho de 40%?

Não. O percentual máximo pertence ao benchmark descrito pelos autores e sua eficácia varia por domínio. Esta metodologia não reproduziu aquele experimento. Uma previsão para outra empresa exigiria evidências do novo contexto e continuaria sujeita às limitações do desenho e das plataformas.

Se não tenho dados, devo registrar zero?

Não. Use estados como não medido, falha de coleta ou indisponível. Zero só é adequado quando o evento foi observado com sucesso e o critério realmente retornou nenhuma ocorrência. Verifique ainda transformações de exportação: alguns relatórios podem converter marcadores de indisponibilidade em zero.

Conclusão

GEO fica auditável quando a equipe consegue reconstruir o caminho entre pergunta, resposta, fonte e conclusão. Uma taxa com denominador explícito e perdas registradas é mais útil que uma promessa de domínio. As melhorias editoriais devem gerar hipóteses testáveis e as medições devem preservar o escopo em que a evidência foi obtida.

Fontes

  1. Aggarwal et al. — GEO: Generative Engine Optimization — Primeira submissão em 16/11/2023; versão 3 em 28/06/2024, aceita no KDD 2024. Resultados delimitados pelo benchmark. Consulta: 04/10/2026.
  2. Google — Generative AI performance report — Escopo de impressões, agregação e exportação do relatório; não equivale a um ranking universal de IA. Consulta: 04/10/2026.
  3. Microsoft Bing — AI Performance — Anúncio de 10/02/2026; dados de citações nas experiências Microsoft e integrações participantes. Consulta: 04/10/2026.
  4. Microsoft Bing — Citation Share e novas dimensões — Anúncio de 16/06/2026; métrica observacional por grounding query, sem equivalência com tráfego ou ranking. Consulta: 04/10/2026.
  5. IndexNow — protocolo — Notificação de URLs modificadas e validação da chave; submissão não comprova indexação. Consulta: 04/10/2026.