Quais sites influenciam o ChatGPT no Brasil? Reddit e Wikipedia pesam mais que toda a mídia
Quais sites influenciam o ChatGPT no Brasil? Em 195 dias e 60.723 domínios, o reddit.com responde por 9,23% das citações e, somado à Wikipedia (14,31%), supera toda a mídia editorial (10,60%). O site da própria marca gera só 56,17% das citações com 84,21% dos domínios — e na comparação entre alternativas fica com 44,98%.
Quando alguém pergunta ao ChatGPT qual é o melhor CDB, o melhor contador online ou o melhor plano de celular — sem citar nenhuma marca —, quais fontes o modelo aciona para sustentar a resposta? Monitoramos essa camada por 195 dias, mapeamos 60.723 domínios e milhões de eventos de citação, e o retrato é nítido: um ecossistema concentrado no topo e pulverizado na base, onde uma comunidade e uma enciclopédia colaborativa pesam mais que qualquer redação jornalística.
Respostas de IA generativa não reproduzem a web de forma neutra. Elas selecionam, comprimem e hierarquizam fontes para responder a uma intenção, mediadas pela camada de retrieval que o modelo aciona quando busca. Nesse processo, algumas fontes viram ancoradouros recorrentes de autoridade, outras entram como validação social, e a imensa maioria fica restrita à cauda longa.
Este estudo mede exatamente quem são essas fontes. A base: registros de citação em respostas do ChatGPT monitoradas pela Ranqia entre 19 de dezembro de 2025 e 1º de julho de 2026, considerando apenas os prompts non-branded — perguntas de decisão sem qualquer menção a marcas — que efetivamente acionaram web search. Cada ocorrência de domínio numa resposta é um evento de citação. Todos os percentuais são relativos; contagens absolutas não são publicadas.
Uma ressalva vale desde já: citação indica uso como fonte, não recomendação, e o desenho é observacional — mede associação, não causalidade.
Um domínio responde por 1 em cada 10 citações
Antes de qualquer ranking, uma constatação: o sistema que hoje intermedia decisões de compra, contratação e investimento no Brasil tem fontes preferidas — e não são as que o marketing tradicional aprendeu a trabalhar.
O reddit.com sozinho concentra 9,23% de todos os eventos de citação do estudo. A Wikipedia vem em segundo, com 5,08%. Somados, os dois chegam a 14,31% de todas as citações — mais que toda a categoria de Notícias e Mídia Editorial combinada (10,60%), brasileira e internacional. O Reddit é citado 8,2 vezes mais que o gov.br, terceiro colocado.
| # | Domínio | Categoria | Share global de citações |
|---|---|---|---|
| 1 | reddit.com | UGC / Comunidades | 9,23% |
| 2 | wikipedia.org | UGC / Enciclopédia | 5,08% |
| 3 | gov.br | Governo / Oficial | 1,13% |
| 4 | reuters.com | Mídia | 0,95% |
| 5 | uol.com.br | Mídia (família) | 0,78% |
| 6 | arxiv.org | Semântico | 0,67% |
| 7 | infomoney.com.br | Mídia | 0,51% |
| 8 | youtube.com | Social | 0,49% |
| 9 | techradar.com | Mídia | 0,47% |
| 10 | idinheiro.com.br | Semântico | 0,41% |
O topo não é dominado por quem publica mais, e sim por quem acumula validação distribuída: comunidade, enciclopédia, lastro oficial e agências de referência.
A influência tem forma de funil: topo estreito, cauda imensa
A curva de concentração revela uma arquitetura em duas velocidades. Os 10 domínios mais citados acumulam 19,42% das citações; os top 100, 35,14%; os top 1000, 63,87%. Ou seja: 36,13% dos eventos ficam fora dos mil domínios mais citados, distribuídos por milhares de fontes especializadas.
| Faixa | Share acumulado de citações |
|---|---|
| Top 10 | 19,42% |
| Top 50 | 29,33% |
| Top 100 | 35,14% |
| Top 300 | 47,13% |
| Top 1000 | 63,87% |
A leitura estratégica muda com isso: não basta disputar uma posição num único ranking. É preciso construir presença em camadas — combinando os ancoradouros recorrentes de autoridade com a cauda longa de fontes especializadas do seu setor. E há um dado de sustentação por trás disso: o ChatGPT raramente responde com uma fonte só. O intervalo modal é de 3 a 5 citações por resposta (43,5% dos casos), e mais de um terço usa 6 ou mais. Cada resposta é uma disputa por um número escasso de vagas de citação.
Eficiência supera volume: poucos lugares certos valem mais
O dado que melhor resume o jogo é a eficiência por categoria — quanto cada grupo captura de citação em relação à sua presença numérica no universo de domínios. Índice acima de 1,00x significa que a categoria “rende” mais do que seu tamanho sugeriria.
| Categoria | Share de citações | Share de domínios | Eficiência |
|---|---|---|---|
| Empresa e Institucional | 56,17% | 84,21% | 0,67x |
| UGC e Comunidades | 14,53% | 0,08% | 191,93x |
| Conteúdo Especializado / Semântico | 14,48% | 12,03% | 1,20x |
| Notícias e Mídia Editorial | 10,60% | 2,43% | 4,36x |
| Governo e Fontes Oficiais | 3,22% | 1,22% | 2,64x |
| Redes Sociais e Publicação | 0,99% | 0,03% | 39,03x |
O UGC é o caso extremo: 0,08% dos domínios capturam 14,53% das citações, um índice de 191,93x, quase todo concentrado em Reddit e Wikipedia. Presença própria é necessária para fatos controláveis e clareza institucional, mas converte pouco (0,67x): 84,21% dos domínios geram só 56,17% das citações. Fontes terceiras — validação, comparação, autoridade percebida — decidem o resto.
O ponto mais disputado é a comparação — e é aí que a marca perde
A abertura para fontes terceiras não é linear no funil. Nas intenções de execução, as marcas ainda dominam: contratação (65,1% das citações são de domínios de empresas), compra e preço (60,7%). Mas no momento de deliberação — a comparação entre alternativas — o espaço da marca encolhe ao mínimo: apenas 44,98%. Mais da metade da resposta que decide a escolha do usuário é construída por terceiros.
Por setor, os territórios mais abertos a fontes independentes são os regulados e de risco: jurídico (35,61% de share de empresas) e investimentos (40,76%) — onde o modelo exige lastro normativo e opinião independente. É também onde há mais espaço a conquistar para quem produz o conteúdo certo.
Um detalhe geográfico fecha o quadro: 51,73% das citações vêm de domínios brasileiros. O ChatGPT respeita o contexto local — mas quase metade do lastro é internacional, com Reuters, OCDE e agências entrando como âncora de credibilidade transversal mesmo em perguntas feitas no Brasil.
Reddit e Wikipedia são hubs — e cumprem papéis diferentes
As fontes também não aparecem isoladas. Quando o ChatGPT cita valor.globo.com, a Wikipedia aparece na mesma resposta em 76,6% dos casos; quando cita contabilidade.com, o Reddit surge em 68,3%. Boa parte dessa coocorrência é consequência da ubiquidade dos hubs — eles estão em toda parte —, não de atração mútua. As exceções com associação genuína são poucas (Reuters e Wikipedia, lift 1,35).
A leitura correta: o hub define a moldura da resposta, e aparecer nela significa disputar as demais vagas de citação, não pegar carona. E os dois hubs jogam papéis distintos: a Wikipedia atua como camada de contexto factual (atrai mídia, Legislativo, LinkedIn); o Reddit, como camada de experiência real de uso (atrai finanças pessoais, tecnologia, pesquisa). Uma marca madura em GEO precisa de presença consistente nas duas.
O que isso muda para PR, marketing e GEO
O SEO tradicional mede descoberta em mecanismos de busca. GEO e AEO medem presença dentro da resposta — onde a seleção de fontes acontece depois que a pergunta já foi interpretada e sintetizada. E, nesse novo jogo, um plano de ação em três ondas emerge dos dados:
- Onda 1 (0–30 dias) — fundações que você controla. Audite como o ChatGPT descreve sua marca hoje, corrija fatos controláveis (site, dados estruturados, páginas institucionais) e mantenha informações factuais corretas em fontes enciclopédicas.
- Onda 2 (30–90 dias) — conteúdo que responde. Produza páginas comparativas e semânticas para perguntas non-branded de decisão, ative PR em veículos econômicos e especializados de alta frequência de citação (a mídia sobre-indexa 4,36x), e transforme presença social em ativos permanentes: vídeos indexáveis valem, feed efêmero não — o YouTube domina a categoria social (49,84%) porque produz ativos legíveis, enquanto o TikTok, com audiência gigante, é residual.
- Onda 3 (3–12 meses) — reputação distribuída. Construa reputação genuína em comunidades, com participação autêntica e conforme as regras de cada plataforma, e monitore o share de citação por cluster e intenção com metas trimestrais.
A conclusão que estrutura o estudo é mensurável: a marca controla a maior fatia individual das citações, mas não controla a camada de validação presente no exato momento da escolha. Visibilidade em sistemas de resposta não se compra por posição — ela se constrói com presença consistente nas fontes que o retrieval recupera. É a mesma dinâmica editorial que descrevemos em por que algumas marcas dominam as respostas do ChatGPT e no domínio semântico como ativo de GEO.
Saber quais domínios narram o seu setor nas respostas de IA, com que peso e em que idioma, não existe no Google Analytics nem no Search Console. É exatamente o que a Ranqia mede em escala — porque, na era da busca generativa, share de marca passou a se decidir na camada de fontes que a IA escolhe ler.
Perguntas frequentes
Quais sites mais influenciam as respostas do ChatGPT no Brasil? O domínio mais citado é o reddit.com, com 9,23% de todos os eventos de citação — quase 1 em cada 10. Em segundo vem a Wikipedia (5,08%). Juntos somam 14,31% das citações, mais que toda a categoria de Notícias e Mídia Editorial combinada (10,60%). Na sequência aparecem gov.br (1,13%), reuters.com (0,95%) e uol.com.br (0,78%).
O site da minha própria empresa basta para aparecer no ChatGPT? Dificilmente. A categoria Empresa e Institucional concentra 84,21% dos domínios, mas gera 56,17% das citações — eficiência de apenas 0,67x. Os outros 43,83% vêm de fontes terceiras. No momento de comparação entre alternativas, as marcas ficam com só 44,98% do share.
Por que o Reddit tem tanto peso nas respostas do ChatGPT? Por dois motivos combinados: o modelo trata comunidades como evidência de experiência real de uso, e há um fator técnico-comercial — a categoria UGC concentra 14,53% das citações com 0,08% dos domínios (191,93x de eficiência), em parte por um acordo de licenciamento entre o Reddit e a OpenAI. Não existe cauda relevante em UGC: ou a marca constrói reputação onde a conversa acontece, ou fica de fora dessa camada.
O que muda para relações públicas e marketing na era da busca generativa? O SEO mede descoberta; GEO e AEO medem presença dentro da resposta. A mídia editorial sobre-indexa 4,36x, e formatos importam mais que audiência (YouTube domina a categoria social com vídeos indexáveis; TikTok é residual). PR ganha centralidade — não a matéria descritiva clássica, mas a pauta estratégica e semanticamente otimizada para os formatos que a IA prefere citar.
Benchmark público Ranqia sobre a camada editorial da IA generativa. Base: respostas do ChatGPT a prompts non-branded monitorados no Brasil entre 19/12/2025 e 01/07/2026, restritas às execuções que acionaram web search · 60.723 domínios distintos e 210.598 URLs únicas mapeados · milhões de eventos de citação analisados · indicadores relativos, sem divulgação de contagens absolutas. Citação indica uso como fonte, não recomendação; o desenho é observacional e não estabelece causalidade. Parte dos domínios de topo mantém acordos de licenciamento de conteúdo com a OpenAI. Estudo produzido pela Ranqia com dados proprietários da sua plataforma de inteligência GEO/AEO.
Monitore onde sua empresa aparece
nas respostas das IAs.
Visibilidade em tempo real para ChatGPT, Gemini, Perplexity e outros modelos — com suporte a queries em português.
Solicitar acesso