Sou Aluno
Formações
Imersões Internacionais
Global MBAs
Eventos
AI Tools
Artigos
Sobre Nós
Para Empresas
Consultoria
Gestão do Negócio

Reddit x Google: O novo preço dos dados para treinar IA

Reddit, decisão britânica e processos judiciais criaram em 18 meses o direito de recusa que faltava para tornar escasso o conteúdo humano que alimenta os modelos.

Reddit x Google: O novo preço dos dados para treinar IA

A tela de resultados do Google com um resumo gerado por IA no topo, o formato que reacendeu a disputa entre plataformas de conteúdo e desenvolvedoras de modelos.

Redação StartSe

, Redator

11 min

5 ago 2026

Atualizado: 5 ago 2026

newsletter

Start Seu dia:
A Newsletter do AGORA!

O Reddit fechou o segundo trimestre de 2026 com receita de US$ 804,9 milhões, alta de 61% na comparação anual, e lucro líquido de US$ 253 milhões, avanço de 183%, batendo todas as estimativas de Wall Street, segundo o balanço divulgado em 30 de julho. A ação caiu entre 7% e 11% no after-hours por causa de uma palavra na carta a acionistas. O CEO Steve Huffman descreveu como "choppy", irregular, o tráfego que o Google ainda envia à plataforma, e o mercado leu a frase como o começo de uma renegociação em que o fornecedor de dados para treinar IA finalmente tem a opção de recusar.

Por que isso importa

Por quase dois anos o dono de conteúdo que quisesse vetar o uso do próprio acervo por sistemas de IA enfrentava um problema de arquitetura, não de vontade: bloquear o rastreador de treinamento do Google significava sair do índice de busca.

Esse acoplamento está sendo desfeito por três frentes simultâneas, e o efeito prático é que o dado humano passa a ter preço de mercado em vez de preço de tabela.

Quem depende de conteúdo proprietário para gerar receita, direta ou indiretamente, está diante da primeira janela real de renegociação desde que os modelos generativos começaram a consumir a web em escala.

O Reddit realmente cortou o Google?

Não. O contrato de licenciamento assinado em fevereiro de 2024, de aproximadamente US$ 60 milhões por ano, está próximo do vencimento, e o Wall Street Journal informou em 22 de julho que executivos discutiram internamente encerrar o acesso do Google ao conteúdo da plataforma para fins de treinamento. As duas empresas seguem negociando. Nenhuma anunciou decisão final, e a informação derrubou a ação em 9% naquele dia.

A leitura de ruptura total não se sustenta por um detalhe de caixa. A parceria com a OpenAI, estimada em cerca de US$ 70 milhões anuais e fechada em maio de 2024, permanece de pé. Licenciamento de dados rendeu US$ 39 milhões ao Reddit apenas no primeiro trimestre de 2026. Na call daquele trimestre, Huffman classificou as relações com Google e OpenAI como importantes, mútuas e valorizadas pela empresa.

O que os executivos querem, segundo a reportagem, é trocar o formato do contrato: cobrança por uso em vez de valor fixo anual. O Wells Fargo projeta que uma renegociação nesses termos poderia levar a linha de licenciamento a cerca de US$ 550 milhões, contra um patamar atual próximo de US$ 130 milhões, e estima perda de aproximadamente US$ 500 milhões caso a companhia abandone o acordo com o Google. Na época do IPO, o total de contratos de licenciamento do Reddit somava US$ 203 milhões.

Mesmo acervo. Mesmo volume. Preço multiplicado porque a alternativa de recusar deixou de ser suicídio comercial.

Por que o acervo do Reddit é difícil de substituir no treinamento de IA

O valor não está no volume de texto. Está na estrutura. Conversa datada, organizada por tema, hierarquizada por voto da comunidade e escrita por gente relatando experiência de primeira mão é o tipo de material que um modelo não consegue produzir para si mesmo sem degradar a própria base.

A escassez desse insumo virou pauta de produto em setores distintos ao longo de julho. A Pangram, empresa de detecção de texto gerado por IA, estimou que cerca de 41% dos posts longos do LinkedIn e 30% dos curtos são inteiramente produzidos por máquina, número reportado pelo 404 Media e citado pela Cybernews, com a ressalva de que detectores de IA têm taxa de erro documentada e a metodologia da empresa foi questionada publicamente. O próprio LinkedIn respondeu em 30 de julho lançando um botão para o usuário sinalizar posts que "parecem AI slop" e desligando o "enhance your post", a ferramenta com que havia ensinado seus usuários a escrever com IA. O Snap anunciou em 31 de julho que vídeos inteiramente gerados por IA deixam de ser elegíveis a recomendação no Spotlight e a monetização. O Substack integrou a Pangram ao próprio produto em 21 de julho, conforme apurou o Axios.

Quatro plataformas, dez dias, a mesma aposta: conteúdo humano verificável passou a ser o ativo defensável.

O que muda quando dizer não deixa de custar o índice de busca

A frente contratual já opera há tempo. O Reddit bloqueia rastreadores que não se comprometem a não usar os dados coletados para treinamento, aplicando a própria política de conteúdo público e o arquivo robots.txt, e buscadores que recusaram os termos passaram a devolver resultados vazios para o site.

A frente judicial abriu em junho de 2025, quando o Reddit processou a Anthropic alegando raspagem sem licença, tornando-se a primeira big tech a acionar judicialmente uma desenvolvedora de modelos por dado de treinamento.

A frente regulatória é a mais recente e a de maior alcance. Em junho de 2026, a Competition and Markets Authority do Reino Unido determinou que publishers podem sair dos AI Overviews e de outros recursos de busca com IA sem perder posição na busca tradicional, e obrigou o Google a atribuir e linkar as fontes que seus resumos utilizam, de acordo com o detalhamento da decisão publicado pela Open Society Foundations. A empresa tem nove meses para implementar. A ação partiu de queixa da Foxglove com a Independent Publisher Alliance e o Movement for an Open Web, e pesquisa encomendada para a campanha apontou que o primeiro colocado orgânico pode perder até 79% do tráfego de uma busca quando há um resumo de IA acima dele.

Não é lei, e não vale fora do Reino Unido. Mas o precedente já se move: o CADE investiga o tema no Brasil, a Comissão Europeia abriu inquérito em dezembro e, na África do Sul, o Google aceitou destinar cerca de US$ 40 milhões a plataformas de mídia local depois de investigação do regulador de concorrência.

Sinais e impactos

Para empresários e CEOs. A pergunta a fazer ao jurídico e ao comercial nas próximas semanas é se os contratos de licenciamento, sindicalização ou API da companhia foram assinados antes ou depois do direito de recusa existir. O contrato de valor fixo assinado em 2024 precifica um mundo em que dizer não era impossível.

Para altos executivos e diretores. A queda de tráfego não é uniforme, e tratar como uniforme é erro de alocação de verba. Análise do Define Media Group sobre dados do Search Console de 64 sites do próprio portfólio encontrou queda de 42% nos cliques orgânicos desde a expansão dos AI Overviews, com as perdas concentradas em conteúdo evergreen e informacional, enquanto o tráfego de breaking news cresceu 103% no mesmo levantamento. O número é correlação sobre uma amostra proprietária, não causalidade demonstrada.

Para empreendedores em estágio inicial. Dado proprietário pequeno e específico ganhou liquidez. Base de atendimento, histórico de suporte, transcrição de comunidade e catálogo técnico deixaram de ser subproduto operacional no momento em que quem treina modelos passou a ter que comprar o que antes coletava de graça.

O sinal a acompanhar não é o resultado da negociação entre Reddit e Google. É o formato do contrato que sair dela. Se o preço por uso substituir o valor fixo, a próxima geração de modelos passa a ter custo marginal de dado, e isso reordena quem consegue treinar do zero e quem vai precisar licenciar. Executivos que estão desenhando estratégia de IA sem incluir a origem do dado na conta podem revisar essa premissa em programas como o AI Leadership e o IA para Negócios, da StartSe.

Huffman resumiu a tese em uma frase na carta a acionistas: as pessoas não querem um resumo do Reddit, elas querem o Reddit. O mercado derrubou a ação em seguida. As duas reações podem estar certas.

Gostou deste conteúdo? Deixa que a gente te avisa quando surgirem assuntos relacionados!

Imagem de fundo do produto: AI First | StartSe

Assuntos relacionados

Imagem de perfil do redator

Leia o próximo artigo

newsletter

Start Seu dia:
A Newsletter do AGORA!