Vaccari's Code

ChatGPT passa a saber sua navegação via rastreadores de anúncios

9/21/2026

Você já parou para pensar o que suas ferramentas de IA favoritas fazem nos bastidores enquanto você navega pela web? Recentemente, uma descoberta detalhada revelou que o ChatGPT, da OpenAI, tem um sistema de rastreamento de anúncios que monitora suas atividades em outros sites, conectando-as diretamente à sua conta. Isso levanta questões importantes sobre privacidade, transparência e a linha tênue entre "análise" e "marketing".

Para nós, builders e tomadores de decisão, entender esses mecanismos não é apenas uma curiosidade técnica, mas uma necessidade para construir sistemas mais éticos e proteger a confiança dos usuários.

A Conexão Inesperada: ChatGPT e Seus Hábitos de Navegação

A peça central dessa história é um cookie chamado __obi, definido por bzr.openai.com (o "bazaar", nome interno da OpenAI para sua plataforma de anúncios) e com escopo para .openai.com. Este cookie é criado quando você usa o ChatGPT e é vinculado à sua conta – ou a um identificador anônimo persistente se você não estiver logado.

Mas a parte que realmente chama a atenção é que o __obi não fica restrito aos domínios da OpenAI. Qualquer empresa que compra anúncios no ChatGPT instala um pequeno trecho de código da OpenAI em seu próprio site, de forma similar ao que varejistas fazem com códigos de rastreamento do Meta e do Google. Ao carregar esse código, o __obi é enviado de volta à OpenAI, junto com dados sobre a página que você está visitando. Isso inclui produtos que você está pesquisando, artigos que está lendo e até comportamentos de compra.

O resultado final é claro: a OpenAI pode conectar o que você faz nesses sites ao seu perfil do ChatGPT. A mecânica foi reproduzida e verificada independentemente, cobrindo centenas de pixels de anunciantes e hostnames, o que valida a extensão desse rastreamento.

Desvendando o Mecanismo Técnico

Como exatamente isso funciona? A operação é engenhosa e aproveita características dos cookies e da comunicação cross-site:

  1. Criação de um Identificador Assinado: No chatgpt.com, o cliente gera um identificador aleatório e o envia para um endpoint da OpenAI. O backend retorna um JWT (JSON Web Token) – um token seguro que contém informações como o emissor (chatgpt-wadi), o público (bzr.openai.com), e o mais importante, o sub (seu ID de conta ou um ID anônimo) e o obi (o identificador de rastreamento). Este token tem um tempo de vida curto, cerca de 60 segundos.

  2. O Identificador Vira um Cookie Cross-Site: O cliente então envia este JWT para bzr.openai.com/v1/obi/sync. Em resposta, a OpenAI define o cookie __obi com o valor do identificador. Este cookie é configurado com Domain=.openai.com, Max-Age=31536000 (um ano), Path=/ e, crucialmente, SameSite=None; Secure. A configuração SameSite=None é o que permite que o cookie seja enviado em requisições cross-site, ou seja, de outros domínios para a OpenAI. Sem isso, o rastreamento em sites de terceiros seria bloqueado pelos navegadores modernos.

  3. Anunciantes o Enviam de Volta: Quando você visita um site de um anunciante que usa o pixel da OpenAI, o navegador anexa o cookie __obi às requisições que carregam o SDK do pixel da OpenAI. Isso significa que, mesmo antes que qualquer código JavaScript do anunciante ou da OpenAI execute, o identificador já é divulgado.

Que Dados São Coletados?

O SDK do pixel não envia apenas o __obi. Ele também coleta informações da página do anunciante. Embora haja uma "denylist" para dados sensíveis como senhas, números de cartão e histórico médico, a amplitude da coleta é notável:

  • URLs: As URLs são reduzidas para origem e caminho (sem query strings), mas caminhos observados incluíram condições médicas, funis de solução de dívidas e formulários de admissão de litígios.
  • Identidade Pessoal: E-mails, telefones e nomes são coletados (muitas vezes via scraping de campos de formulário, texto da página ou do dataLayer de gerenciadores de tags como GTM) e enviados como hashes SHA-256.
  • Localização: País, região, cidade e código postal são enviados em texto claro. O código postal foi o campo de formulário mais coletado.

Curiosamente, a identidade "raspada" do conteúdo da página superou a identidade fornecida diretamente pelos anunciantes em mais de duas vezes nas observações. E sim, tudo isso funciona mesmo quando você está deslogado do ChatGPT, utilizando um identificador anônimo que persiste por pelo menos 27 dias.

Implicações e a Posição da OpenAI

A OpenAI classifica o __obi sob "cookies de análise" em sua política de cookies, descrevendo-os como ferramentas para entender o desempenho e uso de seus serviços. No entanto, o consentimento para "análise" e "marketing" são separados. Todos os tokens de sincronização decodificados carregavam consent_decision: analytics_allowed, o que sugere que mesmo quem permite apenas a análise e recusa o marketing ainda está sujeito a esse rastreamento.

Questionada sobre o porquê da classificação e se usuários que recusam o marketing ainda são rastreados, a OpenAI respondeu com uma mensagem genérica de suporte, prometendo revisar internamente, mas sem responder diretamente às perguntas.

Por Que Isso Importa Para Você, Builder e Tomador de Decisão?

Essa descoberta é um lembrete vívido de que a privacidade de dados é um campo de batalha constante, mesmo com as empresas de IA que mais admiramos.

  • Para Desenvolvedores e Arquitetos: É crucial entender como cookies com SameSite=None podem ser vetor para rastreamento cross-site. Ao integrar SDKs e bibliotecas de terceiros, é vital estar ciente dos dados que eles coletam e das permissões que implicitamente concedem. Um script src pode carregar mais do que você imagina antes mesmo do seu código rodar.
  • Para Líderes de Produto e Fundadores: A confiança do usuário é um ativo inestimável. Quando você usa ou integra serviços de terceiros, está confiando a eles parte da sua responsabilidade com a privacidade dos seus usuários. Entender essas mecânicas é fundamental para avaliar riscos, auditar parceiros e garantir que suas próprias políticas de privacidade sejam transparentes e condizentes com a realidade. A linha entre "análise" e "marketing" é tênue, e a interpretação de uma Big Tech pode não ser a mesma que a dos seus usuários.
  • Para Todos os Tomadores de Decisão: A IA está redefinindo o que é possível, mas também o que é aceitável. Precisamos questionar ativamente as práticas de coleta de dados das ferramentas que usamos e promovemos. A falta de transparência e respostas claras, como observado no caso da OpenAI, mina a confiança no longo prazo e pode ter implicações regulatórias significativas.

Em um mundo onde a IA se torna cada vez mais parte de nossa infraestrutura digital, a vigilância sobre a privacidade de dados não é apenas uma boa prática, é um imperativo ético e de negócios.


Fontes


📬 Gostou? Assine a newsletter do Vaccari's Code e receba as próximas tendências em software e IA direto no seu e-mail: Assinar aqui

← todos os posts · ouça o episódio →