Pixel de anúncios da OpenAI: o que o relato técnico documenta e o que ainda é inferência
Equipe Claudim
21 de setembro de 2026 · 10 min de leitura

Pixel de anúncios da OpenAI: o que o relato técnico documenta e o que ainda é inferência
Um relato técnico publicado em 20 de setembro de 2026 descreve um mecanismo pelo qual o pixel de conversão de anúncios da OpenAI, código que o próprio anunciante instala no seu site para medir campanhas no ChatGPT, envia à empresa um cookie capaz de funcionar como identificador estável do mesmo visitante em sites diferentes. Segundo o autor, esse identificador é gerado enquanto a pessoa está no ChatGPT. A ligação entre o cookie e a conta do usuário, porém, não foi observada. É uma inferência a partir do desenho do sistema, e o próprio pesquisador diz isso no texto.
O material foi publicado no Buchodi's Threat Intel, blog de segurança assinado como Jamie Larson, sem vínculo institucional declarado. O autor afirma ter reproduzido o mecanismo no próprio aparelho, verificado o comportamento com dois métodos independentes de captura e cruzado o resultado com vários meses de tráfego observado.
Até o fechamento desta reportagem, a OpenAI não havia se manifestado publicamente sobre o caso e nenhuma reprodução independente do achado havia sido localizada.
Como o mecanismo é descrito
A sequência relatada tem duas metades.
A primeira acontece dentro do ChatGPT. De acordo com o relato, o cliente gera 16 bytes aleatórios e pede um token ao servidor; recebe de volta um JWT assinado, válido por 60 segundos; envia esse token a um endpoint de sincronização no domínio `bzr.openai.com`; e recebe na resposta um cookie chamado `__obi`, definido no escopo `.openai.com`, com os atributos `SameSite=None` e `Secure` e validade de um ano. Esses dois atributos são exatamente o que permite que um navegador envie o cookie em requisições feitas a partir de outros sites.
A segunda metade acontece fora do ChatGPT. Quando a pessoa visita um site comercial que tenha o pixel de conversão da OpenAI instalado, o script carrega a partir de um domínio da própria OpenAI e o navegador anexa o cookie automaticamente à requisição.
O autor descreve ainda o que viaja junto com o evento de conversão. Identificadores de contato como e-mail, telefone e nomes seguem com hash SHA-256. Dados de localização, incluindo país, região, cidade e código postal, seguem em texto claro. A URL é enviada com origem e caminho: entre 23.929 URLs observadas, nenhuma carregava query string.
Há também uma distinção que o relato atribui à própria nomenclatura do SDK da OpenAI. O payload separa a identidade em quatro origens: valores que o anunciante passa de propósito e valores que o script recolhe sozinho, a partir de campos de formulário, do texto da página ou da camada de tag manager. Segundo a contagem do autor, a identidade recolhida automaticamente superou a fornecida de forma deliberada, em 685 eventos contra 255.
A escala observada
Os números apresentados no relato se dividem em dois conjuntos, com pesos diferentes.
O primeiro é o tráfego agregado observado ao longo de meses: 936 pixels distintos de anunciantes, distribuídos por 1.029 hostnames. Nesse conjunto, o autor afirma que a correspondência automática de identidade estava ativada em 638 de 881 pixels com configuração conhecida.
O segundo conjunto é o teste no próprio aparelho, e é o mais direto. Nele, um mesmo valor de `__obi` foi enviado à OpenAI a partir de 12 sites comerciais, sob 13 identificadores de pixel diferentes. O post nomeia marcas conhecidas de comércio eletrônico, ingressos e educação entre esses sites. Esta reportagem optou por não reproduzir os nomes: nenhuma dessas empresas foi procurada para comentar, e o próprio autor afirma que elas não têm como perceber o comportamento descrito.
O relato também registra que o mecanismo não depende de sessão autenticada para existir. Entre 932 tokens decodificados, 736 indicavam um sujeito do tipo conta de usuário e 196 indicavam anônimo, com o identificador anônimo persistindo por pelo menos 27 dias no mesmo aparelho.
O que o autor declara não ter observado
Esta é a parte decisiva para quem for avaliar o achado, e ela está no próprio texto original.
1. O elo com a conta não foi visto. O autor explica que a resposta HTTP 202 significa apenas que o coletor aceitou o evento com o cookie anexado. Que a OpenAI resolva esse cookie para uma conta no lado do servidor, segundo ele, decorre do desenho do sistema, mas ele não observou isso acontecer.
2. O ambiente de teste é estreito. O comportamento foi observado em Chrome para Android. O Safari bloqueia cookies de terceiros e o Chrome no iOS roda sobre WebKit, de modo que, pelo relato, o mecanismo não opera em navegadores de iOS. O Chrome de desktop não foi testado.
3. O disparo é intermitente. Aproximadamente uma sessão de ChatGPT em cada cinco produziu um token de sincronização, e o cliente web móvel exibe anúncios sem sincronizar.
4. O anunciante não enxerga nada disso. O cookie pertence a um domínio que os scripts do próprio site não conseguem ler.
5. O autor não apresenta o mecanismo como inédito. Ele registra que a Meta construiu o equivalente estrutural anos atrás e que a técnica é padrão no setor de publicidade. O que ele considera sem precedente é aplicá-la a um produto de conversa, no qual as pessoas escrevem coisas que não publicariam em uma rede social.
O que a OpenAI diz, e o que ela não disse
Em sua comunicação pública sobre o teste de anúncios no ChatGPT e na página de ajuda sobre anúncios, a OpenAI descreve a seleção de anúncios a partir do tema da conversa, de conversas anteriores e de interações prévias com anúncios, e afirma que não compartilha conversas com anunciantes nem vende dados de usuários. Essa descrição não menciona coleta de sinal comportamental em sites de terceiros.
A empresa abriu seu gerenciador de anúncios self-service a anunciantes dos Estados Unidos em 2026, conforme noticiou a Axios, eliminando o piso mínimo de investimento que restringia a plataforma a grandes contas. A existência de anúncios no ChatGPT, portanto, não é novidade. A novidade alegada é a documentação de coleta fora da plataforma.
Sobre este caso específico, o autor relata ter enviado o mecanismo e duas perguntas objetivas para os canais de imprensa e de privacidade da OpenAI em 14 de setembro: por que o cookie é classificado como analítico e não como de marketing, e se um usuário que concede consentimento analítico e recusa o de marketing continua recebendo o cookie. Segundo o relato, a resposta veio do suporte, reconheceu o recebimento, informou que as observações seriam compartilhadas internamente e não respondeu a nenhuma das duas perguntas.
Ainda não há replicação independente
Buscas realizadas para esta reportagem não localizaram reprodução técnica por terceiros nem contestação pública do achado. O que circula são republicações e resumos agregadores do mesmo post original, o que não constitui confirmação independente.
Isso não invalida o trabalho. Significa que, no momento, a alegação está sustentada por uma única fonte, sob pseudônimo, sem revisão externa e sem resposta da empresa envolvida.
O que já é público na documentação do produto
Uma camada do que o relato descreve não depende da inferência sobre a conta, porque já está documentada para anunciantes.
Guias técnicos de implementação publicados em setembro de 2026, como o da Kukie e o da Synlig, descrevem que o pixel armazena o identificador de clique em cookie primário no domínio do próprio anunciante, que a funcionalidade de correspondência automática avançada detecta campos de contato nas páginas, gera hash no navegador e anexa os valores aos eventos de conversão sem exigir alteração de código, e que o parâmetro de consentimento do pixel inicializa como verdadeiro, a menos que seja explicitamente definido como falso antes da inicialização.
Esse último ponto é o de consequência mais imediata para uma empresa brasileira. Um pixel que começa medindo por padrão coleta até o momento em que alguém o configure para não coletar. Quem instala o código sem tratar o consentimento antes da inicialização assume esse comportamento por omissão.
O risco recai sobre quem instalou o código
Aqui a discussão sai do terreno da inferência e entra no da responsabilidade, e ela não depende de a ligação com a conta ser confirmada.
A empresa que decide instalar um script de terceiro no próprio site decide a finalidade e os meios daquela coleta específica. Na estrutura da Lei Geral de Proteção de Dados (LGPD), é essa decisão que caracteriza a figura do controlador. Se o script recolhe um campo de formulário antes mesmo de o formulário ser enviado, o dado do cliente saiu do site do anunciante por escolha do anunciante.
A Autoridade Nacional de Proteção de Dados (ANPD) tratou desse desenho no Guia Orientativo sobre Cookies e Proteção de Dados Pessoais, de outubro de 2022, que distingue cookies próprios de cookies de terceiros, exige base legal para o tratamento, recomenda informar de forma transparente o compartilhamento com terceiros e orienta que o banner ofereça opção visível de recusar cookies não necessários.
Fora do Brasil já existe precedente judicial sobre a mesma estrutura. No caso Fashion ID, julgado em 29 de julho de 2019, o Tribunal de Justiça da União Europeia decidiu que o operador de um site que incorpora o botão de curtir do Facebook é controlador conjunto com a plataforma quanto à coleta e à transmissão dos dados dos visitantes, ainda que não responda pelo tratamento posterior feito pela plataforma. A decisão não se aplica ao ordenamento brasileiro, mas descreve com precisão a assimetria em jogo: quem instalou responde pela porta que abriu, mesmo sem enxergar o que acontece do outro lado.
Leitura de governança: quem pode adicionar um script no seu site
O que segue é interpretação, não relato de fato.
O problema prático aqui não é de tecnologia. É de autoridade de decisão. Uma tag de conversão é instalada em minutos, geralmente por um time de marketing, geralmente via gerenciador de tags, geralmente sem passar por jurídico, segurança ou qualquer revisão formal. O prazo é curto, a campanha precisa medir resultado e o código parece inofensivo porque não muda nada visível na página.
Só que essa decisão de minutos cria obrigação para a empresa inteira, e a obrigação dura enquanto o script estiver lá.
A pergunta útil para qualquer gestor que leia esta reportagem não é se o relato do pesquisador se confirmará. É outra, e ela pode ser respondida hoje: quem, na sua empresa, tem autoridade para adicionar um script de terceiro no site, e esse fluxo passa por alguém que entende o risco que ele carrega?
Cinco perguntas que produzem resposta concreta em uma tarde:
1. Existe inventário atualizado de todas as tags e scripts de terceiros em produção, com data de instalação e responsável nomeado?
2. Alguém consegue dizer, sem abrir o código, quais desses scripts leem campos de formulário?
3. O consentimento é configurado antes da inicialização das tags, ou as tags começam medindo e param depois?
4. Existe um passo de aprovação obrigatório entre pedir uma tag nova e ela chegar à produção?
5. A política de privacidade publicada no site corresponde ao que os scripts efetivamente coletam hoje?
Nenhuma dessas perguntas exige decisão sobre a OpenAI, sobre o cookie `__obi` ou sobre o desfecho desta apuração. Elas exigem apenas saber o que já está rodando no seu próprio domínio. Na maior parte das empresas, essa resposta não existe, e é isso que transforma uma notícia sobre publicidade em um problema de processo.


