A ironia já vem empacotada e pronta para consumo: pesquisadores usaram a IA da Anthropic para encontrar uma porta dos fundos na OpenAI. A equipe da Hacktron AI botou o modelo Claude para analisar a arquitetura, mapeou um caminho até contas de funcionários da empresa, reportou o buraco de forma responsável e embolsou um cheque de US$ 6.500 pelo bug bounty.

A OpenAI corrigiu o lado dela em cerca de 14 horas. O mercado acordou com as manchetes do Guardian e da Forbes, mas o detalhe técnico é muito mais mundano — e útil para a defesa corporativa — do que o pânico sugere.

Ilustração / foto de imprensa sobre o caso OpenAI × Claude

The Guardian — crédito da capa. Watermark The Zero é aplicado pelo componente do site; não precisa “assar” na imagem remota.

Overrated

Meme de 'IA invadiu IA'

Underrated

Divulgação responsável com patch em 14 horas

O caminho da pedra (sem receita de bolo)

Segundo o relatório publicado pela Hacktron em setembro de 2026, a cadeia do ataque explorou erros que a TI conhece bem:

  1. Upload de imagem no fórum comunitário da OpenAI (baseado em Discourse). O problema estava no pipeline de processamento do arquivo, não é um truque novo.
  2. Misconfiguração de SSO no lado da OpenAI. Isso permitiu pivotar o comprometimento do fórum da comunidade para dentro da infraestrutura crítica.
  3. Acesso real: os pesquisadores conseguiram acesso a contas ChatGPT/Codex de funcionários e subiram um pull request inofensivo via integração apenas para provar o impacto.

Eles pararam por aí e reportaram. A OpenAI esclareceu que o prêmio de US$ 6.500 cobriu o achado do lado deles (a falha de identidade e SSO). Testar o Discourse hospedado no domínio da comunidade estava tecnicamente fora do escopo do programa. O Discourse foi notificado, aplicou o patch rápido e isolou o processamento de imagens.

Capa / asset do post da Hacktron sobre o caso

Hacktron AI — asset do blog. Fonte primária do relato.

Nada de Exterminador do Futuro

Esqueça a narrativa barata da IA maligna vencendo o laboratório rival. Isso é pesquisa de segurança clássica com humanos no volante e modelos recentes operando como copilotos para mastigar dados. Também não espere payloads soltos por aqui — o foco é arquitetura de segurança, não um tutorial para script kiddies.

A lição principal? O que antes exigia meses de expertise escassa, agora leva dias com um time reduzido usando a IA certa.

A defesa precisa recalcular a rota. Menos "ninguém vai se dar a esse trabalho" e mais sandbox blindado em tudo que processa arquivo de usuário, tempo de resposta cirúrgico e um SSO que não entregue a chave do castelo inteiro por causa de um fórum comprometido. No fim das contas, a empresa que vende o futuro foi lembrada por um modelo concorrente de que pipeline de imagem e SSO frouxo ainda são falhas de 2014.

Fontes

The Zero.