A ironia já vem empacotada e pronta para consumo: pesquisadores usaram a IA da Anthropic para encontrar uma porta dos fundos na OpenAI. A equipe da Hacktron AI botou o modelo Claude para analisar a arquitetura, mapeou um caminho até contas de funcionários da empresa, reportou o buraco de forma responsável e embolsou um cheque de US$ 6.500 pelo bug bounty.
A OpenAI corrigiu o lado dela em cerca de 14 horas. O mercado acordou com as manchetes do Guardian e da Forbes, mas o detalhe técnico é muito mais mundano — e útil para a defesa corporativa — do que o pânico sugere.

The Guardian — crédito da capa. Watermark The Zero é aplicado pelo componente do site; não precisa “assar” na imagem remota.
Overrated
Meme de 'IA invadiu IA'
Underrated
Divulgação responsável com patch em 14 horas
O caminho da pedra (sem receita de bolo)
Segundo o relatório publicado pela Hacktron em setembro de 2026, a cadeia do ataque explorou erros que a TI conhece bem:
- Upload de imagem no fórum comunitário da OpenAI (baseado em Discourse). O problema estava no pipeline de processamento do arquivo, não é um truque novo.
- Misconfiguração de SSO no lado da OpenAI. Isso permitiu pivotar o comprometimento do fórum da comunidade para dentro da infraestrutura crítica.
- Acesso real: os pesquisadores conseguiram acesso a contas ChatGPT/Codex de funcionários e subiram um pull request inofensivo via integração apenas para provar o impacto.
Eles pararam por aí e reportaram. A OpenAI esclareceu que o prêmio de US$ 6.500 cobriu o achado do lado deles (a falha de identidade e SSO). Testar o Discourse hospedado no domínio da comunidade estava tecnicamente fora do escopo do programa. O Discourse foi notificado, aplicou o patch rápido e isolou o processamento de imagens.

Hacktron AI — asset do blog. Fonte primária do relato.
Nada de Exterminador do Futuro
Esqueça a narrativa barata da IA maligna vencendo o laboratório rival. Isso é pesquisa de segurança clássica com humanos no volante e modelos recentes operando como copilotos para mastigar dados. Também não espere payloads soltos por aqui — o foco é arquitetura de segurança, não um tutorial para script kiddies.
A lição principal? O que antes exigia meses de expertise escassa, agora leva dias com um time reduzido usando a IA certa.
A defesa precisa recalcular a rota. Menos "ninguém vai se dar a esse trabalho" e mais sandbox blindado em tudo que processa arquivo de usuário, tempo de resposta cirúrgico e um SSO que não entregue a chave do castelo inteiro por causa de um fórum comprometido. No fim das contas, a empresa que vende o futuro foi lembrada por um modelo concorrente de que pipeline de imagem e SSO frouxo ainda são falhas de 2014.
Fontes
- Hacktron — Hacking OpenAI
- The Guardian — OpenAI ‘ethically hacked’ with help of Anthropic’s Claude
- Forbes — Security Researchers Hacked Into OpenAI Using Anthropic’s Claude
The Zero.