Em teste autorizado pela OpenAI, Hacktron AI identificou uma falha no fórum público e tomou o controle do site. A equipe usou modelos da Anthropic para avançar na cadeia e entrar em contas de funcionários.
Pesquisadores da startup Hacktron AI conseguiram acessar contas do ChatGPT vinculadas a funcionários da OpenAI durante um exercício de segurança realizado com autorização da empresa. Para explorar a vulnerabilidade, a equipe utilizou modelos de inteligência artificial desenvolvidos pela Anthropic, concorrente direta da OpenAI.
O teste identificou uma falha no fórum público de ajuda da OpenAI, operado pela plataforma Discourse. A vulnerabilidade permitiu que os pesquisadores assumissem o controle do site e, a partir daí, avançassem na cadeia de ataque até obter acesso às contas. A ação foi apresentada como parte de um exercício autorizado e comunicado pelas partes envolvidas após a descoberta.
Durante a operação, a Hacktron AI empregou diferentes versões dos modelos Claude, da Anthropic. O Claude Opus 4.8 foi usado na identificação e na exploração inicial da brecha, mas apresentou dificuldades de consistência. Em seguida, a equipe recorreu ao Claude Opus 5, que conseguiu produzir um ataque funcional em cerca de três horas. O Claude Mythos não foi utilizado na operação, por ter acesso restrito a organizações selecionadas.
O episódio chamou atenção para o uso da inteligência artificial em operações de segurança ofensiva e para a capacidade dessas ferramentas de acelerar tanto a identificação quanto a exploração de vulnerabilidades. Especialistas ouvidos em reportagens semelhantes indicaram preocupação com a possibilidade de que a IA torne ciberataques sofisticados mais rápidos e baratos, embora o uso em exercícios autorizados também seja apresentado como forma de melhorar a defesa.
Após concluir o teste, a Hacktron AI comunicou a vulnerabilidade à OpenAI e à Discourse. As empresas trabalharam na correção da falha e na coordenação da resposta ao incidente para mitigar riscos decorrentes do acesso às contas.
A OpenAI confirmou o incidente à AFP e informou que a vulnerabilidade foi corrigida cerca de 14 horas após receber a notificação dos pesquisadores. Como parte de seu programa de recompensas por identificação de bugs, a empresa pagou US$ 6.500 à Hacktron AI, valor equivalente a cerca de R$ 34 mil. Drew Pusateri, porta-voz da OpenAI, agradeceu aos pesquisadores pelo contato e pelo compartilhamento das descobertas, e a empresa destacou a rapidez da comunicação e da correção.
A Hacktron AI informou que pretende continuar realizando testes de segurança semelhantes em outras empresas do setor, mantendo a prática de notificar vulnerabilidades descobertas para que sejam corrigidas pela equipe responsável.
LEIA TAMBÉM
Receba as notícias no seu WhatsApp
Entre no nosso canal oficial e fique por dentro de tudo que acontece em Sergipe
Entrar no canal →

