Pesquisadores da startup Hacktron AI conseguiram acessar as contas do ChatGPT da OpenAI usando um modelo de inteligência artificial (IA) da Anthropic, conforme informado em seu site nesta sexta-feira (18).

A invasão foi realizada durante um exercício de segurança organizado pela própria OpenAI, com a ajuda de especialistas externos.

Vulnerabilidade identificada

Os pesquisadores encontraram uma vulnerabilidade no fórum público de ajuda da OpenAI, gerido pela plataforma Discourse, que lhes permitiu tomar o controle do site.

A OpenAI confirmou a falha e informou que ela foi corrigida em cerca de 14 horas após ser notificada. A empresa também pagou uma recompensa de 6.500 dólares (aproximadamente 34.000 reais) aos pesquisadores.

Modelos de IA utilizados

Os pesquisadores inicialmente usaram o Claude Opus 4.8, da Anthropic, para identificar e explorar a falha de software, mas tiveram dificuldades para conseguir que funcionasse de forma consistente.

Depois recorreram ao Claude Opus 5, o modelo mais recente, que produziu um ataque funcional em três horas.