Pesquisadores da Hacktron AI conseguiram comprometer contas de funcionários da OpenAI e alcançar um repositório interno da empresa após encadear vulnerabilidades com ajuda do Claude Opus 5, da Anthropic. As falhas foram reportadas de forma responsável e renderam US$ 6.500 em bug bounty.

O grupo, formado por Harsh Jaiswal, Mohan Pedhapati e Rahul Maini, afirma ter concluído o caminho entre a descoberta inicial e o acesso ao ambiente interno em menos de 72 horas. Para demonstrar o nível de acesso sem consultar código sensível, os pesquisadores fizeram o Codex criar uma pull request inofensiva no monorepo interno da OpenAI.

A operação começou no community.openai.com, fórum oficial da empresa baseado no Discourse. Uma vulnerabilidade no processamento de imagens HEIC e HEIF permitiu execução remota de código.

Uma segunda falha, relacionada à implementação de single sign-on (SSO) da OpenAI, permitiu ampliar o acesso para contas de ChatGPT e Codex de usuários que haviam usado a autenticação da empresa, incluindo funcionários.

Claude Opus 5 ajudou a concluir o exploit

A equipe havia iniciado o trabalho com uma versão anterior do Claude, mas encontrou dificuldades para tornar o exploit confiável. Após o lançamento do Claude Opus 5, o modelo produziu em cerca de três horas um exploit funcional para ARM64, posteriormente adaptado ao ambiente usado pelo fórum.

A Hacktron ressalta que o processo ainda exigiu orientação de pesquisadores experientes e não foi totalmente autônomo.

A OpenAI recebeu o relatório em 25 de julho e confirmou uma correção de sua parte cerca de 14 horas depois. Em 1º de setembro, encerrou o caso e pagou os US$ 6.500 à equipe. O valor se referia especificamente à vulnerabilidade no lado da OpenAI, enquanto a falha do Discourse foi tratada separadamente.

Continue no Radar