Claude Opus 5: como a IA da Anthropic invadiu a OpenAI

Alex da Cruz
Alex da Cruz é desenvolvedor full-stack em São Paulo. Trabalha com React, TypeScript e automação, e usa inteligência artificial no dia a dia para resolver problemas reais de código e de operação — não como demonstração. Já tocou uma operação de e-commerce de ponta a ponta e hoje constrói e mantém o pipeline de automação por trás deste blog. Escreve aqui sobre o que testa de fato.
Pesquisadores da startup Hacktron AI usaram o modelo Claude, da Anthropic, para invadir os sistemas da OpenAI. Segundo o Ars Technica e o TechCrunch, a operação fez parte de um programa de bug bounty de 6.500 dólares e expôs falhas críticas na infraestrutura da criadora do ChatGPT.
Como a falha foi explorada pelo Claude?
O ataque começou com o envio de uma imagem no formato HEIF para o fórum da comunidade da OpenAI, hospedado no Discourse. O TechCrunch detalha que o arquivo passou pela ferramenta ImageMagick e pela biblioteca libheif, onde havia um erro de memória antigo que nunca recebeu um número CVE oficial, mantendo o software vulnerável sem que os administradores notassem.
Qual foi o papel do Claude Opus 5 no ataque?
Segundo os relatos publicados nas fontes, a versão anterior (Opus 4.8) falhou em criar uma exploração funcional ao longo de várias sessões. No entanto, horas após o lançamento do Opus 5 pela Anthropic, os pesquisadores alimentaram o sistema com o mesmo problema e obtiveram sucesso imediato na criação do exploit.
Quais dados foram acessados na invasão?
De acordo com o Ars Technica, a falha permitiu que o grupo capturasse credenciais de login interno e assumisse o controle da conta do ChatGPT de um funcionário da OpenAI. Como essa conta estava conectada à organização da empresa no GitHub, os pesquisadores tiveram acesso a dados confidenciais de software antes de reportarem o problema para correção.
Fontes
- Researchers used Claude to hack OpenAI — arstechnica.com
- Researchers used Anthropic’s Claude to hack into OpenAI — techcrunch.com
Perguntas frequentes
- Qual modelo de IA foi usado na invasão da OpenAI?
- Os pesquisadores utilizaram o Claude Opus 5, versão voltada para cibersegurança lançada pela Anthropic.
- Quanto a OpenAI pagou pela descoberta da falha?
- A empresa pagou 6.500 dólares à equipe da Hacktron AI através de seu programa de recompensas por bugs.
- Qual foi a brecha inicial explorada no sistema?
- O ataque explorou uma falha não catalogada (sem CVE) na biblioteca libheif durante o processamento de imagens enviadas ao fórum da empresa.
Comentários
0 comentário
Seja o primeiro a comentar.
Continue Lendo

Salesforce Koa: modelo de raciocínio da Nvidia reduz custos de IA
Salesforce e Nvidia lançam o Koa, um modelo de raciocínio voltado para o mercado corporativo que promete eficiência de tokens e segurança.

Modelos de IA de Ponta Custam 5x Mais por Vantagem
Relatório da Mozilla revela que pagar por modelos fechados de IA custa 5 vezes mais por uma vantagem de apenas 4 meses no mercado.

Agentes de IA: Auditoria e Monitoramento Garantem Segurança
A segurança no uso de agentes autônomos exige unir testes formais de risco pré-implantação a canais transparentes de monitoramento entre pares em tempo real.