O que é o GPT-5.5-Cyber
Em 22 de junho de 2026, a OpenAI anunciou o lançamento completo do GPT-5.5-Cyber, parte do programa de defesa cibernética da empresa chamado Daybreak. É uma versão do GPT-5.5 ajustada especificamente para o ciclo completo de defesa: ler bases de código grandes, mapear caminhos de ataque, validar vulnerabilidades em ambiente controlado, escrever correções e testar essas correções antes de passar para revisão humana.
Assim como o Mythos 5 da Anthropic, ele não é um produto de acesso público. Só profissionais de segurança verificados conseguem usar, através de um programa de acesso controlado da própria OpenAI.
Os números do benchmark
A comparação usa o CyberGym, um benchmark desenvolvido na Universidade de Berkeley que apresenta a modelos de IA 1.507 vulnerabilidades conhecidas de software, vindas de 188 projetos de código aberto, e mede quantas delas o modelo consegue reproduzir num ambiente controlado.
| Modelo | CyberGym |
|---|---|
| GPT-5.5-Cyber | 85,6% |
| Mythos 5 (Anthropic) | 83,8% |
| Claude Opus 4.7 (modelo de uso geral) | 73,1% |
A OpenAI também divulgou números em dois outros testes — ExploitGym (mede se o modelo consegue transformar uma falha em um ataque funcional) e SEC-bench Pro (mede a capacidade de encontrar falhas totalmente novas ao longo do tempo) — mas a Anthropic não divulgou as notas do Mythos 5 nesses dois, então não é possível comparar diretamente ali.
Por que essa diferença de dois pontos importa tanto
Isoladamente, uma diferença de menos de dois pontos percentuais num benchmark seria irrelevante. O que torna essa comparação significativa é o contexto: o Mythos 5 foi tirado do ar em 12 de junho de 2026, depois de o governo dos Estados Unidos emitir uma diretiva de controle de exportação citando risco à segurança nacional — justamente pela capacidade do modelo de identificar falhas de cibersegurança.
Agora existe um modelo concorrente que supera o Mythos 5 exatamente nesse tipo de capacidade, e ele continua disponível normalmente para quem tem acesso autorizado.
Quer entender a história completa desde o início?
Já cobrimos em detalhe o banimento original do Fable 5 e do Mythos 5 — vale ler antes de seguir.
A jogada estratégica da OpenAI
O ponto mais relevante não é o número do benchmark, e sim o caminho percorrido até o lançamento. A OpenAI executou testes prévios ao lançamento em parceria com agências federais — incluindo o Center for AI Standards and Innovation e o Gabinete do Diretor Nacional de Cibersegurança dos EUA — antes de liberar o modelo.
É, na prática, a mesma abordagem de acesso restrito que a Anthropic tentou aplicar ao Mythos 5 — só que a OpenAI conseguiu aprovação do governo antes do lançamento, em vez de depois.
Dias antes do banimento, o CEO da Anthropic, Dario Amodei, publicou um ensaio comparando modelos de IA de fronteira a aviões que reguladores de segurança deveriam poder impedir de voar caso falhem em auditorias. Poucos dias depois, o próprio governo "aterrissou" o modelo da Anthropic.
Atualização do caso Fable 5 e Mythos 5
A entrada da disputa na esfera judicial é a novidade mais relevante desde o nosso último artigo sobre o tema — sinaliza que a Anthropic não está apenas negociando nos bastidores, mas contestando formalmente a medida.
O que isso significa pra você
Para quem usa o Claude no trabalho todos os dias, a resposta direta é: nada muda. Essa disputa toda acontece na fronteira mais restrita e experimental da indústria de IA — modelos de acesso fechado, voltados a um público extremamente específico de profissionais de cibersegurança verificados.
O que vale observar, de forma mais ampla, é a velocidade da competição entre as grandes empresas de IA nessa área: um banimento que poderia ter dado à OpenAI uma vantagem de meses durou, na prática, menos de duas semanas até aparecer um concorrente direto.
Domine o Claude que você já tem acesso hoje
Enquanto os modelos de fronteira seguem em disputa, o Claude padrão continua sendo uma das ferramentas mais subutilizadas por quem não sabe explorar todo o potencial dele.
Quero dominar o Claude agoraPerguntas frequentes
É uma versão do GPT-5.5 da OpenAI ajustada especificamente para defesa cibernética: encontra falhas de segurança em código, escreve correções e testa essas correções antes de passar para revisão humana. Faz parte do programa Daybreak, da OpenAI, e não está disponível ao público geral — só para profissionais de segurança verificados.
No benchmark CyberGym, o GPT-5.5-Cyber pontuou 85,6% contra 83,8% do Mythos 5 — uma diferença de menos de dois pontos. A Anthropic não divulgou as notas do Mythos 5 nos outros dois testes usados, então não é possível comparar diretamente neles.
Porque o Mythos 5 foi banido pelo governo dos Estados Unidos justamente por ser considerado arriscado demais nessa área — e agora um modelo concorrente supera ele exatamente no teste que mede esse risco, mas continua disponível normalmente para profissionais de segurança verificados.
Não, até a data desta atualização. Os dois modelos seguem suspensos desde 12 de junho de 2026, sem data oficial de retorno. A Anthropic está negociando com o Departamento de Comércio dos EUA e também entrou com uma ação judicial contra o governo americano.
Não. Essa disputa envolve exclusivamente os modelos de fronteira mais restritos — Fable 5 e Mythos 5. O Claude Opus, Sonnet e Haiku, usados no Claude.ai e nos aplicativos do dia a dia, continuam funcionando normalmente, sem qualquer alteração.
Todos com acesso imediato e garantia incondicional de 7 dias.
Artigos relacionados: