GPT-5.5 chega com avanços em codificação agêntica e segurança

A OpenAI anunciou o lançamento do GPT-5.5, seu modelo mais inteligente e intuitivo até o momento, com ganhos especialmente fortes em codificação agêntica, uso de computador, trabalho de conhecimento e pesquisa científica inicial, conforme comunicado publicado pela empresa em 23 de abril de 2026. O modelo já está disponível para usuários Plus, Pro, Business e Enterprise no ChatGPT e Codex, e o GPT-5.5 Pro foi lançado para usuários Pro, Business e Enterprise no ChatGPT.

Desempenho técnico e eficiência

De acordo com o comunicado, o GPT-5.5 atinge 82,7% no Terminal-Bench 2.0 (que testa fluxos de trabalho complexos de linha de comando) e 58,6% no SWE-Bench Pro (que avalia resolução de problemas reais do GitHub). O modelo também alcançou 84,9% no GDPval (teste de produção de trabalho de conhecimento em 44 ocupações) e 78,7% no OSWorld-Verified (medição da capacidade de operar ambientes reais de computador). Segundo a empresa, o GPT-5.5 entrega inteligência de ponta por metade do custo de modelos concorrentes de codificação.

Capacidades de segurança cibernética

O texto informa que a OpenAI classificou as capacidades de segurança cibernética e biológica/química do GPT-5.5 como “Alto” em seu Preparedness Framework. Embora o modelo não tenha atingido o nível “Crítico” de capacidade cibernética, as avaliações da empresa mostraram que suas capacidades representam um avanço em relação ao GPT-5.4. A OpenAI implementou classificadores mais rigorosos para riscos cibernéticos e mantém, desde o GPT-5.2, salvaguardas específicas para essa área. A empresa está expandindo o acesso a modelos com permissão cibernética por meio do Trusted Access for Cyber, começando pelo Codex.

Avaliações e resultados de segurança

O GPT-5.5 passou por todo o processo de segurança e governança da empresa antes do lançamento, incluindo avaliações de preparação, testes específicos de domínio, novas avaliações direcionadas para capacidades avançadas de biologia e segurança cibernética, e testes robustos com especialistas externos. A OpenAI compartilhou detalhes adicionais no system card do modelo. Na avaliação Capture-the-Flags (desafios internos de CTF), o GPT-5.5 atingiu 88,1%, ante 83,7% do GPT-5.4; no CyberGym, alcançou 81,8%, contra 79,0% do modelo anterior.

Depoimentos de uso

Dan Shipper, fundador e CEO da Every, descreveu o GPT-5.5 como “o primeiro modelo de codificação que usei que tem clareza conceitual séria”. Pietro Schirano, CEO da MagicPath, relatou que o modelo mesclou uma branch com centenas de alterações de frontend e refatoração em uma branch principal que também havia mudado substancialmente, resolvendo o trabalho em uma única tentativa em cerca de 20 minutos. Um engenheiro da NVIDIA que teve acesso antecipado ao modelo afirmou: “Perder o acesso ao GPT-5.5 parece que amputaram um membro meu.”

Aprendizado e Melhores Práticas (origem: IA)

CISOs e operadores de segurança devem avaliar continuamente modelos de IA com capacidades cibernéticas avançadas usando estruturas de preparação e testes direcionados. Implementar controles de acesso diferenciados baseados em confiança para ferramentas de IA com capacidades ofensivas. Estabelecer salvaguardas específicas por categoria de risco (cibernético, biológico, químico) e monitorar ativamente o uso indevido por meio de autenticação e análise de padrões de comportamento.