Um mês de pausa termina em lançamento escalonado
Em agosto, um comunicado da OpenAI revelou algo sem precedente: o desenvolvimento do Astra havia sido desacelerado porque a empresa não conseguia descartar que o modelo, ainda não lançado, tivesse capacidades cibernéticas de nível Crítico, o degrau mais alto do Preparedness Framework, o protocolo interno que classifica o risco de cada modelo antes do lançamento.
No dia 3 de setembro de 2026, a pausa terminou. A OpenAI lançou oficialmente o GPT-6 Astra e confirmou o que o comunicado de agosto já sugeria: o modelo cruzou mesmo o limite Crítico. É o primeiro laboratório de fronteira a admitir publicamente que um modelo próprio ativou o nível de risco mais alto do seu próprio framework de segurança, e, desta vez, o modelo saiu do estágio de pausa e foi mesmo lançado.
O anúncio nem saiu redondo: segundo a Forbes, material de divulgação da OpenAI circulou em veículos como Reuters, CNBC e The Verge antes da página oficial do Astra ficar no ar. A página chegou a sumir por quase uma hora depois das primeiras matérias saírem, voltando ao ar por volta de três da tarde (horário do leste dos EUA).
O que "Crítico" significa na prática
Pelo Preparedness Framework, um modelo cruza o limite Crítico em cibersegurança quando consegue identificar e desenvolver exploits zero-day funcionais em sistemas reais e endurecidos sem intervenção humana, ou quando consegue planejar e executar um ataque cibernético completo partindo apenas de um objetivo de alto nível, sem alguém guiando cada etapa.
Os números que a OpenAI divulgou sustentam a classificação:
- 100% no ExploitBench, o benchmark que mede a capacidade de transformar uma falha conhecida em um ataque funcional. O GPT-5.6 Sol, modelo anterior mais capaz da empresa em cibersegurança, marcava 78,5%.
- Dois zero-days reais descobertos e explorados durante a avaliação: vulnerabilidades que ninguém conhecia antes do teste. A OpenAI diz estar reportando as duas aos mantenedores responsáveis.
- Num benchmark interno com 20 vulnerabilidades de alta severidade do V8 (motor JavaScript do Chrome) divulgadas nos três meses anteriores, o Astra marcou 39,0% contra 5,5% do Sol, usando muito menos tokens de saída por tarefa.
Em resposta, a OpenAI reforçou isolamento de ambiente de teste, criptografia de checkpoints, monitoramento universal de toda a cadeia de raciocínio (chain-of-thought) e mecanismos de contenção para casos de desalinhamento.
Quem recebe o quê
O ponto que mais importa para quem usa IA em produção é este: os números acima vêm da versão com acesso Daybreak Blue, o programa que dá a defensores de cibersegurança verificados acesso a capacidades que a OpenAI bloqueia no produto padrão. Não é a configuração que chega para o usuário comum.
O rollout é escalonado e desigual em capacidade, não só em prazo:
| Canal | Quando | O que recebe |
|---|---|---|
| Daybreak (defensores verificados) | Primeiro | Acesso a tarefas de defesa cibernética; desenvolvimento de exploits continua fora do escopo mesmo aqui |
| ChatGPT Plus, Pro, Business, Enterprise | Dias seguintes | Modelo com filtros de segurança e monitoramento de abuso; recusa tarefas avançadas de cibersegurança |
API (gpt-6-astra) e Amazon Bedrock |
Dias seguintes | Mesma restrição do ChatGPT; nível Enterprise fica desligado por padrão, o admin do workspace precisa ativar |
Ou seja: a capacidade que motivou o alerta Crítico não está disponível pra quem assina o ChatGPT ou chama a API: ela fica atrás de um programa de verificação de identidade e uso restrito a defesa. É um desenho de acesso em camadas parecido com o que a OpenAI já vinha usando no Daybreak desde agosto.
Onde o Astra não ganha
Fora de cibersegurança, o Astra lidera a maioria dos benchmarks que a OpenAI e a Artificial Analysis publicaram: 72,6% no OSWorld 2.0 (uso de computador), cerca de 47% mais rápido por tarefa que o Sol; 97,6% no FrontierMath Tier 4; 99,9% no ARC-AGI-3.
Mas perde numa linha inteira: no Humanity's Last Exam com ferramentas, o Astra marca 57,2%, atrás do Claude Fable 5.1 (65,0%) e do Claude Opus 5 (63,6%). É o único benchmark acadêmico relevante em que o modelo mais novo da OpenAI fica atrás de qualquer Claude da tabela, vale registrar, já que a semana passada aqui no blog mostramos justamente o Fable 5 perdendo o topo do Intelligence Index para o Opus 5 no ranking geral.
Preço da API: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída no modo Standard. O modo Fast roda até 2,5 vezes mais rápido cobrando o dobro dos dois valores.
O que isso muda pra quem constrói com IA
Duas coisas práticas saem desse lançamento, além da corrida de benchmark:
Primeiro precedente de auto-divulgação vira rotina. A OpenAI publicou o comunicado de pausa em agosto e agora confirma a classificação Crítica no lançamento, com número de zero-days e score de benchmark junto. Isso muda o que vale cobrar de qualquer fornecedor de IA que alega ter avaliação de segurança: se um modelo com capacidade ofensiva real está sendo vendido, a pergunta certa não é "vocês testam segurança", é "qual threshold vocês cruzaram e o que ficou bloqueado por causa disso".
A capacidade perigosa não é a capacidade que você contrata. Quem assina Plus, Enterprise ou chama a API recebe a versão com filtro. Isso é bom pro caso de uso comum, mas significa que comparar o Astra "puro" (o da tabela de benchmark) com o Astra que roda na sua integração é comparar dois produtos diferentes: vale testar a versão restrita antes de decidir migração, não o número da manchete.