O que é o GPT-6 Astra e o que ele pode fazer
O Astra foi descrito pela OpenAI como "o modelo mais inteligente e alinhado que já construímos". O foco não é apenas raciocínio — é execução autônoma. A empresa posiciona o modelo para operar computadores da mesma forma que uma pessoa o faria: navegando interfaces, executando código, conduzindo pesquisas científicas e produzindo documentos profissionais sem intervenção humana passo a passo. O lema da campanha de lançamento resume o posicionamento: "Qualquer coisa que você possa fazer num computador, Astra pode fazer por você. Rápido." O modelo foi treinado no maior ciclo de computação da história da OpenAI — mais de 100.000 GPUs no complexo Stargate, no Texas — e é o primeiro onde modelos anteriores supervisionaram ativamente o treinamento do novo.
Benchmarks: avanços reais e controvérsias declaradas
Os números publicados pela OpenAI são agressivos. O Astra atingiu 97,6% no FrontierMath Tier 4, benchmark matemático de nível avançado; 99,9% no ARC-AGI-3 usando o harness interno da OpenAI; e 100% no ExploitBench, que mede a capacidade de transformar vulnerabilidades conhecidas em exploits funcionais. Em uso de computador, o modelo marcou 72,6% no OSWorld 2.0, completando tarefas em cerca de 47% menos tempo do que seu antecessor GPT-5.6 Sol. Mas as controvérsias chegaram junto com os resultados. O ARC Prize — organização independente que administra o ARC-AGI-3 — reportou 62,7% usando seu harness padrão, muito abaixo dos 99,9% da OpenAI. A diferença está no método: a OpenAI usou um "Provider Adapter" que preserva estado de raciocínio entre chamadas, técnica não disponível no harness padrão. O resultado é impressionante de qualquer forma — mas a comparação direta com outros modelos fica comprometida.
Cibersegurança: o primeiro modelo "Critical" da OpenAI
O Astra é o primeiro modelo da OpenAI a atingir o nível "Critical" no seu próprio Preparedness Framework — a escala interna de avaliação de risco em cibersegurança. Na prática, isso significa que o modelo tem capacidade de executar tarefas que poderiam causar danos significativos em infraestrutura digital. No ExploitBench com vulnerabilidades recentes — junho a agosto de 2026 — o Astra marcou 39% contra 5,5% do GPT-5.6 Sol. No SRE-Bench, que mede engenharia reversa de binários sem acesso ao código-fonte, o modelo resolveu 88% das tarefas na primeira tentativa e 99,2% em até quatro tentativas. Por isso, as capacidades mais sensíveis de cibersegurança não estão disponíveis publicamente — ficam restritas a organizações vetadas no programa Daybreak Access. O modelo público recusa tarefas como geração de exploits de prova de conceito.
Rollout polêmico e preço 2,5 vezes maior
O lançamento não foi sem turbulência. O acesso começou restrito a um grupo limitado de organizações no programa Daybreak, deixando assinantes pagos — inclusive usuários Pro — sem acesso no primeiro dia. Sam Altman precisou pedir desculpas publicamente e garantiu prioridade aos assinantes Pro na próxima fase do rollout. O preço na API é de 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída — 2,5 vezes o valor do GPT-5.6 Sol. A janela de contexto é de 1.050.000 tokens, com output máximo de 128.000 tokens. O modelo está disponível também via Amazon Bedrock e Microsoft Foundry. O corte de conhecimento é 30 de abril de 2026.
Semana de corrida no topo
O lançamento do GPT-6 Astra acontece dois dias depois do lançamento do Claude Fable 5.1 pela Anthropic, em 1 de setembro de 2026. A semana concentrou ainda anúncios da Meta e do Google. Sam Altman descreveu o momento como "uma nova geração de empreendedorismo". Brockman foi além: afirmou acreditar pessoalmente que a OpenAI atingiu AGI com este modelo, deixando a interpretação final a cargo de cada usuário. O Astra compete diretamente com o Claude Fable 5.1 da Anthropic nos benchmarks de uso de computador e codificação — segmento onde os dois modelos agora dividem o topo da tabela.

