Três coisas que mudaram na IA nesta semana, com fonte para cada uma
A primeira semana de setembro de 2026 entregou movimentos que valem ficar de olho: um novo modelo frontier com classificação de risco inédita, um update da Anthropic que barateia agentes em produção, e o Google encerrando dez anos de Google Assistant de um dia para o outro.
Não tem especulação aqui. Cada dado abaixo tem URL de fonte primária.
GPT-6 Astra chega com o primeiro alerta 'Crítico' de cibersegurança da OpenAI
A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026. O modelo foi descrito pela empresa como o mais capaz que já implantou amplamente, voltado para uso de computador, navegação, engenharia de software, ciências e trabalho profissional.
O detalhe que nenhuma cobertura deveria ignorar está no System Card publicado no mesmo dia:
"O GPT-6 Astra é o nosso primeiro modelo a atingir o nível Crítico de capacidade cibernética sob nosso Preparedness Framework."
Fonte: OpenAI Safety Overview: GPT-6 Astra, openai.com/index/safety-overview-gpt-6-astra/
O que isso significa na prática? A nota do card oficial explica:
"Com as ferramentas e acessos certos, o GPT-6 Astra consegue encontrar falhas de segurança desconhecidas e desenvolver formas novas de explorá-las em muitos sistemas bem protegidos, sem que uma pessoa guie cada passo."
Fonte: OpenAI Deployment Safety Hub, deploymentsafety.openai.com/gpt-6-astra
Em resposta ao risco, a OpenAI reforçou as proteções: isolamento mais estrito, criptografia de checkpoints e monitoramento universal de trajetórias completas, incluindo cadeias de raciocínio. No benchmark de robustez contra injeção indireta de prompt (Gray Swan IPI Arena, 1.810 ataques), a taxa de sucesso de ataque no Astra ficou em 8,5%, contra 27,0% do GPT-5.6 Sol.
Fonte: GPT-6 Astra System Card, deploymentsafety.openai.com/gpt-6-astra
Nos benchmarks de raciocínio e uso de computador, o Astra satura o FrontierMath Tier 4 (97,6%), o ARC-AGI-3 (99,9% com o harness da OpenAI) e marca 72,6% no OSWorld 2.0, ≈47% menos tempo por tarefa que o Sol.
Fonte: openai.com/index/gpt-6-astra/
O acesso foi liberado primeiro para empresas no programa Daybreak, depois para ChatGPT Plus, Pro, Business e Enterprise, API e AWS. O preço de lista é de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída.
Fonte: openai.com/index/gpt-6-astra/ e deploymentsafety.openai.com/gpt-6-astra
Anthropic lança Fable 5.1 e corta 75% no custo de leituras de cache
Um dia antes do Astra, em 1 de setembro de 2026, a Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1. Os dois são o mesmo modelo base; o Fable 5.1 é a versão de acesso geral, com salvaguardas de produção. O Mythos 5.1 fica restrito a organizações vetadas em programas de acesso confiável, principalmente cibersegurança e ciências da vida.
Os preços de entrada e saída não mudaram em relação ao Fable 5: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída. A mudança real está na leitura de cache:
"Reduzimos o preço das leituras de cache do Fable 5.1 em todos os lugares onde o uso é cobrado por token, como na nossa API."
Fonte: Anthropic, via 9to5Mac, 9to5mac.com/2026/09/01/anthropic-upgrades-claude-with-new-fable-5-1-model-details-here/
A taxa de leitura de cache caiu de US$ 1 para US$ 0,25 por milhão de tokens, redução de 75%. A Anthropic estima economia de ≈25% em cargas de trabalho típicas e até ≈45% em tarefas de código e agentes com alto reaproveitamento de contexto. Esses números vêm de medições internas da Anthropic em agosto de 2026 e devem ser tratados como estimativa de fornecedor, não garantia.
Fonte: emergent.sh/news/claude-fable-5-1-release-date
Por que isso importa para quem roda agentes em produção? Agentes consomem muito contexto repetido: histórico de conversa, instruções do sistema, documentos de referência. Quando o modelo já processou esse contexto antes, a leitura de cache substitui o processamento completo. Com o preço de cache 75% mais barato, o custo efetivo de rodar um agente baseado em Fable cai de forma relevante em workloads intensivos.
No System Card publicado junto com o lançamento, a Anthropic registra:
"O Claude Fable 5.1 e o Claude Mythos 5.1 demonstram as maiores capacidades cibernéticas gerais de qualquer modelo que já lançamos."
Fonte: Anthropic System Card PDF, anthropic.com (via CDN oficial)
Google encerrou o Google Assistant em dispositivos móveis
A partir de 4 de setembro de 2026, o Google começou a remover o Google Assistant de celulares Android, tablets, relógios Wear OS, fones de ouvido e carros com Android Auto. O Gemini passou a ser o assistente padrão nessas plataformas. A troca é gradual (leva semanas para alcançar todos os dispositivos), mas é irreversível: uma vez feita, o usuário não consegue voltar para o Assistant.
Casas inteligentes com Google Home, Google TV e carros com Google integrado diretamente (Google built-in) mantêm o Assistant por enquanto.
Fonte: 9to5Google via implicator.ai/google-sets-september-4-date-to-replace-assistant-with-gemini-on-android/
O Gemini chegou a 950 milhões de usuários ativos mensais no segundo trimestre do ano fiscal de 2026, com o número de usuários ativos diários triplicando em relação ao ano anterior, segundo declarações do CEO da Alphabet, Sundar Pichai, durante o resultado da empresa.
Fonte: thestreet.com/technology/google-assistant-shutdown-gemini-replacement
O cientista-chefe da OpenAI pediu desaceleração voluntária no dia seguinte ao lançamento do Astra
Em 6 de setembro de 2026, três dias depois do lançamento do GPT-6 Astra, Jakub Pachocki, cientista-chefe da OpenAI, publicou o ensaio "An Alien Mind" no site da própria empresa. O texto vai direto:
"Acredito atualmente que nenhum laboratório resolveu o alinhamento e o monitoramento em grau suficiente para continuar escalando responsavelmente na velocidade máxima por muito mais tempo. Espero e torço para que desacelerações voluntárias se tornem comuns até que padrões de segurança compartilhados sejam estabelecidos. E acredito que a coordenação internacional sobre o desenvolvimento futuro da IA precisa se tornar uma prioridade máxima para governos ao redor do mundo."
Fonte: OpenAI, openai.com/index/an-alien-mind/
Pachocki também escreveu que tem forte expectativa, com base em resultados internos, de que o ritmo atual de progresso poderia sustentar melhoria recursiva (o modelo melhorando a si mesmo). Ele descreveu o momento como um período que exige cautela extrema.
Fonte: unite.ai/in-an-alien-mind-openais-jakub-pachocki-urges-shared-safety-bars/
O timing é relevante: o mesmo laboratório que lançou o modelo frontier mais capaz da semana publicou, 72 horas depois, um pedido formal de freio. Isso não é contradição de relações públicas. É a descrição mais honesta do dilema que o setor inteiro enfrenta: os modelos ficam melhores rápido demais para que as ferramentas de segurança acompanhem.
O que esses movimentos têm em comum
Os três eventos desta semana contam a mesma história por ângulos diferentes:
- Capacidade: os modelos chegaram a um ponto em que encontram vulnerabilidades de segurança sem orientação humana.
- Custo: a Anthropic reduziu o preço efetivo de agentes em produção ao baratear leituras de cache.
- Infraestrutura: o Google aposentou um assistente que funcionava para substituir um modelo de linguagem de propósito geral, sinalizando que a era dos assistentes de voz baseados em regras acabou.
- Governança: o cientista-chefe do laboratório mais avançado do mundo disse publicamente que a indústria ainda não está pronta para o que está construindo.
Para quem decide sobre automação e software, a mensagem prática é: os blocos de construção ficaram mais capazes e mais baratos ao mesmo tempo. O que ainda está em aberto é a camada de governança, avaliação e monitoramento que garante que esses blocos se comportem como esperado em produção.
Todas as informações acima têm fonte primária verificável. Nenhum número foi estimado ou inferido sem URL.