A OpenAI comunicou em 7 de agosto de 2026 que seu modelo Astra, atualmente em desenvolvimento, apresentou avanços significativos em capacidades de cibersegurança, chegando ao que a empresa classifica como um possível limiar “crítico” sob seu Preparedness Framework.

O que muda com Astra

Segundo a OpenAI, avaliações internas recentes e análises de especialistas indicam que o Astra avançou em agentic coding e tarefas de cibersegurança a ponto de não ser possível descartar que o modelo tenha atingido a categoria de capacidade crítica. Esse é o primeiro modelo da empresa avaliado nesse patamar — versões anteriores, como o GPT-5.6-Sol, foram classificadas apenas como “High” (alto), sem atingir o nível crítico.

O Preparedness Framework, publicado originalmente em dezembro de 2023, define critérios para escalonar respostas internas à medida que modelos se aproximam de capacidades sensíveis, como ataques cibernéticos, biologia, química e autoaperfeiçoamento de IA. O limiar crítico para cibersegurança é atingido se o modelo for capaz de identificar e desenvolver exploits zero-day funcionais em sistemas resistentes sem intervenção humana, ou executar ataques cibernéticos de ponta a ponta em alvos protegidos apenas a partir de objetivos abstratos.

Astra ainda está em fase de testes internos e, segundo a OpenAI, não foi envolvido em incidentes recentes como o ataque à Hugging Face.

Medidas e salvaguardas adotadas

Diante do potencial avanço, a OpenAI anunciou a intensificação dos testes de robustez em salvaguardas e controles de segurança. Entre as ações já implementadas estão:

  • Ambientes de teste isolados para modelos de maior capacidade;
  • Restrição de acesso à rede e a ferramentas;
  • Proteções e criptografia reforçadas dos weights do modelo;
  • Monitoramento universal para ações de risco e sinais de desalinhamento durante o uso agentic;
  • Pausa em atividades internas com Astra que não atendam aos novos requisitos de segurança;
  • Monitores que avaliam o Chain of Thought do modelo e acionam respostas automáticas para interromper atividades de alto risco.

Além disso, a OpenAI informou que irá colaborar com órgãos governamentais e organizações de segurança para avaliações externas controladas, fornecendo recomendações de segurança para parceiros que testem workloads de alto risco.

Contexto do Preparedness Framework

O Preparedness Framework foi criado como resposta a possíveis emergências de capacidade em IA, estabelecendo protocolos para antecipação e mitigação de riscos. Em junho de 2025, a OpenAI já havia aplicado o framework ao detectar avanços em biologia, adotando procedimentos semelhantes aos atuais.

A empresa reforça que o objetivo é garantir que modelos avançados ajudem defensores a identificar vulnerabilidades antes de atacantes, e compromete-se a trabalhar com governos e sociedade civil para que essas capacidades sejam usadas de forma responsável.

Por que importa

A admissão pública de um possível limiar crítico em cibersegurança marca uma inflexão na governança de modelos fundacionais. O anúncio antecipa um debate sobre transparência, limites de divulgação e responsabilidade compartilhada — especialmente quando as capacidades ultrapassam o escopo de controle tradicional. Para empresas e desenvolvedores, o episódio sinaliza a necessidade de revisar políticas de integração de modelos de IA em ambientes sensíveis, e reforça a urgência de frameworks de segurança alinhados ao ritmo real de evolução dos LLMs.

Tags
  • #openai
  • #astra
  • #cibersegurança
  • #preparedness framework