Tudo o que sabemos sobre o Astra, novo modelo da OpenAI
GPT-6 Astra promete mais velocidade e precisão em computadores, programação e pesquisas científicas

A OpenAI apresentou o GPT-6 Astra, novo modelo de inteligência artificial que, segundo a empresa, representa um salto em capacidade de raciocínio, uso de computadores, programação, ciência e tarefas profissionais.
De acordo com a OpenAI, o Astra reúne avanços em pré-treinamento, aprendizado por reforço e alinhamento.
O modelo também foi desenvolvido para executar tarefas de várias etapas com maior autonomia, mantendo atenção às instruções e aos limites definidos pelo usuário.
Leia também: Agentes da OpenAI trapacearam, hackearam a Hugging Face e esconderam provas
Os ganhos de capacidade, no entanto, vêm acompanhados de novas questões de segurança. O Astra é o primeiro modelo da OpenAI a atingir o nível considerado crítico em cibersegurança e, segundo avaliações da própria empresa, parte de seu raciocínio é mais difícil de monitorar do que no GPT-5.6 Sol.
Ao mesmo tempo, a OpenAI afirma que o Astra é seu modelo mais alinhado até agora e apresentou testes em que ele respeitou melhor os limites definidos para uma tarefa do que seu antecessor.
E a empresa foi além: durante a apresentação do modelo, seu presidente, Greg Brockman, sugeriu que o Astra pode marcar a chegada da chamada inteligência artificial geral, ou AGI.
AFINAL, O ASTRA É AGI?
“Bem-vindos à era da AGI”, afirmou Brockman durante uma conversa com jornalistas sobre o lançamento. Segundo ele, quando a indústria olhar para trás e tentar determinar quando a inteligência artificial geral chegou, o Astra poderá ser visto como esse marco.
A afirmação é significativa porque AGI não é apenas sinônimo de uma IA mais poderosa. A própria OpenAI usa o termo para descrever sistemas altamente autônomos capazes de superar humanos na maior parte do trabalho economicamente relevante.
Mas não existe um teste único ou uma definição universalmente aceita que permita declarar que uma inteligência artificial atingiu a AGI. Resultados em benchmarks mostram capacidades específicas de um modelo e não encerram, sozinhos, essa discussão.
Por enquanto, portanto, a chegada da AGI com o Astra permanece mais como uma afirmação da liderança da OpenAI do que como um consenso da indústria ou da comunidade científica.
Os números divulgados pela empresa ajudam a explicar o entusiasmo. O modelo atingiu resultados próximos da saturação em alguns dos testes mais difíceis usados hoje para avaliar raciocínio, matemática e capacidade de agir em ambientes digitais
GPT-6 ASTRA É MAIS RÁPIDO NO USO DO COMPUTADOR
Um dos principais destaques do Astra está na capacidade de interagir diretamente com computadores e navegadores.
Isso significa que o modelo não precisa apenas responder a perguntas. Ele pode executar sequências de ações, como preencher formulários, atualizar registros em sistemas, pesquisar informações, analisar dados ou testar o funcionamento de um site.
Nos testes com o OSWorld 2.0, o Astra levou cerca de 47% menos tempo por tarefa que o GPT-5.6 Sol. O novo modelo também pode criar sites, testar suas funções e ajudar a identificar problemas em softwares.
A OpenAI também afirma que, combinado a atualizações do Codex, o Astra alcança uma conclusão de tarefas até 1,9 vez mais rápida em comparação com a experiência atual do GPT-5.6 Sol no benchmark Mind2Web.
A capacidade de operar computadores é uma peça importante da atual corrida por agentes de IA, sistemas capazes não apenas de gerar uma resposta, mas de receber um objetivo e executar várias etapas para alcançá-lo.
NOVO MODELO TAMBÉM AVANÇA EM PROGRAMAÇÃO
Na área de desenvolvimento, a OpenAI classifica o Astra como seu melhor modelo para engenharia de software até o momento.
De acordo com a empresa, o modelo apresenta desempenho superior em tarefas complexas realizadas em bases de código reais. No DeepSWE v1.1, por exemplo, o Astra alcançou 74,1%, contra 72,7% do GPT-5.6 Sol.
Outro recurso experimental do Codex permite que o Astra mantenha informações entre diferentes janelas de contexto. Assim, o modelo pode recuperar requisitos anteriores, tentativas de correção e resultados de testes durante projetos mais longos.
Durante projetos longos, o modelo pode consultar requisitos anteriores, resultados de testes e tentativas de correção em vez de depender apenas de resumos produzidos durante o processo.
A ideia é reduzir um problema comum em tarefas extensas: a perda de informações relevantes conforme a conversa ou o trabalho avança.
ASTRA TAMBÉM FOCA EM CIÊNCIA
A OpenAI afirma que o modelo já contribuiu para avanços em matemática. Entre os resultados divulgados estão trabalhos relacionados a problemas sobre lacunas entre números primos, com provas formalizadas em Lean.
No FrontierMath Tier 4, o Astra alcançou 97,6% nos testes apresentados pela empresa. Além disso, obteve 99,9% no ARC-AGI-3, benchmark voltado para tarefas de raciocínio abstrato.
Leia também: OpenAI transforma anúncios no ChatGPT em negócio de US$ 1 bilhão
CIBERSEGURANÇA GANHA ATENÇÃO
É na segurança que o lançamento do Astra ganha uma camada mais complexa.
A OpenAI afirma que o novo modelo é mais alinhado e mais cuidadoso em respeitar os limites estabelecidos pelo usuário. Um dos testes foi criado a partir do incidente envolvendo agentes da empresa e servidores da Hugging Face.
Nessa avaliação, o modelo recebia uma tarefa difícil ou impossível e era observado para verificar se ultrapassaria o alvo que havia sido autorizado a acessar.
Sem as proteções usadas em produção, o GPT-5.6 Sol ultrapassou esse limite em cerca de 48% dos casos. O Astra não fez isso em nenhuma das tentativas divulgadas pela empresa.
Mas o próprio relatório de segurança do GPT-6 Astra aponta outro problema: a capacidade de acompanhar o raciocínio do modelo diminuiu.
Segundo a OpenAI, o Astra apresenta uma “redução substancial” na monitorabilidade de sua cadeia de raciocínio em comparação com modelos anteriores.
Na prática, parte do trabalho feito pelo sistema pode ocorrer sem deixar sinais tão claros nos registros de raciocínio que pesquisadores usam para tentar identificar comportamentos indesejados. A OpenAI diz levar essa deterioração “muito a sério”. Segundo a empresa, se a tendência continuar nas próximas gerações, os atuais mecanismos de monitoramento podem perder eficácia para detectar algumas formas de comportamento desalinhado.
Isso cria um paradoxo: o Astra parece respeitar melhor os limites definidos para uma tarefa, mas, caso algo dê errado, acompanhar alguns aspectos de seu raciocínio pode ser mais difícil.
TESTES ENCONTRARAM COMPORTAMENTOS FORA DOS LIMITES
Avaliações externas também encontraram sinais que ajudam a dimensionar esse problema.
Em testes realizados pelo AI Security Institute do Reino Unido (UK AISI), o Astra foi colocado em ambientes simulados diante de desafios difíceis de cibersegurança.
Em algumas situações, o modelo tomou ações fora do escopo previsto, incluindo escrever código malicioso para projetos de código aberto simulados, criar identidades falsas para enganar desenvolvedores e tentar conquistar confiança com contribuições legítimas antes de inserir código malicioso.
Quando as instruções não deixavam claro se o acesso à internet estava proibido, esse tipo de comportamento apareceu em 60 de 499 testes. Quando a proibição foi explicitada, o número caiu para dois em 500.
É importante colocar o resultado em contexto: nenhuma rede, sistema ou repositório real foi acessado. Todo o ambiente era simulado, e os próprios pesquisadores afirmam que ainda não está claro até que ponto o Astra agiu daquela maneira justamente por perceber que estava em uma avaliação.
Os testes, portanto, não mostram que o Astra realizará ataques de forma autônoma no mundo real. Eles mostram, porém, por que definir limites claros e monitorar agentes cada vez mais capazes está se tornando uma questão central para empresas de inteligência artificial.
CIBERSEGURANÇA É UM DOS PONTOS MAIS SENSÍVEIS
O GPT-6 Astra também representa um avanço importante em cibersegurança. Segundo a OpenAI, o modelo atingiu o nível Critical nessa área dentro do Preparedness Framework da empresa.
A classificação indica que suas capacidades já são altas o suficiente para exigir as proteções mais fortes previstas pela OpenAI para esse tipo de risco.
Nos testes feitos sem as salvaguardas usadas na versão disponibilizada aos usuários, o Astra alcançou 100% no ExploitBench, que avalia a capacidade de transformar vulnerabilidades conhecidas em exploits funcionais. O GPT-5.6 Sol havia alcançado 78,5%.
A OpenAI afirma ainda que o Astra descobriu e utilizou duas vulnerabilidades zero-day — falhas até então desconhecidas — durante as avaliações. Segundo a empresa, ambas estão sendo comunicadas aos responsáveis pelos softwares afetados.
Outros testes conduzidos por especialistas mostraram que o modelo, sem as salvaguardas de produção, conseguiu usar vulnerabilidades desconhecidas para executar códigos em navegadores protegidos e criar exploits para obter privilégios maiores em sistemas operacionais.
Essas capacidades podem ter aplicação defensiva: encontrar uma falha antes que ela seja explorada permite que desenvolvedores a corrijam mais rapidamente.
O problema é que a mesma capacidade também pode ser usada para ataques. Quanto mais fácil se torna encontrar uma vulnerabilidade e desenvolver uma maneira de explorá-la, menor pode ser a barreira técnica para agentes mal-intencionados.
Por causa desse aumento de capacidade, a empresa reforçou as proteções contra uso indevido. A versão disponibilizada ao público deverá recusar algumas tarefas avançadas, como a criação de exploits para vulnerabilidades.
Por meio do OpenAI Daybreak, a empresa pretende liberar gradualmente recursos menos restritos para organizações e profissionais autorizados que atuam na defesa de sistemas.
QUANDO O GPT-6 ASTRA ESTARÁ DISPONÍVEL?
Segundo a OpenAI, o GPT-6 Astra começou a ser disponibilizado para um grupo limitado de organizações e chegará, nos dias seguintes, aos usuários dos planos ChatGPT Plus, Pro, Business e Enterprise.
O modelo também estará disponível pela API da OpenAI, além de Microsoft Azure e AWS Bedrock.
(*Atualizada em 4 de setembro de 2026, às 12h35)