OpenAI lança oficialmente GPT-6 Astra: como experimentá-lo


Um ano após o lançamento do GPT-5, a OpenAI anunciou a chegada do GPT-6 Astra, que começará a ser implementado imediatamente. A empresa de IA chamou o Astra de “o modelo mais inteligente e alinhado do mundo”.

OpenAI Astra marca uma nova geração de modelos para a empresa de IA, mas também traz novos riscos.

Um dia antes do lançamento do Astra, a OpenAI confirmou que o Astra foi considerado um risco “crítico” de segurança cibernética, mas que a empresa avançaria com um lançamento com salvaguardas em vigor. A Estrutura de Preparação da empresa rastreia riscos em três domínios (químico/biológico, autoaperfeiçoamento e segurança cibernética), e um porta-voz da OpenAI confirmou ao Mashable que o Astra é o primeiro modelo OpenAI a ser designado como risco crítico – o nível de ameaça mais alto – em qualquer domínio.

Estranhamente, em sua postagem no blog anunciando o Astra, a OpenAI não chamou o Astra de seu modelo mais avançado, mas apenas de “o modelo mais capaz que já implantamos amplamente”. A empresa também divulgou um cartão de sistema detalhado descrevendo os riscos de treinamento e segurança do modelo.

Como experimentar o GPT-6 Astra

A OpenAI lançará o GPT-6 a partir de hoje, embora possa não estar disponível para usuários comuns imediatamente.

OpenAI disse que o GPT-6 Astra estará disponível no lançamento para organizações selecionadas, mas estará disponível para usuários ChatGPT Plus, Pro, Business e Enterprise “nos próximos dias”. Também estará disponível através da API OpenAI e AWS.

O preço da API será:

Você pode aprender mais sobre preços e disponibilidade na página do GPT-6 Astra.

GPT-6 Astra: Cibersegurança e proteção

A OpenAI escreveu que “com as ferramentas e o acesso certos, o GPT‑6 Astra pode encontrar falhas de segurança anteriormente desconhecidas e desenvolver novas maneiras de explorá-las em muitos sistemas bem protegidos, sem que uma pessoa oriente cada etapa”. Como resultado, as habilidades de segurança cibernética mais avançadas da Astra estarão disponíveis apenas para um grupo seleto de parceiros de teste, e a OpenAI disse que também reforçou a segurança em torno do modelo. De acordo com a OpenAI, essas salvaguardas são projetadas para evitar dois resultados:

  • Impedir que atores mal-intencionados usem o Astra para desenvolver novas explorações ou realizar ataques cibernéticos contra sistemas críticos

  • Impedir que “o próprio modelo cause danos cibernéticos ao realizar uma ação não autorizada (ou desalinhada)”

No teste de benchmarking de segurança cibernética ExploitBench, a OpenAI relata que o GPT-6 atinge uma pontuação perfeita de 100 por cento, mesmo em seu nível de raciocínio mais baixo testado. No teste de benchmark ExploitGym Honeypot, OpenAI relatou uma pontuação perfeita de 0,0%.

tabela mostrando o desempenho do gpt-6 no teste de benchmarking do exploitbench

O GPT-6 mostra uma melhoria significativa em relação ao GPT 5.6 Sol no teste de benchmarking ExploitBench.
Credit: OpenAI

Apesar de representar riscos existenciais de segurança cibernética, a OpenAI disse em seu anúncio que o GPT-6 é geralmente mais seguro do que seus antecessores recentes. Em particular, a empresa disse: “O GPT‑6 Astra é significativamente mais seguro em cenários de maior risco”.

O cartão do sistema GPT-6 Astra relata melhores pontuações em avaliações de segurança que medem riscos, como promoção de confiança emocional em usuários, envolvimento com solicitações de automutilação e respostas inadequadas a usuários menores de 18 anos.

tabela mostrando avaliações de segurança para gpt-6 astra e outros modelos openAI recentes

A OpenAI afirma que o Astra obteve pontuações mais altas do que outros modelos recentes em avaliações de segurança (pontuações mais altas são melhores).
Credit: OpenAI

Ao mesmo tempo, a OpenAI admitiu que “a monitorabilidade do GPT‑6 Astra diminuiu em relação ao GPT‑5.6 Sol”, o que significa que o modelo pode ser mais difícil de compreender e controlar.

“Descobrimos que o GPT‑6 Astra é mais capaz de controlar seu próprio CoT do que o GPT‑5.6 Sol, e é menos propenso a incluir informações incriminatórias em seu CoT”, diz uma postagem no blog da OpenAI. “Em ambientes adversários (onde forçamos o modelo a escapar dos nossos monitores), descobrimos que o modelo é capaz de permanecer indetectado quando tem um desempenho estrategicamente inferior nas avaliações (sandbag) e pode por vezes escapar aos nossos monitores internos quando solicitado a realizar certas tarefas de sabotagem”.

GPT-6 Astra: Taxa de alucinação

A OpenAI forneceu menos detalhes sobre as taxas de alucinação e factualidade do GPT-6. Em cartões de sistema anteriores, a OpenAI forneceu detalhes sobre a propensão de seus modelos para inventar fatos ou repetir informações erradas dos próprios usuários.

Dito isto, o cartão do sistema afirma que o GPT-6 fez progressos nesse sentido, gerando menos mentiras e alucinações do que o GPT-5.6 Sol e outros modelos recentes.

gráfico mostrando taxas de alucinação para gpt-6 astra


Credit: OpenAI

“Descobrimos que o Astra comete substancialmente menos erros factuais do que o GPT-5.6 Sol e tem significativamente menos probabilidade de reproduzir alucinações relatadas pelos usuários. Essas melhorias são particularmente pronunciadas em configurações de latência e raciocínio muito baixas.”

As alucinações continuam sendo um dos problemas mais persistentes dos modelos de IA.

GPT-6 Astra: desempenho de referência

A OpenAI divulgou pontuações de benchmark para GPT-6 Astra, mostrando uma melhoria acentuada nos testes de benchmarking mais comuns em comparação com GPT-5.6 Sol e Fable 5.1, que a Anthropic lançou no início desta semana. Notavelmente, o GPT-6 Astra teve pontuação inferior no Último Exame da Humanidade (com ferramentas).

Os destaques incluem:

  • Ciência de banco terminal 0.1: 64,6 por cento

  • FrontierMath Nível 4 (v2): 97,6 por cento

  • Diamante GPQA: 96,0 por cento

  • Último Exame da Humanidade (com ferramentas): 57,2 por cento

  • ExplorarBench: 100 por cento

  • Explorar Ginásio: 42,4 por cento

  • ARC-AGI-1: 98,5 por cento

    ___________________________________________________________________________________________________________________________

    Divulgação: Ziff Davis, empresa controladora da Mashable, em abril de 2025 entrou com uma ação contra a OpenAI, alegando que ela infringiu os direitos autorais de Ziff Davis no treinamento e operação de seus sistemas de IA.



Source link

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *

Botão Voltar ao Topo