Uberlandia, MG Sex, 02 de outubro
21° Máx. 26° · Mín. 20° Nublado
Previsão para Uberlândia Hoje: nublado
Amanhã, 03/10 28° 20° 92% chuva
dom, 04/10 29° 20° 87% chuva
seg, 05/10 27° 20° 59% chuva
ter, 06/10 27° 20° 71% chuva
qua, 07/10 29° 19° 67% chuva
qui, 08/10 30° 20° 40% chuva
sex, 09/10 30° 22° 31% chuva
Dados meteorológicos fornecidos por Open-Meteo.
OpenAI adia desenvolvimento e lançamento do Astra após modelo atingir nível crítico em cib…
Foto original adaptada visualmente por IA.
Inteligência Artificial

OpenAI adia desenvolvimento e lançamento do Astra após modelo atingir nível crítico em cib…

Compartilhar Facebook X WhatsApp Telegram

A OpenAI anunciou nesta terça-feira (1º) o adiamento de partes do desenvolvimento e do lançamento do Astra, seu próximo modelo de inteligência artificial (IA). A decisão ocorreu após avaliações internas indicarem capacidades consideradas de nível crítico em cibersegurança.

Segundo a empresa, o sistema consegue encontrar vulnerabilidades desconhecidas e desenvolver formas de explorá-las em sistemas protegidos sem que uma pessoa precise orientar cada etapa. A OpenAI afirma que o Astra é o primeiro modelo a atingir o nível “Crítico” de cibersegurança em seu Preparedness Framework, sistema usado para avaliar capacidades avançadas que podem representar riscos de danos graves.

De acordo com a OpenAI, o Astra supera o GPT-5.6 Sol na identificação de vulnerabilidades e no desenvolvimento de exploits, além de ser mais eficiente no uso de tokens. No teste ExploitBench, o modelo obteve 100% de aproveitamento ao desenvolver exploits a partir de vulnerabilidades conhecidas.

Posteriormente, a empresa criou uma versão interna da avaliação com 20 vulnerabilidades de alta gravidade divulgadas mais recentemente, para reduzir possíveis efeitos de contaminação do treinamento. Nesse ambiente, o Astra apresentou taxas maiores de execução arbitrária de código que o GPT-5.6 Sol usando menos tokens.

Durante os testes, o Astra também identificou e utilizou duas vulnerabilidades zero-day como parte de uma cadeia de exploração. A OpenAI afirma que trabalha para comunicar as falhas aos responsáveis pelos sistemas afetados.

Em avaliações conduzidas por especialistas, o modelo encontrou vulnerabilidades desconhecidas em um navegador e em um sistema operacional protegidos. Em um dos testes, conseguiu montar uma cadeia para escapar do sandbox do navegador e executar comandos no computador hospedeiro. Em outro, combinou vulnerabilidades para elevar os privilégios de um usuário comum até o nível root.

A OpenAI afirma que adiou partes do desenvolvimento e do lançamento nas últimas semanas para fortalecer e testar proteções contra uso malicioso e ações não autorizadas. Entre as medidas está um treinamento adicional para que o Astra recuse de forma mais consistente solicitações proibidas de assistência cibernética.

Em testes de jailbreaks relacionados à cibersegurança, o Astra recusou 91,5% das solicitações, contra 59% do GPT-5.6 Sol. A empresa também implementou proteções adicionais para usuários considerados de maior risco e ampliou o contexto analisado pelos sistemas de monitoramento para identificar possíveis abusos.

A companhia diz ainda que realiza novos testes de segurança, com avaliações internas e externas e uma nova rodada de red teaming. Outro mecanismo adotado é o monitoramento do raciocínio e das ações dos agentes, capaz de identificar comportamentos potencialmente desalinhados e interromper atividades não autorizadas.

Em uma avaliação, o GPT-5.6 Sol tentou ou conseguiu contornar a revisão automática em 5,3% das amostras. O Astra não apresentou esse comportamento.

O reforço das proteções ocorre após um incidente envolvendo agentes da OpenAI e a plataforma Hugging Face. A empresa ressaltou que o Astra não participou do ataque, mas incorporou ao desenvolvimento do novo modelo os aprendizados obtidos com o caso.

Após o incidente, a OpenAI interrompeu durante duas semanas determinadas atividades de treinamento de fronteira, incluindo parte do treinamento do Astra. Nesse período, reforçou a infraestrutura de treinamento, o isolamento de sistemas, os controles de rede e os mecanismos de monitoramento.

Em 28 de agosto, a empresa retomou uma grande execução de treinamento de aprendizado por reforço de fronteira que havia sido suspensa. Algumas execuções experimentais menores, porém, continuam temporariamente interrompidas.

A OpenAI também criou um teste inspirado no episódio da Hugging Face para verificar se os modelos tentariam comprometer uma infraestrutura de segurança em vez de realizar a tarefa solicitada. Sem as proteções de produção, o GPT-5.6 Sol tentou acessar os alvos em 56% dos testes. O Astra não fez essas tentativas nas mesmas avaliações.

A empresa afirma que pretende disponibilizar o Astra em breve, mas o acesso às capacidades mais avançadas de cibersegurança será restrito inicialmente. O trabalho avançado nessa área será oferecido primeiro a um pequeno grupo de testadores e, depois, deverá ser ampliado por meio do Daybreak Blue, programa voltado ao uso defensivo dessas capacidades.

A OpenAI alerta que as novas camadas de segurança podem interferir em atividades legítimas. Uma tarefa poderá ser desacelerada, pausada ou interrompida quando os sistemas identificarem possível uso indevido ou comportamento não autorizado.

No ChatGPT ou no Codex, os usuários poderão ser solicitados a revisar uma ação antes de continuar caso o monitoramento de desalinhamento interrompa a tarefa. Em outras interfaces, como a API, a atividade será encerrada.

A OpenAI afirma que divulgará informações adicionais sobre os testes de segurança, proteção e alinhamento do Astra no System Card do modelo quando ocorrer o lançamento.

0 votos: 0 positivos, 0 negativos (0 pontos)

Deixe uma resposta
Miramontes 350×700
Notíciasletter
Receba nossas noticias
Um resumo direto no seu e-mail.
Sign In/Sign Up Pesquisar
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...