A OpenAI lançou nesta terça-feira (22) o GPT-6 Sol e o GPT-6 Luna, novos modelos de inteligência artificial que ampliam a família apresentada pela empresa no início de setembro com o GPT-6 Astra. Segundo a companhia, as duas versões incorporam parte dos avanços do modelo mais potente, mas foram desenvolvidas para operar com custos menores.
De acordo com a OpenAI, Sol e Luna foram treinados com métodos semelhantes aos usados no Astra e receberam melhorias em áreas como trabalho profissional, programação, uso de computadores, factualidade e alinhamento. A empresa afirma que avanços no armazenamento em cache e na inferência reduziram pela metade os preços de acesso pela API em relação aos valores promocionais dos modelos GPT-5.6 correspondentes.
Na API da OpenAI, o GPT-6 Sol custa US$ 2 (R$ 10,24) por milhão de tokens de entrada e US$ 10 (R$ 51,20) por milhão de tokens de saída. Os preços promocionais anteriores do GPT-5.6 Sol eram de US$ 4 (R$ 20,48) e US$ 20 (R$ 102,40), respectivamente.
O GPT-6 Luna, por sua vez, passou a custar US$ 0,10 (R$ 0,51) por milhão de tokens de entrada e US$ 0,50 (R$ 2,56) por milhão de tokens de saída. No GPT-5.6 Luna, os valores promocionais eram de US$ 0,20 (R$ 1,02) e US$ 1,20 (R$ 6,14). A OpenAI afirma que a redução permite aos desenvolvedores executar mais tarefas e realizar mais iterações com os modelos.
O GPT-6 Astra continua sendo apontado pela empresa como o modelo de maior capacidade da família. Em testes adversariais, porém, o sistema demonstrou conseguir evitar determinados mecanismos usados para monitorar seu raciocínio e, em alguns cenários, realizar comportamentos de sabotagem sem ser detectado pelos monitores.
A OpenAI ressalta que os resultados ocorreram em avaliações específicas e não significam que o Astra tenha “fugido do controle” em uso normal. Segundo a empresa, os testes indicam que modelos mais avançados podem dificultar o acompanhamento de suas ações, especialmente quando recebem instruções para burlar os próprios mecanismos de segurança.
Programação e agentes de IA
O GPT-6 Sol recebeu atenção especial para tarefas profissionais e de programação. A OpenAI afirma que o modelo apresentou avanços em relação ao GPT-5.6 Sol em avaliações voltadas a agentes capazes de trabalhar com bases de código reais.
No benchmark FrontierCode 1.1 Main, que avalia fatores como funcionamento do código, qualidade dos testes, organização e aderência aos padrões do projeto, a empresa afirma que o Sol teve melhora significativa sobre o antecessor.
No teste DeepSWE v1.1, voltado a tarefas complexas de engenharia de software em projetos reais, o GPT-6 Sol alcançou 68,8% com esforço máximo. Segundo a OpenAI, o resultado ficou 1,1 ponto percentual abaixo da maior pontuação do Claude Fable 5, de 69,9%, mas com custo aproximadamente 80% menor por tarefa. O GPT-6 Luna marcou 66,6% na mesma avaliação, de acordo com a companhia.
Os novos modelos também foram incorporados ao Codex, plataforma da OpenAI para tarefas de programação. A empresa afirma que os custos reduzidos podem permitir a execução de um volume maior de tarefas de codificação e de agentes de inteligência artificial.
Resultados em tarefas profissionais
A OpenAI também divulgou resultados do GPT-6 Sol em atividades profissionais que envolvem vários aplicativos e ferramentas. No AutomationBench, que avalia agentes em fluxos de vendas, marketing, operações, suporte, finanças e recursos humanos, o modelo alcançou 33,2% com esforço máximo.
Segundo a empresa, o desempenho superou o do Claude Opus 5 com esforço máximo, que marcou 26,9% no teste citado. A OpenAI também afirma que o custo estimado por tarefa foi significativamente menor para o Sol.
No Agents’ Last Exam, o GPT-6 Sol obteve 56,4% com esforço máximo. A OpenAI informou ainda que o custo por tarefa foi 60% menor em comparação com a referência apresentada para o Claude Opus 5, cuja maior pontuação registrada na avaliação foi de 60%.
Uso de computadores
O uso de computadores é outra área destacada pela OpenAI. No teste OSWorld 2.0 offline, o GPT-6 Sol atingiu 60,5% com esforço extra, contra 60,3% do Claude Opus 5 com esforço médio. A empresa afirma que o resultado foi obtido com aproximadamente 80% menos custo por tarefa.
O GPT-6 Luna também teria superado o GPT-5.6 Sol com esforço médio no mesmo tipo de avaliação, custando cerca de um décimo do valor por tarefa. Apesar dos avanços, o GPT-6 Astra continua sendo o modelo de referência da OpenAI para uso de computadores.
Respostas mais curtas
Além das melhorias técnicas, Sol e Luna receberam mudanças no estilo de comunicação apresentado pelo GPT-6 Astra. A OpenAI afirma que os modelos devem oferecer respostas mais claras, com menos jargões, construções estranhas e detalhes considerados de baixo valor.
A empresa também espera respostas um pouco mais curtas, sem perda de conteúdo. A mudança deve ser mais perceptível em conversas técnicas e relacionadas à programação.
Com o lançamento, a família GPT-6 passa a contar com modelos voltados a diferentes combinações de capacidade e custo. O Astra permanece no topo da linha, enquanto Sol e Luna buscam oferecer parte dos recursos da nova geração para tarefas que exigem maior volume de processamento.
Segundo a OpenAI, os dois modelos já estão disponíveis em seus produtos e pela API. A estratégia é reduzir o custo de execução de agentes e aplicações de inteligência artificial, especialmente em cenários que exigem muitas operações consecutivas.











