OpenAI lança GPT-6 Sol e Luna, novos modelos de IA que prometem mais desempenho por menos dinheiro
Tudo sobre Inteligência Artificial
Tudo sobre OpenAI
A OpenAI ampliou nesta terça-feira (22) sua nova geração de modelos de inteligência artificial (IA) com o lançamento do GPT-6 Sol e do GPT-6 Luna. As duas versões chegam depois do GPT-6 Astra, apresentado pela empresa no início de setembro, e foram desenvolvidas para oferecer parte dos avanços da geração mais potente com custos menores.Continua após a publicidadeSegundo a OpenAI, Sol e Luna foram treinados com métodos semelhantes aos utilizados no Astra, incorporando avanços em áreas, como trabalho profissional, programação, uso de computadores, factualidade e alinhamento.A principal diferença está na relação entre capacidade e custo. A empresa afirma que melhorias no armazenamento em cache e na inferência permitiram reduzir em 50% os preços de acesso pela API em comparação com os valores promocionais dos modelos GPT-5.6 correspondentes.GPT-6 Sol e Luna custam menos
Na API da OpenAI, o GPT-6 Sol passa a custar US$ 2 (R$ 10,24) por milhão de tokens de entrada e US$ 10 (R$ 51,20) por milhão de tokens de saída;
No GPT-5.6 Sol, os valores promocionais anteriores eram de US$ 4 (R$ 20,48) e US$ 20 (R$ 102,40), respectivamente;
Já o GPT-6 Luna custa US$ 0,10 (R$ 0,51) por milhão de tokens de entrada e US$ 0,50 (R$ 2,56) por milhão de tokens de saída;
No GPT-5.6 Luna, os preços promocionais eram de US$ 0,20 (R$ 1,02) e US$ 1,20 (R$ 6,14);
A companhia destaca que a redução de custos foi pensada para permitir que desenvolvedores executem mais tarefas e façam mais iterações com os modelos;
O GPT-6 Astra, por sua vez, continua sendo apresentado pela OpenAI como o modelo de maior capacidade da família para quem busca o desempenho máximo.
Apesar de o GPT-6 Astra continuar sendo apontado pela OpenAI como o modelo mais avançado da família, a própria empresa também identificou desafios relacionados ao controle e ao monitoramento do sistema. Em testes adversariais, o modelo demonstrou capacidade de evitar determinados mecanismos usados para monitorar seu raciocínio e, em alguns cenários, realizar comportamentos de sabotagem sem ser detectado pelos monitores.A OpenAI ressalta que esses resultados ocorreram em avaliações específicas e não significam que o GPT-6 Astra tenha “fugido do controle” em uso normal. Ao mesmo tempo, os testes indicam que modelos mais avançados podem tornar mais difícil acompanhar internamente o que estão fazendo, especialmente quando são colocados diante de instruções para burlar os próprios mecanismos de segurança.Foco em programação e agentes de IAO GPT-6 Sol recebeu atenção especial para tarefas profissionais e de programação. A OpenAI afirma que o modelo apresenta avanços significativos em relação ao GPT-5.6 Sol em testes voltados para agentes capazes de trabalhar em bases de código reais.
No benchmark FrontierCode 1.1 Main, que avalia não apenas se o código funciona, mas também aspectos como qualidade dos testes, organização e aderência aos padrões do projeto, a empresa afirma que o Sol apresentou melhora significativa em relação ao antecessor.Em outro teste, o DeepSWE v1.1, voltado para tarefas complexas de engenharia de software em projetos reais, o GPT-6 Sol atingiu 68,8% com esforço máximo. Segundo a OpenAI, o resultado ficou a 1,1 ponto percentual da maior pontuação do Claude Fable 5, de 69,9%, mas com custo aproximadamente 80% menor por tarefa. O GPT-6 Luna também apresentou desempenho de 66,6% no mesmo teste, de acordo com a empresa.Esses recursos também chegam ao Codex, plataforma da OpenAI voltada para tarefas de programação. A companhia afirma que os custos menores dos novos modelos podem permitir que desenvolvedores executem mais tarefas de codificação e agentes de IA.Continua após a publicidadeDesempenho em tarefas profissionaisA OpenAI também destacou resultados do GPT-6 Sol em tarefas profissionais que envolvem múltiplos aplicativos e ferramentas.No AutomationBench, que testa agentes em fluxos de trabalho de vendas, marketing, operações, suporte, finanças e recursos humanos, o Sol, com esforço máximo, atingiu 33,2%, segundo a empresa.A OpenAI afirma que esse resultado superou o Claude Opus 5 com esforço máximo, que marcou 26,9% no teste citado pela companhia. O custo estimado por tarefa também teria sido significativamente menor para o Sol.Em outro teste, chamado Agents’ Last Exam, o GPT-6 Sol atingiu 56,4% com esforço máximo. A OpenAI afirma que o resultado ficou acima da maior pontuação do Claude Opus 5 registrada na avaliação, de 60%, mas com custo 60% menor por tarefa.
OpenAI afirma que esse resultado superou o Claude Opus 5 com esforço máximo, que marcou 26,9% no teste citado pela companhia – Imagem: Camilo Concha/ShutterstockContinua após a publicidadeLeia mais:Modelos também melhoram uso do computadorO uso de computadores é outra área destacada pela OpenAI.No teste OSWorld 2.0 offline, o GPT-6 Sol, com esforço extra, atingiu 60,5%, segundo a empresa, contra 60,3% do Claude Opus 5 com esforço médio. A OpenAI afirma que o resultado foi obtido com aproximadamente 80% menos custo por tarefa.O GPT-6 Luna, por sua vez, teria superado o GPT-5.6 Sol com esforço médio no mesmo tipo de avaliação, custando cerca de um décimo do valor por tarefa.Apesar dos avanços, a OpenAI mantém o GPT-6 Astra como seu modelo de referência para uso de computadores.Respostas mais claras e menos verbosasAlém dos ganhos técnicos, Sol e Luna também receberam mudanças no estilo de comunicação introduzido no GPT-6 Astra.A OpenAI afirma que os novos modelos devem apresentar respostas mais claras, com menos jargões, menos construções estranhas e menos detalhes considerados de baixo valor. A empresa também espera respostas um pouco mais curtas, sem perda de conteúdo.Continua após a publicidadeA mudança deve ser especialmente perceptível em conversas técnicas e relacionadas a programação.Expansão da família GPT-6O lançamento de Sol e Luna amplia rapidamente a família GPT-6. O primeiro modelo da geração, o GPT-6 Astra, foi apresentado no início de setembro com foco em tarefas, como programação, pesquisa científica, uso de computadores, cibersegurança e trabalho profissional.Agora, a OpenAI passa a oferecer modelos com diferentes combinações de capacidade e custo. O Astra permanece no topo da linha, enquanto Sol e Luna buscam levar parte dos recursos da nova geração para tarefas que exigem maior volume de processamento.A chegada dos dois modelos também reforça a estratégia da empresa de reduzir o custo de execução de agentes e aplicações de IA, especialmente em cenários nos quais os sistemas precisam realizar muitas operações consecutivas.Continua após a publicidadeSol e Luna já estão sendo disponibilizados pela OpenAI em seus produtos e pela API, ampliando o acesso à nova geração de modelos.
Rodrigo Mozelli
Rodrigo Mozelli é jornalista formado pela Universidade Metodista de São Paulo (UMESP) e, atualmente, é redator do Olhar Digital.
Ver todos os artigos →









