A OpenAI anunciou o GPT-6 Sol e o GPT-6 Luna, novos modelos de inteligência artificial que ampliam o ecossistema de modelos de fronteira da empresa. A dupla foi desenvolvida com foco em reduzir custos e acelerar o uso de IA , levando recursos apresentados no modelo topo de linha Astra para tarefas profissionais e aplicações em larga escala. Os modelos já estão disponíveis no ChatGPT Work e no Codex para usuários dos planos Plus, Pro, Business, Enterprise e Edu. Nos planos Free e Go, o GPT-6 Luna pode ser usado pelo aplicativo para desktop . Para desenvolvedores, os modelos estão disponíveis pela API. A OpenAI afirma que a chegada ao ChatGPT será gradual ao longo do dia, mas os modelos ainda não estão disponíveis na interface padrão de “Chat”. O GPT-6 Sol é voltado para tarefas profissionais complexas e programação e o Luna foi desenvolvido para trabalhos de alto volume, como resumos e extração de informações. A arquitetura dos dois modelos também foi otimizada para fluxos de trabalho longos e agentes de IA , com recursos que ajudam a reduzir o custo de operações que reutilizam grandes quantidades de contexto. Um desses recursos é o cache de prompts . A leitura de tokens de entrada armazenados em cache recebe 90% de desconto, o que reduz o custo de aplicações que reaproveitam informações ao longo de diferentes etapas de uma tarefa. Na API, o GPT-6 Sol tem o preço reduzido de US$ 4 para US$ 2 por 1 milhão de tokens de entrada e de US$ 20 para US$ 10 na saída. Já o GPT-6 Luna cai de US$ 0,20 para US$ 0,10 na entrada e de US$ 1,20 para US$ 0,50 na saída. Os dois modelos têm redução de 50% nos preços em relação aos valores promocionais da linha GPT-5.6. A combinação entre preços menores, cache barato e foco em tarefas de longa duração busca tornar o uso dos modelos mais viável para desenvolvedores que precisam processar grandes volumes de informações. O lançamento ocorre em meio à forte disputa entre OpenAI e Anthropic . Apenas 90 minutos antes do anúncio da OpenAI, a Anthropic apresentou uma nova versão do Opus 5.5, com preços menores e desempenho no nível do Fable. GPT-6 Sol e Luna mostram resultados em diferentes tarefas Os testes de desempenho apresentados pela OpenAI mostram resultados diferentes de acordo com a proposta de cada modelo. O GPT-6 Sol foi avaliado em tarefas profissionais, programação e engenharia de software, enquanto o Luna também apresentou resultados em automação, uso de computador, engenharia de software e confiabilidade factual. No AutomationBench, que avalia fluxos de trabalho de negócios em diferentes aplicativos, o GPT-6 Sol superou o Claude Opus 5, da concorrência, com custo equivalente a apenas 9% do valor por tarefa . Na programação, o modelo igualou o desempenho do Claude Fable 5.1 no FrontierCode, que verifica se o código produzido está pronto para ser incorporado a bases de código reais. Já no DeepSWE v1.1, voltado para tarefas complexas de engenharia de software, o Sol alcançou 68,8% de pontuação , com custo 80% menor que o de modelos concorrentes de alto desempenho. O GPT-6 Luna também apresentou evolução em relação à geração anterior. No AutomationBench, em nível de esforço alto, o modelo superou o GPT-5.6 Luna em 5,4 pontos percentuais , com custo por tarefa 58% menor . No DeepSWE v1.1, o Luna alcançou 66,6% de pontuação no nível máximo de esforço, resultado comparável ao de Claude Opus 5 e Claude Fable 5 em níveis médios de esforço. No OSWorld 2.0 offline, que avalia tarefas de uso de computador, o Luna também superou o GPT-5.6 Sol, considerando esforço médio para o modelo anterior, com apenas um décimo do preço . A OpenAI ainda avaliou a confiabilidade factual dos modelos. Em níveis mais altos de esforço, o Luna alcançou a mesma confiabilidade do antigo GPT-5.6 Sol por 1% do custo . A OpenAI também alterou o estilo de colaboração dos modelos para reduzir jargões e informações de pouco valor . A proposta é entregar respostas mais curtas e claras. Em avaliações de alinhamento, o Luna ainda apresentou taxas menores de alegações enganosas sobre seu próprio trabalho de programação em comparação com o GPT-5.6 Luna. Novas ferramentas ajudam a controlar custos e desempenho A OpenAI também lançou novas ferramentas para que desenvolvedores acompanhem o uso dos modelos e encontrem formas de melhorar o desempenho das aplicações. O Prompt Caching Dashboard, por exemplo, identifica oportunidades de cache que não foram aproveitadas , o que ajuda a encontrar pontos em que o processamento pode ser otimizado. Outra mudança permite ajustar o esforço de raciocínio e a disponibilidade de ferramentas sem invalidar o cache já existente. Com isso, agentes de IA podem alterar esses parâmetros durante fluxos de trabalho que reutilizam o mesmo contexto sem perder as informações armazenadas no cache. Os recursos também chegam acompanhados de melhorias de segurança herdadas do trabalho de alinhamento feito para o Astra. Segundo a OpenAI, o GPT-6 Sol e o Luna apresentam taxas menores de alegações enganosas em tarefas de programação e tiveram resultados melhores em avaliações que testam tentativas de contornar avisos de segurança. Se você gostou do conteúdo, talvez também se interesse por conferir “ [object Object] ”.






