A OpenAI anunciou oficialmente o lançamento do GPT-6 Sol e do GPT-6 Luna, novos modelos de inteligência artificial que expandem o ecossistema de ponta da companhia. Desenvolvidos com o objetivo de reduzir custos operacionais e acelerar a adoção da tecnologia, os sistemas trazem recursos avançados anteriormente restritos ao modelo de topo de linha Astra, direcionando-os para demandas profissionais e aplicações corporativas em larga escala.
Atualmente, as novidades já se encontram disponíveis no ChatGPT Work e no Codex, atendendo diretamente os usuários dos planos Plus, Pro, Business, Enterprise e Edu. Nas modalidades Free e Go, o GPT-6 Luna pode ser acessado por meio do aplicativo para desktop. Para a comunidade de desenvolvedores, a distribuição ocorre via API. Conforme informado pela OpenAI, a implementação no ChatGPT ocorre de maneira gradual ao longo do dia, embora os modelos ainda não integrem a interface padrão de chat tradicional.
Em termos de especialização, o GPT-6 Sol foi concebido para lidar com demandas profissionais complexas e atividades de programação, enquanto o GPT-6 Luna foca em operações de alto volume, a exemplo de resumos textuais e extração de dados. Além disso, a arquitetura de ambos foi inteiramente otimizada para dar suporte a fluxos de trabalho longos e agentes autônomos de IA, incorporando mecanismos que atenuam consideravelmente os gastos associados a tarefas que demandam a reutilização constante de contextos extensos.
Um dos principais pilares dessa economia é o recurso de cache de prompts. A leitura de tokens de entrada salvos em cache assegura um desconto de 90%, o que diminui drasticamente o orçamento de aplicações que reaproveitam dados em diferentes etapas de um processo. No ambiente de API, a tabela de preços do GPT-6 Sol foi ajustada de US$ 4 para US$ 2 por 1 milhão de tokens de entrada, e de US$ 20 para US$ 10 na saída. No caso do GPT-6 Luna, os valores caíram de US$ 0,20 para US$ 0,10 na entrada, e de US$ 1,20 para US$ 0,50 na saída.
No panorama geral, os dois novos lançamentos registram uma diminuição de 50% nos preços quando comparados aos valores promocionais da linha anterior GPT-5.6. A união de tarifas mais baixas, eficiência no cache e foco em operações de longa duração visa viabilizar o desenvolvimento de soluções robustas para empresas que lidam diariamente com um fluxo massivo de informações.
A chegada ao mercado ocorre em meio a uma disputa acirrada entre a OpenAI e a Anthropic. Apenas 90 minutos antes do anúncio oficial da OpenAI, a concorrente apresentou uma nova versão do Opus 5.5, trazendo preços reduzidos e capacidade equivalente à do Fable.
Os testes de desempenho divulgados pela OpenAI evidenciam vantagens específicas para cada arquitetura. Enquanto o GPT-6 Sol passou por rigorosas avaliações em cenários profissionais e engenharia de software, o Luna demonstrou alta competência em automação, uso de computadores, engenharia de software e confiabilidade factual.
- AutomationBench: O GPT-6 Sol superou o Claude Opus 5 em fluxos de trabalho de negócios em múltiplos aplicativos, operando com um custo equivalente a apenas 9% do valor cobrado por tarefa pelo concorrente.
- FrontierCode: Na área de programação, o Sol alcançou o mesmo nível de desempenho do Claude Fable 5.1 ao verificar se códigos recém-criados estão prontos para integração em bases reais.
- DeepSWE v1.1: Voltado para a engenharia de software complexa, o Sol atingiu 68,8% de pontuação, mantendo um custo 80% inferior em relação a modelos concorrentes de alto desempenho.
O GPT-6 Luna também marcou uma evolução expressiva em comparação com a geração passada. No AutomationBench, sob um nível de esforço elevado, o modelo superou o antecessor GPT-5.6 Luna em 5,4 pontos percentuais, apresentando um custo por tarefa 58% menor. Já no DeepSWE v1.1, o Luna obteve 66,6% de pontuação em seu esforço máximo, equiparando-se aos desempenhos de Claude Opus 5 e Claude Fable 5 sob níveis intermediários de esforço.
No teste OSWorld 2.0 offline, que mede a eficiência em tarefas de uso de computador, o Luna superou o antigo GPT-5.6 Sol — considerando esforço médio para o modelo anterior — custando apenas um décimo do preço. A OpenAI também mediu a confiabilidade factual: operando em patamares de esforço mais altos, o Luna igualou a precisão factual do antigo GPT-5.6 Sol exigindo apenas 1% do custo operacional.
Como parte das melhorias de experiência, a OpenAI modificou o estilo de colaboração dos modelos para minimizar jargões técnicos e dados irrelevantes, priorizando respostas mais diretas e transparentes. Nos testes de alinhamento, o Luna registrou índices menores de afirmações imprecisas sobre suas próprias tarefas de programação se comparado ao seu antecessor direto, o GPT-5.6 Luna.
Para auxiliar os desenvolvedores, a empresa introduziu novas ferramentas de monitoramento de desempenho. O Prompt Caching Dashboard, por exemplo, identifica lacunas e oportunidades de cache que ainda não foram aproveitadas, apontando com precisão os trechos onde o processamento pode ser aprimorado.
Outra inovação importante permite ajustar dinamicamente o esforço de raciocínio e a disponibilidade de ferramentas sem que o cache preexistente seja invalidado. Desse modo, agentes inteligentes podem modificar tais parâmetros durante fluxos contínuos que reutilizam o mesmo contexto sem correr o risco de perder os dados já armazenados.
Esses aprimoramentos chegam acompanhados de avanços robustos de segurança herdados do projeto de alinhamento do modelo Astra. De acordo com a OpenAI, o GPT-6 Sol e o Luna exibem menores taxas de declarações enganosas ao escrever códigos e obtiveram pontuações superiores em avaliações direcionadas a testar a resistência contra tentativas de burlar diretrizes de segurança.
Se você gostou do conteúdo, talvez também se interesse por conferir “ChatGPT grátis vale a pena? Veja o que dá e o que não dá para fazer”.
Fonte original: Canaltech