A expansão do universo da inteligência artificial continua a um ritmo frenético. Pouco tempo após o lançamento do poderoso GPT-6 Astra, a tecnológica responsável pelo ChatGPT decidiu alargar a sua oferta para responder a diferentes escalas, ritmos e orçamentos de trabalho. De acordo com a OpenAI, a empresa acaba de disponibilizar os novos modelos GPT-6 Sol e GPT-6 Luna. Estas duas novidades pretendem democratizar o acesso às capacidades avançadas da geração atual, ao oferecer um equilíbrio notável entre desempenho de ponta e eficiência de custos para tarefas diárias.
Desempenho de topo a uma fracção do preço
Os novos intervenientes foram treinados com métodos semelhantes aos do seu irmão mais velho. O objectivo passou por trazer os avanços em áreas como o trabalho profissional, a factualidade e a programação para modelos mais rápidos e acessíveis. Graças a melhorias na cache e na inferência, a infra-estrutura consegue agora servir estas ferramentas de forma muito mais barata. Consequentemente, a tecnológica decidiu passar essa poupança directamente para os utilizadores, ao reduzir os preços da API para o Sol e o Luna em 50% face aos valores promocionais do antigo GPT-5.6. Esta estratégia comercial surge numa altura crucial, especialmente quando se sabe que a OpenAI antecipa perdas recorde até 2030, o que torna a optimização de recursos uma prioridade absoluta para garantir a sustentabilidade do projecto a longo prazo.
Testes de fluxo de trabalho e factualidade
O modelo Sol assume-se como uma excelente opção para tarefas difíceis, ao dar aos programadores uma maior margem para iterar devido aos limites de utilização mais elevados. Nos testes do AutomationBench, que avaliam fluxos de trabalho empresariais, o Sol superou o concorrente Claude Opus 5 a custar apenas 9% do valor por tarefa desse rival. Já o Luna conseguiu melhorar o desempenho do seu antecessor em 5,4 pontos percentuais, com uma redução de custos na ordem dos 58%. A utilidade de uma resposta depende da exactidão dos factos apresentados, um campo onde a fiabilidade também deu um salto significativo. Nas avaliações internas de conversas reais, o Sol comete agora cerca de metade dos erros do seu antecessor. O Luna não fica atrás e consegue igualar a fiabilidade do antigo GPT-5.6 Sol por cerca de uma centésima parte do valor.
Revolução na programação e uso de computadores
O impacto destas novidades estende-se profundamente ao universo do desenvolvimento de software. A utilização interna de agentes de programação cresceu de forma exponencial, com o consumo diário de tokens a ultrapassar os 600 dólares para o investigador mediano e a chegar aos 7000 dólares para os profissionais mais intensivos. No teste DeepSWE v1.1, focado em engenharia de software complexa, o Sol atingiu uma pontuação de 68,8%, ficando a apenas 1,1 pontos percentuais da pontuação máxima do Claude Fable 5, mas a custar menos 80% por tarefa. No mesmo cenário, o Luna apresenta custos 93% inferiores aos do Opus 5. Embora o modelo Astra continue a ser a escolha principal para tarefas que exigem precisão absoluta, como demonstra a recente disponibilização do modelo Astra for Law desenhado especialmente para processos jurídicos, os novos Sol e Luna herdam o seu estilo de comunicação claro. Os utilizadores podem esperar conversas técnicas com menos jargão e uma maior clareza nas interacções diárias.
