A OpenAI anunciou nesta terça-feira (22) o GPT-6 Sol e o GPT-6 Luna, dois novos integrantes da família GPT-6 voltados a diferentes níveis de desempenho, velocidade e custo. Os modelos chegam poucas semanas depois do GPT-6 Astra e levam parte dos avanços da arquitetura mais recente da empresa para opções mais econômicas.
O GPT-6 Sol ocupa a faixa destinada a tarefas mais exigentes, incluindo programação, automação e fluxos de trabalho com agentes. Já o GPT-6 Luna prioriza velocidade e custo em aplicações de maior volume. Segundo a OpenAI, ambos foram treinados com métodos semelhantes aos utilizados no Astra e receberam melhorias em raciocínio profissional, factualidade, programação, uso de computadores e alinhamento.
A redução no preço da API é um dos principais pontos do lançamento. O GPT-6 Sol custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, metade dos valores promocionais cobrados pelo GPT-5.6 Sol. No Luna, a entrada caiu de US$ 0,20 para US$ 0,10 por milhão de tokens, enquanto a saída passou de US$ 1,20 para US$ 0,50 — uma redução de aproximadamente 58% neste último caso.
Os novos modelos também começam a chegar aos produtos da empresa, mas ainda não estão disponíveis no Chat convencional do ChatGPT. De acordo com a OpenAI, Sol e Luna passam a ser oferecidos no ChatGPT Work e no Codex para usuários Plus, Pro, Business, Enterprise e Edu. Usuários dos planos Free e Go recebem acesso ao GPT-6 Luna pelo aplicativo para desktop.
GPT-6 Sol e Luna ficam mais baratos na API
A estratégia da OpenAI com os dois modelos combina aumento de capacidade com redução do custo de inferência. A empresa afirma ter obtido ganhos de eficiência tanto na infraestrutura quanto no sistema de cache, permitindo diminuir os preços cobrados dos desenvolvedores.
No GPT-6 Sol, o preço de entrada caiu de US$ 4 para US$ 2 por milhão de tokens. A saída passou de US$ 20 para US$ 10. Nos dois casos, a redução é de 50%.
O GPT-6 Luna continua ocupando a faixa de menor custo. O processamento de um milhão de tokens de entrada custa US$ 0,10, contra US$ 0,20 no GPT-5.6 Luna. Já um milhão de tokens de saída custa US$ 0,50, ante US$ 1,20 anteriormente.
Os números informados referem-se à API e devem ser considerados separadamente das regras de uso e dos limites oferecidos dentro dos diferentes planos do ChatGPT.
OpenAI destaca ganhos em automação e programação
Para demonstrar o desempenho do GPT-6 Sol, a OpenAI divulgou resultados de diferentes avaliações voltadas a agentes e tarefas profissionais. No AutomationBench 1.0.6, por exemplo, o Sol com nível de esforço “xhigh” obteve pontuação de 33,2%, com custo estimado de US$ 0,27 por tarefa.
No mesmo teste, a OpenAI informa que o Claude Opus 5, da Anthropic, atingiu 26,9%. A empresa afirma ainda que o custo por tarefa do modelo concorrente foi aproximadamente 11 vezes maior.
Essas comparações, no entanto, precisam ser interpretadas dentro das condições específicas de cada benchmark. Configuração de esforço, ferramentas disponíveis, prompts, ambiente de execução e metodologia de medição podem influenciar os resultados. A própria OpenAI informa que seus modelos foram avaliados em ambiente de pesquisa ou pela API e que os números dos concorrentes foram obtidos de resultados publicados publicamente.
Em programação, o GPT-6 Sol também apresentou evolução em relação ao GPT-5.6 Sol segundo os testes divulgados pela empresa. No DeepSWE 1.1, voltado a tarefas complexas de engenharia de software em bases de código reais, o modelo marcou 68,8% no nível máximo de esforço.
O GPT-6 Luna chegou a 66,6% no mesmo benchmark. A OpenAI posiciona o resultado como uma alternativa de menor custo para tarefas de programação que não exigem necessariamente o modelo mais avançado da família.
Factualidade também recebeu atenção
Outro ponto destacado pela OpenAI é a redução de erros factuais. Em uma avaliação interna baseada em conversas anonimizadas nas quais usuários haviam identificado erros em respostas anteriores, o GPT-6 Sol apresentou aproximadamente metade da taxa de erros de seu antecessor, segundo a companhia.
A avaliação não representa o comportamento médio do modelo. A própria empresa explica que o conjunto foi construído justamente com conversas mais propensas a provocar erros factuais, o que torna os números inadequados para estimar uma taxa geral de erro no uso cotidiano.
O GPT-6 Luna também apresentou melhora nesse teste. A OpenAI afirma que, em níveis mais elevados de esforço de raciocínio, o modelo consegue se aproximar do desempenho factual do GPT-5.6 Sol com custo consideravelmente menor.
Uso de computadores e agentes entra na disputa por eficiência
Os dois modelos também foram avaliados em tarefas nas quais agentes precisam controlar interfaces e concluir atividades em computadores. No OSWorld 2.0, o GPT-6 Sol com esforço “xhigh” atingiu 60,5%, enquanto o Claude Opus 5, em configuração média reportada pela OpenAI, registrou 60,3%.
Mais do que estabelecer uma diferença absoluta de capacidade, a OpenAI utiliza esses testes para defender a relação entre desempenho e custo de seus novos modelos. Essa abordagem aparece repetidamente no anúncio: o Astra continua sendo apresentado como a opção de maior capacidade, enquanto Sol e Luna buscam entregar parte desse desempenho com menor gasto computacional.
A segmentação deixa mais clara a estratégia da família GPT-6. Astra permanece voltado às tarefas em que a prioridade é obter o máximo desempenho disponível; Sol ocupa uma camada intermediária para trabalhos complexos e uso frequente; e Luna atende aplicações em que custo, velocidade e escala têm peso maior.
Cache pode reduzir ainda mais o custo de agentes
Além de diminuir o preço dos tokens, a OpenAI anunciou mudanças no sistema de prompt caching. O recurso permite reaproveitar partes de um contexto já processado, algo particularmente relevante em agentes e conversas longas que repetem grandes volumes de instruções.
Segundo a empresa, leituras de tokens armazenados no cache podem receber desconto de 90%. A plataforma também ganhou ferramentas para monitorar a taxa de aproveitamento do cache e diagnosticar situações em que conteúdos poderiam ter sido reutilizados.
Outra mudança permite modificar o nível de esforço de raciocínio ou ativar e desativar ferramentas sem necessariamente invalidar todo o contexto anteriormente armazenado.
A OpenAI cita o GitHub como exemplo e afirma que as melhorias reduziram em mais de 50% a parcela de tokens de prompt que precisava ser processada novamente em bilhões de requisições aos modelos da empresa nos últimos meses.
Onde GPT-6 Sol e Luna estão disponíveis
Desde 22 de setembro, GPT-6 Sol e GPT-6 Luna estão sendo liberados no ChatGPT Work e no Codex para assinantes dos planos Plus, Pro, Business, Enterprise e Edu, segundo o anúncio.
Usuários dos planos Free e Go podem acessar o GPT-6 Luna pelo aplicativo do ChatGPT para desktop. A distribuição ocorre gradualmente.
Há uma distinção importante: no momento do anúncio, Sol e Luna ainda não estavam disponíveis no Chat convencional do ChatGPT. Portanto, mesmo usuários de planos compatíveis podem não encontrar os novos modelos no seletor usado para conversas comuns.
Na API, os modelos podem ser acessados pelos identificadores gpt-6-sol e gpt-6-luna.
A chegada dos dois modelos mostra que a OpenAI está ampliando a família GPT-6 não apenas pela busca do maior desempenho possível, representado pelo Astra, mas também pela tentativa de reduzir o custo de colocar modelos mais capazes em aplicações que processam grandes volumes de informações ou executam tarefas continuamente.
Compartilhar
