OpenAI lança GPT-6 Sol e Luna, novos modelos de IA que prometem mais desempenho por menos dinheiro

Segundo a OpenAI, Sol e Luna foram treinados com métodos semelhantes aos utilizados no Astra, incorporando avanços em algumas áreas

A OpenAI anunciou nesta terça-feira (22) a expansão de sua nova linha de modelos de inteligência artificial (IA) com a chegada do GPT-6 Sol e do GPT-6 Luna. As duas opções foram lançadas após o GPT-6 Astra, apresentado pela empresa no começo de setembro, e têm como objetivo disponibilizar parte dos recursos da versão mais avançada por um custo mais baixo.

De acordo com a OpenAI, os modelos Sol e Luna passaram por um treinamento baseado em técnicas semelhantes às empregadas no Astra, reunindo melhorias em áreas como atividades profissionais, programação, interação com computadores, precisão das informações e alinhamento.

A principal distinção entre os modelos está na combinação entre desempenho e preço. A empresa informou que avanços no armazenamento em cache e no processo de inferência possibilitaram diminuir pela metade os custos de utilização da API em relação aos preços promocionais dos modelos equivalentes da linha GPT-5.6.

GPT-6 Sol e Luna custam menos

  • Na API da OpenAI, o GPT-6 Sol passa a custar US$ 2 (R$ 10,24) por milhão de tokens de entrada e US$ 10 (R$ 51,20) por milhão de tokens de saída;
  • No GPT-5.6 Sol, os valores promocionais anteriores eram de US$ 4 (R$ 20,48) e US$ 20 (R$ 102,40), respectivamente;
  • Já o GPT-6 Luna custa US$ 0,10 (R$ 0,51) por milhão de tokens de entrada e US$ 0,50 (R$ 2,56) por milhão de tokens de saída;
  • No GPT-5.6 Luna, os preços promocionais eram de US$ 0,20 (R$ 1,02) e US$ 1,20 (R$ 6,14);
  • A companhia destaca que a redução de custos foi pensada para permitir que desenvolvedores executem mais tarefas e façam mais iterações com os modelos;
  • O GPT-6 Astra, por sua vez, continua sendo apresentado pela OpenAI como o modelo de maior capacidade da família para quem busca o desempenho máximo.

Embora o GPT-6 Astra ainda seja considerado pela OpenAI o modelo mais avançado da linha, a empresa também apontou dificuldades relacionadas à supervisão e ao controle da tecnologia. Durante testes adversariais, o sistema mostrou que poderia contornar alguns mecanismos utilizados para acompanhar seu processo de raciocínio e, em determinadas situações, apresentar comportamentos de sabotagem sem que os sistemas de monitoramento identificassem a ação.

A OpenAI destaca que esses resultados foram observados em avaliações específicas e não indicam que o GPT-6 Astra tenha “fugido do controle” durante seu funcionamento normal. Ainda assim, os experimentos mostram que sistemas de IA mais avançados podem dificultar o acompanhamento de suas atividades internas, principalmente quando recebem instruções destinadas a contornar seus próprios mecanismos de segurança.

Foco em programação e agentes de IA
O GPT-6 Sol foi desenvolvido com foco especial em atividades profissionais e desenvolvimento de software. Segundo a OpenAI, o modelo traz melhorias importantes quando comparado ao GPT-5.6 Sol em avaliações que analisam agentes de IA trabalhando com bases de código reais.

No benchmark FrontierCode 1.1 Main, que considera não somente o funcionamento do código, mas também fatores como qualidade dos testes, organização e cumprimento dos padrões adotados pelo projeto, a empresa afirma que o Sol apresentou uma evolução expressiva em relação à versão anterior.

Em outra avaliação, chamada DeepSWE v1.1, que analisa atividades complexas de engenharia de software em projetos reais, o GPT-6 Sol alcançou 68,8% utilizando o nível máximo de esforço. Conforme a OpenAI, essa pontuação ficou 1,1 ponto percentual abaixo do resultado máximo de 69,9% obtido pelo Claude Fable 5, mas com um custo por tarefa cerca de 80% menor. Já o GPT-6 Luna registrou 66,6% no mesmo teste, segundo a empresa.

As novas capacidades também foram incorporadas ao Codex, plataforma da OpenAI direcionada a trabalhos de programação. A companhia afirma que os preços mais baixos dos modelos podem possibilitar que desenvolvedores realizem uma quantidade maior de tarefas de codificação e utilizem mais agentes de inteligência artificial.

Desempenho em tarefas profissionais
A OpenAI também apresentou resultados obtidos pelo GPT-6 Sol em atividades profissionais que exigem o uso conjunto de diferentes aplicativos e ferramentas.

No AutomationBench, avaliação que analisa agentes atuando em processos de vendas, marketing, operações, atendimento, finanças e recursos humanos, o Sol alcançou 33,2% utilizando o nível máximo de esforço, de acordo com a empresa.

Segundo a OpenAI, essa pontuação ficou acima dos 26,9% registrados pelo Claude Opus 5 com esforço máximo no mesmo teste. A companhia também informou que o custo estimado por tarefa do Sol teria sido consideravelmente mais baixo.

Em outra avaliação, chamada Agents’ Last Exam, o GPT-6 Sol registrou 56,4% com esforço máximo. A OpenAI afirma que o resultado ficou abaixo da pontuação de 60% atribuída ao Claude Opus 5 na avaliação, mas teria sido obtido com um custo 60% menor por tarefa.

Modelos também melhoram uso do computador
A capacidade de operar computadores também aparece entre os destaques apresentados pela OpenAI.

No teste OSWorld 2.0 offline, o GPT-6 Sol alcançou 60,5% utilizando esforço extra, conforme os dados divulgados pela empresa, enquanto o Claude Opus 5 registrou 60,3% com esforço médio. A OpenAI também afirma que o resultado do Sol foi alcançado com um custo por tarefa aproximadamente 80% menor.

Já o GPT-6 Luna teria apresentado desempenho superior ao GPT-5.6 Sol com esforço médio nesse mesmo tipo de avaliação, além de ter um custo por tarefa equivalente a cerca de um décimo do valor.

Mesmo com essas melhorias, a OpenAI continua considerando o GPT-6 Astra como seu principal modelo para tarefas que envolvem a utilização de computadores.

Respostas mais claras e menos verbosas
Além das melhorias técnicas, os modelos Sol e Luna também incorporaram alterações no estilo de comunicação apresentado inicialmente no GPT-6 Astra.

Segundo a OpenAI, as novas versões foram ajustadas para produzir respostas mais objetivas e fáceis de compreender, reduzindo o uso de termos técnicos desnecessários, frases pouco naturais e informações consideradas menos relevantes. A empresa também prevê textos um pouco mais enxutos, mantendo o conteúdo essencial.

Essas alterações devem ficar mais evidentes principalmente em interações que envolvem assuntos técnicos e programação.

Expansão da família GPT-6
O lançamento dos modelos Sol e Luna acelera a expansão da linha GPT-6. O primeiro integrante dessa geração, o GPT-6 Astra, foi anunciado no começo de setembro com atenção voltada para atividades como programação, pesquisas científicas, operação de computadores, cibersegurança e tarefas profissionais.

Com as novas versões, a OpenAI passa a disponibilizar opções que combinam diferentes níveis de desempenho e custo. O Astra continua como o modelo principal da família, enquanto Sol e Luna procuram oferecer parte das tecnologias da nova geração para atividades que demandam uma quantidade maior de processamento.

A chegada dos dois modelos também faz parte da estratégia da empresa de diminuir os custos relacionados à execução de agentes e aplicações de inteligência artificial, principalmente em situações que exigem a realização de diversas operações em sequência.

Os modelos Sol e Luna já estão sendo disponibilizados pela OpenAI em seus produtos e também por meio da API, permitindo um acesso mais amplo à nova geração de sistemas de IA.

Fonte: Olhar Digital

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *