NoticiasInteligência ArtificialTecnologia

GPT-5.6 fica mais barato na API da OpenAI

PUBLICIDADE

A OpenAI anunciou em 30 de julho de 2026 uma redução de preços para modelos da família GPT-5.6 e a estreia do Fast mode na API. A mudança de GPT-5.6 fica mais barato atinge principalmente empresas, desenvolvedores e usuários de produtos como ChatGPT Work e Codex, com foco em melhorar a relação entre desempenho, custo e velocidade em tarefas de inteligência artificial.

Segundo a empresa, o GPT-5.6 Luna, descrito como o modelo mais rápido e acessível da linha, ficará 80% mais barato. Já o GPT-5.6 Terra, posicionado como opção equilibrada para atividades do dia a dia, terá corte de 20%. O GPT-5.6 Sol mantém o preço, mas passa a contar com Fast mode, modo que promete respostas até 2,5 vezes mais rápidas que o processamento Standard, cobrando o dobro do valor.

GPT-5.6 fica mais barato? O que muda nos preços do GPT-5.6

A principal alteração está no custo por milhão de tokens na OpenAI API. A partir de 30 de julho, o GPT-5.6 Terra passa a custar US$ 2 por milhão de tokens de entrada e US$ 12 por milhão de tokens de saída. O GPT-5.6 Luna passa a custar US$ 0,20 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída.

PUBLICIDADE
ModeloEntradaSaídaMudança
GPT-5.6 LunaUS$ 0,20 por milhão de tokensUS$ 1,20 por milhão de tokens80% mais barato
GPT-5.6 TerraUS$ 2 por milhão de tokensUS$ 12 por milhão de tokens20% mais barato
GPT-5.6 SolPreço sem alteraçãoPreço sem alteraçãoFast mode até 2,5x mais rápido

Na prática, a decisão reduz o custo de uso em fluxos com grande volume de chamadas, como classificação de atendimento ao cliente, análise de documentos, automações de agentes, programação assistida e execução de tarefas repetitivas. A OpenAI afirma que os novos preços também afetam a forma como o consumo é contabilizado em assinaturas pagas ao usar Codex e ChatGPT Work.

Luna, Terra e Sol: funções diferentes na mesma família

A estratégia da OpenAI é separar melhor os modelos conforme o resultado esperado. O Luna foi apresentado como a alternativa de menor custo para tarefas em escala, sem abrir mão de qualidade considerada alta pela empresa. Ele pode usar ferramentas, executar fluxos de várias etapas e operar em aplicações empresariais que antes poderiam ser caras demais para rodar continuamente.

O Terra ocupa uma posição intermediária. A proposta é atender tarefas cotidianas com equilíbrio entre custo, qualidade e latência. Já o Sol segue como opção mais poderosa da família GPT-5.6, indicado para etapas que exigem maior raciocínio, definição de planos, resolução de incertezas ou decisões com maior impacto.

  • Luna: automações em larga escala, agentes e tarefas bem definidas.
  • Terra: trabalho diário, perguntas sobre documentos e tarefas com latência relevante.
  • Sol: raciocínio mais complexo, planejamento e uso quando velocidade premium compensa.

Fast mode substitui Priority Processing na API

Outra novidade é o Fast mode, que substitui a oferta chamada Priority Processing. Para o GPT-5.6 Sol, o modo rápido entrega até 2,5 vezes mais velocidade que o processamento Standard, mantendo o mesmo nível de inteligência, mas com preço duas vezes maior.

A mudança foi desenhada para compatibilidade retroativa. Solicitações antigas marcadas como priority passarão automaticamente a usar Fast mode. No Codex, a funcionalidade também se alinha ao comando /fast, simplificando a experiência para desenvolvedores que já dependem de respostas mais rápidas em fluxos de programação.

Por que a OpenAI diz que ficou mais eficiente

A empresa atribui os cortes a melhorias em várias camadas: arquitetura dos modelos, sistemas de inferência, roteamento de cargas, geração de tokens e gerenciamento de contexto. Em termos simples, a OpenAI afirma conseguir entregar mais trabalho útil com a mesma capacidade computacional.

Um ponto destacado é o uso do próprio GPT-5.6 Sol para auxiliar processos técnicos internos. Dentro de um fluxo liderado por humanos, o modelo teria ajudado a reescrever e otimizar kernels de produção, desenhar centenas de experimentos e monitorar treinamentos. Segundo a OpenAI, esse trabalho contribuiu para reduzir em 20% o custo de ponta a ponta ao servir o modelo e aumentou a eficiência de geração de tokens em mais de 15%.

“Tornar inteligência avançada mais abundante e acessível é central para a missão da OpenAI de garantir que a AGI beneficie toda a humanidade.”

OpenAI, comunicado oficial de produto

Empresas citam economia em agentes e programação

O anúncio trouxe depoimentos de empresas que testaram ou adotaram modelos da família GPT-5.6. A Replit afirmou que o Luna está destravando casos de uso que não esperava construir tão cedo. A Notion disse que o Terra entregou qualidade comparável ao GPT-5.5 em seu agente pessoal, com metade do custo por tarefa e 60% menos tempo em avaliações internas.

A Blitzy relatou que o Luna permitiu sair de uma única chamada de saída estruturada para um ciclo completo de agente com uso de ferramentas. A empresa também afirmou ter aumentado o reaproveitamento de cache de prompt de 24% para 90%, lidando com 2,2 vezes mais contexto e 8,5 vezes menos tokens de saída, a um custo 87% menor que o GPT-5.4 mini.

Cognition, Dust e Ramp também foram citadas no comunicado. Os relatos apontam para um uso crescente de modelos mais baratos em tarefas de bastidor, enquanto modelos mais robustos ficam reservados para decisões de maior complexidade. Essa divisão tende a ser importante para empresas que desejam escalar IA sem elevar proporcionalmente a conta de infraestrutura.

Impacto para ChatGPT Work, Codex e AWS como GPT-5.6 fica mais barato

O GPT-5.6 Terra e o Luna continuam disponíveis no ChatGPT Work, no Codex e na OpenAI API. Usuários Free e Go podem acessar o Terra no ChatGPT Work e no Codex, enquanto assinantes Plus, Pro, Business e Enterprise podem escolher Terra e Luna.

A OpenAI afirma que os preços das assinaturas do ChatGPT e do Codex não mudam, assim como os orçamentos de cota. O que muda é que o uso de Terra e Luna passa a consumir menos créditos. A companhia também informou que a atualização de preços começaria a ser implementada na AWS ainda em 30 de julho.

O que isso significa para o mercado de IA

O anúncio reforça uma tendência central da inteligência artificial generativa: a disputa não ocorre apenas por modelos mais capazes, mas também por melhor desempenho por dólar. Para empresas, isso significa avaliar menos o “melhor modelo” de forma isolada e mais a combinação ideal entre custo, latência, confiabilidade e qualidade por etapa do fluxo.

Em um fluxo de desenvolvimento de software, por exemplo, o Sol pode definir a estratégia e resolver pontos ambíguos, enquanto o Luna executa mudanças bem especificadas, escreve testes e valida resultados. Em atendimento ou análise documental, o Terra pode equilibrar resposta rápida e qualidade suficiente para tarefas recorrentes.

Se as promessas de eficiência se confirmarem em produção, a queda de preços pode ampliar o uso de agentes de IA em operações comuns, não apenas em projetos experimentais. Ainda assim, cada empresa precisará medir resultados com avaliações próprias, já que custo menor só representa ganho real quando a qualidade final atende ao padrão exigido.

Perguntas Frequentes sobre GPT-5.6 fica mais barato

  1. O que mudou no preço do GPT-5.6 Luna?

    O GPT-5.6 Luna ficou 80% mais barato. Na API, custa US$ 0,20 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída.

  2. Quanto custa o GPT-5.6 Terra na OpenAI API?

    O GPT-5.6 Terra custa US$ 2 por milhão de tokens de entrada e US$ 12 por milhão de tokens de saída, após redução de 20% anunciada pela OpenAI.

  3. O que é o Fast mode do GPT-5.6 Sol?

    Fast mode é o modo rápido da API. Ele substitui Priority Processing e promete até 2,5 vezes mais velocidade no GPT-5.6 Sol, pelo dobro do preço.

  4. ChatGPT Work e Codex terão aumento de assinatura?

    Não. A OpenAI informou que os preços de assinatura e cotas não mudam; Terra e Luna apenas passam a consumir menos créditos de uso.

Considerações finais

COm o GPT-5.6 fica mais barato mostra que a OpenAI quer tornar modelos avançados mais viáveis para uso empresarial contínuo. Com Fast mode no Sol, a empresa também tenta atender casos em que velocidade justifica custo maior. O movimento coloca eficiência, tokens e custo por tarefa no centro da próxima fase da IA generativa.

Diogo Fernando

Apaixonado por tecnologia e cultura pop, programo para resolver problemas e transformar vidas. Empreendedor e geek, busco novas ideias e desafios. Acredito na tecnologia como superpoder do século XXI.