GPT-5.6 chega ao ChatGPT, Codex e API; multiagente estreia em beta
A OpenAI anunciou a família GPT-5.6, formada por Sol, Terra e Luna, com chegada gradual ao ChatGPT, Codex e API. A atualização traz novas opções de custo por token e recursos distintos para fluxos avançados: o modo ultra, que coordena quatro agentes em paralelo por padrão em produtos específicos, e o modo multiagente da Responses API, inicialmente em beta.
Para quem desenvolve ou opera IA no Brasil, a novidade não é só escolher o modelo mais capaz. A decisão envolve qualidade no seu caso de uso, limites de acesso do plano, volume de tokens e o custo de ferramentas, cache e etapas adicionais de um fluxo.
O que é a família GPT-5.6
A família anunciada pela OpenAI tem três variantes: GPT-5.6 Sol, apresentado como o modelo principal; GPT-5.6 Terra, para uso cotidiano; e GPT-5.6 Luna, a opção de menor custo. Segundo a empresa, a geração recebeu melhorias de desempenho e segurança. Essas avaliações são da própria OpenAI: equipes devem validar qualidade, confiabilidade e segurança com tarefas representativas antes de adotar qualquer variante em produção.
Quem terá acesso no ChatGPT, Codex e API
O rollout é gradual e a disponibilidade depende do produto, plano e conta. No ChatGPT, a OpenAI informa acesso ao Sol para Plus, Pro, Business e Enterprise em níveis de esforço médio ou superiores; Pro e Enterprise também podem selecionar Sol Pro. No ChatGPT Work e no Codex, Free e Go recebem acesso ao Terra, enquanto Plus ou superiores podem selecionar Sol, Terra ou Luna.
O modo ultra tem regras próprias: no ChatGPT Work ele é destinado a Pro e Enterprise; no Codex, a Plus e planos superiores. Na API, Sol, Terra e Luna estão listados como as variantes da família. Antes de mudar uma aplicação, confira o painel e a documentação da sua conta, pois limites e disponibilidade podem mudar durante a distribuição.
Preços da API: Sol, Terra e Luna
A tabela abaixo reúne os preços padrão da API informados pela OpenAI, em dólares por milhão de tokens. Ela não representa o preço de uma assinatura do ChatGPT e está sujeita a alterações. Em termos simples, tokens de entrada são o conteúdo enviado ao modelo; tokens de saída são o que ele gera.
| Modelo | Entrada | Saída | Entrada em cache | Gravação de cache |
|---|---|---|---|---|
| GPT-5.6 Sol | US$ 5 | US$ 30 | US$ 0,50 | US$ 6,25 |
| GPT-5.6 Terra | US$ 2,50 | US$ 15 | US$ 0,25 | US$ 3,125 |
| GPT-5.6 Luna | US$ 1 | US$ 6 | US$ 0,10 | US$ 1,25 |
Leituras de cache têm desconto de 90%, segundo a documentação. Já a gravação de cache custa 1,25 vez a tarifa normal de entrada. Portanto, cache pode ajudar em contextos repetidos, mas não é economia automática na primeira chamada.
Como escolher sem perder o controle de custo
Sol para prioridade de capacidade
O Sol tem a maior tarifa da família. Ele deve ser comparado em tarefas nas quais uma resposta melhor possa justificar mais gasto, sempre com limites de saída e uma bateria de testes própria.
Terra para buscar equilíbrio
Com tarifa intermediária, o Terra é um ponto de partida razoável para comparar qualidade e orçamento em fluxos que precisam de escala sem partir diretamente para a opção mais cara.
Luna para etapas sensíveis a volume
O Luna tem a menor tarifa anunciada. Pode ser útil para protótipos, classificação, extração estruturada ou etapas de um pipeline que tolerem sua qualidade após validação. Preço menor não substitui teste de precisão, especialmente com dados relevantes.
- Meça entrada, saída, cache, chamadas de ferramentas e etapas de subagentes separadamente.
- Defina um teto de tokens de saída quando respostas longas não forem necessárias.
- Evite reenviar contexto que a aplicação não usa e avalie cache apenas para trechos realmente repetidos.
- Crie alertas por ambiente e funcionalidade antes de liberar um recurso para todos os usuários.
Não há conversão automática para reais: o total para uma equipe brasileira depende do volume, câmbio, tributos, meio de pagamento e condições da conta.
Ultra, multiagente e Programmatic Tool Calling não são a mesma coisa
Os termos aparecem no mesmo lançamento, mas atendem a camadas diferentes do produto.
- Ultra: configuração disponível em produtos e planos específicos que coordena quatro agentes paralelos por padrão. A OpenAI alerta que isso usa mais tokens.
- Modo multiagente: recurso inicialmente em beta da Responses API para executar subagentes concorrentes e sintetizar resultados em uma solicitação.
- Programmatic Tool Calling (PTC): recurso para o modelo escrever e executar JavaScript em um runtime isolado, orquestrando ferramentas com chamadas paralelas, loops e condições.

Em automações com impacto externo, esses recursos exigem governança: limite ferramentas e permissões, valide argumentos antes de executar ações, registre eventos e mantenha revisão humana em operações sensíveis.

Confirmado e o que ainda vale validar
Confirmado pela OpenAI
- A família inclui Sol, Terra e Luna.
- Há rollout gradual em ChatGPT, Codex e API, com acesso que varia por produto e plano.
- Os preços padrão da API e as tarifas de cache listados acima constam na documentação.
- O ultra coordena quatro agentes paralelos por padrão.
- O modo multiagente da Responses API começa em beta.
- O PTC permite orquestrar ferramentas programaticamente em runtime isolado.
O que observar antes da adoção
- Disponibilidade efetiva, limites e plano da sua conta.
- Qualidade e custo total no seu conjunto de prompts, dados e integrações.
- Estabilidade do beta multiagente e comportamento de automações com ferramentas.
- Políticas de segurança, aprovação e auditoria para ações externas.
Perguntas frequentes
O GPT-5.6 está disponível para todos no ChatGPT?
Não necessariamente. A OpenAI descreve um rollout gradual e regras diferentes por produto, plano e nível de esforço.
Qual a diferença entre ultra, multiagente e PTC?
Ultra é uma configuração de produto que coordena quatro agentes; multiagente é um recurso beta da Responses API; PTC é a execução de JavaScript em runtime isolado para orquestrar ferramentas.
Os preços valem para assinatura do ChatGPT?
Não. Os valores da tabela são preços da API por milhão de tokens.
Quanto custa o cache do GPT-5.6?
Para leituras de cache, Sol custa US$ 0,50, Terra US$ 0,25 e Luna US$ 0,10 por milhão de tokens. A gravação custa 1,25 vez a tarifa normal de entrada: US$ 6,25, US$ 3,125 e US$ 1,25, respectivamente.


