Pular para o conteúdo
Zenteck
Últimas
Ferramentas de IA

GPT-6 Luna e Claude Opus 5.5: Preços e Limites

Por Alex da Cruz1 min de leitura0 comentário
gpt-6-luna-claude-opus-5-5-precos-limites
A

Alex da Cruz

Alex da Cruz é desenvolvedor full-stack em São Paulo. Trabalha com React, TypeScript e automação, e usa inteligência artificial no dia a dia para resolver problemas reais de código e de operação — não como demonstração. Já tocou uma operação de e-commerce de ponta a ponta e hoje constrói e mantém o pipeline de automação por trás deste blog. Escreve aqui sobre o que testa de fato.

Ver perfil →

Segundo levantamento publicado no simonwillison.net, a OpenAI e a Anthropic lançaram novos modelos acompanhados de reduções expressivas de preços, alterando a viabilidade financeira de fluxos baseados em agentes.

Quanto custam o GPT-6 Luna e o Claude Opus 5.5?

O GPT-6 Luna reduziu o preço de entrada para $0,10 por milhão de tokens e $0,50 na saída, custando metade da versão anterior. O Claude Opus 5.5 caiu para $4 no input e $20 no output, com uma queda de 60% na leitura em cache.

Quais são os riscos do modo de raciocínio máximo no Opus 5.5?

Testes práticos demonstraram que o Claude Opus 5.5 no nível máximo de raciocínio consome seu limite de 128.000 tokens de saída apenas com o processo interno de pensamento. Cada falha desse tipo custou $2,56 e levou cerca de 20 minutos sem entregar resultado.

O que muda na prática para quem desenvolve?

A queda drástica no custo de modelos como o GPT-6 Luna viabiliza aplicações de alto volume que antes eram inviáveis financeiramente. Por outro lado, equipes técnicas precisam auditar o uso de níveis máximos de raciocínio para evitar gargalos e cobranças desnecessárias.

Fontes

  1. Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net

Perguntas frequentes

Qual é o preço do GPT-6 Luna?
O GPT-6 Luna custa $0,10 por milhão de tokens de entrada, $0,01 para tokens em cache e $0,50 por milhão de tokens de saída.
O Claude Opus 5.5 falha em tarefas complexas?
Sim, testes mostraram que o modelo no nível máximo de pensamento pode estourar o limite de 128 mil tokens apenas no planejamento interno, interrompendo a execução.