Claude Opus 5.5, GPT-6 Sol e Luna: a guerra de preços da IA e qual modelo usar
Anthropic e OpenAI lançaram modelos mais baratos com uma hora de diferença. O que cada um entrega e quanto custa de verdade.
No dia 22 de setembro de 2026, a Anthropic lançou o Claude Opus 5.5. Cerca de uma hora depois, a OpenAI respondeu com o GPT-6 Sol e o GPT-6 Luna. Os três lançamentos têm uma coisa em comum: são mais baratos que os modelos que substituem. A imprensa de tecnologia chamou o dia de início de uma guerra de preços, e o nome pegou.
Este artigo explica o que cada modelo faz, quanto custa, como eles se comparam com o GPT-6 Astra e o Claude Fable 5.1, e qual faz sentido para cada tipo de trabalho. No final, respondemos às perguntas mais comuns sobre Claude Opus e GPT-6.
O contexto: dois lançamentos em uma hora
Setembro já tinha sido intenso antes do dia 22. A Anthropic lançou o Claude Fable 5.1, seu modelo mais capaz com acesso aberto ao público, no dia 1º. A OpenAI lançou o GPT-6 Astra, que chamou de "o modelo mais inteligente do mundo", no dia 3. Os dois são modelos de topo, com preço de topo: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída.
O dia 22 foi sobre o outro lado da equação. Em vez de mais capacidade, as duas empresas entregaram capacidade parecida por menos dinheiro. O Opus 5.5 promete desempenho do nível do Fable 5.1 na maior parte das tarefas, custando 60% menos. O GPT-6 Sol e o GPT-6 Luna custam metade do que custavam os equivalentes da geração anterior.
Para quem paga a conta de uma integração com IA, esse tipo de lançamento importa mais que um recorde de benchmark.
Claude Opus 5.5: o que mudou
O Claude Opus 5.5 é o primeiro modelo da família 5.5 da Anthropic. Ele chegou 60 dias depois do Claude Opus 5, lançado em julho, e ocupa o espaço entre o Opus 5 e o Fable 5.1.
Preço. Na API, custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, 20% menos que o Opus 5. A leitura de cache, usada quando o mesmo contexto é enviado várias vezes, caiu 60%, para US$ 0,20 por milhão de tokens. Somando a economia de tokens, a Anthropic diz que o custo de rodar tarefas típicas ficou cerca de 40% menor que no Opus 5.
Desempenho. Segundo a Anthropic, o Opus 5.5 rende como o Fable 5.1 na maior parte do trabalho e fica à frente em programação com agentes, uso de computador e trabalho de escritório. No Terminal-Bench 4.0, que mede tarefas reais de linha de comando, marca 66,4%, contra 57,9% do GPT-6 Astra. Também gera texto 30% mais rápido que o antecessor.
Escrita. A Anthropic diz que o modelo responde de forma mais direta e clara, corrigindo um estilo prolixo que usuários criticavam nas versões anteriores.
Uma ressalva. Testes independentes mostram que, no nível máximo de raciocínio, o Opus 5.5 às vezes pensa demais em tarefas simples: gasta o limite de 128 mil tokens de saída sem terminar, o que custa tempo e dinheiro. Na prática, vale usar o nível de esforço padrão e subir só quando a tarefa pedir.
Onde usar. Está disponível na API da Anthropic, na Amazon Web Services, no Google Cloud e no Microsoft Azure. No app do Claude, está nos planos Pro, Max, Team e Enterprise. O Claude Sonnet 5.5 e o Claude Haiku 5.5, versões menores da mesma família, estão previstos para as próximas semanas.
GPT-6 Sol e GPT-6 Luna: o que mudou
A OpenAI organiza a família GPT-6 em três modelos: Luna, o mais barato; Sol, o intermediário; e Astra, o mais capaz. O Astra saiu no dia 3. Sol e Luna completaram a família no dia 22.
GPT-6 Sol custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. É exatamente metade do preço do Claude Opus 5.5 e metade do que custava o GPT-5.6 equivalente. Supera levemente o antecessor e fica abaixo do Astra.
GPT-6 Luna custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, contra US$ 0,20 e US$ 1,20 da versão anterior. É um dos modelos mais baratos que a OpenAI já lançou, feito para tarefas simples em volume muito alto: classificar mensagens, extrair dados de documentos, responder perguntas frequentes.
Onde usar. Os dois estão na API. No ChatGPT, chegaram primeiro ao ChatGPT Work e ao Codex, a ferramenta de programação da OpenAI, para assinantes dos planos Plus, Pro, Business, Enterprise e Edu. O Luna também foi liberado no app para computador para os planos Free e Go.
Opus 5.5 vs GPT-6: comparando os cinco modelos
Com os lançamentos de setembro, as duas empresas têm cinco modelos que disputam o mesmo espaço. Estes são os preços na API, por milhão de tokens:
- Claude Fable 5.1: US$ 10 de entrada e US$ 50 de saída.
- GPT-6 Astra: US$ 10 de entrada e US$ 50 de saída.
- Claude Opus 5.5: US$ 4 de entrada e US$ 20 de saída.
- GPT-6 Sol: US$ 2 de entrada e US$ 10 de saída.
- GPT-6 Luna: US$ 0,10 de entrada e US$ 0,50 de saída.
Em capacidade, o índice independente da Artificial Analysis, que agrega vários testes, coloca o Fable 5.1 em 66 pontos e o GPT-6 Astra em 61. O Opus 5.5, pelos números da Anthropic, fica no nível do Fable na maioria das tarefas. Sol e Luna ficam abaixo do Astra, como a própria OpenAI indica.
GPT-6 Astra vs Fable 5.1
É a comparação entre os dois modelos de topo, e ela tem uma resposta clara nos números: o Fable 5.1 está à frente no índice geral, pelo mesmo preço. O Astra foi lançado como "o modelo mais inteligente do mundo", mas as avaliações independentes não confirmaram esse título. Na prática, depois do dia 22, os dois perderam espaço: o Opus 5.5 entrega resultado parecido com o do Fable por menos da metade do preço.
Preço por token não é custo por tarefa
A comparação de preço de tabela engana, e é por isso que a discussão mudou de "preço por token" para "custo por tarefa".
Um modelo mais barato por token pode gastar mais tokens para chegar ao mesmo resultado, principalmente quando raciocina antes de responder. Um modelo mais caro pode resolver em uma tentativa o que o barato resolve em três. E o cache muda a conta de forma radical em integrações que enviam o mesmo contexto várias vezes, como um atendimento que sempre carrega as mesmas instruções.
Para ter uma ideia de ordem de grandeza, imagine uma tarefa com 20 mil tokens de entrada e 5 mil de saída, algo como analisar um contrato de dez páginas e escrever um resumo. Sem contar tokens de raciocínio nem cache, ela custa cerca de US$ 0,45 no Fable 5.1 ou no Astra, US$ 0,18 no Opus 5.5, US$ 0,09 no Sol e menos de meio centavo de dólar no Luna.
A diferença entre os extremos é de cem vezes. Por isso, a pergunta certa não é "qual o melhor modelo?", e sim "qual o modelo mais barato que resolve esta tarefa bem?".
Qual modelo usar
Uma regra prática, a partir dos preços e dos números publicados:
Tarefas simples em volume: GPT-6 Luna. Classificar mensagens, extrair campos de notas fiscais, responder perguntas com resposta conhecida. O custo é tão baixo que deixa de ser uma variável.
Uso geral com orçamento controlado: GPT-6 Sol. Bom equilíbrio para atendimento, redação e análise de documentos, pela metade do preço do Opus 5.5.
Programação, agentes e tarefas longas: Claude Opus 5.5. É onde ele tem a maior vantagem nos testes publicados, e onde errar custa mais que a diferença de preço.
Os problemas mais difíceis: Claude Fable 5.1 ou GPT-6 Astra, só quando o Opus 5.5 não resolver. Pelos números atuais, o Fable leva vantagem.
Nenhuma regra substitui teste. Antes de migrar algo importante, rode uma amostra do seu próprio trabalho nos modelos candidatos e compare resultado e custo total. Uma tarde de teste costuma economizar meses de conta alta.
O que a guerra de preços muda para empresas
Projetos que não fechavam a conta passam a fechar. Uma automação que custava US$ 1 por atendimento e passa a custar US$ 0,20 muda de categoria: deixa de ser experimento e vira operação. Vale revisitar ideias descartadas por custo nos últimos meses.
Não se prenda a um fornecedor. Em setembro, a liderança mudou de mãos em semanas, e os preços caíram pela metade em um dia. Integrações construídas de forma que trocar de modelo seja uma mudança de configuração, e não um projeto novo, aproveitam cada rodada de queda de preço.
O preço vai continuar caindo, mas não conte com isso no orçamento. Os lançamentos também trazem reajustes e promoções com prazo. Faça as contas com o preço de hoje e trate cada queda como margem extra.
Perguntas frequentes
Quando o Claude Opus 5.5 foi lançado?
Em 22 de setembro de 2026, como primeiro modelo da família Claude 5.5. Ele chegou 60 dias depois do Claude Opus 5.
O Opus 5.5 é um software?
Não exatamente. O Opus 5.5 é um modelo de inteligência artificial: o "cérebro" que gera as respostas. Você usa esse modelo por meio de um software, como o app do Claude, o Claude Code para programação, ou um sistema da sua empresa conectado à API da Anthropic.
Qual é o preço do Claude Opus?
Na API, o Claude Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída. Para usar pelo app do Claude, é preciso assinar um plano pago: Pro, Max, Team ou Enterprise.
O Claude Opus é gratuito?
Não. O plano gratuito do Claude usa modelos menores da linha Sonnet. O Opus fica nos planos pagos e na API, cobrada por uso.
O que é o Claude Opus?
Claude é a família de modelos de IA da Anthropic, e Opus é a linha de modelos grandes e mais capazes dessa família. Abaixo dele ficam o Sonnet, intermediário, e o Haiku, o mais rápido e barato. Acima, desde 2026, fica o Fable, a linha de topo aberta ao público. O número indica a geração: 5.5 é a versão mais recente.
Qual o melhor Opus?
Hoje, o Claude Opus 5.5. Ele supera o Opus 5 e as versões da linha 4 (4.6, 4.7 e 4.8, lançadas ao longo do primeiro semestre de 2026) e custa menos que todas elas. Quem ainda usa uma versão anterior tem motivo para atualizar: paga menos e recebe mais.
Quando vai lançar o GPT-6?
Já lançou. O GPT-6 Astra, o modelo mais capaz da família, saiu em 3 de setembro de 2026. O GPT-6 Sol e o GPT-6 Luna saíram em 22 de setembro.
Como usar o GPT-6 Astra?
No ChatGPT, o Astra está disponível para assinantes dos planos Plus, Pro, Business e Enterprise. Para desenvolvedores, está na API da OpenAI, a US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída.
Qual GPT é grátis?
O ChatGPT tem um plano gratuito, com limites de uso. Dos modelos novos, o GPT-6 Luna foi liberado para usuários gratuitos no app do ChatGPT para computador. Astra e Sol exigem plano pago ou uso pela API.
Qual é o GPT mais potente?
O GPT-6 Astra, lançado em setembro de 2026. Vale notar que, nas avaliações independentes, ele fica atrás do Claude Fable 5.1 no índice geral de capacidade.
O que é GPT?
GPT é a sigla de Generative Pre-trained Transformer, a família de modelos de linguagem da OpenAI que alimenta o ChatGPT. "Generative" porque gera texto, "pre-trained" porque aprende com um grande volume de dados antes de ser ajustado, e "transformer" por causa da arquitetura de rede neural em que é baseado.
Modelos mais baratos só viram resultado quando estão ligados ao trabalho de verdade: aos seus documentos, ao seu atendimento, aos seus sistemas. A Sharpfy constrói integrações com IA sob medida, escolhendo o modelo certo para cada tarefa e deixando a troca de fornecedor a uma mudança de configuração. E se o seu gargalo é atendimento, o Sharpfy CRM coloca uma recepcionista com IA no WhatsApp, 24 horas por dia.