Claude 5.5: Opus vs Sonnet vs Haiku para PMEs
Compare Claude Opus 5.5, Sonnet 5.5 e Haiku 5.5 com preços, contexto, benchmarks e custos calculados para decidir como rotear tarefas de uma PME brasileira
Principais conclusões
- Compare Claude Opus 5.5, Sonnet 5.5 e Haiku 5.5 pelo custo por resolução aceita, incluindo tokens de raciocínio, ferramentas e novas tentativas, não apenas tarifa de entrada.
- Reserve Haiku 5.5 para tarefas curtas verificáveis e conte tokens do prompt: a tarifa de entrada passa de US$ 0,10 para US$ 0,50 acima de 100 mil.
- Valide benchmarks com versão, esforço e ferramentas iguais: Sonnet 5.5 registra 70,6% no Terminal-Bench 4.0 divulgado pela Anthropic, mas isso não demonstra superioridade universal ao Opus.
- Simule o roteamento antes de implantar: distribuir 80% das solicitações ao Haiku, 15% ao Sonnet e 5% ao Opus reduz custos somente se escaladas e retrabalho forem controlados.
- Planeje com a Techify um piloto de IA para sua PME quando precisar combinar atendimento, documentos e desenvolvimento com qualidade verificável e orçamento por tarefa concluída.
O Claude Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada até 100 mil tokens de prompt, enquanto o Opus 5.5 custa US$ 4, uma diferença de 40 vezes na tarifa de entrada. Este comparativo mostra quando essa economia ajuda, quando o Sonnet 5.5 basta e quando pagar pelo Opus pode evitar retrabalho.
O melhor modelo depende do trabalho, não da hierarquia
Claude Opus 5.5, Sonnet 5.5 e Haiku 5.5 atendem a perfis diferentes de complexidade, velocidade e volume. A apuração de 7 de outubro de 2026 confirmou os três anúncios oficiais: Opus em 22 de setembro, Sonnet em 28 de setembro e Haiku em 7 de outubro.
A tese da Techify neste comparativo é usar o modelo menos caro que atinja o resultado exigido, sem transformar toda interação em uma tarefa do modelo principal. O texto combina anúncios, documentação, preços comerciais e avaliações independentes; os cálculos são simulações em Python, não resultados de projetos ou testes próprios.
1. Compare capacidade e disponibilidade antes do preço
Os três modelos oferecem janela de contexto de 1 milhão de tokens, saída máxima de 128 mil tokens na Messages API e entrada de texto e imagens com saída textual. Contexto é capacidade de processamento, não garantia de recuperação perfeita nem geração nativa de vídeo ou áudio.
| Critério | Opus 5.5 | Sonnet 5.5 | Haiku 5.5 |
|---|---|---|---|
| ID na Claude API | claude-opus-5-5 | claude-sonnet-5-5 | claude-haiku-5-5 |
| Lançamento | 22/09/2026 | 28/09/2026 | 07/10/2026 |
| Contexto / saída síncrona | 1M / 128K | 1M / 128K | 1M / 128K |
| Esforço padrão na API | medium | high | medium |
| Perfil divulgado | Trabalho longo e ambíguo | Execução delimitada e coding | Extração, classificação e roteamento |
A documentação lista Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS para os três. Essa disponibilidade não garante a mesma ferramenta, região ou quota em todos os canais; assinatura do aplicativo também não equivale a créditos de API. A latência publicada é relativa: Haiku é o mais rápido em operação padrão, sem uma promessa de p95 para sua aplicação.
Para uma PME, comece pelo fluxo: extrair campos de pedidos é diferente de reconciliar regras comerciais contraditórias. O guia de adoção do Claude em PMEs ajuda a separar produto, integração e processo antes de comprar capacidade que o trabalho não exige.
2. Preços: calcule entrada, saída, cache e batch separadamente
O custo da Claude API depende dos tokens efetivamente cobrados, não apenas do texto visível da resposta. A tabela reúne tarifas globais padrão em dólares por milhão de tokens, consultadas em 7 de outubro de 2026; não são mensalidades do Claude nem cotações em reais.
| Modelo / tamanho do prompt | Entrada | Saída | Cache gravação 5 min | Cache gravação 1 h | Cache leitura | Batch entrada / saída |
|---|---|---|---|---|---|---|
| Opus 5.5 | US$ 4 | US$ 20 | US$ 5 | US$ 8 | US$ 0,20 | US$ 2 / US$ 10 |
| Sonnet 5.5 | US$ 2 | US$ 10 | US$ 2,50 | US$ 4 | US$ 0,10* | US$ 1 / US$ 5 |
| Haiku 5.5, até 100 mil | US$ 0,10 | US$ 0,50 | US$ 0,125 | US$ 0,20 | US$ 0,01 | US$ 0,05 / US$ 0,25 |
| Haiku 5.5, acima de 100 mil | US$ 0,50 | US$ 2,50 | US$ 0,625 | US$ 1 | US$ 0,05 | US$ 0,25 / US$ 1,25 |
*Há divergência documental no cache do Sonnet: a página comercial atual e o anúncio do Haiku informam US$ 0,10; a tabela de modelos da documentação ainda mostra US$ 0,20, embora a explicação de caching nessa mesma documentação já cite US$ 0,10. Os cálculos abaixo usam US$ 0,10. Confirme a tarifa no canal contratado antes de fechar orçamento.
Batch concede 50% de desconto nos tokens e pode combinar com cache, mas é assíncrono, não uma opção equivalente para atendimento imediato. Opus Fast Mode custa US$ 8 de entrada e US$ 40 de saída, não combina com batch e não deve ser confundido com a tarifa padrão. Ferramentas, execução, impostos e eventuais adicionais regionais exigem orçamento separado.
3. Benchmarks oficiais: Sonnet não fica sempre atrás do Opus
O Sonnet 5.5 supera o Opus 5.5 no Terminal-Bench 4.0 divulgado pela Anthropic: 70,6% contra 66,4%, enquanto o Haiku registra 39,2%. Isso derruba a leitura simplista de que a família mais cara vence toda tarefa, mas não demonstra superioridade universal.
| Benchmark divulgado pela Anthropic | Opus 5.5 | Sonnet 5.5 | Haiku 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66,4%, xhigh | 70,6% | 39,2% |
| FrontierCode 1.1, Main | 54,4% | 52,1%, xhigh | 46,4% |
| Humanity’s Last Exam, com ferramentas | 67,7% | 64,5% | 57,4% |
Esses resultados vêm de materiais do fornecedor, não de uma reprodução da Techify. Nem todas as linhas publicam o mesmo esforço e orçamento: o Sonnet também tem 46,2% em FrontierCode no esforço max, abaixo de xhigh. A própria Anthropic explica que revisões adicionais podem produzir mudanças fora do escopo ou timeouts. Mais raciocínio não é ganho monotônico.
O anúncio do Opus informa erro-padrão de 2,6 pontos percentuais no Terminal-Bench e substituição por modelos anteriores em algumas tarefas sensíveis. OSWorld aparece como avaliação parcial ou subconjunto offline, conforme o release; misturar essas versões geraria uma comparação falsa. Use o ranking para selecionar candidatos e teste seu repositório com o mesmo harness, contexto e ferramentas.
4. Avaliações independentes: diferencie leaderboard de release
A Artificial Analysis publica resultados próprios que não coincidem exatamente com os números dos anúncios. Na consulta de 7 de outubro, GDPval-AA v2.1 mostrava Opus 5.5 max com 1866 Elo e Sonnet 5.5 max com 1839; Haiku 5.5 não aparecia no conteúdo consultado desse leaderboard.
| Avaliação independente consultada | Opus 5.5, max | Sonnet 5.5, max | Haiku 5.5 |
|---|---|---|---|
| GDPval-AA v2.1 | 1866 Elo | 1839 Elo | Indisponível na página consultada |
| AA-Briefcase v1.1 | 1807 Elo | 1823 Elo | Indisponível na página consultada |
GDPval-AA contém 220 tarefas em 44 profissões e nove setores, usa o framework Stirrup e julgamentos pareados de entregas anonimizadas por um avaliador LLM. AA-Briefcase reúne 91 tarefas de quatro projetos privados, combinando requisitos e julgamentos de análise e apresentação. Elo não é porcentagem de acerto; uma diferença pequena não permite declarar vencedor sem considerar incerteza e desenho da avaliação.
As entradas consultadas trazem a indicação Default Fallback, sem identificar ali o modelo substituto. O anúncio do Haiku divulga 1620 no GDPval-AA, mas não o tratamos como verificação independente direta. O anúncio do Sonnet também menciona um bug de saída estruturada em implantação de pré-lançamento; mudar implantação, esforço ou data pode mudar o resultado. Para a PME, a análise da Techify prioriza aprovação de entregas reais, não combinar números de páginas distintas em um ranking artificial.
5. Custos calculados: 10 mil solicitações não custam o mesmo
Dez mil solicitações com 3 mil tokens de entrada e 500 de saída cobrados por solicitação custariam US$ 5,50 no Haiku, US$ 110 no Sonnet e US$ 220 no Opus, sem cache. Os números foram calculados em Python com Decimal, mantendo os mesmos volumes faturáveis para isolar tarifas.
| Cenário hipotético | Haiku 5.5, prompt curto | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| 10 mil solicitações padrão | US$ 5,50 | US$ 110 | US$ 220 |
| Mesmo volume em batch, sem cache | US$ 2,75 | US$ 55 | US$ 110 |
| Cache ideal de prefixo de 2 mil tokens | US$ 3,70 | US$ 72,00 | US$ 144,01 |
A conta padrão é 10.000 × (3.000 × tarifa_entrada + 500 × tarifa_saida) / 1.000.000. No cache ideal, os 3 mil tokens se dividem em prefixo fixo de 2 mil e entrada nova de mil: cobramos uma gravação de cinco minutos e 9.999 leituras bem-sucedidas, além da entrada nova e saída de todas as solicitações. Expiração, prefixos diferentes ou falhas de cache aumentam o custo; não é previsão operacional.
A Techify propõe comparar custo por resolução aceita: tokens, novas tentativas, chamadas de ferramentas e tempo humano de correção. O exemplo exclui impostos, câmbio, runtime e ferramentas; se houver raciocínio faturado além dos 500 tokens, ele precisa entrar na conta. Não convertemos para reais sem uma taxa de câmbio definida, e as práticas de redução de contexto e tokens continuam úteis em qualquer família.
6. O limite de 100 mil tokens muda a economia do Haiku
O Haiku 5.5 tem contexto de 1 milhão de tokens, mas sua tarifa sobe cinco vezes quando o prompt passa de 100 mil tokens. Opus e Sonnet mantêm a tarifa padrão ao longo da janela documentada; capacidade máxima e faixa econômica são conceitos diferentes.
Em uma requisição sem cache com 100 mil tokens de entrada e mil de saída, a fórmula publicada dá US$ 0,0105. Com 100.001 tokens de entrada e a mesma saída, a faixa superior resulta em US$ 0,0525005. O cálculo aplica a tarifa da faixa ao pedido, não apenas ao token excedente. Isso não torna o Haiku automaticamente caro, mas inviabiliza estimativas que multiplicam qualquer contexto por US$ 0,10.
Recuperar só trechos relevantes de catálogo, contrato e histórico pode ser mais eficiente que enviar o arquivo inteiro. O tokenizer novo também produz aproximadamente 30% mais tokens que o do Haiku 4.5, segundo a documentação, com variação por conteúdo. Conte tokens reais em português, mantenha margem no limite e não assuma que uma leitura de cache elimina a necessidade de verificar o tamanho do prompt.
7. Matriz de decisão para uma PME brasileira
Haiku é candidato inicial para tarefas curtas verificáveis, Sonnet para execução delimitada com várias etapas e Opus para ambiguidade com alto custo de erro. Essa matriz é uma proposta de arquitetura, não um resultado de benchmark interno nem promessa de acurácia.
| Fluxo de PME | Candidato inicial | Quando subir de complexidade |
|---|---|---|
| Extrair CNPJ, produto e número do pedido | Haiku | Campos conflitantes ou evidência incompleta |
| Classificar SAC e resumir histórico | Haiku | Exceção comercial ou contradição entre registros |
| Preparar proposta com regras conhecidas | Sonnet | Condições conflitantes ou negociação não padronizada |
| Corrigir bug delimitado com testes | Sonnet | Falha persistente ou dependências não compreendidas |
| Investigar arquitetura ou migração ambígua | Opus | Buscar evidências e dividir o escopo, não só elevar esforço |
A regra forte é não colocar Opus no caminho de toda mensagem do WhatsApp só porque ele é o mais capaz da comparação. Identificar intenção e localizar um pedido pode ser uma chamada barata; resolver uma divergência contratual é outro trabalho. Separe as etapas para não pagar raciocínio extenso por confirmação de endereço ou status de entrega.
Implemente a decisão com sinais verificáveis: JSON inválido, campo obrigatório ausente, documento contraditório, teste falhando ou ferramenta retornando erro. Não use apenas a confiança declarada pelo modelo. Em orquestração com subagentes, o modelo principal pode delegar extrações sem transferir todo o histórico; paralelizar sem necessidade também multiplica chamadas.
8. Roteamento só economiza se o reprocessamento não consumir a diferença
Uma distribuição hipotética de 80% das solicitações para Haiku, 15% para Sonnet e 5% para Opus custaria US$ 31,90 no cenário de 10 mil chamadas descrito acima. Isso representa 71% menos que enviar todas as solicitações ao Sonnet por US$ 110, antes de qualquer custo adicional de roteamento.
Essa conta é particionamento direto, não cascata: cada solicitação usa um único modelo. Se Haiku tentar primeiro e Sonnet refizer depois, as duas chamadas entram na fatura. A economia bruta de US$ 78,10 é o teto disponível para absorver roteador, escaladas e retrabalho antes de perder a vantagem sobre o cenário todo em Sonnet, assumindo a mesma qualidade final.
Para começar, separe uma amostra de 100 tarefas com respostas ou critérios de aceite conhecidos, incluindo abreviações, notas fiscais e mensagens incompletas em pt-BR. Meça aprovação sem correção, tokens faturados, latência p95 e número de escaladas. O tamanho de 100 é uma sugestão de piloto, não uma validação estatística universal; amplie a amostra nos fluxos com maior impacto financeiro.
O Haiku 5.5 foi lançado em 7 de outubro de 2026 e já há divergência entre páginas de preços do Sonnet; atualize a planilha de custos antes de aprovar o próximo orçamento de API.
9. Concorrentes e integração: compare a versão exata
Os concorrentes citados nos anúncios incluem GPT-6 Astra, GPT-6 Sol e GPT-6 Luna, mas nem todas as versões são intercambiáveis. A documentação atual da OpenAI consultada já apresenta GPT-6.1 Sol, portanto resultados publicados para GPT-6 Sol não devem ser atribuídos automaticamente ao sucessor.
No anúncio do Opus, GPT-6 Astra registra 57,9% no Terminal-Bench 4.0, abaixo de 66,4% do Opus, mas 41,4% em AutomationBench, acima de 40,0%. No anúncio do Haiku, GPT-6 Luna tem 16,4% no Terminal-Bench, contra 39,2% do Haiku. São comparações divulgadas pela Anthropic, com atribuições e condições específicas, não uma medição independente de preço, latência ou qualidade em português.
Inclua um concorrente no piloto quando houver necessidade concreta, como melhor integração com o stack atual ou resultado insuficiente nas tarefas-alvo. Não há neste comparativo um preço verificado desses concorrentes para montar uma classificação de custo-benefício entre fornecedores. Na migração do Haiku, adapte também o cliente: raciocínio vem ativado por padrão, parâmetros de amostragem não padrão podem retornar erro e o texto deve ser selecionado pelo tipo de bloco, não pela primeira posição da resposta.
Na implementação dessa estratégia, os detalhes de Opus 5.5, Sonnet 5.5 e Haiku 5.5 ajudam a identificar o modelo apropriado para cada etapa, sem tratar uma posição no benchmark como garantia de qualidade para toda tarefa.
Conclusão
Haiku 5.5 é o candidato econômico para volume verificável, Sonnet 5.5 para execução delimitada e Opus 5.5 para trabalho ambíguo; o vencedor real é o fluxo que entrega mais resoluções corretas dentro do orçamento. Confirme tarifas, preserve a versão dos benchmarks e trate as simulações como ponto de partida, não como prova de desempenho da sua operação.
Se sua PME precisa transformar atendimento, propostas ou desenvolvimento em uma automação com custo mensurável, converse com a Techify sobre um piloto com matriz de tarefas, avaliação de qualidade e roteamento por complexidade.
Sobre o autor
Editor — Techify
Rob é editor da Techify e escreve sobre IA aplicada, automação e engenharia de sistemas para empresas que querem escalar.
- Focado em automação com IA aplicada