Modelos e tiers

Três níveis de serviço. Saber quando subir de tier vale mais do que saber os detalhes de cada um.

Sonnet 5claude-sonnet-5O dia a dia: edições, refactors e perguntas diretas. É o mais rápido.CORE E MAX
Opus 5claude-opus-5Quando o contexto pesa: multi-arquivo, debugging, análise cuidadosa.CORE E MAX
Fable 5.1claude-fable-5-1O nível mais alto: raciocina antes de responder.SÓ MAX
Sobre os tiers

Sonnet 5, Opus 5 e Fable 5.1 são modelos oficiais Claude desenvolvidos pela Anthropic e providos pela Infinite Model. A infraestrutura que os disponibiliza pode evoluir ao longo do tempo, sem alterar o compromisso com a qualidade, velocidade e capacidade de cada modelo.

Escolhendo no CLI

Dentro do Claude Code, /model mostra e troca o modelo ativo. O catálogo lista apenas o que o seu plano roteia: no Core aparecem Sonnet 5 e Opus 5; no Max e no Passe de 7 dias, os três.

Também dá para definir por variável de ambiente, antes de abrir o CLI:

bash
export ANTHROPIC_MODEL=claude-opus-5

IDs aceitos pela API

Para quem integra direto ou configura outras ferramentas:

IDRoteia para
claude-sonnet-5Sonnet 5
claude-opus-5Opus 5
claude-fable-5-1Fable 5.1 — exige plano Max
claude-fable-5idem — o id anterior continua aceito
claude-haiku-4-5-20251001Sonnet 5 (alias de compatibilidade)

Pedir um modelo fora do seu plano devolve 403 tier_not_allowed. No Core, é o que acontece com claude-fable-5. O upgrade para Max resolve na hora, sem trocar de chave nem reconfigurar nada.

Cada modelo tem o seu preço por milhão de tokens na tabela do site, e é por ela que o uso é medido em reais: o Fable 5.1 custa mais por requisição que o Sonnet 5. Subir de tier quando a tarefa pede vale a pena; deixar o Fable 5.1 como padrão para tudo gasta o saldo mais rápido.

Qual usar quando

  • Sonnet 5 como padrão. Resolve a maior parte do trabalho de edição e implementação, e responde rápido. Se a tarefa está clara, comece aqui.
  • Opus 5 quando o contexto pesa: várias partes do código envolvidas, refactor com consequências, um bug que atravessa arquivos.
  • Fable 5.1 quando errar custa caro: decisões de arquitetura, problemas que você já tentou resolver e voltaram, código crítico. Ele demora mais porque está raciocinando de verdade.

Regra prática: suba de tier quando perceber que está re-perguntando. O custo de uma resposta melhor é menor que o de três medianas.

O raciocínio, em todos os tiers

Os três tiers pensam antes de responder, e o pensamento não é exibido: é o mesmo comportamento da API oficial, em que o bloco de raciocínio chega vazio. O que você vê é a pausa. No CLI, "Thinking…" até o texto começar; no chat do painel, o indicador "pensando". Tarefas difíceis passam dezenas de segundos assim, sobretudo no Fable 5.

O seletor de esforço do Claude Code (/effort ou output_config.effort) vale aqui: low responde mais rápido e pensa menos, max pensa o máximo. O padrão é high. Só o Fable 5.1 alcança o nível mais alto.

Em tarefas muito longas, esse raciocínio consome parte do orçamento de saída. Se a resposta vier curta demais, peça continuação ou divida a tarefa.

Imagem

Os três tiers leem imagem: arraste um print ou uma foto no Claude Code, no Claude Desktop ou no editor e pergunte sobre ela. Formatos aceitos: JPEG, PNG, GIF e WebP.

Eles não geram imagem. Para desenho, diagrama ou arte, o caminho é outro produto.

Uma imagem custa entrada como qualquer texto, e o preço acompanha o tamanho em pixels: uma captura de tela comum fica entre 250 e 800 tokens.