Modelos e tiers
Três níveis de serviço. Saber quando subir de tier vale mais do que saber os detalhes de cada um.
Sonnet 5, Opus 5 e Fable 5.1 são modelos oficiais Claude desenvolvidos pela Anthropic e providos pela Infinite Model. A infraestrutura que os disponibiliza pode evoluir ao longo do tempo, sem alterar o compromisso com a qualidade, velocidade e capacidade de cada modelo.
Escolhendo no CLI
Dentro do Claude Code, /model mostra e troca o modelo ativo. O catálogo lista apenas o que o seu plano roteia: no Core aparecem Sonnet 5 e Opus 5; no Max e no Passe de 7 dias, os três.
Também dá para definir por variável de ambiente, antes de abrir o CLI:
export ANTHROPIC_MODEL=claude-opus-5IDs aceitos pela API
Para quem integra direto ou configura outras ferramentas:
| ID | Roteia para |
|---|---|
claude-sonnet-5 | Sonnet 5 |
claude-opus-5 | Opus 5 |
claude-fable-5-1 | Fable 5.1 — exige plano Max |
claude-fable-5 | idem — o id anterior continua aceito |
claude-haiku-4-5-20251001 | Sonnet 5 (alias de compatibilidade) |
Pedir um modelo fora do seu plano devolve 403 tier_not_allowed. No Core, é o que acontece com claude-fable-5. O upgrade para Max resolve na hora, sem trocar de chave nem reconfigurar nada.
Cada modelo tem o seu preço por milhão de tokens na tabela do site, e é por ela que o uso é medido em reais: o Fable 5.1 custa mais por requisição que o Sonnet 5. Subir de tier quando a tarefa pede vale a pena; deixar o Fable 5.1 como padrão para tudo gasta o saldo mais rápido.
Qual usar quando
- Sonnet 5 como padrão. Resolve a maior parte do trabalho de edição e implementação, e responde rápido. Se a tarefa está clara, comece aqui.
- Opus 5 quando o contexto pesa: várias partes do código envolvidas, refactor com consequências, um bug que atravessa arquivos.
- Fable 5.1 quando errar custa caro: decisões de arquitetura, problemas que você já tentou resolver e voltaram, código crítico. Ele demora mais porque está raciocinando de verdade.
Regra prática: suba de tier quando perceber que está re-perguntando. O custo de uma resposta melhor é menor que o de três medianas.
O raciocínio, em todos os tiers
Os três tiers pensam antes de responder, e o pensamento não é exibido: é o mesmo comportamento da API oficial, em que o bloco de raciocínio chega vazio. O que você vê é a pausa. No CLI, "Thinking…" até o texto começar; no chat do painel, o indicador "pensando". Tarefas difíceis passam dezenas de segundos assim, sobretudo no Fable 5.
O seletor de esforço do Claude Code (/effort ou output_config.effort) vale aqui: low responde mais rápido e pensa menos, max pensa o máximo. O padrão é high. Só o Fable 5.1 alcança o nível mais alto.
Em tarefas muito longas, esse raciocínio consome parte do orçamento de saída. Se a resposta vier curta demais, peça continuação ou divida a tarefa.
Imagem
Os três tiers leem imagem: arraste um print ou uma foto no Claude Code, no Claude Desktop ou no editor e pergunte sobre ela. Formatos aceitos: JPEG, PNG, GIF e WebP.
Eles não geram imagem. Para desenho, diagrama ou arte, o caminho é outro produto.
Uma imagem custa entrada como qualquer texto, e o preço acompanha o tamanho em pixels: uma captura de tela comum fica entre 250 e 800 tokens.