Trabalho agêntico de longo horizonte
Lida com tarefas de múltiplas etapas que duram horas, usam várias ferramentas, recuperam-se de etapas com falha e continuam rumo a um resultado definido com menos supervisão.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "claude-fable-5-1",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, agentes de programação e trabalho com documentos. Preço por 1M de tokens — entrada, entrada em cache e saída são cobradas separadamente. GPTProto está 10% abaixo das tarifas oficiais.
| Cenário | Lista de Claude | OpenRouter | GPTProto | Economia / mês |
|---|---|---|---|---|
| Pessoal10M tokens / mês (4.8M cache) | $133.20 | $140.53 | $119.88 | −$13.32≈ $159.84 / ano |
| Equipe100M tokens / mês (48M cache) | $1332.00 | $1405.26 | $1198.80 | −$133.20≈ $1598.40 / ano |
| Empresarial500M tokens / mês (240M cache) | $6660.00 | $7026.30 | $5994.00 | −$666.00≈ $7992.00 / ano |
Crie agentes de programação, sistemas de pesquisa e fluxos de trabalho complexos com documentos usando a API do Claude Fable 5.1. Ela combina uma janela de contexto de 1M tokens, até 128K tokens de saída e pensamento adaptativo sempre ativo. Acesse-a no GPTProto com 10% abaixo das tarifas padrão de entrada e saída da Anthropic.
Trabalho agêntico de longo horizonte
Lida com tarefas de múltiplas etapas que duram horas, usam várias ferramentas, recuperam-se de etapas com falha e continuam rumo a um resultado definido com menos supervisão.
Engenharia em nível de base de código
Oferece suporte a recursos em todo o repositório, revisão de código, análise de desempenho, criação de testes, depuração de causa raiz e implementação em vários arquivos.
Contexto de 1M e saída de 128K
Processa grandes repositórios e documentação técnica em uma janela de contexto de 1M tokens e depois retorna até 128K tokens em uma única resposta.
Pensamento adaptativo sempre ativo
O raciocínio permanece ativado. Ajuste o esforço de baixo a máximo para equilibrar a dificuldade da tarefa, a latência e o uso de tokens, em vez de desligar o pensamento.
Claude Fable 5.1 é o modelo disponível publicamente mais capaz da Anthropic para raciocínio exigente e trabalho agêntico de longo horizonte. Lançado em 1º de setembro de 2026, ele sucede o Claude Fable 5, mantendo a mesma janela de contexto de 1M de tokens, saída máxima de 128K e preço de lista base. É um modelo proprietário hospedado, projetado para trabalhos difíceis que precisam manter a qualidade ao longo de muitas etapas.
| Especificação | Claude Fable 5.1 |
|---|---|
| Data de lançamento | 1º de setembro de 2026 |
| ID oficial do modelo da API | claude-fable-5-1 |
| Janela de contexto | 1,000,000 tokens |
| Saída máxima | 128,000 tokens |
| Pensamento | Adaptativo, sempre ativo |
| Esforço | Alto por padrão; de baixo a máximo suportado |
| Data de corte de conhecimento | Junho de 2026 |
O Fable 5.1 melhora mais claramente em trabalhos que combinam raciocínio, ferramentas e longas cadeias de execução. A Anthropic relata 55.8% no Terminal-Bench 4.0 contra 42.0% do Fable 5. Seu preço direto de leitura de cache também caiu de $1 para $0.25 por milhão de tokens, com a Anthropic estimando um custo típico de carga de trabalho cerca de 25% menor e economias de até aproximadamente 45% para trabalho altamente agêntico. As economias reais dependem da reutilização de cache.
| Aplicação | Por que o Fable 5.1 se encaixa |
|---|---|
| Programação agêntica | Planeja alterações no repositório, escreve testes, verifica resultados e se recupera de etapas com falha. |
| Agentes de longa duração | Mantém a direção em sequências estendidas de ferramentas e trabalho assíncrono. |
| Pesquisa | Sintetiza grandes coleções de fontes e segue instruções de várias partes. |
| Trabalho de conhecimento | Produz documentos, planilhas, apresentações e entregáveis operacionais para revisão. |
O conjunto de benchmarks publicados pela Anthropic indica que o Fable 5.1 é destinado a tarefas em que a qualidade de conclusão de longo horizonte importa mais do que latência mínima ou preço por token.
| Avaliação publicada pela Anthropic | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Estes são resultados executados pelos provedores, não rankings independentes. Para comparações com GPT-5.6, Grok 4.6, Qwen3.8-Max-0902, Kimi K3 ou GLM-5.3 Flash, use ferramentas, contexto, limites de tempo e testes de aceitação idênticos. Escolha o Fable 5.1 quando a falha na conclusão de um fluxo de trabalho longo for mais cara do que seu preço por token mais alto.
Migrar do Claude Fable 5 ou Opus 5 exige mais do que alterar o nome do modelo:
A escolha forçada de ferramenta não é suportada. tool_choice valores any e tool retornam um erro 400. Use auto com instruções explícitas e esquemas de ferramentas estritos, ou solicite JSON estruturado.
O pensamento não pode ser desativado. Controle o gasto e a latência por meio de effort; teste medium para etapas rotineiras e reserve xhigh ou max para ganhos comprovados por avaliação.
Mantenha o histórico de conversa somente de acréscimo. Editar mensagens anteriores pode invalidar blocos de pensamento preservados. Após a compactação do lado do cliente, remova blocos de pensamento obsoletos ou reinicie a partir de um resumo limpo.
Use o Claude Fable 5.1 para trabalhos difíceis, de longa duração e caros de reiniciar: engenharia em escala de repositório, depuração aberta, pesquisa com vários documentos ou agentes que coordenam várias ferramentas. Use um modelo de menor custo para chat rotineiro, extração, classificação e geração de código curto.
Guias, comparações e atualizações relacionadas a este modelo.
Todos os artigos
Claude Fable 5.1 e Mythos 5.1 compartilham um modelo, mas diferem no acesso. Veja preços, recursos, benchmarks, salvaguardas e alterações na migração da API.

Meta Descrição: Compare GLM 5.3 Flash vs DeepSeek V4 Flash para programação, trabalho de frontend, agentes, velocidade, contexto e preços da API para escolher o melhor modelo.

Qwen3.8-Flash-Next vs GLM-5.3 Flash comparados para programação, agentes, trabalho de frontend, velocidade, preços, contexto, licenças e uso em produção.

O que é o Tencent Hy4 Preview? Veja seu status de lançamento, design MoE 770B, contexto de 1M, preços da API, benchmarks, limites e comparações de modelos.