Preços+7% bônus

O preço de pico da DeepSeek já está ativo: quando a API custa mais?

O que é o DeepSeek Peak Pricing? A DeepSeek acabou de mudar sua API para o modelo de preços de pico/fora do pico. Saiba quando a API custa mais, quanto custa a mais e como reduzir sua fatura pela metade.

O preço de pico da DeepSeek já está ativo: quando a API custa mais?

Se você acordou no dia 17 de agosto e a fatura da sua API DeepSeek de repente parecia diferente, não é imaginação sua. A DeepSeek lançou oficialmente o Peak Pricing — um modelo de cobrança baseado em horários de pico e fora de pico, que muda quanto você paga por token dependendo de quando suas solicitações chegam à API.

Em resumo: rode suas cargas de trabalho durante os horários de pico e você paga o preço cheio. Mude-as para horários mais tranquilos e você paga metade. Este guia detalha exatamente o que é o DeepSeek Peak Pricing, quando a API custa mais, quanto custa em cada nível e no que você deve ficar atento.

Índice

O que é o preço de pico da DeepSeek?

O preço de pico da DeepSeek é um sistema de cobrança dinâmico por faixa de horário para a API da DeepSeek. Em vez de cobrar uma tarifa única durante todo o dia, a DeepSeek agora divide cada dia em duas janelas:

  • Horário de pico — as janelas mais movimentadas, cobradas pela tarifa integral (mais alta).

  • Horário fora de pico — tudo o mais, cobrado exatamente pela metade da tarifa de pico.

A nova precificação entrou em vigor às 00:00, horário de Pequim (UTC+8), em 17 de agosto de 2026, e se aplica à atual linha de modelos da DeepSeek, incluindo DeepSeek-V4-Flash e DeepSeek-V4-Pro.

Se você já usou serviços de nuvem com descontos "spot" ou "fora de pico", o conceito vai parecer familiar: o provedor incentiva o tráfego não urgente a migrar para períodos mais ociosos ao deixá-lo mais barato, o que equilibra a demanda na infraestrutura.


Quando a API da DeepSeek custa mais? (Horário de pico vs. fora de pico)

Esta é a coisa mais importante para memorizar. O preço de pico se aplica durante estas duas janelas diárias:

Janela Horário de Pequim (UTC+8) Tarifa
Pico (manhã) 09:00 – 12:00 Preço integral
Pico (tarde) 14:00 – 18:00 Preço integral
Fora de pico (todas as outras horas) 18:00 – 09:00 do dia seguinte, mais 12:00 – 14:00 50% de desconto

Em outras palavras, a API custa mais por um total de 7 horas por dia (09:00–12:00 e 14:00–18:00, horário de Pequim). As 17 horas restantes custam metade do preço, incluindo o intervalo do almoço entre os dois blocos de pico.

Dica rápida para usuários globais: Converta essas janelas para o seu próprio fuso horário. O horário de Pequim 09:00–12:00 / 14:00–18:00 corresponde aproximadamente ao dia comercial padrão chinês. Se você estiver nos EUA ou na Europa, grande parte do seu dia de trabalho pode cair justamente na janela fora de pico da DeepSeek — ou seja, você pode estar pagando a tarifa com desconto sem mudar nada.

Preço de pico da DeepSeek: detalhamento completo de preços

Todos os preços abaixo são por 1M de tokens, convertidos das taxas oficiais da DeepSeek em CNY para USD aproximado (≈ US$ 1 = ¥7,2). O preço fora de pico é sempre a metade da tarifa de pico.

DeepSeek-V4-Flash

A camada leve e de alta velocidade — ideal para tarefas de alto volume e sensíveis à latência.

Tipo de token Fora de pico (por 1M) Pico (por 1M)
Entrada (cache hit) ~$0.007 ~$0.014
Entrada (cache miss) ~$0.21 ~$0.42
Saída ~$0.63 ~$1.25

👉 Explore o DeepSeek-V4-Flash no GPT Proto →

DeepSeek-V4-Pro

A camada de raciocínio principal — criada para cargas de trabalho complexas e de alta precisão.

Tipo de token Fora de pico (por 1M) Pico (por 1M)
Entrada (cache hit) ~$0.021 ~$0.042
Entrada (cache miss) ~$0.63 ~$1.25
Saída ~$1.88 ~$3.75

👉 Explore o DeepSeek-V4-Pro no GPT Proto →

(Os valores em USD são aproximados e fornecidos para conveniência; o preço oficial da DeepSeek é denominado em CNY e pode variar com as taxas de câmbio.)


O preço de pico da DeepSeek custa mais ou menos?

A resposta honesta: depende inteiramente de quando você executa suas requisições.

  • Se o seu tráfego ocorrer nos horários de pico → você paga mais do que uma comparação ingênua com tarifas fixas antigas, porque o pico é a camada integral (mais alta).

  • Se o seu tráfego ocorrer nos horários fora de pico → você paga metade da tarifa de pico, o que é um desconto real e significativo.

O preço de pico não é um aumento genérico de preços disfarçado de recurso. É uma redistribuição: a mesma carga de trabalho pode custar até 2× mais ou até 50% menos do que a tarifa de pico, apenas com base no horário. Para quem executa trabalhos em lote, processamento de dados offline, resumos noturnos ou pipelines não urgentes, a janela fora de pico é essencialmente dinheiro de graça — programe o trabalho fora das janelas de 09:00–12:00 e 14:00–18:00, horário de Pequim, e corte a conta pela metade.

Por que a DeepSeek usa preço de pico?

O preço de pico resolve um problema clássico de infraestrutura: a demanda é desigual. Durante o horário comercial chinês, o tráfego da API dispara; durante a madrugada, os servidores ficam relativamente ociosos. Uma tarifa fixa força a DeepSeek a provisionar para o pico e absorver o desperdício nos períodos de baixa.

Ao tornar os horários fora de pico mais baratos, a DeepSeek:

  1. Suaviza a demanda — incentivando cargas de trabalho flexíveis a migrarem para horários mais ociosos, reduzindo o congestionamento durante os picos.

  2. Melhora a confiabilidade — menos sobrecarga no horário de pico significa latência e disponibilidade mais consistentes quando isso importa.

  3. Reduz o custo para usuários flexíveis — equipes que não precisam de respostas em tempo real ganham um desconto embutido de 50% apenas por remanejarem o agendamento.

  4. Mantém a capacidade premium disponível — quem realmente precisa de throughput no horário de pico continua tendo acesso, a uma tarifa que reflete a maior demanda.

É a mesma lógica por trás das tarifas de energia fora de pico e das instâncias spot na nuvem — alinhe o preço à demanda real e todos podem otimizar de acordo.

O que você deve observar ao usar o preço de pico da DeepSeek?

Antes de presumir que seus custos vão cair magicamente, tenha estas coisas em mente:

  1. A confusão de fuso horário é a armadilha nº 1. As janelas de pico são definidas no horário de Pequim (UTC+8), não no seu horário local. Se você errar o cálculo, pode agendar um trabalho em lote "barato" bem para dentro da janela de pico. Sempre converta primeiro.

  2. O intervalo do almoço (12:00–14:00) é fora de pico. Ele fica entre os dois blocos de pico, então um trabalho que começa às 13:00 tem desconto — mas um que roda das 11:30 às 14:30 atravessa pico → fora de pico → pico. Fique de olho nos limites dos seus trabalhos.

  3. O preço com cache hit é drasticamente mais barato — mas ainda dobra no pico. Tokens de entrada em cache são, de longe, o item mais barato da conta. Reutilizar prompts e contexto (prompt caching) continua sendo uma das maiores alavancas na sua fatura, independentemente da janela de horário.

  4. O tráfego em tempo real / voltado ao usuário nem sempre pode ser movido. Se o seu produto atende usuários ao vivo durante o horário comercial chinês, você fica preso às tarifas de pico nesse tráfego. Somente cargas de trabalho adiáveis se beneficiam do agendamento fora de pico.

  5. A escolha do modelo ainda é o que mais importa. O preço de pico é uma alavanca de horário; escolher o modelo certo é a alavanca maior. Se o V4-Flash atende ao seu padrão de qualidade, ele custa uma fração do custo do V4-Pro em qualquer horário. Alinhe o modelo à tarefa antes de otimizar o relógio.

Como realmente economizar com o preço de pico

Uma lista de verificação rápida e prática:

  • ✅ Processe em lote e agende trabalhos não urgentes (embeddings, resumos, avaliações, limpeza de dados) na janela fora de pico de 17 horas.

  • ✅ Converta os horários de pico para o seu fuso horário local e marque-os no calendário da sua equipe.

  • ✅ Aposte no prompt caching para manter os tokens de entrada com cache hit como a principal linha de custo.

  • ✅ Escolha o modelo no tamanho certo — use DeepSeek-V4-Flash para volume e velocidade, e reserve DeepSeek-V4-Pro para tarefas que realmente precisam do poder extra de raciocínio.

  • ✅ Monitore e divida o tráfego — direcione as requisições em tempo real conforme necessário, mas adie tudo o que puder esperar.

Conclusão

O preço de pico da DeepSeek não é um simples aumento de preço — é um modelo de preços baseado no horário que recompensa a flexibilidade. A API custa mais apenas durante 09:00–12:00 e 14:00–18:00, horário de Pequim, e fica com metade do preço nas outras 17 horas do dia. Entenda as janelas, preste atenção ao fuso horário, use cache agressivamente e escolha o modelo certo, e você pode tranquilamente ficar no lado mais barato da equação.

Pronto para construir com os modelos DeepSeek mais recentes? Compare especificações e preços diretamente:

Perguntas Frequentes

O que é o DeepSeek Peak Pricing?

O DeepSeek Peak Pricing é um modelo de cobrança baseado no tempo para a API DeepSeek. O dia é dividido em horários de pico (cobrados pelo preço integral) e horários fora do pico (cobrados pela metade do preço). Entrou em vigor às 00:00, horário de Pequim (UTC+8), em 17 de agosto de 2026.

Quais são os horários de pico da DeepSeek?

Os horários de pico são das 09:00 às 12:00 e das 14:00 às 18:00, horário de Pequim (UTC+8) — 7 horas no total por dia. Todas as outras horas, incluindo o intervalo de almoço das 12:00 às 14:00 e todos os horários noturnos, são fora do pico.

O DeepSeek custa mais ou menos com o preço de pico?

Depende do horário. As solicitações durante os horários de pico são cobradas pela tarifa integral, enquanto as solicitações fora do pico custam exatamente **metade** da tarifa de pico. Cargas de trabalho flexíveis agendadas para horários fora do pico pagam menos; o tráfego em tempo real durante os horários de pico paga mais.

Quanto posso economizar com o preço fora do pico?

O preço fora do pico é **50% da tarifa de pico** para todos os tipos de token (entrada com cache-hit, entrada com cache-miss e saída), tanto para o DeepSeek-V4-Flash quanto para o DeepSeek-V4-Pro. Transferir trabalhos adiáveis para o horário fora do pico efetivamente reduz o custo pela metade.

Qual fuso horário os horários de pico usam?

Todas as janelas de pico são definidas no horário de Pequim (UTC+8), não no seu horário local. Converta-as para o seu fuso horário antes de agendar trabalhos — este é o erro mais comum que os usuários cometem.

O preço de pico se aplica tanto ao DeepSeek-V4-Flash quanto ao DeepSeek-V4-Pro?

Sim. O preço de pico/fora do pico se aplica à linha atual de modelos da DeepSeek, incluindo [DeepSeek-V4-Flash](https://gptproto.com/model/deepseek/deepseek-v4-flash) e [DeepSeek-V4-Pro](https://gptproto.com/model/deepseek/deepseek-v4-pro).

Por que a DeepSeek mudou para o preço de pico?

Para equilibrar a demanda. Tornar os horários fora do pico mais baratos incentiva cargas de trabalho flexíveis a se deslocarem para períodos mais tranquilos, o que reduz o congestionamento nos horários de pico, melhora a confiabilidade e reduz os custos para usuários que não precisam de respostas em tempo real.

Como posso evitar pagar preços de pico?

Agrupe e agende trabalhos não urgentes na janela de 17 horas fora do pico, apoie-se no cache de prompt para manter os tokens com cache-hit dominantes e adeque o modelo à tarefa — use o V4-Flash para trabalhos de alto volume e reserve o V4-Pro para tarefas que realmente precisam de raciocínio extra.

Artigos relacionados

Mais blogs
O que é o GLM-5.3? Lançamento silencioso do plano de programação da Z.ai, preços e atualizações confirmadas

O que é o GLM-5.3? Lançamento silencioso do plano de programação da Z.ai, preços e atualizações confirmadas

Os resultados de pesquisa ainda descrevem o GLM-5.3 como um rumor de lançamento. A própria documentação da Z.ai agora diz o contrário — mas apenas parcialmente. Em 14 de agosto de 2026, o GLM-5.3 está disponível no GLM Coding Plan da Z.ai . O guia oficial de configuração identifica glm-5.3 como o modelo atual, oferece suporte a um contexto opcional de 1 milhão de tokens e documenta níveis de esforço de raciocínio baixo, alto e máximo. No entanto, a Z.ai ainda não publicou um anúncio de lançamento datado, um model card completo, pesos abertos, preços padrão de API por token ou resultados de benchmarks para esta versão. Essa distinção é importante. O GLM-5.3 não é mais apenas um apelido da comunidade, mas também ainda não é um lançamento público totalmente documentado. Verifiquei separadamente o guia do Coding Plan, o catálogo geral de modelos, a página de preços, as notas de lançamento e os repositórios públicos de modelos. Eles ainda não estão totalmente sincronizados, o que explica por que uma resposta simples de “lançado ou não lançado” pode ser enganosa.

Michael Johnson | 2026-08-14

Grok 4.6 vs DeepSeek V4 Pro: Programação, Preços e Qual é Melhor?

Grok 4.6 vs DeepSeek V4 Pro: Programação, Preços e Qual é Melhor?

rok 4.6 e DeepSeek V4 Pro foram projetados para tarefas difíceis de raciocínio e programação, mas não são intercambiáveis. Grok 4.6 é a opção mais forte quando a tarefa envolve capturas de tela, protótipos de interfaces, depuração visual ou os problemas mais difíceis de programação agêntica. DeepSeek V4 Pro é mais atraente quando custo, contexto longo e programação baseada em texto em grande volume são as prioridades. A resposta curta é simples: Grok 4.6 é o modelo mais completo, enquanto DeepSeek V4 Pro é o modelo de programação mais econômico. Esta comparação entre Grok 4.6 e DeepSeek V4 Pro aborda programação, desenvolvimento frontend, janelas de contexto, evidências de benchmarks públicos, preços da API e a atualização mais recente do DeepSeek V4 Pro. Ela também explica qual modelo faz mais sentido para diferentes cargas de trabalho de desenvolvedores. Veredito rápido: escolha Grok 4.6 para trabalho frontend visual, depuração difícil e tarefas de programação de alto risco. Escolha DeepSeek V4 Pro para repositórios extensos, fluxos de trabalho com muito texto e custos menores de API. Para roteamento em produção, DeepSeek V4 Pro pode lidar com a carga padrão, enquanto Grok 4.6 assume escalonamentos visuais ou difíceis.

Tiffany Layne | 2026-08-13

DeepSeek V4 Pro vs Kimi K3: O que mudou após a atualização 0813?

DeepSeek V4 Pro vs Kimi K3: O que mudou após a atualização 0813?

A comparação entre DeepSeek V4 Pro e Kimi K3 mudou em 13 de agosto de 2026. A DeepSeek substituiu a prévia do V4 Pro por trás do seu alias de API existente pelo DeepSeek V4 Pro 0813, mantendo o nome de modelo que os desenvolvedores já usam. A resposta curta é: o Kimi K3 ainda lidera em inteligência medida de forma geral e suporta entrada visual. O DeepSeek V4 Pro 0813 é mais rápido e drasticamente mais barato para codificação baseada em texto e cargas de trabalho de agentes. Para a maioria das equipes que processam repositórios, fazem revisões de código ou operam agentes de alto volume, o DeepSeek agora é a melhor opção padrão. O Kimi justifica o preço mais alto quando a entrada multimodal ou o maior teto de raciocínio disponível importa mais que o custo. Um detalhe de implementação é fácil de passar despercebido: no GPTProto, você não precisa de um sufixo 0813 . Continue chamando deepseek-v4-pro , e a rota usa automaticamente a versão atual.

Tiffany Layne | 2026-08-13

Grok 4.6 vs Kimi K3: Qual deles se adapta ao seu projeto?

Grok 4.6 vs Kimi K3: Qual deles se adapta ao seu projeto?

Dois lançamentos de ponta chegaram com quatro semanas de diferença, ambos voltados diretamente ao mesmo comprador: o desenvolvedor que executa agentes, não chatbots. A Moonshot AI lançou o Kimi K3 em 16 de julho de 2026. A xAI respondeu em 12 de agosto com o Grok 4.6. Pesquise hoje por "Grok 4.6 vs Kimi K3" e você encontrará a cobertura do lançamento de cada lado, além de uma pilha de fichas técnicas — mas quase ninguém colocou os dois lado a lado sob a perspectiva de quem constrói. É essa lacuna que este artigo preenche. Aqui está a versão curta, porque você veio em busca de uma decisão, não de uma recapitulação. O Grok 4.6 vence em eficiência de turnos agênticos e hospedagem sem intervenção. Ele conclui tarefas longas e com várias etapas em menos ciclos e usando menos tokens, e você nunca precisa tocar na infraestrutura. O Kimi K3 vence em contexto, vídeo nativo e controle — uma janela de 1 milhão de tokens, entrada de imagens e vídeo, além de pesos abertos para download caso você precise hospedar por conta própria ou operar em uma rede isolada. No número que todos citam, eles quase empatam: a Artificial Analysis estima o custo por tarefa de ambos em aproximadamente $0.84 . Portanto, a diferença de um ponto no índice de inteligência não será o seu fator decisivo. Os dois modelos seguem caminhos opostos para chegar ao mesmo custo, e essa é a bifurcação que você realmente precisa escolher. Se você executa fluxos de trabalho agênticos de alto volume e sensíveis a custos e quer um endpoint gerenciado, escolha o Grok 4.6. Se precisa inserir um repositório inteiro ou um vídeo em uma única janela de contexto — ou se tem um motivo de conformidade para manter os pesos por conta própria — escolha o Kimi K3. O restante deste artigo mostra o raciocínio por trás dessa decisão.

Schuyler Stacy | 2026-08-13