Preços+7% bônus

O que é o Step 5 Preview? O modelo de agente 600B da StepFun explicado

Step 5 Preview explicado: explore o modelo MoE 600B da StepFun, preços, benchmarks de codificação e finanças, contexto de 1M, acesso à API e status de lançamento.

O que é o Step 5 Preview? O modelo de agente 600B da StepFun explicado

Atualizado em 21 de setembro de 2026

Step 5 Preview é o novo modelo de raciocínio carro-chefe da StepFun para programação, agentes de longa duração, pesquisa profissional e finanças. Os números de destaque são incomuns: uma arquitetura esparsa Mixture-of-Experts de 600 bilhões de parâmetros, 27 bilhões de parâmetros ativos por token, uma janela de contexto de 1 milhão de tokens e entrada nativa de texto, imagem e vídeo.

Essas especificações tornam o modelo de IA chinês digno de atenção, mas não determinam se ele se encaixa em uma carga de trabalho de produção. Testes independentes dão a ele uma pequena vantagem de inteligência sobre o GLM 5.3 Flash e o DeepSeek V4.1 Flash; ambos os rivais são mais baratos, e o DeepSeek é mais rápido.

Uma observação sobre disponibilidade importa antes de prosseguir: Step 5 Preview está disponível por meio da própria API da StepFun, mas ele ainda não está disponível no GPTProto em 21 de setembro de 2026. O GPTProto planeja adicioná-lo mais tarde. Desenvolvedores que precisam de um modelo por meio do GPTProto hoje podem avaliar GLM 5.3 Flash, DeepSeek Flash, ou navegar pelo catálogo de modelos de texto.

Índice

O que é o Step 5 Preview?

O Step 5 Preview é um modelo de raciocínio multimodal desenvolvido pela StepFun, com sede em Xangai. Ele foi projetado para planejar, chamar ferramentas, inspecionar resultados, revisar sua abordagem e continuar até produzir um entregável.

Aqui estão os principais fatos da documentação oficial do modelo e página de lançamento da StepFun:

Especificação Step 5 Preview
Desenvolvedor StepFun
ID do modelo step-5-preview
Arquitetura Mistura de Especialistas esparsa
Parâmetros 600B no total, 27B ativos por token
Janela de contexto 1M tokens
Saída máxima 64K tokens
Entrada Texto, imagens e vídeo
Saída Texto
Controle de raciocínio baixo, médio, ou alto
Status da API Disponível pela StepFun
Status de pesos abertos Planejado para 15 de outubro de 2026
Status no GPT Proto Ainda não disponível; integração planejada

“Preview” é importante. A API já pode ser usada, mas comportamento, limites, preços e até o nome podem mudar antes de um lançamento estável. A StepFun afirma que os pesos do modelo serão liberados em 15 de outubro de 2026. Até que isso aconteça, ele deve ser tratado como um modelo proprietário hospedado — não como um modelo de pesos abertos que já pode ser auto-hospedado.

Recursos e arquitetura do Step 5 Preview

600B parâmetros sem ativar todos os 600B

O Step 5 Preview usa um design esparso de Mixture-of-Experts, ou MoE. Ele contém 600 bilhões de parâmetros no total, mas apenas 27 bilhões ficam ativos para cada token. Um sistema de roteamento seleciona os especialistas relevantes para a entrada atual.

“600B” descreve a capacidade total; não significa que todo token incorre no custo de um modelo denso de 600B. A contagem de ativos é mais relevante para a eficiência de inferência, mas hardware, batching, duração do raciocínio e capacidade do provedor ainda determinam o desempenho real.

Um contexto de 1M tokens e saída de 64K tokens

A janela de contexto de 1 milhão de tokens é voltada para grandes repositórios, relatórios, conversas e coleções de documentos. A saída máxima é de 64.000 tokens. Um contexto grande ainda exige recuperação disciplinada: mais material pode adicionar evidências irrelevantes, instruções conflitantes e custo.

O cache de prompt torna o trabalho repetido sobre o mesmo código-fonte, biblioteca de políticas ou corpus de pesquisa muito mais barato do que reenviar entrada sem cache repetidamente.

Entrada de texto, imagem e vídeo

O modelo aceita texto, até 60 imagens por requisição e vídeo. As imagens podem ser JPEG, PNG, WebP ou GIF estático. Os formatos de vídeo incluem MP4, QuickTime e Matroska; a StepFun recomenda clipes com menos de cinco minutos.

Você pode ver bancos de dados de terceiros listando apenas entrada de texto e imagem. Isso não contradiz necessariamente a StepFun. Por exemplo, Artificial Analysis registra as modalidades cobertas por sua listagem e testes, enquanto a StepFun documenta o suporte a vídeo em sua própria API. Para limites de implementação, use a documentação primária; para desempenho comparativo, use testes independentes.

Chamada de ferramentas não é acesso integrado ao mundo exterior

O Step 5 Preview oferece suporte a streaming, chamada de funções, modo JSON, JSON Schema e esforço de raciocínio ajustável. No entanto, o modelo não navega na web de forma independente, não executa código nem acessa os arquivos de um desenvolvedor. A StepFun afirma explicitamente que busca, execução de código, manuseio de documentos e outras ferramentas devem ser fornecidos pelo aplicativo integrador.

O modelo pode decidir quando e como usar uma ferramenta, mas o sistema de agente ao redor controla suas ferramentas, permissões e validação de resultados.

Step 5 Preview para codificação e trabalho com agentes

Em um agente de codificação, o modelo recebe um objetivo, lê arquivos, aplica alterações, executa testes, observa falhas e itera. Seu contexto longo pode preservar a estrutura do repositório e decisões anteriores ao longo desse ciclo.

A StepFun relata os seguintes resultados para o modelo com alto esforço de raciocínio:

Benchmark Pontuação do Step 5 Preview O que avalia
DeepSWE v1.1 67.7% Engenharia de software em nível de repositório
StepCodeBench 49.0% Tarefas de engenharia multilíngues
Terminal-Bench v4 33.3% Uso de ferramentas de codificação e terminal
Agents’ Last Exam (ALE-CLI) 29.5% Tarefas de agente de uso de computador
GPQA Diamond 93.5% Raciocínio e conhecimento em nível de pós-graduação
HLE 46.5% Perguntas amplas e difíceis de especialistas

Estes são resultados relatados pelo fornecedor. O StepCodeBench é interno; alguns concorrentes usam esforço “Max” enquanto o Step 5 usa “High”; e algumas comparações de HLE com ferramentas usam subconjuntos diferentes. As pontuações mostram capacidade, não superioridade garantida em um repositório específico.

A StepFun reconhece uma lacuna significativa nas tarefas de codificação mais difíceis e de longa duração. Teste correção de bugs, mudanças de recursos, geração de testes e rollback no seu próprio código, depois meça tarefas aceitas por dólar e por minuto.

As evidências iniciais da comunidade são escassas. Em um tópico de lançamento no Linux DO, um usuário gostou do raciocínio intermediário visível; a discussão no Reddit focou mais em pesos vazados ou espelhados do que na confiabilidade em produção. Essas anedotas do dia de lançamento sugerem perguntas a testar, não um ranking.

Por que o Step 5 Preview foca em finanças

O Step 5 Preview em finanças não se resume a responder perguntas de contabilidade. A StepFun tem como alvo fluxos de trabalho de analistas que reúnem documentos regulatórios e dados de mercado, conciliam definições, constroem valuations, executam cálculos e produzem um relatório auditável. Fontes, premissas, fórmulas e sensibilidades devem permanecer rastreáveis.

A StepFun relata 66,4% no benchmark externo FrontierFinance. Também relata 74,5% no FinStepBench LiveSearch, 60,6% no CorporateValuation e 55,8% no Finance Deep Research. Os três últimos são benchmarks internos da StepFun, então devem ter menos peso do que testes independentes até que terceiros reproduzam os resultados.

Uma pontuação forte não torna decisões financeiras não supervisionadas seguras. Mantenha links de fontes, rastros de cálculo, portões de aprovação e revisão humana — especialmente para decisões de investimento, crédito, impostos ou conformidade.

Quão bom é o Step 5 Preview em testes independentes?

Artificial Analysis dá ao Step 5 Preview uma pontuação de 44 no Intelligence Index. Ele mediu a saída em 99,8 tokens por segundo, um tempo de 2,96 segundos até o primeiro token e US$ 0,72 por tarefa do Intelligence Index na API da StepFun.

O aviso importante é a verbosidade: 160 milhões de tokens de saída na avaliação versus uma mediana de 92 milhões na categoria. Um preço razoável por token ainda pode produzir um custo alto por tarefa, então sistemas de produção precisam de limites de saída, esforço de raciocínio adequado e condições de parada.

Testes independentes também listam entrada de texto e imagem, não vídeo. Isso reflete o escopo do registro do modelo pelo avaliador; a documentação oficial da API da StepFun continua sendo a fonte para capacidade de vídeo. Manter esses dois tipos de evidência separados evita transformar uma diferença de cobertura de teste em uma falsa contradição.

Preços do Step 5 Preview explicados

A página oficial de preços da StepFun lista três tarifas por 1 milhão de tokens:

Tipo de token Preço
Entrada sem cache $1.00
Entrada com cache $0.05
Saída $2.70

Para o Step 5 Preview, o preço de entrada sem cache inclui gravar novo conteúdo no cache. A cobrança de saída inclui tanto tokens de raciocínio quanto a resposta final, então o raciocínio oculto não é gratuito.

Por exemplo, 100.000 tokens de entrada sem cache mais 10.000 tokens de saída custam cerca de US$ 0,127. Com a entrada totalmente em cache, a mesma requisição custa cerca de US$ 0,032. Ciclos de ferramentas, tentativas repetidas e duração do raciocínio podem alterar o total.

Este é o preço da StepFun, não um preço do GPT Proto. O GPT Proto ainda não adicionou o modelo, então não há uma tarifa legítima do GPT Proto para o Step 5 Preview a citar.

Step 5 Preview vs GLM 5.3 Flash vs DeepSeek Flash

Esta tabela usa dados do Artificial Analysis atualizados em 21 de setembro de 2026. DeepSeek Flash significa DeepSeek V4.1 Flash com esforço máximo de raciocínio.

Modelo Intelligence Index Velocidade de saída Entrada / saída por 1M tokens Custo por tarefa Contexto Pesos
Step 5 Preview 44 99.8 tok/s $1.00 / $2.70 $0.72 1M Planejado para 15 de out.
GLM 5.3 Flash 42 95.0 tok/s $0.15 / $0.50 $0.25 1M Aberto, MIT
DeepSeek V4.1 Flash 39 242.3 tok/s $0.30 / $1.20 $0.27 1M Aberto, MIT

GLM 5.3 Flash vs Step 5 Preview

O Step 5 Preview lidera por dois pontos no Index, com velocidade semelhante. O GLM é muito mais barato e seus pesos licenciados sob MIT já estão disponíveis. O Step 5 é mais interessante para fluxos de trabalho específicos de finanças ou entrada oficial de vídeo; o GLM é o ponto de partida mais forte para custo e auto-hospedagem.

Step 5 Preview vs DeepSeek Flash

O Step 5 lidera por cinco pontos no Index, mas o DeepSeek é mais de duas vezes mais rápido, custa muito menos por tarefa e já tem pesos abertos. Escolha o Step 5 apenas se seu raciocínio produzir trabalho aceito adicional suficiente para justificar execuções mais lentas e caras.

Atualmente, o GPT Proto oferece tanto o GLM 5.3 Flash quanto o DeepSeek Flash. Para uma comparação mais aprofundada entre essas opções disponíveis, veja GLM 5.3 Flash vs DeepSeek V4 Flash.

Como você pode acessar o Step 5 Preview?

Desenvolvedores podem chamar o endpoint POST /v1/chat/completions da StepFun com o ID de modelo step-5-preview. O formato da requisição segue o estilo chat-completions da OpenAI. Este exemplo tem como alvo diretamente a StepFun; não é de modo algum um endpoint do GPT Proto.

curl https://api.stepfun.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $STEP_API_KEY" \
  -d '{
    "model": "step-5-preview",
    "messages": [
      {
        "role": "user",
        "content": "Review this repository migration plan and list the three highest-risk assumptions."
      }
    ],
    "reasoning_effort": "medium",
    "max_tokens": 1200
  }'

A referência oficial da API deve ser consultada antes do uso em produção para parâmetros atuais, erros, limites de taxa e formatos de requisição multimodal.

Se você prefere um único saldo e uma interface unificada entre muitos modelos, o GPT Proto planeja adicionar o Step 5 Preview mais tarde. Até que o modelo apareça no catálogo ao vivo, não presuma que um nome semelhante, um espelho de terceiros ou uma rota não oficial seja a integração do GPT Proto.

Vale a pena testar o Step 5 Preview?

O Step 5 Preview merece uma avaliação controlada para documentos longos, agentes de codificação, pesquisa multimodal ou fluxos de trabalho financeiros rastreáveis. Sua pontuação independente de inteligência é forte e seu contexto de 1M é útil.

Ele não é a escolha padrão. O GLM é mais barato e tem pesos abertos; o DeepSeek é muito mais rápido; e o Step 5 continua verboso, em preview e indisponível no GPT Proto.

A melhor métrica de decisão é trabalho concluído e revisado — não contagem de parâmetros ou um único benchmark. Execute as mesmas tarefas representativas em cada candidato, registre correção, taxa de intervenção, latência e custo total de tokens, depois escolha o modelo que produz o menor custo por resultado aceito.

Perguntas Frequentes

O que é o Step 5 Preview?

O Step 5 Preview é o modelo de raciocínio MoE esparso da StepFun, com 600B no total e 27B ativos, para codificação agêntica, trabalho profissional, finanças e análise multimodal. Ele oferece suporte a contexto de 1M tokens e entrada de texto, imagem e vídeo.

Quando o Step 5 Preview foi lançado?

O Step 5 Preview entrou em disponibilidade de API em setembro de 2026. O Artificial Analysis registra 18 de setembro, enquanto o anúncio de lançamento público da StepFun apareceu por volta de 20 de setembro. A StepFun afirma que pesos abertos estão planejados para 15 de outubro de 2026.

Quanto custa o Step 5 Preview?

A StepFun cobra $1.00 por 1M de tokens de entrada não armazenados em cache, $0.05 por 1M de tokens de entrada armazenados em cache e $2.70 por 1M de tokens de saída. Os tokens de raciocínio estão incluídos na cobrança de saída.

O Step 5 Preview é de código aberto?

Ainda não. A StepFun diz que planeja lançar pesos abertos em 15 de outubro de 2026. A licença e os detalhes finais de lançamento devem ser verificados quando os pesos realmente surgirem.

O Step 5 Preview oferece suporte a vídeo?

Sim. A documentação oficial da StepFun lista entrada de texto, imagem e vídeo, com saída de texto. Alguns bancos de dados independentes de modelos listam apenas as modalidades que testaram, então suas entradas podem mostrar apenas texto e imagem.

O Step 5 Preview é bom para codificação?

Os benchmarks do fornecedor sugerem forte codificação em nível de repositório e comportamento agêntico, mas os resultados variam entre os testes, e a StepFun reconhece uma lacuna restante nas tarefas de longa duração mais difíceis. Avalie-o em seus próprios repositórios antes de tomar uma decisão de produção.

O Step 5 Preview é melhor que o GLM 5.3 Flash?

Ele pontua ligeiramente mais alto no atual Índice de Inteligência da Artificial Analysis, 44 contra 42. O GLM 5.3 Flash é substancialmente mais barato e já tem pesos abertos, enquanto as velocidades de saída medidas são semelhantes.

Artigos relacionados

Mais blogs
O que é Jev? O Modelo System One da TypeSafe AI Explicado

O que é Jev? O Modelo System One da TypeSafe AI Explicado

Resumo Jev é o primeiro modelo System One da TypeSafe AI: um modelo projetado para transformar texto ou estado de aplicação em formato de texto em decisões tipadas predefinidas com probabilidades. Ao contrário de um modelo de linguagem de grande porte padrão, o Jev não se destina a escrever uma resposta um token por vez. Ele avalia perguntas delimitadas e retorna resultados estruturados em paralelo. Isso o torna interessante para classificação, roteamento, pontuação, validação e seleção de ações de agentes — mas não para escrita aberta, programação ou raciocínio em várias etapas. A maneira prática de pensar no Jev não é “um chatbot mais rápido”. É um componente de decisão probabilística que o software pode chamar quando as regras comuns são frágeis demais, mas a geração livre não é necessária. Experimente o Jev Latest no GPTProto Atualização — 23 de setembro de 2026: O Jev Latest agora está disponível por meio do GPTProto. Abra a página do modelo de API do Jev Latest para conferir preços em tempo real e o formato de requisição atual para decisões Choice, Score e Noul.

Michael Johnson | 2026-09-20

5 Melhores APIs para Startups de Tecnologia em 2026: Uma Stack MVP Enxuta

5 Melhores APIs para Startups de Tecnologia em 2026: Uma Stack MVP Enxuta

Uma startup raramente perde seu primeiro mês porque escolheu a marca “errada” de banco de dados. Ela perde o mês nas costuras: permissões incompatíveis, eventos de pagamento que não atualizam assinaturas, chaves de IA vazadas ou e-mails transacionais ausentes. Este é, portanto, um stack prático de APIs para um produto web baseado em assinatura — especialmente um MVP de SaaS de IA — e não um diretório de ferramentas não relacionadas. Meu padrão recomendado é GPTProto para inferência de IA, Supabase para dados e serviços de backend, Stripe para pagamentos e Resend para e-mail transacional . Clerk é a quinta opção, mas é um upgrade, não um requisito, porque o Supabase já inclui autenticação. O stack pode começar sem taxas mensais fixas de plataforma nos serviços que não são de IA, embora chamadas de modelo, pagamentos bem-sucedidos e uso excedente ainda criem custos variáveis. Uma chave para sua equipe Preços e limites de planos neste guia foram verificados em 18 de setembro de 2026. Verifique as páginas dos produtos vinculadas antes de comprometer um orçamento de produção.

Schuyler Stacy | 2026-09-18

O que é GPT-6 Sol? Recursos, Preços, Acesso à API e Testes

O que é GPT-6 Sol? Recursos, Preços, Acesso à API e Testes

GPT-6 Sol é um modelo GPT-6 da OpenAI criado para programação complexa e fluxos de trabalho agênticos , com um preço mais baixo que o GPT-6 Astra. A OpenAI o lançou em 22 de setembro de 2026 , sob o ID público do modelo gpt-6-sol . Agora você pode usar o GPT-6 Sol no GPTProto . Se sua carga de trabalho prioriza throughput e custo em vez de capacidade máxima de programação, o GPT-6 Luna também está disponível no GPTProto . Última verificação: 23 de setembro de 2026. Este guia agora reflete o lançamento oficial, as especificações do modelo, os preços de tabela da OpenAI e a disponibilidade no GPTProto. Preços e acesso podem mudar, então verifique a página do modelo ao vivo antes de migrar o tráfego de produção. Pergunta Resposta verificada O GPT-6 Sol foi lançado? Sim—22 de setembro de 2026 ID público do modelo gpt-6-sol Para que ele foi projetado? Programação complexa e fluxos de trabalho agênticos Janela de contexto 1.050.000 tokens Saída máxima 128.000 tokens Data de corte de conhecimento 20 de abril de 2026 Preço oficial padrão da API $2 / 1M tokens de entrada; $10 / 1M tokens de saída Entrada e saída Entrada de texto e imagem; saída de texto Você pode usá-lo pelo GPTProto? Sim—abra a página do modelo GPT-6 Sol Explore a chave de API do GPT-6 SOL

Michael Johnson | 2026-09-17

As 6 melhores APIs de LLM acessíveis para agentes de IA em 2026

As 6 melhores APIs de LLM acessíveis para agentes de IA em 2026

Uma API de LLM acessível para um agente de IA não é necessariamente o modelo com o preço mais baixo por token de entrada. Um agente pode escolher uma ferramenta, construir argumentos, ler o resultado, revisar seu plano e chamar outra ferramenta antes de produzir uma resposta útil. Um modelo barato que faz chamadas inválidas ou precisa de várias tentativas pode, por isso, custar mais do que um modelo um pouco mais caro que conclui a tarefa de uma só vez. Este guia compara seis modelos prontos para agentes disponíveis através da GPTProto. A classificação considera o preço da API, o uso de ferramentas, evidências independentes de desempenho, velocidade, limites de contexto e o risco prático de pagar por ciclos desnecessários do agente. Trata-se de uma comparação de benchmarks públicos e de preços — não de uma alegação de que realizamos um teste privado frente a frente. Uma Chave para a Sua Equipe Resposta rápida: GLM-5.3 Flash é a opção padrão mais forte para a maioria dos agentes sensíveis a custos. DeepSeek Flash é a alternativa de pesos abertos mais rápida, enquanto GPT-5.6 Luna é uma opção promissora para trabalho leve e de alto volume, assim que o preço de sua rota em tempo real for confirmado. MiniMax M3 é adequado para sessões longas com documentos, Gemini 3.8 Flash lidera em velocidade multimodal, e Grok 4.6 é melhor tratado como um modelo de escalonamento para tarefas mais difíceis.

Michael Johnson | 2026-09-15