Preços+7% bônus
Michael Johnson2026-07-27

Qwen 3.8 Max vs Qwen 3.7 Max: O que mudou e qual deles os desenvolvedores devem escolher?

Compare o Qwen 3.8 Max com o Qwen 3.7 Max em codificação, contexto, preço, estabilidade de API e uso em produção. Veja por que os desenvolvedores devem testar o 3.8, mas implantar o 3.7.

Qwen 3.8 Max vs Qwen 3.7 Max: O que mudou e qual deles os desenvolvedores devem escolher?

Atualizado em 7 de agosto de 2026: O Qwen3.8-Max agora é uma API de produção estável, não uma prévia em constante mudança. A recomendação desta comparação foi atualizada de acordo.

O Qwen3.8-Max agora é a opção padrão mais forte para novas cargas de trabalho de alta complexidade. Ele adiciona compreensão nativa de imagens e vídeos, uma arquitetura MoE documentada de 2,4T com 95B parâmetros ativos, melhor posicionamento para tarefas de longo horizonte e até 128K de saída.

O Qwen3.7-Max ainda tem uma vantagem convincente: o preço. No GPTProto, ele custa atualmente US$ 0,36 por milhão de tokens de entrada e US$ 1,44 por milhão de tokens de saída. Isso o torna uma opção prática para codificação somente de texto, análise de documentos e fluxos de produção existentes que não precisam dos novos recursos multimodais ou de agente do modelo.

Resposta curta: escolha o Qwen3.8-Max para novas tarefas complexas de codificação, trabalho visual e agentes de longa duração. Mantenha o Qwen3.7-Max quando a eficiência de custo somente de texto ou uma linha de base de produção já testada for mais importante do que a capacidade máxima.

Índice

Qwen 3.8 Max vs Qwen 3.7 Max em resumo

Categoria Qwen 3.8 Max Qwen 3.7 Max
Status API de produção estável API de produção estável
Nome do modelo qwen3.8-max qwen3.7-max
Data de lançamento 3 de agosto de 2026 19 de maio de 2026
Arquitetura 2.4T MoE, 95B ativos Não divulgado publicamente
Janela de contexto Até 1M de tokens Até 1M de tokens
Saída máxima Até 128K de tokens Até 128K de tokens nas listagens oficiais atuais
Entradas Texto, imagens e vídeos Texto
Raciocínio Raciocínio híbrido Raciocínio suportado
Chamada de função Suportado Suportado
Preço oficial $2 de entrada / $6 de saída por 1M $2,50 / $7,50; promoção temporária de $1,25 / $3,75
Acesso via GPT Proto Disponível agora Disponível agora
Melhor uso Codificação complexa, trabalho visual, pesquisa, agentes de longa duração Produção de custo mais baixo somente texto
Pesos abertos Anunciado; não lançado até 7 de agosto Proprietário

O número de contexto de 1M do 3.8 é importante porque vários guias iniciais ainda o listam como desconhecido. A tabela atual demodelos de geração de texto da QwenCloud agora lista 1M para ambos os modelos. Isso elimina uma lacuna de especificação, mas não mostra que o 3.8 usa contexto longo com mais precisão.

O que o Qwen 3.8 Max realmente atualizou?

Em seuanúncio de 19 de julho, a Qwen confirmou a contagem de parâmetros de 2,4T e disse que os pesos abertos viriam em seguida. Anota de lançamento do Qoder da Alibaba posiciona o 3.8 como uma melhoria em relação ao 3.7 em codificação e produtividade profissional, especialmente desenvolvimento full-stack, análise de dados, trabalho de escritório e outras tarefas de longo horizonte. Umaatualização da Qwen posterior diz que a prévia deu um passo notável no trabalho de frontend web.

Esses são sinais úteis, mas são declarações do fornecedor, não resultados medidos frente a frente. Nenhuma tabela pública nos diz o quanto o 3.8 é melhor para resolver problemas de repositório, concluir tarefas baseadas em ferramentas ou preservar requisitos ao longo de uma sessão longa. A contagem de parâmetros ativos também não é divulgada; portanto, o título de 2,4T não informa aos desenvolvedores o custo de serviço ou a latência do modelo.

A história honesta da atualização é, portanto, limitada: o 3.8 tem como alvo melhor execução nas cargas de trabalho que o 3.7 já atendia, ao mesmo tempo que adiciona um modelo maior e um ritmo de lançamento mais rápido. Não é uma atualização de janela de contexto. Não é uma atualização de chamada de função. Se é uma atualização de qualidade, isso permanece uma hipótese razoável, não um resultado verificado.

Há outro custo. A Qwen diz que a prévia está melhorando continuamente. Isso parece atraente durante a avaliação, mas um modelo em movimento complica os testes de regressão. O mesmo prompt pode se comportar de forma diferente após uma atualização não anunciada, e um teste aprovado hoje não garante o mesmo resultado na próxima semana. Para equipes de produção, estabilidade de versão é um recurso.

Qwen 3.8 Max vs Qwen 3.7 Max para codificação

O Qwen3.7-Max tem um caso direto para codificação em escala de repositório. Ele aceita até 1M de tokens, suporta raciocínio e ferramentas e já pode ser chamado por uma API convencional. Sua interface somente texto não é uma limitação quando o agente recebe arquivos-fonte, diffs, logs e resultados de ferramentas como texto.

Medições independentes também nos dão uma linha de base. AArtificial Analysis dá ao Qwen3.7-Max nota 46 em seu Índice de Inteligência. Ela mediu a velocidade de saída em 202,2 tokens por segundo e o tempo até o primeiro token em 2,62 segundos pela API da Alibaba. Esses resultados variam conforme o provedor e a carga de trabalho, mas ainda são mais úteis do que uma alegação de ranking sem metodologia.

Há um trade-off. O Qwen3.7-Max gerou 100M de tokens de saída durante a avaliação do Índice de Inteligência, contra uma mediana de 63M para os modelos do seu grupo de comparação. Em linguagem simples: ele pode ser verboso. Geração rápida de tokens não significa automaticamente uma resposta curta ou uma conta total baixa, especialmente quando os tokens de saída custam mais do que os de entrada.

O Qwen3.8-Max-Preview é mais interessante para trabalho exploratório de frontend e agentes de longa duração. A Qwen destacou especificamente ganhos amplos em frontend web, e o Qoder o posiciona para desenvolvimento full-stack. Eu o testaria em geração de UI, depuração em múltiplas etapas e tarefas que misturam código com trabalho de escritório ou dados. Eu não moveria um agente de codificação em produção apenas por causa do nome do modelo.

Na semana de lançamento, umadiscussão r/ClaudeCode atraiu mais de 40 comentários. Isso é um sinal de demanda, não um resultado de desempenho. O entusiasmo da comunidade pode nos dizer quais cargas de trabalho os desenvolvedores consideram importantes; sem prompts controlados e resultados publicados, não pode nos dizer qual modelo deve carregar o tráfego de produção.

Para um teste justo de codificação entre o Qwen 3.8 Max e o Qwen 3.7 Max, mantenha idênticos o commit do repositório, o prompt do sistema, as ferramentas, as permissões e os critérios de sucesso. Registre falhas de ferramentas, testes aprovados, correções humanas, tempo decorrido e uso de tokens. Se qualquer um desses insumos for diferente, o resultado é uma demonstração—não uma comparação.

Desempenho: resultados medidos vs. alegações do fornecedor

A Alibaba descreve o Qwen3.8-Max-Preview como um dos principais modelos de fronteira e diz que ele fica atrás apenas do Fable 5 em sua avaliação interna. A primeira parte é plausível. A segunda parte não é verificável de forma independente, porque a Alibaba não divulgou os nomes dos benchmarks, pontuações, prompts ou procedimento de avaliação por trás dela.

Evidência Qwen 3.8 Max Qwen 3.7 Max
Posicionamento do fornecedor Codificação e Cowork aprimorados; classificação interna atrás do Fable 5 Principal modelo focado em agentes para codificação, produtividade e trabalho autônomo de longa duração
Tabela pública de benchmarks Não publicada Resultados disponíveis do fornecedor, além de testes compostos independentes
Índice de Inteligência da Artificial Analysis Nenhum resultado encontrado até 27 de julho de 2026 46
Velocidade de saída medida de forma independente Não disponível 202,2 tokens/s pela API da Alibaba
TTFT medido de forma independente Não disponível 2,62 segundos pela API da Alibaba
Reprodutibilidade A prévia muda durante o período de avaliação Endpoint lançado mais estável

Essa lacuna de evidências não prova que o 3.8 é pior. Isso significa que “qual é melhor” tem duas respostas. Na capacidade esperada, o 3.8 é o provável vencedor. No desempenho demonstrado e reproduzível, o 3.7 tem atualmente o caso mais forte.

Preços do Qwen 3.8 Max vs Qwen 3.7 Max

O Qwen3.8-Max agora usa o preço padrão de tokens pré-pago (pay-as-you-go). O antigo plano de créditos da era Preview não é mais a base relevante para esta comparação.

Modalidade de preço Qwen 3.8 Max Qwen 3.7 Max
Preço oficial de entrada $2 por 1M de tokens $2,50 por 1M de tokens
Preço oficial de saída $6 por 1M de tokens $7,50 por 1M de tokens
Preço de entrada no GPT Proto $1,80 por 1M de tokens $0,36 por 1M de tokens
Preço de saída no GPT Proto $5,40 por 1M de tokens $1,44 por 1M de tokens

Embora o Qwen3.8-Max tenha um preço oficial mais baixo que o Qwen3.7-Max, o GPT Proto oferece atualmente um desconto muito maior no modelo mais antigo. No GPT Proto, o Qwen3.7-Max custa 80% menos para entrada e cerca de 73% menos para saída do que o Qwen3.8-Max.

Por exemplo, uma carga de trabalho que usa 10 milhões de tokens de entrada e 2 milhões de tokens de saída custaria:

  • Qwen3.8-Max no GPT Proto: 10 × $1.80 + 2 × $5.40 = $28.80

  • Qwen3.7-Max no GPT Proto: 10 × $0.36 + 2 × $1.44 = $6.48

Isso torna Qwen3.7-Max a escolha clara de orçamento para cargas de trabalho de alto volume e somente texto. No entanto, Qwen3.8-Max adiciona compreensão nativa de imagens e vídeos, saídas estruturadas, um teto de saída maior e um posicionamento mais forte para codificação complexa e agentes de longo horizonte.

A solicitação mais barata nem sempre é a tarefa concluída mais barata. As equipes devem comparar sucesso na primeira tentativa, repetições, falhas de ferramentas, uso de tokens e tempo de correção humana. Comece com o Qwen3.8-Max quando os novos recursos afetarem o fluxo de trabalho; mantenha o Qwen3.7-Max quando seu preço mais baixo entregar o melhor custo por resultado aceito.

Por que não há uma tabela de saídas comparadas aqui

Uma captura de tela lado a lado pareceria convincente. Também seria enganosa neste momento.

O Qwen3.8-Max-Preview não está disponível no GPT Proto, e sua documentação oficial diz que o modelo pode mudar durante a prévia. Comparar uma execução recente da API do 3.7 com uma captura de tela sem data do 3.8 de um produto diferente misturaria versões de modelo, infraestrutura, ferramentas e possivelmente prompts de sistema. Não vou rotular isso como um teste controlado.

O teste de qualidade publicável é simples: execute a mesma tarefa de repositório em ambos os modelos no mesmo dia, preserve o prompt completo e o rastro das ferramentas e publique as saídas brutas junto com os critérios de julgamento. Até que essa execução exista, a ausência de uma amostra é mais honesta do que um selo decorativo de vencedor.

Qual modelo você deve escolher?

Sua prioridade Melhor escolha Por quê
Melhor capacidade geral da Qwen Qwen 3.8 Max Novo principal modelo com posicionamento mais forte em codificação, recursos visuais, pesquisa e tarefas de longo horizonte
Trabalho complexo em repositório ou com agentes Qwen 3.8 Max Projetado para execução autônoma mais longa e fluxos de ferramentas em loop fechado
Entrada de imagens, vídeos ou documentos visuais Qwen 3.8 Max O 3.7 Max é somente texto
Menor custo de tokens de texto no GPT Proto Qwen 3.7 Max $0,36 de entrada e $1,44 de saída por 1M de tokens
Aplicação existente com testes de regressão Mantenha o 3.7 até a validação Um lançamento estável ainda precisa de testes de migração específicos para a carga de trabalho
Nova aplicação começando hoje Comece com o 3.8 Não há mais um motivo de status de prévia para usar o 3.7 por padrão
Self-hosting hoje Nenhum O 3.7 é proprietário; os pesos do 3.8 foram anunciados, mas ainda não podem ser baixados

A antiga recomendação—“envie o 3.7 e apenas avalie o 3.8”—não se encaixa mais no estado do produto.

Para trabalho novo, comece a avaliação com Qwen3.8-Max no GPT Proto. Mantenha o Qwen3.7-Max quando seu preço de token muito menor ou uma linha de base validada existente produzir um melhor custo por tarefa aceita.

Experimente o Qwen 3.8 Max pelo GPT Proto

O Qwen3.8-Max agora está disponível por meio da API compatível com OpenAI do GPT Proto.

export GPTPROTO_API_KEY="your_api_key_here"

curl https://gptproto.com/v1/chat/completions \
  -H "Authorization: Bearer $GPTPROTO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-max",
    "messages": [
      {
        "role": "system",
        "content": "Inspecione a implementação existente antes de propor alterações. Preserve os contratos de API atuais e liste as etapas de verificação para cada edição."
      },
      {
        "role": "user",
        "content": "Revise a arquitetura deste repositório e identifique as três premissas de maior risco."
      }
    ]
  }'

A versão em Python usa o cliente oficial da OpenAI:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["GPTPROTO_API_KEY"],
    base_url="https://gptproto.com/v1",
)

response = client.chat.completions.create(
    model="qwen3.7-max",
    messages=[
        {
            "role": "system",
            "content": (
                "Você é um engenheiro de software sênior. Retorne o menor "
                "patch seguro e explique cada arquivo alterado."
            ),
        },
        {
            "role": "user",
            "content": (
                "Revise esta função para verificar a correção e proponha uma correção testada: "
                "def divide_total(total, count): return total / count"
            ),
        },
    ],
)

print(response.choices[0].message.content)

O SDK adiciona o cabeçalho de autorização Bearer. Trocar para outro modelo compatível só exige mudar a string do modelo; mantenha um conjunto de avaliação separado para que uma troca conveniente não se torne uma mudança de produção não testada.

Checklist para uma atualização segura

Comece salvando uma linha de base do 3.7 a partir da sua carga de trabalho real, não de um quebra-cabeça de codificação sintético. Preserve o prompt, o estado do repositório, as ferramentas, a saída esperada, a latência e o uso de tokens. Depois, execute o mesmo pacote contra o 3.8 Preview e inspecione as falhas, não apenas a resposta de melhor aparência.

Defina o limite de migração antes de ver o resultado. Por exemplo, exija que o novo modelo passe nos mesmos testes sem aumento de erros de ferramentas e sem mudança de custo inaceitável. Rode novamente a avaliação após atualizações importantes da prévia. Por fim, espere por um identificador de modelo estável e um preço publicado antes de mover tráfego que carrega um compromisso de disponibilidade ou orçamento.

Este processo é menos empolgante do que migrar no dia do lançamento. Também é assim que você evita que uma atualização de modelo vire um incidente.

Veredito final

O Qwen3.8-Max agora é o melhor modelo Qwen padrão para novas cargas de trabalho complexas. A API estável remove a maior objeção da comparação original, enquanto a entrada multimodal e o comportamento de horizonte longo mais forte dão a ele um teto de capacidade mais amplo.

O Qwen3.7-Max não está obsoleto. Seu preço no GPT Proto o torna um forte modelo de produção somente texto, especialmente quando uma carga de trabalho já foi testada e não se beneficia de visão ou execução autônoma estendida.

Comece novas avaliações com Qwen3.8-Max. Mantenha o 3.7 onde ele vence no custo por tarefa aceita—não simplesmente porque foi lançado antes.

Uma chave, mais modelos de IA

Descubra acesso acessível aos principais modelos de IA por meio de uma única API compatível com OpenAI.

Explorar modelos de API
Uma chave, mais modelos de IA
Modelos relacionados
Todos os modelos
Qwen
by Qwen
10% OFF
Qwen
by Qwen
10% OFF
OpenAI
20% OFF
Claude
10% OFF

Perguntas frequentes

Qual é a atualização do Qwen 3.7 Max para o Qwen 3.8 Max?

A Qwen posiciona o 3.8 como uma melhoria em codificação, desenvolvimento full-stack, análise de dados, fluxos de escritório e tarefas de longo horizonte. Ele também tem 2,4T de parâmetros totais. Ambos os modelos já oferecem contexto de 1M, raciocínio, chamada de função e ferramentas integradas; portanto, a atualização reivindicada é principalmente qualidade de execução, e não um novo recurso de API.

O Qwen 3.8 Max é melhor que o Qwen 3.7 Max para codificação?

Provavelmente em algumas cargas de trabalho, mas essa conclusão ainda não foi medida de forma independente. A Qwen relata ganhos em frontend e codificação, enquanto o 3.7 tem as evidências públicas mais fortes hoje. Teste o 3.8 para novos desenvolvimentos; mantenha o 3.7 em produção até a prévia se estabilizar.

O Qwen 3.8 Max tem janela de contexto de 1M?

Sim. A tabela atual de modelos de geração de texto da QwenCloud lista uma janela de contexto de 1M para o Qwen3.8-Max-Preview e o Qwen3.7-Max.

Quanto custa o Qwen 3.8 Max?

Ainda não há um preço individual por token. Ele está disponível pelo Token Plan e pelo acesso baseado em créditos do Qoder. O Token Plan lista atualmente níveis individuais por tempo limitado a US$ 6, US$ 18 e US$ 68 por mês, mas essas assinaturas cobrem vários modelos e não podem ser comparadas diretamente com o preço por token do 3.7.

O Qwen 3.8 Max é open source?

Hoje não. A Qwen diz que os pesos abertos estão chegando em breve, mas nenhum peso, data de lançamento ou licença foi publicado. O Qwen3.7-Max é proprietário.

O Qwen 3.8 Max está disponível no GPTProto?

Sim. O GPTProto oferece atualmente o Qwen3.8-Max.

Qual modelo os desenvolvedores devem escolher?

Escolha o Qwen3.7-Max para acesso de produção estável, dados de desempenho independentes e custos previsíveis de tokens. Avalie o Qwen3.8-Max-Preview para tarefas de frontend, Cowork e agentes de longa duração e reconsidere a migração quando a Alibaba publicar uma versão estável, uma tabela de benchmarks e um preço por token.

Artigos relacionados

Mais blogs
Qwen 3.8 Max vs GLM 5.2: Qual é melhor para programação em 2026?

Qwen 3.8 Max vs GLM 5.2: Qual é melhor para programação em 2026?

Atualizado em 7 de agosto de 2026: O Qwen3.8-Max agora é uma API de produção estável e está disponível por meio do GPTProto. A recomendação de implantação da era Preview foi atualizada. Resumo Escolha o Qwen3.8-Max quando a capacidade máxima hospedada, entrada multimodal, desenvolvimento frontend, análise visual ou execução de agentes em tarefas de longa duração forem mais importantes. Escolha o GLM-5.2 quando o menor custo por token, os pesos licenciados sob MIT, a hospedagem própria ou uma implantação aberta e reproduzível forem mais importantes. Agora, ambos os modelos têm acesso estável à API. O GLM não é mais a única opção de produção. O preço oficial do Qwen é de US$ 2/M para entrada e US$ 6/M para saída. Atualmente, o GPTProto lista o GLM-5.2 a US$ 1,26/M para entrada e US$ 3,96/M para saída. O Qwen é a opção mais forte quando a prioridade é capacidade. O GLM é a opção mais forte quando o foco é custo e controle.

Michael Johnson | 2026-07-22

Qwen 3.8 Max vs Kimi K3: qual está pronto para trabalho de programação real?

Qwen 3.8 Max vs Kimi K3: qual está pronto para trabalho de programação real?

Atualização — 28 de julho de 2026: a Moonshot AI publicou agora os pesos completos do Kimi K3, o cartão do modelo, a licença personalizada e o relatório técnico. O lançamento resolve a questão da disponibilidade do lado do Kimi. Isso não torna fácil hospedar um modelo com 2,8 trilhões de parâmetros por conta própria: o repositório oficial tem cerca de 1,56 TB, e a Moonshot recomenda implantações em supernós com 64 ou mais aceleradores. Qwen 3.8 Max vs Kimi K3 parece uma disputa direta entre dois enormes modelos chineses de IA: a prévia de 2,4 trilhões de parâmetros da Alibaba contra o modelo principal de 2,8 trilhões de parâmetros da Moonshot AI. Os números sugerem uma conclusão simples. O modelo maior deveria vencer. Não é isso que as evidências disponíveis mostram, e essa não é a comparação mais útil para desenvolvedores. Em 23 de julho de 2026, o Qwen 3.8 Max ainda é uma prévia em evolução distribuída pelo Token Plan da Alibaba. O Kimi K3 já tem uma API documentada, preços de tokens publicados, uma janela de contexto de 1 milhão de tokens e um plano datado para o lançamento de seus pesos completos. A diferença de capacidade pode ser pequena. A diferença de prontidão do produto não é. Meu julgamento é direto: o Kimi K3 é a escolha mais segura se você precisa criar e orçar uma aplicação real hoje. O Qwen 3.8 Max Preview vale ser testado em um fluxo de trabalho de programação, especialmente enquanto os Créditos promocionais da Alibaba tornam a experimentação barata, mas ainda não forneceu informações estáveis suficientes para vencer uma decisão de produção. Resumo: Kimi K3 é a escolha mais segura para produção hoje Escolha o Kimi K3 se precisar de uma API convencional, custos previsíveis por token, compreensão nativa de imagens e vídeos ou um modelo que possa colocar agora por trás de um produto voltado ao cliente. Escolha o Qwen 3.8 Max Preview se já usa o ecossistema de programação da Alibaba e quer testar um novo modelo promissor a baixo custo promocional. O único teste detalhado de programação comparativo disponível no momento da publicação deu ao Kimi K3 uma pontuação de 83 e ao Qwen 3.8 Max uma pontuação de 80. Essa diferença de três pontos é uma evidência útil, não uma classificação universal. O Qwen mostrou limites de sistema mais claros e execução impecável de ferramentas no teste; o Kimi lidou de forma mais completa com o histórico de revisões e a regeneração. Ambos também fizeram inferências sem suporte que exigiram correção factual. Em termos simples: o Kimi atualmente vence a decisão de implantação. O Qwen não perdeu a disputa de capacidade; simplesmente é cedo demais para declarar que venceu.

Schuyler Stacy | 2026-07-28

Melhor API de IA para Desenvolvedores em 2026: 10 Plataformas Comparadas

Melhor API de IA para Desenvolvedores em 2026: 10 Plataformas Comparadas

TL;DR Melhores APIs diretas: OpenAI é a opção padrão mais segura para uso geral; Anthropic Claude é a mais forte para programação e agentes de longa duração; Gemini é adequada para prototipagem multimodal de baixo custo; e DeepSeek lidera em preço por token de texto. Melhores opções multimodelo: OpenRouter é a escolha mais clara para testar vários LLMs. GPTProto é mais indicada quando um produto precisa de modelos de texto, imagem e vídeo sob uma única chave de API e um saldo compartilhado. Melhores opções de infraestrutura: Amazon Bedrock é adequada para implantações empresariais regidas pela AWS, enquanto Replicate, fal.ai e Together AI são mais indicadas para inferência de modelos abertos ou de mídia generativa. Não existe um vencedor universal. Compare a adequação à carga de trabalho, a cobertura de modelos, as unidades reais de cobrança, os controles de produção e o custo de migração. Os preços e a disponibilidade foram verificados em 14 de julho de 2026; confirme as páginas atuais dos provedores antes da implantação.

Tiffany Layne | 2026-07-15

O que é o Qwen 3.8 Max? Lançamento, especificações, preços e pesos abertos

O que é o Qwen 3.8 Max? Lançamento, especificações, preços e pesos abertos

Atualizado em 7 de agosto de 2026: A Alibaba lançou oficialmente a versão de produção do Qwen3.8-Max em 3 de agosto, substituindo o anterior qwen3.8-max-preview como o atual modelo de API principal. Este artigo foi atualizado com a arquitetura confirmada, a janela de contexto, os preços, a disponibilidade da API e o cronograma dos pesos abertos. O Qwen3.8-Max é o modelo Qwen mais avançado da Alibaba até o momento: um modelo multimodal Sparse Mixture-of-Experts com 2,4 trilhões de parâmetros totais e 95 bilhões de parâmetros ativos por solicitação. O modelo estável aceita entradas de texto, imagem e vídeo, produz texto como saída e oferece uma janela de contexto de até 1 milhão de tokens, com até 128 mil tokens de saída. Ele foi projetado para programação complexa, análise visual, pesquisa, trabalho profissional e tarefas de agentes de longa duração. O lançamento também muda a resposta prática para desenvolvedores. O Qwen3.8-Max não está mais limitado a uma versão de prévia sujeita a alterações nem a um plano pessoal exclusivo de Créditos. Agora ele conta com uma API normal de pagamento conforme o uso, com a Alibaba anunciando US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. Ele também está disponível por meio da API do Qwen 3.8 Max no GPTProto . Minha opinião resumida: o Qwen 3.8 Max é uma prévia real e excepcionalmente interessante, não um lançamento de produto concluído. Os desenvolvedores devem testá-lo, registrar a data de cada resultado e evitar planejar migrações para produção com base em especificações que a Alibaba ainda não publicou.

Tiffany Layne | 2026-07-23