Tarifs+7% bonus
Michael Johnson2026-07-27

Qwen 3.8 Max vs Qwen 3.7 Max : quelles nouveautés et lequel les développeurs doivent-ils choisir ?

Comparez Qwen 3.8 Max et Qwen 3.7 Max pour le développement, le contexte, la tarification, la stabilité de l’API et la production. Découvrez pourquoi les développeurs doivent tester 3.8, mais déployer 3.7.

Qwen 3.8 Max vs Qwen 3.7 Max : quelles nouveautés et lequel les développeurs doivent-ils choisir ?

Mis à jour le 7 août 2026 : Qwen3.8-Max est désormais une API de production stable, et non plus une préversion évolutive. La recommandation de cette comparaison a été mise à jour en conséquence.

Qwen3.8-Max est désormais le meilleur choix par défaut pour les nouvelles charges de travail complexes. Il ajoute la compréhension native des images et des vidéos, une architecture MoE documentée de 2,4 T avec 95 Md de paramètres actifs, un meilleur positionnement pour les tâches à long horizon et jusqu’à 128 K tokens en sortie.

Qwen3.7-Max conserve toutefois un avantage décisif : le prix. Sur GPTProto, il coûte actuellement 0,36 $ par million de tokens d’entrée et 1,44 $ par million de tokens de sortie. Il constitue donc une option pratique pour le développement basé uniquement sur le texte, l’analyse de documents et les workflows de production existants qui n’ont pas besoin des améliorations multimodales ou agentiques du nouveau modèle.

Réponse courte : choisissez Qwen3.8-Max pour le nouveau développement complexe, les tâches visuelles et les agents de longue durée. Conservez Qwen3.7-Max lorsque l’efficacité des coûts pour le texte uniquement ou une base de production déjà testée compte davantage que la capacité maximale.

Table des matières

Qwen 3.8 Max vs Qwen 3.7 Max at a Glance

Category Qwen 3.8 Max Qwen 3.7 Max
Status Stable production API Stable production API
Model name qwen3.8-max qwen3.7-max
Release date August 3, 2026 May 19, 2026
Architecture 2.4T MoE, 95B active Not publicly disclosed
Context window Up to 1M tokens Up to 1M tokens
Maximum output Up to 128K tokens Up to 128K tokens in current official listings
Inputs Text, images, and video Text
Thinking Hybrid thinking Thinking supported
Function calling Supported Supported
Official list price $2 input / $6 output per 1M $2.50 / $7.50; temporary $1.25 / $3.75 promotion
GPT Proto access Available now Available now
Best fit Complex coding, visual work, research, long agents Lower-cost text-only production
Open weights Announced; not released as of August 7 Proprietary

The 1M context figure for 3.8 matters because several early explainers still list it as unknown. QwenCloud’s current text-generation model table now lists 1M for both models. That closes one spec gap, but it does not show that 3.8 uses long context more accurately.

What Did Qwen 3.8 Max Actually Upgrade?

In its July 19 announcement, Qwen confirmed the 2.4T parameter count and said open weights would follow. Alibaba’s Qoder release note positions 3.8 as an improvement over 3.7 in coding and professional productivity, especially full-stack development, data analysis, office work, and other long-horizon tasks. A later Qwen update says the preview made a notable step on web frontend work.

Those are useful signals, but they are vendor statements rather than measured head-to-head results. No public table tells us how much better 3.8 is at resolving repository issues, completing tool-driven tasks, or preserving requirements across a long session. The active parameter count is also undisclosed, so the 2.4T headline does not tell developers the model’s serving cost or latency.

The honest upgrade story is therefore narrow: 3.8 targets better execution on the workloads 3.7 already targeted, while adding a larger model and a faster release cadence. It is not a context-window upgrade. It is not a function-calling upgrade. Whether it is a quality upgrade remains a reasonable hypothesis, not a verified result.

There is another cost. Qwen says the preview is improving continuously. That sounds attractive during evaluation, but a moving model complicates regression testing. The same prompt can behave differently after an unannounced update, and a passing test today does not guarantee the same result next week. For production teams, version stability is a feature.

Qwen 3.8 Max vs Qwen 3.7 Max for Coding

Qwen3.7-Max has a straightforward case for repository-scale coding. It accepts up to 1M tokens, supports thinking and tools, and is already callable through a conventional API. Its text-only interface is not a limitation when the agent receives source files, diffs, logs, and tool results as text.

Independent measurements also give us a baseline. Artificial Analysis scores Qwen3.7-Max at 46 on its Intelligence Index. It measured output speed at 202.2 tokens per second and time to first token at 2.62 seconds through Alibaba’s API. Those results will vary by provider and workload, but they are still more useful than a ranking claim without a methodology.

There is a trade-off. Qwen3.7-Max generated 100M output tokens during the Intelligence Index evaluation, compared with a 63M median for models in its comparison group. In plain language: it can be verbose. Fast token generation does not automatically mean a short response or a low total bill, especially when output tokens cost more than input tokens.

Qwen3.8-Max-Preview is more interesting for exploratory frontend and long-running agent work. Qwen specifically called out broad gains in web frontend, and Qoder positions it for full-stack development. I would test it on UI generation, multi-stage debugging, and tasks that mix code with office or data work. I would not move a production coding agent solely because of the model name.

A launch-week r/ClaudeCode discussion drew more than 40 comments. That is a demand signal, not a performance result. Community excitement can tell us which workloads developers care about; without controlled prompts and published outputs, it cannot tell us which model should carry production traffic.

For a fair Qwen 3.8 Max vs Qwen 3.7 Max coding test, keep the repository commit, system prompt, tools, permissions, and success criteria identical. Record tool failures, tests passed, human corrections, wall-clock time, and token use. If any of those inputs differ, the result is a demo—not a comparison.

Performance: Measured Results vs Vendor Claims

Alibaba describes Qwen3.8-Max-Preview as one of the leading frontier models and says it ranks behind only Fable 5 in its internal evaluation. The first half is plausible. The second half is not independently verifiable because Alibaba has not released the benchmark names, scores, prompts, or evaluation procedure behind it.

Evidence Qwen 3.8 Max Qwen 3.7 Max
Vendor positioning Improved coding and Cowork; internal ranking behind Fable 5 Agent-focused flagship for coding, productivity, and long autonomous work
Public benchmark table Not published Available vendor results, plus independent composite testing
Artificial Analysis Intelligence Index No result found as of July 27, 2026 46
Independently measured output speed Not available 202.2 tokens/s through Alibaba’s API
Independently measured TTFT Not available 2.62 seconds through Alibaba’s API
Reproducibility Preview changes during evaluation period More stable released endpoint

This evidence gap does not prove that 3.8 is worse. It means “which is better” has two answers. On expected capability, 3.8 is the likely winner. On demonstrated, reproducible performance, 3.7 currently has the stronger case.

Qwen 3.8 Max vs Qwen 3.7 Max Pricing

Qwen3.8-Max now uses standard pay-as-you-go token pricing. The earlier Preview-era Credits plan is no longer the relevant basis for this comparison.

Pricing Route Qwen 3.8 Max Qwen 3.7 Max
Official input price $2 per 1M tokens $2.50 per 1M tokens
Official output price $6 per 1M tokens $7.50 per 1M tokens
GPT Proto input price $1.80 per 1M tokens $0.36 per 1M tokens
GPT Proto output price $5.40 per 1M tokens $1.44 per 1M tokens

Although Qwen3.8-Max has a lower official list price than Qwen3.7-Max, GPT Proto currently offers a much deeper discount on the older model. On GPT Proto, Qwen3.7-Max costs 80% less for input and about 73% less for output than Qwen3.8-Max.

For example, a workload using 10 million input tokens and 2 million output tokens would cost:

  • Qwen3.8-Max on GPT Proto: 10 × $1.80 + 2 × $5.40 = $28.80

  • Qwen3.7-Max on GPT Proto: 10 × $0.36 + 2 × $1.44 = $6.48

That makes Qwen3.7-Max the clear budget choice for high-volume, text-only workloads. However, Qwen3.8-Max adds native image and video understanding, structured outputs, a longer output ceiling, and stronger positioning for complex coding and long-horizon agents.

The cheapest request is not always the cheapest completed task. Teams should compare first-pass success, retries, tool failures, token usage, and human correction time. Start with Qwen3.8-Max when the new capabilities affect the workflow; keep Qwen3.7-Max when its lower price delivers the better cost per accepted result.

Why There Is No Matched Output Table Here

A side-by-side screenshot would look convincing. It would also be misleading right now.

Qwen3.8-Max-Preview is not available on GPT Proto, and its official documentation says the model can change throughout the preview. Comparing a fresh 3.7 API run with an undated 3.8 screenshot from a different product would mix model versions, infrastructure, tools, and possibly system prompts. I will not label that as a controlled test.

The publication-quality test is simple: run the same repository task against both models on the same day, preserve the full prompt and tool trace, and publish the raw outputs alongside the judgment criteria. Until that run exists, the absence of a sample is more honest than a decorative winner badge.

Which Model Should You Choose?

Your Priority Better Choice Why
Best overall Qwen capability Qwen 3.8 Max New flagship with stronger coding, visual, research, and long-horizon positioning
Complex repository or agent work Qwen 3.8 Max Designed for longer autonomous execution and closed-loop tool workflows
Image, video, or visual-document input Qwen 3.8 Max 3.7 Max is text-only
Lowest GPT Proto text-token cost Qwen 3.7 Max $0.36 input and $1.44 output per 1M tokens
Existing regression-tested application Keep 3.7 until validated A stable release still needs workload-specific migration testing
New application starting today Start with 3.8 There is no longer a preview-status reason to default to 3.7
Self-hosting today Neither 3.7 is proprietary; 3.8 weights are announced but not yet downloadable

The old recommendation—“ship 3.7 and only evaluate 3.8”—no longer fits the product state.

For new work, start the evaluation with Qwen3.8-Max on GPT Proto. Keep Qwen3.7-Max when its much lower token price or an existing validated baseline produces a better cost per accepted task.

Try Qwen 3.8 Max Through GPT Proto

Qwen3.8-Max is now available through GPT Proto’s OpenAI-compatible API.

export GPTPROTO_API_KEY="your_api_key_here"

curl https://gptproto.com/v1/chat/completions \
  -H "Authorization: Bearer $GPTPROTO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-max",
    "messages": [
      {
        "role": "system",
        "content": "Inspect the existing implementation before proposing changes. Preserve current API contracts and list the verification steps for every edit."
      },
      {
        "role": "user",
        "content": "Review this repository architecture and identify the three highest-risk assumptions."
      }
    ]
  }'

The Python version uses the official OpenAI client:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["GPTPROTO_API_KEY"],
    base_url="https://gptproto.com/v1",
)

response = client.chat.completions.create(
    model="qwen3.7-max",
    messages=[
        {
            "role": "system",
            "content": (
                "You are a senior software engineer. Return the smallest "
                "safe patch and explain each changed file."
            ),
        },
        {
            "role": "user",
            "content": (
                "Review this function for correctness and propose a tested fix: "
                "def divide_total(total, count): return total / count"
            ),
        },
    ],
)

print(response.choices[0].message.content)

The SDK adds the Bearer authorization header. Switching to another compatible model only requires changing the model string; keep a separate evaluation set so a convenient swap does not become an untested production change.

A Safe Upgrade Checklist

Start by saving a 3.7 baseline from your real workload, not a synthetic coding puzzle. Preserve the prompt, repository state, tools, expected output, latency, and token usage. Then run the same package against 3.8 Preview and inspect failures, not only the best-looking answer.

Set the migration threshold before seeing the result. For example, require the new model to pass the same tests with no increase in tool errors and no unacceptable cost change. Re-run the evaluation after major preview updates. Finally, wait for a stable model identifier and a published price before moving traffic that carries an uptime or budget commitment.

This process is less exciting than switching on launch day. It is also how you keep a model upgrade from becoming an incident.

Final Verdict

Qwen3.8-Max is now the better default Qwen model for new complex workloads. The stable API removes the largest objection in the original comparison, while multimodal input and stronger long-horizon behavior give it a broader capability ceiling.

Qwen3.7-Max is not obsolete. Its GPT Proto price makes it a strong text-only production model, especially when a workload is already tested and does not benefit from vision or extended autonomous execution.

Start new evaluations with Qwen3.8-Max. Keep 3.7 where it wins on cost per accepted task—not simply because it was released earlier.

Une clé, davantage de modèles d’IA

Accédez à des modèles d’IA de premier plan à un prix abordable grâce à une API compatible OpenAI unique.

Parcourir les modèles d’API
Une clé, davantage de modèles d’IA
Modèles associés
Tous les modèles
Qwen
by Qwen
10% OFF
Qwen
by Qwen
10% OFF
OpenAI
20% OFF
Claude
10% OFF

Questions fréquemment posées

Quelle est l’amélioration apportée par Qwen 3.8 Max par rapport à Qwen 3.7 Max ?

Qwen présente 3.8 comme une amélioration pour le développement, le développement full-stack, l’analyse de données, les workflows bureautiques et les tâches à long horizon. Il dispose également de 2,4 T de paramètres au total. Les deux modèles proposent déjà un contexte de 1 M, le raisonnement, les appels de fonctions et des outils intégrés ; l’amélioration annoncée concerne donc principalement la qualité d’exécution plutôt qu’une nouvelle fonctionnalité d’API.

Qwen 3.8 Max est-il meilleur que Qwen 3.7 Max pour le développement ?

Probablement sur certaines charges de travail, mais cette conclusion n’a pas encore été mesurée indépendamment. Qwen fait état de progrès dans le frontend et le développement, tandis que 3.7 dispose aujourd’hui de preuves publiques plus solides. Testez 3.8 pour les nouveaux développements ; conservez 3.7 en production jusqu’à la stabilisation de la préversion.

Qwen 3.8 Max dispose-t-il d’une fenêtre de contexte de 1 M ?

Oui. Le tableau actuel des modèles de génération de texte de QwenCloud indique une fenêtre de contexte de 1 M pour Qwen3.8-Max-Preview et Qwen3.7-Max.

Combien coûte Qwen 3.8 Max ?

Il n’existe pas encore de prix autonome par token. Le modèle est disponible via Token Plan et l’accès basé sur les crédits Qoder. Token Plan propose actuellement des forfaits individuels à durée limitée à 6 $, 18 $ et 68 $ par mois, mais ces abonnements couvrent plusieurs modèles et ne peuvent pas être comparés directement à la tarification par token de 3.7.

Qwen 3.8 Max est-il open source ?

Pas aujourd’hui. Qwen indique que les poids ouverts arriveront prochainement, mais aucun poids, aucune date de sortie ni aucune licence n’ont été publiés. Qwen3.7-Max est propriétaire.

Qwen 3.8 Max est-il disponible sur GPTProto ?

Oui. GPTProto propose actuellement Qwen3.8-Max.

Quel modèle les développeurs doivent-ils choisir ?

Choisissez Qwen3.7-Max pour un accès stable en production, des données de performance indépendantes et des coûts de tokens prévisibles. Évaluez Qwen3.8-Max-Preview pour le frontend, Cowork et les tâches agentiques longues, puis réévaluez la migration lorsque Alibaba publiera une version stable, un tableau de benchmarks et un prix par token.

Articles associés

Plus de blogs
Qwen 3.8 Max vs GLM 5.2 : lequel est le meilleur pour coder en 2026 ?

Qwen 3.8 Max vs GLM 5.2 : lequel est le meilleur pour coder en 2026 ?

Mis à jour le 7 août 2026 : Qwen3.8-Max est désormais une API de production stable et est disponible via GPTProto. La recommandation de déploiement datant de la période Preview a été mise à jour. En bref Choisissez Qwen3.8-Max lorsque la capacité hébergée maximale, les entrées multimodales, le développement frontend, l’analyse visuelle ou l’exécution d’agents sur de longues séquences sont prioritaires. Choisissez GLM-5.2 lorsque le coût inférieur des tokens, les poids sous licence MIT, l’auto-hébergement ou un déploiement ouvert et reproductible sont plus importants. Les deux modèles disposent désormais d’un accès API stable. GLM n’est plus la seule option de production. Le tarif officiel de Qwen est de 2 $/M en entrée et 6 $/M en sortie. GPTProto affiche actuellement GLM-5.2 à 1,26 $/M en entrée et 3,96 $/M en sortie. Qwen est le meilleur choix si la priorité est la capacité. GLM est le meilleur choix en matière de coût et de contrôle.

Michael Johnson | 2026-07-22

Qwen 3.8 Max vs Kimi K3 : lequel est prêt pour le vrai travail de programmation ?

Qwen 3.8 Max vs Kimi K3 : lequel est prêt pour le vrai travail de programmation ?

Mise à jour — 28 juillet 2026 : Moonshot AI a désormais publié les poids complets de Kimi K3, sa fiche modèle, sa licence personnalisée et son rapport technique. Cette publication répond à la question de la disponibilité du côté de Kimi. Elle ne rend pas pour autant un modèle de 2,8 billions de paramètres facile à auto-héberger : le dépôt officiel fait environ 1,56 To et Moonshot recommande des déploiements sur supernœuds avec au moins 64 accélérateurs. Qwen 3.8 Max vs Kimi K3 ressemble à un duel sans ambiguïté entre deux modèles d’IA chinois géants : l’aperçu d’Alibaba de 2,4 billions de paramètres face au modèle phare de Moonshot AI de 2,8 billions de paramètres. Les chiffres invitent à une conclusion simple. Le modèle le plus grand devrait l’emporter. Ce n’est pas ce que montrent les éléments disponibles, et ce n’est pas la comparaison la plus utile pour les développeurs. Au 23 juillet 2026, Qwen 3.8 Max reste un aperçu en évolution distribué via le Token Plan d’Alibaba. Kimi K3 dispose déjà d’une API documentée, de tarifs publiés par jeton, d’une fenêtre de contexte d’un million de jetons et d’un calendrier daté pour la publication de ses poids complets. L’écart de capacités pourrait être faible. L’écart de maturité produit ne l’est pas. Mon avis est simple : Kimi K3 est le choix le plus sûr si vous devez créer et budgétiser une véritable application aujourd’hui. Qwen 3.8 Max Preview mérite d’être testé dans un flux de travail de programmation, notamment tant que les Credits promotionnels d’Alibaba rendent l’expérimentation peu coûteuse, mais il n’a pas encore fourni suffisamment d’informations stables pour s’imposer dans une décision de production. En bref : Kimi K3 est le choix de production le plus sûr aujourd’hui Choisissez Kimi K3 si vous avez besoin d’une API conventionnelle, de coûts prévisibles par jeton, d’une compréhension native des images et des vidéos, ou d’un modèle que vous pouvez intégrer dès maintenant à un produit destiné aux clients. Choisissez Qwen 3.8 Max Preview si vous utilisez déjà l’écosystème de programmation d’Alibaba et souhaitez tester un nouveau modèle prometteur à faible coût promotionnel. Le seul test détaillé de programmation comparatif disponible au moment de la publication a attribué 83 points à Kimi K3 et 80 à Qwen 3.8 Max. Cet écart de trois points constitue un élément utile, pas un classement universel. Qwen a montré des frontières système plus nettes et une exécution parfaite des outils lors du test ; Kimi a géré plus complètement l’historique des révisions et la régénération. Les deux modèles ont également formulé des déductions non étayées qui ont nécessité une correction factuelle. En clair : Kimi remporte actuellement la décision de déploiement. Qwen n’a pas perdu le concours des capacités ; il est simplement trop tôt pour déclarer qu’il l’a remporté.

Schuyler Stacy | 2026-07-28

Meilleure API d’IA pour les développeurs en 2026 : comparaison de 10 plateformes

Meilleure API d’IA pour les développeurs en 2026 : comparaison de 10 plateformes

TL;DR Best direct APIs: OpenAI is the safest general-purpose default; Anthropic Claude is strongest for coding and long-running agents; Gemini suits low-cost multimodal prototyping; and DeepSeek leads on text-token price. Best multi-model options: OpenRouter is the clearest choice for testing many LLMs. GPTProto is the stronger fit when one product needs text, image, and video models under one API key and shared balance. Best infrastructure choices: Amazon Bedrock fits AWS-governed enterprise deployments, while Replicate, fal.ai, and Together AI are better suited to open-model or generative-media inference. There is no universal winner. Compare workload fit, model coverage, real billing units, production controls, and switching cost. Prices and availability were checked on July 14, 2026; verify live provider pages before deployment.

Tiffany Layne | 2026-07-15

Qu’est-ce que Qwen 3.8 Max ? Lancement, spécifications, tarifs et poids ouverts

Qu’est-ce que Qwen 3.8 Max ? Lancement, spécifications, tarifs et poids ouverts

Mis à jour le 7 août 2026 : Alibaba a officiellement lancé la version de production de Qwen3.8-Max le 3 août, remplaçant l’ancien modèle qwen3.8-max-preview comme modèle phare actuel de son API. Cet article a été mis à jour avec l’architecture confirmée, la fenêtre de contexte, les tarifs, la disponibilité de l’API et le calendrier des poids ouverts. Qwen3.8-Max est le modèle Qwen le plus performant d’Alibaba à ce jour : un modèle multimodal Sparse Mixture-of-Experts doté de 2,4 billions de paramètres au total et de 95 milliards de paramètres actifs par requête. Le modèle stable prend en charge les entrées texte, image et vidéo, produit des sorties textuelles et offre une fenêtre de contexte allant jusqu’à 1 million de tokens, avec jusqu’à 128 k tokens en sortie. Il est conçu pour le codage complexe, l’analyse visuelle, la recherche, les travaux professionnels et les tâches d’agents à long horizon. Ce lancement change également la réponse pratique pour les développeurs. Qwen3.8-Max n’est plus limité à un aperçu susceptible d’évoluer ni à un forfait personnel exclusivement basé sur les crédits. Il dispose désormais d’une API normale à la consommation, Alibaba l’affichant à 2 $ par million de tokens d’entrée et 6 $ par million de tokens de sortie. Il est également disponible via l’ API Qwen 3.8 Max sur GPTProto . En bref : Qwen 3.8 Max est un aperçu réel et particulièrement intéressant, et non un lancement de produit finalisé. Les développeurs devraient le tester, noter la date de chaque résultat et éviter de planifier des migrations en production autour de spécifications qu’Alibaba n’a pas encore publiées.

Tiffany Layne | 2026-07-23