Tiffany Layne2026-07-23

什麼是 Qwen 3.8 Max?發布日期、2.4T 預覽版、價格與早期基準測試

Qwen 3.8 Max 詳解:7 月 19 日預覽版發布、2.4T 宣稱、Token Plan 定價、開放權重狀態、基準測試與比較。

什麼是 Qwen 3.8 Max?發布日期、2.4T 預覽版、價格與早期基準測試

 

Qwen 3.8 Max 是阿里巴巴推出的新款 2.4 兆參數中國旗艦模型,但目前可用的版本仍稱為 qwen3.8-max-preview。這個後綴很重要。截至 2026 年 7 月 21 日,阿里巴巴尚未發布正式版模型、技術報告、傳統的按 Token 計價 API 價格或可下載權重。

該預覽版於 7 月 19 日透過阿里巴巴的 Token Plan、Qoder 和 QoderWork 上線。在 官方 Qwen 公告中,團隊表示 Qwen 3.8 將「很快」開放權重,並稱其能力可媲美領先的前沿模型,僅次於 Fable 5。該排名並未附帶公開的基準測試套件或測試方法。

我的簡短看法是:Qwen 3.8 Max 是一個真實且異常有趣的預覽版,而不是已完成的產品發布。開發者應該進行測試、記錄每項結果的日期,並避免根據阿里巴巴尚未公布的規格來規劃正式環境遷移。

 

目錄

Qwen 3.8 Max 一覽

問題 截至 2026 年 7 月 21 日已確認的資訊
官方模型 ID qwen3.8-max-preview
預覽版發布日期 2026 年 7 月 19 日
開發者 Alibaba Qwen
模型定位 全新的 Qwen 旗艦模型;阿里巴巴稱其為最新且能力最強的 Qwen 模型
參數數量 總計 2.4 兆個參數
輸入 根據阿里巴巴的發布資料,支援文字加視覺理解
阿里巴巴列出的主要用途 全端開發、資料分析、辦公流程,以及視覺文件或 UI 分析
存取方式 阿里巴巴 Token Plan、Qoder 和 QoderWork
一般按 Token 計價的 API 價格 尚未發布
上下文視窗 尚未發布
每個 Token 的啟用參數 尚未發布
權重 目前尚未提供;阿里巴巴表示即將發布開放權重版本
正式版發布日期 尚未公布

這份清單比一些早期 Qwen 3.8 Max 報導中的規格表更短,原因很簡單。預覽版模型不會因為在其他 2026 年旗艦模型旁邊看起來合理,就自動具備 100 萬 Token 上下文視窗、特定的混合專家架構,或發布授權。

Qwen 3.8 Max 已經發布了嗎?

是的,以預覽版形式發布;但作為完成的正式版,答案是否定的。

阿里巴巴於 2026 年 7 月 19 日發布了 qwen3.8-max-preview。Qwen Cloud 的文件表示,該模型會在預覽期間持續改進,之後也可能被移除或由正式版本取代。因此,這個端點會持續變動:7 月 21 日進行的測試,可能無法重現一週後的行為。

目前沒有已確認的 Qwen 3.8 Max 正式版發布日期。「很快開放權重」也不是日期。在阿里巴巴發布模型卡、檢查點、授權條款和穩定模型 ID 之前,任何更精確的時間表都只是推測。

這是目前搜尋結果最容易混淆故事的地方。幾個標題把預覽版日期當成完整發布日期。開發者需要分清這兩個日期,因為適合互動式程式設計工作階段的預覽版,不一定適合有版本控管的應用程式後端。

2.4T 參數宣稱代表什麼?

2.4T 這個數字是官方資訊,但它在實際運作上的意義仍然未知。

總參數數量告訴我們檢查點的規模,但不能告訴我們每個 Token 實際啟用多少參數、自託管部署需要多少記憶體,或模型執行速度有多快。這些問題取決於架構、量化、快取、路由和服務堆疊。

Kimi K3 說明了為何這個區別很重要。它被描述為擁有 2.8T 參數的混合專家模型,但每個 Token 只啟用 896 個專家中的 16 個。GLM-5.2公布的總參數約為 753B,每個 Token 啟用約 40B。阿里巴巴尚未披露 Qwen 3.8 Max 對應的啟用參數數量。

因此,2.4T 不是速度基準,也不是成本基準。在技術報告發布之前,應將它視為模型規模的宣傳數字。

Qwen 3.8 Max 是開源的嗎?

目前還不是。阿里巴巴表示 Qwen 3.8 很快就會開放權重。

開放權重和開源並不能互換。開放權重版本會提供可下載的模型權重;而開發者能否修改、重新發布或用於商業用途,則取決於授權條款。阿里巴巴尚未確認將發布哪個 Qwen 3.8 檢查點、是否會是完整的 2.4T Max 模型,或適用哪種授權。

如果目前就需要自託管,GLM-5.2是更明確的選擇:其權重和 MIT 授權已經發布。Qwen 3.8 Max 未來可能成為能力更強的選項,但那是未來的比較,而不是目前可據以部署的事實。

Qwen 3.8 Max 定價:訂閱方案,而非一般 API 費率

阿里巴巴尚未公布 Qwen 3.8 Max Preview 每百萬個輸入/輸出 Token 的標準價格。目前的存取方式是在 Token Plan 中使用 Credits。

個人方案的發布價格如下:

方案 發布價格 標準價格 每 5 小時 Credits 每 7 天 Credits
Lite $6/月 $8/月 700 2,500
Standard $18/月 $25/月 3,000 10,000
Pro $68/月 $80/月 12,000 40,000

這些都是限時發布價格。在預覽期間,Qwen Cloud 表示 Qwen 3.8 Max 消耗的 Credits 最低可為正常速率的 10%。此外,UTC+8 22:00 至 08:00 期間還可享有額外的 Credits 折扣。

但比折扣更重要的是限制。Credits 不是 Token,阿里巴巴也沒有公布簡單的換算方式,讓人可以誠實地比較每百萬個 Token 的價格。Credits 的使用量可能會因模型選擇、推理、快取和工具呼叫而有所不同。

個人 Token Plan 也禁止將其金鑰用於自動化腳本、應用程式後端和非互動式批次工作。它是為互動式程式設計和代理工具而設計。簡單來說,目前的 Qwen 3.8 Max 方案適合評估和輔助開發,但不是面向客戶產品的一般計量式基礎設施。

早期 Qwen 3.8 Max 基準測試顯示了什麼?

阿里巴巴所稱「僅次於 Fable 5」是供應商宣稱。該公司尚未公布相關基準測試的名稱、分數、提示詞、代理設定或評估方法。目前也沒有公開的 Qwen 3.8 技術報告或已建立的獨立排行榜條目。

一項有參考價值的早期測試來自 與 Kimi K3 的配對 StackPerf 比較。兩個模型都檢查了 269 個檔案的凍結副本,並有 60 分鐘時間產出包含引用、遷移步驟、測試和證據記錄的儲存庫級整合設計。報告在審查前已匿名化。

在扣除事實錯誤後,Kimi K3 得分 83/100;Qwen 3.8 Max Preview 得分 80/100。Qwen 的工具使用分數為 9/10,高於 Kimi 的 8/10;它成功完成全部 44 次工具呼叫,並以較少的請求產出更長的報告。Kimi 更快完成,在測試路線中使用的 Token 較少,且更完整地處理了修訂和重新生成。

這是針對某一類長上下文軟體架構工作的可信證據,但不能證明 Kimi K3 整體上更好,也不能證明 Qwen 整體上更好。兩個模型透過不同供應商執行,而路由延遲、快取、發布流量和推理設定都會影響結果。

早期社群觀察同樣好壞參半。在主要的 Hacker News 發布討論中,一名測試者表示,動畫 SVG 任務花費了超過 10 分鐘的推理時間;另一名開發者則表示,該預覽版在程式設計方面運作良好,但仍太新,難以下定論。這些都是個人經驗,不是基準測試,但確實指出了兩項值得在自有測試中測量的指標:得到可用答案所需的時間,以及每個 Token 完成的任務量。

Qwen 3.8 Max 與 Qwen 3.7 Max 比較

Qwen 3.8 Max 看起來在能力範圍上有所提升,但 Qwen 3.7 Max 目前仍是更安全的 API 選擇。

面向 Qwen 3.8 Max Preview Qwen 3.7 Max
狀態 持續更新的預覽版 現有 API 模型
已公布參數 總計 2.4T 不是主要的公開賣點
視覺能力 阿里巴巴表示支援 僅支援文字
上下文 尚未發布 100 萬個 Token
最大輸出 尚未發布 65,536 個 Token
權重 已承諾,但尚未發布 封閉權重
定價 Token Plan Credits;沒有一般 Token 費率 GPT Proto 價格:每 1M 個 Token,輸入 $0.36/輸出 $1.44
正式環境後端使用 個人方案禁止自動化後端使用 傳統計量式 API 存取

我不建議直接將模型字串從 Qwen 3.7 Max 盲目升級到 3.8 預覽版。首先應檢查輸出穩定性、工具結構、延遲、推理 Token 使用量,以及最終正式版模型是否保留預覽版的行為。

如果現在需要為應用程式使用 Qwen API,現有的 Qwen 3.7 Max 端點是實際可行的過渡方案:

curl "https://gptproto.com/v1/chat/completions" \
  -H "Authorization: Bearer $GPTPROTO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.7-max",
    "messages": [
      {
        "role": "user",
        "content": "Review this architecture and list the three highest-risk assumptions."
      }
    ]
  }'

這段程式碼呼叫的是 Qwen 3.7 Max,而不是 Qwen 3.8 Max。這項區別可以避免發布週常見的失敗:為平台並未提供的端點撰寫程式碼。

Qwen 3.8 Max 與 Kimi K3、GLM-5.2 及 Fable 5 比較

這項比較必然不對稱,因為 Qwen 3.8 Max 缺少數項公開規格。

模型 目前測試它的最佳理由 主要取捨
Qwen 3.8 Max Preview 全新的 2.4T Qwen 旗艦模型,具備視覺能力且早期代理測試結果亮眼 持續變動的預覽版,上下文和 Token 價格未知,目前尚無權重
Kimi K3 已發布 2.8T MoE 架構、100 萬多模態上下文,並提供傳統 API 存取 始終開啟的推理可能增加延遲和輸出成本
GLM-5.2 MIT 開放權重、已知的啟用參數、100 萬 Token 上下文,以及較低成本的代理式程式設計 僅支援文字;在部分任務上,整體能力可能落後最新的封閉式預覽模型
Fable 5 Qwen 自身發布宣稱中,針對長期任務所列出的參考對象 價格較高,且 Qwen 尚未公布其比較宣稱的證據

就 Qwen 3.8 Max 與 Kimi K3 的比較而言,目前最佳的公開配對測試給予 Kimi 三分領先,但 Qwen 的工具使用子分數較高。就 Qwen 3.8 Max 與 GLM-5.2 的比較而言,決策重點與其說是未經驗證的品質排名,不如說是部署條件:GLM 目前已有可下載且採用 MIT 授權的權重;Qwen 則沒有。至於 Qwen 3.8 Max 與 Fable 5,目前沒有足夠的公開證據驗證阿里巴巴的排名。

查看完整的 Qwen 3.8 Max 與 Kimi K3 比較

開發者現在應該使用 Qwen 3.8 Max 嗎?

如果你正在評估程式設計代理、多模態文件工作或儲存庫規模的推理,並且能接受預覽版在測試過程中持續變動,那麼現在就可以使用它。請儲存模型 ID、日期、提示詞、工具定義和原始輸出。缺少這些資訊,之後的比較幾乎沒有意義。

如果你需要固定行為、計量式後端價格、已公布的上下文限制或自託管權重,現在不要圍繞它建立正式環境遷移。這個預覽版目前仍未解決這四項需求。

若要進行目前的正式環境工作,請將具代表性的任務交由具備穩定存取方式和已公布限制的模型。GPT Proto 讓你能以相同餘額比較 Qwen 3.7 MaxKimi K3GLM-5.2。你也可以瀏覽 完整模型集合,或從 GPT Proto 首頁開始。

Qwen 3.8 Max 值得持續關注。缺少模型卡,比發布當天的又一個誇大形容更為重要。

創意工作室

使用生產級 API 生成圖像、影片及更多內容。

開始創作
創意工作室
相關模型
全部模型
Z-AI
by Z-AI
10% OFF
Qwen
by Qwen
10% OFF
MoonshotAI
10% OFF
Claude
20% OFF

常見問題

Qwen 3.8 Max 的發布日期是什麼時候?

Qwen3.8-Max-Preview 於 2026 年 7 月 19 日發布。阿里巴巴尚未公布正式版發布日期或開放權重檢查點日期。

Qwen 3.8 Max 是阿里巴巴的新旗艦模型嗎?

是的。阿里巴巴將 Qwen3.8-Max-Preview 描述為 Qwen 家族中最新且能力最強的模型。

Qwen 3.8 Max 有 2.4 兆個參數嗎?

阿里巴巴表示該模型共有 2.4T 個參數。該公司尚未公布啟用參數數量或完整架構,因此不能直接將這個數字換算成推理速度或成本。

Qwen 3.8 Max 是開放權重模型嗎?

目前還沒有。Qwen 表示即將發布開放權重版本,但尚未公布確切檢查點、授權條款或下載日期。

Qwen 3.8 Max 的價格是多少?

目前沒有標準的每百萬個 Token 價格。該預覽版透過阿里巴巴以 Credits 為基礎的 Token Plan 提供,限時個人發布價格最低為每月 6 美元。Credits 沒有已公布的一對一 Token 換算方式。

我可以在應用程式後端使用 Qwen 3.8 Max 嗎?

Qwen Cloud 個人 Token Plan 表示,其金鑰用於互動式程式設計和代理工具,並禁止自動化腳本、應用程式後端和非互動式批次使用。部署前請確認確切方案和端點的條款。

Qwen 3.8 Max 比 Kimi K3 或 GLM-5.2 更好嗎?

目前還沒有足夠廣泛的獨立證據。在一項涉及 269 個檔案的軟體架構測試中,Kimi K3 得分 83/100,Qwen 3.8 Max Preview 得分 80/100,但 Qwen 的工具使用子分數較高。對於自託管而言,GLM-5.2 仍然更容易評估,因為其架構、權重和 MIT 授權都已公開。

相關文章

更多部落格
Kimi K3 是什麼?真的接近 GPT-5.6 與 Fable 5 嗎?

Kimi K3 是什麼?真的接近 GPT-5.6 與 Fable 5 嗎?

TL;DR Kimi K3 是 Moonshot AI 推出的 2.8 兆參數多模態模型,專為長時間跨度的程式設計、知識工作、推理與代理工作流程打造。獨立測試顯示,它整體表現接近 Claude Opus 4.8 與 GPT-5.5,但 GPT-5.6 Sol 和 Claude Fable 5 仍然領先。K3 在代理基準測試中更加接近頂尖模型,並在部分自動化測試中取得領先,但其測得的幻覺率較 K2.6 上升。 Kimi K3 現已開放權重。Moonshot AI 已發布完整模型檢查點、模型卡、技術報告與自訂 Kimi K3 License。官方 Hugging Face 儲存庫由 96 個 safetensors 分片組成,容量約 1.56 TB;Moonshot 建議使用配備 64 個以上加速器的超級節點部署。開放權重解決了所有權問題,但並不代表 K3 成為一般的本地模型。 對大多數開發者而言,託管 API 仍是最實際的起點。目前, GPTProto 上的 Kimi K3 API 列出的價格為每百萬個輸入 token 2.70 美元,以及每百萬個輸出 token 13.50 美元。當資料控管、自訂推論或模型修改的價值足以抵銷基礎設施成本與授權審查時,再選擇模型權重。 簡而言之,Kimi K3 已足夠接近 GPT-5.6 和 Fable 5,足以加入同一場討論—而如今開放權重的發布,也讓開發者擁有一個這兩個閉源模型都不提供的部署選項。

Michael Johnson | 2026-07-28

GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?

GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?

TL;DR: 當任務困難、執行時間長或涉及視覺內容時,Kimi K3 是更強的程式設計模型。在 Moonshot 公開的程式設計比較中,它全面領先 GLM-5.2,並可透過其託管服務接受圖片與影片。對於日常的儲存庫工作,GLM-5.2 仍是更好的預設選擇:成本低得多、運行規模較小,且採用寬鬆的 MIT 授權。Kimi K3 現在也已釋出權重,但其 1.56 TB 儲存庫、建議使用 64 個以上加速器的部署要求,以及自訂授權,意味著自行託管需要投入更多資源。當能力是瓶頸時選擇 Kimi;當成本與日常運營簡易性更重要時選擇 GLM。 GLM-5.2 與 Kimi K3 程式碼比較中有趣的地方,不在於兩個模型都能撰寫 React 元件或解決簡短演算法。這個層級的模型早已具備這些能力。真正有用的問題是,當任務變得複雜時會發生什麼:儲存庫稽核、多檔案遷移、只會在螢幕截圖中出現的錯誤,或必須讓多個系統保持一致的可遊玩 Three.js 原型。 這也是價格差異開始產生影響的地方。Kimi K3 在最困難的公開測試中表現較佳,但其官方輸出價格超過 GLM-5.2 的三倍。每天執行數千次普通審查的團隊,使用 GLM 可能能以每美元完成更多工作。試圖挽救一個棘手視覺專案的開發者,則可能很樂意為 K3 買單。

Tiffany Layne | 2026-07-28

2026 年開發者最佳 AI API:10 個平台比較

2026 年開發者最佳 AI API:10 個平台比較

重點摘要 最佳直接 API: OpenAI 是最安全的通用預設選擇;Anthropic Claude 最適合程式碼開發與長時間執行的代理;Gemini 適合低成本多模態原型開發;DeepSeek 則在文字 Token 價格方面領先。 最佳多模型選項: OpenRouter 是測試多種 LLM 的清晰選擇。當單一產品需要透過一個 API 金鑰和共用餘額使用文字、圖片與影片模型時,GPTProto 更為合適。 最佳基礎架構選擇: Amazon Bedrock 適合受 AWS 管理的企業部署;Replicate、fal.ai 與 Together AI 則更適合開放模型或生成式媒體推理。 沒有適用於所有情境的唯一贏家。請比較工作負載適配度、模型涵蓋範圍、實際計費單位、生產環境控制能力與切換成本。價格與可用性已於 2026 年 7 月 14 日確認;部署前請查看供應商的即時頁面。

Tiffany Layne | 2026-07-15

MiniMax M3 程式設計:基準測試、實際定價,以及如何透過 API 呼叫(2026)

MiniMax M3 程式設計:基準測試、實際定價,以及如何透過 API 呼叫(2026)

MiniMax M3 適合程式設計嗎?簡短答案是:對代理式和多檔案工作來說適合,但有兩個注意事項,我會在你繼續讀下去前先坦白說明。大多數熱門的程式設計評分都是 MiniMax 在自家基礎架構上執行的,而所謂的「100 萬 token 上下文」在 512K 處有一道價格門檻,尤其會影響程式設計代理。只要知道這些限制,兩者都可以妥善處理。可惜大多數發布報導都沒有清楚呈現這些資訊。 我寫這篇文章,是因為圍繞 M3 的程式設計宣傳被簡化成一個數字 — SWE-Bench Pro 的 59% — 而這個數字承擔了太多未經檢視的解讀。接下來我會說明這個模型實際上是什麼、獨立測量結果落在哪裡、在真實程式設計工作負載下的成本,以及如何透過 GPTProto API 呼叫它。如果你只想知道結論:一位對所有嚴肅模型都執行相同測試組合的獨立評測者認為,M3「在實際程式設計上接近 GPT 和 Opus,但還沒有超越它們」。這也符合中立基準測試的結果。

Schuyler Stacy | 2026-07-02