Claude Opus 5 是 Anthropic 針對複雜代理式程式設計、專業分析與企業知識工作推出的 Opus 級模型。它是 Claude Opus 4.8 的後繼版本,在保留相同官方 token 價格的同時,提升了處理困難、多步驟任務的效能。
Anthropic Claude Opus 5 API 接受文字與影像輸入,並輸出文字。其 1M token context window 預設即可使用,不需要透過獨立的長 context beta。模型最多可產生 128K 個輸出 token,因此適合大型程式碼變更、詳細技術報告、文件轉換,以及需要大量推理與工具互動的代理執行。
| 規格 | Claude Opus 5 |
| 提供者 | Anthropic |
| API 模型 ID | claude-opus-5 |
| 輸入模態 | 文字與影像 |
| 輸出模態 | 文字 |
| Context window | 1,000,000 tokens |
| 最大輸出 | 128,000 tokens |
| 推理 | 預設啟用自適應思考 |
| 運算量控制 | 低、中、高、xhigh 與 max |
| 可靠知識截止日期 | 2026 年 5 月 |
| Prompt cache 最低值 | 512 tokens |
| GPTProto 費率 | $4 輸入 / $20 輸出(每 1M tokens) |
| 官方基準費率 | $5 輸入 / $25 輸出(每 1M tokens) |
Claude Opus 5 適用於真實開發者工作的哪些領域
大型儲存庫軟體工程
Claude Opus 5 的用途不僅限於獨立的程式碼補全。適合的任務包括跨服務追蹤錯誤、實作多檔案功能、審查 pull request、現代化舊版模組、產生測試,以及在回傳結果前於瀏覽器中檢查應用程式。
長時間執行的代理工作流程
模型可以規劃、呼叫工具、檢查中間結果,並持續完成多階段任務。它支援子代理協作,因此適合將研究、實作與驗證分配給專門代理的工作流程。
這並不代表每個代理都應在 Opus 5 上執行。實際的路由策略應保留 Opus 5 處理模糊、高影響或對失敗敏感的工作,同時將可預測的轉換與輕量請求交給成本較低的模型。
文件、試算表與專業分析
除了程式設計之外,Claude Opus 5 也為以文件為主的企業任務而設計。範例包括比較合約、檢查財務模型、分析研究檔案、將來源資料轉換為結構化報告,以及編輯複雜的試算表或簡報內容。
大型 Context Review
1M-token context window 可容納大量程式碼、文件、對話記錄或多個來源檔案。但 context 容量本身不代表一定能回想起所有內容,因此重要需求仍應清楚陳述,並在具代表性的工作負載上進行評估。
Claude Opus 5 與 Opus 4.8、Fable 5 及 GPT-5.6 Sol 的比較
Claude Opus 5 位於高性價比前沿模型與最昂貴的長時間代理模型之間。正確的選擇取決於任務完成度、延遲、修正工作量與 token 總用量,而不只是基準測試排名。
| 因素 | Claude Opus 5 | Claude Opus 4.8 | Claude Fable 5 | GPT-5.6 Sol |
| 提供者 | Anthropic | Anthropic | Anthropic | OpenAI |
| Context window | 1M | 1M | 1M | 1.05M |
| 最大輸出 | 128K | 128K | 128K | 128K |
| 官方輸入/輸出費率 | $5 / $25 | $5 / $25 | $10 / $50 | $5 / $30 |
| 推理行為 | 預設啟用自適應思考 | 可使用自適應思考,但預設未啟用 | 始終啟用自適應思考 | 推理運算量從無到 max |
| 最適用途 | 複雜程式設計、代理與企業工作 | 現有且經過驗證的 Opus 整合 | Anthropic 最高能力的代理工作 | 程式設計、瀏覽、工具與專業交付成果 |
| 主要取捨 | 成本高於中階模型 | 行為較舊且能力較低 | 官方 Opus 5 token 價格的兩倍 | 官方輸出價格高於 Opus 5 |
GPTProto 以每百萬輸入/輸出 token $4/$20 的價格提供 Claude Opus 5,比 Anthropic 列出的基準費率低 20%。
當任務需要 Opus 級推理,但不足以支持 Fable 5 官方 $10/$50 token 費率時,請選擇 Claude Opus 5。只有在現有工作流程已經過仔細驗證,且遷移風險比新模型帶來的提升更重要時,才繼續使用 Opus 4.8。
Claude Opus 5 與 GPT-5.6 Sol 之間的選擇較為接近。GPT-5.6 Sol 擁有稍大的 context window 與原生 OpenAI 工具,而 Opus 5 的官方輸出 token 價格較低,並且專門定位於複雜的代理式程式設計。在將正式流量路由至其中一個模型前,請先使用相同的真實任務比較兩者。
如何評估 Claude Opus 5 用於正式工作
不要只根據每 token 費率評判 Claude Opus 5。如果需要額外提示、重試、人工修正或失敗的工具呼叫,即使 token 較便宜的模型,總成本仍可能更高。
從 20 到 50 個具代表性的任務建立評估集,並測量:
- 首次嘗試的任務完成度。
- 已接受的程式碼變更或交付成果。
- 重試與人工修正的次數。
- 有效與失敗的工具呼叫。
- 輸入、快取輸入、推理與輸出 token 的總量。
- 取得已接受結果所需的時間。
- 每個已接受任務的成本,而非每個個別請求的成本。
使用相當的指示,對 Claude Opus 4.8、Fable 5 或 GPT-5.6 Sol 執行相同的任務集。這能揭示 Opus 5 更強的代理行為是否確實降低了專案總成本。
從 Claude Opus 4.8 遷移至 Claude Opus 5
遷移不只是將模型 ID 從 claude-opus-4-8 改為 claude-opus-5。
- 思考功能預設已啟用。由於
max_tokens同時涵蓋推理與可見回應 token,因此請求可能需要預留更多輸出空間。 - 不再支援手動設定的延伸思考預算。請改用自適應思考與 effort 參數。
- 完整的 1M-token context window 預設即可使用,因此不需要舊版的長 context beta 標頭。
- 請針對每個 effort 等級重新執行評估。針對 Opus 4.8 調校的設定不應自動沿用。
- 對話中途變更工具需要 beta 標頭。
- 模型層級支援網路搜尋,但 Anthropic 獨立的網頁擷取工具無法在 Opus 5 上使用。
遷移前,請確認您使用的 API gateway 與 SDK 路徑會傳遞應用程式所需的 thinking、effort、tool、caching 與 beta-header 參數。














