重點摘要:
GPT-5.4 是 OpenAI 最新的模型,將推理、程式設計與桌面控制整合於一體。它在大多數基準測試中優於 GPT-5.2,支援 100 萬 token 的上下文視窗,現在也可透過 GPT Proto 等平台以更低的 API 費率使用。
GPT-5.4 是 OpenAI 最新的 AI 模型,將進階推理、程式設計與內建電腦使用功能整合於一體。了解最新功能、它與 GPT-5.2 的比較,以及如何透過 GPT Proto 以實惠價格使用。

GPT-5.4 是 OpenAI 最新的模型,將推理、程式設計與桌面控制整合於一體。它在大多數基準測試中優於 GPT-5.2,支援 100 萬 token 的上下文視窗,現在也可透過 GPT Proto 等平台以更低的 API 費率使用。
OpenAI 已推出 GPT-5.4,這是其迄今功能最強大的模型,並同時推出專為最具挑戰性任務打造的 Pro 版本。目前 Plus、Team 和 Pro 使用者可在 ChatGPT 中使用,亦可透過 API 使用。這次發布代表 AI 在日常專業工作上的能力向前邁進了一大步。GPT-5.4 是 OpenAI 首個內建電腦使用功能(Computer Use)的通用模型,這表示它能像真實使用者一樣與桌面互動,而不只是生成文字。

本指南涵蓋以下內容:
GPT-5.4 的實際定義,以及它與 GPT-5.2 的差異
寫作、程式設計與推理方面的關鍵效能提升
全新的電腦使用與視覺理解功能
GPT-5.4 如何處理長篇文件與大型程式碼庫
GPT-5.4 與 GPT-5.4 Pro 在 ChatGPT 和 API 中的定價
如何透過 GPT Proto 以實惠價格使用 GPT-5.4
GPT-5.4 不只是上一版本的小幅更新。它整合了過去分屬不同模型的三項能力:通用推理、程式設計能力與電腦使用。在此版本推出前,需要這三項能力的開發者必須在不同的專用模型之間分配請求。現在則有了一個統一的選項。
此模型支援 100 萬 token 的上下文視窗,單次回應最多可輸出 128,000 個 token。其知識截止日期為 2025 年 8 月 31 日。
過去這些能力分屬不同工具或模型變體。GPT-5.4 將它們整合至單一 API 端點:
通用推理與寫作 — 包括文件撰寫、分析與問答
程式碼生成與除錯 — 繼承自 GPT-5.3-Codex 的能力
電腦使用 — 透過螢幕截圖與滑鼠/鍵盤輸入直接控制桌面環境
這種整合讓建構 AI 應用程式變得更加容易,尤其適合需要透過單一整合點(例如 GPT Proto)存取靈活多用途模型的開發者。
| 基準測試 | GPT-5.2 | GPT-5.4 | GPT-5.4 Pro |
| ARC-AGI-2 | 52.90% | 73.30% | 83.30% |
| GPQA Diamond | — | 92.80% | — |
| FrontierMath Tier 4 | 18.80% | 27.10% | 38.00% |
| 人類最後的考試(無工具) | — | 39.80% | — |
| BrowseComp | 65.80% | 82.70% | 89.30% |
| OSWorld-Verified | 47.30% | 75.00% | — |
ARC-AGI-2 在所有基準測試中展現了最大幅度的提升,標準模型從 52.9% 提升至 73.3%,Pro 則達到 83.3%。這項測試衡量抽象模式識別能力,而這一直是語言模型較難處理的領域。
一項值得注意的退步是:GPT-5.4 在 HealthBench 上的得分略低於 GPT-5.2(62.6% 對 63.3%)。OpenAI 在系統卡中公開了這項結果,而不是淡化它,這一點值得注意。
GPT-5.4 Thinking 目前正陸續向 Plus、Team 和 Pro 訂閱者推出,並將取代 GPT-5.2 Thinking 成為預設模型。GPT-5.2 Thinking 將在「舊版」區段中保留至 2026 年 6 月 5 日。免費使用者可能透過自動路由使用 GPT-5.4,但無法手動選取。
以下是不同版本 API 定價的比較:
| 模型 | 輸入(每 100 萬 token) | 輸出(每 100 萬 token) |
| gpt-5.2 | $1.75 | $14.00 |
| gpt-5.4 | $2.50 | $15.00 |
| gpt-5.2 Pro | $21.00 | $168.00 |
| gpt-5.4 Pro | $30.00 | $180.00 |
以下是一些需要了解的事項:
Batch 與 Flex 處理可享半價
優先處理的費率是標準費率的 2 倍
單一工作階段中超過 272K token 的請求,整個工作階段的輸入將按 2 倍計費,輸出則按 1.5 倍計費
區域資料駐留處理將額外增加 10%
GPT-5.4 Pro 的價格是標準版本的 12 倍。不過,基準測試顯示兩者各有不同優勢。標準版本在 GDPval 上的得分其實略高(83.0% 對 82.0%),而 Pro 版本在深度網路研究與複雜代理任務方面表現更佳。
GPT-5.4 延續 GPT-5.3-Codex 的程式設計優勢,同時提升了在長時間、多步驟程式設計工作階段中專注於任務的能力。
在以真實 GitHub 問題為基礎的 SWE-Bench Pro 上,GPT-5.4 得分為 57.7%,GPT-5.2 則為 55.6%。在測試命令列操作的 Terminal-Bench 2.0 上,GPT-5.4 得分為 75.1%(GPT-5.3-Codex 在這項特定測試中以 77.3% 略勝一籌,這是值得注意的小幅退步)。
Codex 的新功能:/fast 模式可在不改變底層模型的情況下,將 token 生成速度提升最多 1.5 倍。此外還有實驗性的 Playwright Interactive 模式,讓 Codex 在建立網頁或桌面應用程式時啟動即時瀏覽器視窗,以便在開發過程中進行即時視覺測試。
如果你想透過 Codex 或 Claude Code 等工具,使用 GPT-5.4 進行程式設計專案,GPT Proto 支援直接 API 整合,並提供相較於 OpenAI 公開定價更優惠的價格。
OpenAI 以 GDPval 進行 GPT-5.4 測試。這是一項內部基準測試,旨在模擬美國九大經濟產業中 44 種職業類別的真實工作。任務包括建立試算表、撰寫簡報、安排日程、製作圖表等。

GPT-5.4 在 GDPval 上得分 83.0%。GPT-5.2 則為 70.9%。對於高度貼近專業人士實際工作內容的任務而言,這代表提升了 12 個百分點。
OpenAI 另外針對辦公生產力任務進行了測試:
在旨在模擬投資銀行分析工作的試算表建模測試中,GPT-5.4 得分為 87.3%,GPT-5.2 則為 68.4%,提升了 19 個百分點。
在盲測簡報比較中,人類評審有 68% 的時間偏好 GPT-5.4 的輸出,並指出其圖片運用更佳、視覺版面配置更加多樣。
隨著模型一同推出的還有 ChatGPT for Excel 外掛程式,以及 Codex 和 API 中用於試算表與簡報生成的更新版技能套件。

GPT-5.4 目前是 OpenAI 事實準確度最高的模型。OpenAI 使用一組過去曾被真實使用者標記為含有錯誤的提示進行測試,發現 GPT-5.4 產生錯誤個別主張的頻率比 GPT-5.2 低 33%,完整回應中至少包含一項錯誤的頻率則低 18%。
這是本次發布中最重要的新增功能之一。GPT-5.4 在 OSWorld-Verified 上得分 75.0%,這項基準測試衡量模型透過螢幕截圖控制真實桌面環境的能力。同一測試中的人類基準為 72.4%。GPT-5.4 已在此任務上超越人類水平的表現。

開發者可以透過兩種方式使用此能力:
以螢幕截圖驅動的控制 — 模型接收螢幕截圖,並輸出滑鼠座標與鍵盤指令以操作介面
透過程式碼進行瀏覽器自動化 — 模型撰寫 Playwright 指令碼,以程式化方式控制瀏覽器,適合表單填寫、資料輸入與網頁測試
此功能可透過標準 API 直接使用內建的 computer 工具。不需要特殊的模型路由。你也可以設定確認政策,在模型執行高風險操作前要求人類核准。
對於建立代理工作流程或自動化工具的團隊而言,GPT Proto 等平台可讓你透過統一 API,以具競爭力的價格輕鬆存取 GPT-5.4 的電腦使用能力。
GPT-5.4 引入了更智慧的方式來處理大型工具庫。過去,每次 API 呼叫都必須包含所有可用工具的完整定義;當設定的工具很多時,這種做法成本高昂。現在,模型採用檢索方式:它會先查看可用工具的簡短清單,然後擷取實際需要使用的工具之完整定義。
在 MCP Atlas 基準測試的工具密集型任務中,單是這項變更就讓 token 使用量減少了 47%,且沒有降低準確度。GPT-5.4 在該基準測試中的得分為 67.2%,高於 GPT-5.2 的 60.6%。
在測試網路研究與多頁資訊檢索能力的 BrowseComp 上,GPT-5.4 得分為 82.7%,Pro 變體則為 89.3%,兩者都遠高於 GPT-5.2 的 65.8%。
你可以直接在 GPT Proto 的網路搜尋介面中試用 GPT-5.4 的網路搜尋與研究能力;該介面也支援檔案查詢,可在 GPT Proto 的檔案分析頁面中使用。
如果 OpenAI 的直接 API 定價感覺過高,尤其是對需要大量執行或建立正式環境應用程式的團隊而言,GPT Proto AI API 平台提供了一個實用的替代方案。GPT Proto 是統一的 AI API 平台,整合了包括 GPT-5.4 在內的頂尖模型存取權,提供折扣費率;對於 GPT 模型而言,價格通常比市場價格低 30% 至 40%。

開發者不必為每個供應商管理不同的 API 金鑰,只需連線至 GPT Proto 一次,即可透過單一標準化 API 端點存取 GPT-5.4 及數百個其他模型。平台採用智慧路由與自動故障轉移,因此當供應商發生停機時,你的請求會在不中斷的情況下重新導向。
GPT Proto 也支援 GPT-5.4 的多模態功能。你可以在 GPT Proto 的圖片轉文字頁面中探索圖片轉文字處理,這對文件分析、高解析度螢幕截圖處理,以及視覺理解十分重要的電腦使用工作流程尤其有用。
對於已經同時使用多種 AI 工具,或認為目前供應商的價格與可靠性難以預測的個人和團隊而言,GPT Proto 提供了一種穩定且具成本效益的方式,讓你在沒有供應商綁定或長期合約的情況下建構於 GPT-5.4 之上。
GPT-5.4 是 OpenAI 最新的模型,作為 GPT-5.2 的升級版推出。主要差異在於,GPT-5.4 具備原生電腦使用能力(可透過螢幕截圖控制桌面軟體),在大多數專業與推理基準測試中得分更高,並將程式設計、推理與視覺控制整合至單一模型,而不再需要為每項能力使用不同工具。
它能查看電腦螢幕的螢幕截圖,然後傳送滑鼠點擊與鍵盤輸入來操作軟體。這適用於網頁瀏覽器、桌面應用程式及表單工作流程。開發者可透過標準 API 使用此功能,不需要另外使用專用模型。
標準 GPT-5.4 模型的費用為每 100 萬個輸入 token $2.50,以及每 100 萬個輸出 token $15.00。GPT-5.4 Pro 的費用高出許多,每 100 萬個輸入 token 為 $30.00,每 100 萬個輸出 token 為 $180.00。GPT Proto 等平台透過統一 API 以較低費率提供 GPT-5.4 存取權。
GPT-5.4 Thinking 開放給 ChatGPT Plus、Team 和 Pro 訂閱者使用。Enterprise 與 Education 使用者可由管理員啟用。免費使用者可能透過自動路由遇到此模型,但無法手動選擇。GPT-5.4 Pro 僅限 Pro 與 Enterprise 帳戶使用。
GPT-5.4 是一次意義重大的升級,尤其適合需要在單一工作流程中進行推理、程式設計並與軟體互動的使用者。其電腦使用功能在 OSWorld 上超越人類基準,是一項真正重要的里程碑。試算表處理、程式碼生成與長上下文處理方面的改進都十分實用,且有完整文件記錄。
其價格高於 GPT-5.2,但對大多數專業使用情境而言,效能提升足以抵銷成本。如果你希望在不犧牲模型存取權的情況下控制成本,GPT Proto 值得探索,作為進入 GPT-5.4 生態系統的更實惠入口。

介紹 2026 年 2 月 26 日,Google DeepMind 低調推出了 Nano Banana 2 — 而 AI 社群立即注意到它。發布後數小時內,它便登上 Arena 文字轉圖像排行榜首位,以 1,279 分擊敗 GPT-image-1 和 Nano Banana Pro。其官方技術名稱為 Gemini 3.1 Flash Image (也稱為 Gemini 3.1 Flash Image Preview)。 對於需要大規模快速生成高品質圖像的開發者、設計師和內容創作者而言,Nano Banana 2 回答了一個懸而未決一段時間的問題:能否在不受 Pro 等級速度限制與成本影響的情況下,獲得 Pro 等級的圖像品質?事實證明,答案是可以。
Tiffany Layne | 2026-03-05

重點摘要 Seedance 2.0 是 ByteDance 強大的全新 AI 影片模型,能原生生成具電影感的片段與音訊。其推出引發 Disney 及其他好萊塢片商因版權疑慮而發出的停止侵權與禁止令函。開發者目前可透過 GPT Proto 等平台使用較早期的 Seedance 版本,Seedance 2.0 API 支援即將推出。
Tiffany Layne | 2026-02-26

AI 影片的新標準 ByteDance 正式透過推出 Seedance 2.0 ,重新定義了生成式媒體的格局。這個模型的能力遠遠超越前代版本,提供電影級的 15 秒影片片段、原生 2K 解析度,以及複雜的多模態輸入功能,吸引創作者與開發者排隊等候存取。不論你是希望為複雜打鬥場景製作分鏡的電影製作人,還是希望透過 GPT Proto 尋找可靠 Seedance 2.0 API 解決方案的開發者,本指南都會為你解析這項業界新巨頭的一切重要資訊。
Tiffany Layne | 2026-02-25