GPT Proto

GPTProto

  • 儀表板
  • LLM

    • deepseek
      DeepSeek Flash新功能
    • z-ai
      GLM 5.3
    • claude
      Claude Fable 5
    • deepseek
      DeepSeek v4 Pro
    • google
      Gemini 3.7 Flash
    • grok
      Grok 4.6
    探索模型 >

    影像

    • openai
      GPT Image 2.5 Sunburst新功能
    • openai
      GPT Image 2
    • google
      Nano Banana Pro (Gemini 3 Pro Image)
    • google
      Nano Banana 2 (Gemini 3.1 Flash Image)
    • midjourney
      Midjourney
    • openai
      GPT Image 2.5 Flare
    探索模型 >

    影片

    • minimax
      Minimax H3新功能
    • bytedance
      Seedance 2.5 (Build 260628)
    • bytedance
      Seedance 2.0 (Build 260128)
    • bytedance
      Seedance 2.0 Mini (Build 260615)
    • kling
      Kling v3.0 4k
    • vidu
      Vidu Q3 Turbo
    探索模型 >
    探索 232+ 種模型 >
  • 生成器

    • 建立圖片
    • 建立影片
    • 在畫布中編輯
    • 聊天

    功能

    • AI 貓跳舞影片生成器新功能
    • 無限制 AI 影片生成器
    • AI 包裝設計生成器
    • 動漫 AI 藝術生成器
    • AI 物件移除器
    • AI 圖片編輯器
    • AI 動作轉移
    • AI 浮水印移除工具
    • 線上 AI 圖片增強器
    • 線上背景移除工具
    探索全部 >

    提示詞

    • Seedance 2.0 提示詞新功能
    • GPT Image 2 提示詞
    • Nano Banana Pro 提示詞
    • Seedream 5.0 Pro 提示詞
    • Midjourney 提示詞
  • AI 部落格

    • OpenRouter 與 GPTProto:定價、模型、路由,以及 2026 年哪個 API 更好?
    • AI 產品廣告工作流程:從洗衣精圖片到 25 秒廣告片
    • DeepSeek V4 Pro 與 GLM 5.2:2026 年哪個更好?
    • 2026 年 7 款最佳影像編輯 AI 模型:API、批次編輯與產品照片
    • DeepSeek V4 Pro 與 Kimi K3:0813 更新後有何變化?
    探索全部 >

    AI 洞察

    • DeepSeek 尖峰定價已上線:API 何時費用更高?
    • 什麼是 GLM-5.3?Z.ai 悄然推出的程式設計方案、價格與已確認的升級
    • 什麼是 OpenAI 最新的 Astra 模型?發布日期、基準測試與比較(2026)
    • MiniMax H3 正式登場:其影片編輯升級實際帶來哪些改變
    • 什麼是 Emochi AI?以及它為什麼成長得這麼快?(2026)
    探索全部 >

    AI 文件

    • gpt-image-2
    • gpt-5.4
    • kimi-k2.5
    • claude-opus-4-6
    • kling-v3.0-pro
    探索全部 >

    AI 技能

    • browser-use
    • claude-to-im
    • competitive-ads-extractor
    • content-creator
    • data-storytelling
    探索全部 >
定價+7% 贈送
English繁體中文한국어日本語EspañolРусский
立即開始
  1. 首頁
  2. /模型
  3. /Grok
  4. /grok-2-image
Grok
Grok 2 Image
$ 
Grok 4 Image 是 xAI 推出的前沿多模態模型。它結合精準的視覺推理與即時資訊存取能力,能在 128k 上下文視窗中,以業界領先的準確度解讀複雜圖表、OCR 資料與 UI 設計。

模態

輸入: 文字
輸出: 圖像

API 呼叫範例
Submit a Request
$ 
curl --request POST "https://gptproto.com/v1/images/generations" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "grok-2-image",
    "prompt": "a cat.",
    "n": 1
  }'
Grok 2 Image 定價

先從單次樣本成本開始,再選擇測試預算。GPTProto 費率比標價低 40%。

你的用量

$0.042 / 張

相關模型
所有模型
Grok 2 Image
目前
$ 
byGrok$0.042 / 每次
GPT Image 2.5 Sunburst
$ 
byOpenAI$7.6/M input$28.5/M output
GPT Image 2.5 Flare
$ 
byOpenAI$7.6/M input$28.5/M output
Grok Imagine Image 2.0
$ 
byGrok$0.04 / 每次1K · 2K · more
Seedream 5.0 Pro (Build 260628)
$ 
byBytedance$0.0405 / 每次1K · 2K
Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
$ 
byGoogle$0.0202 / 每次1K
Nano Banana 2 (Gemini 3.1 Flash Image)
$ 
byGoogle$0.0402 / 每次1K · 2K · 4K
GPT Image 2
$ 
byOpenAI$6.4/M input$24/M output
Nano Banana 2 (Gemini 3.1 Flash Image)
$ 
byGoogle$0.0402 / 每次1K · 2K · 4K
Seedream 5.0 (Build 260128)
$ 
byBytedance$0.0298 / 每次
Doubao Seedream 5.0 (Build 260128)
$ 
byBytedance$0.0298 / 每次
Grok Imagine Image
$ 
byGrok$0.012 / 每次
Kling Image o1
$ 
byKling$0.0224 / 每次
Grok Imagine 0.9
$ 
byGrok$0.135 / 每次
Grok 4 Image
$ 
byGrok$0.042 / 每次
Image Watermark Remover
$ 
byGPTProto$0.01 / 每次
Image Zoom
$ 
byGPTProto$0.02 / 每次
Qwen Image
$ 
byQwen$0.0315 / 每次
Flux Kontext Max
$ 
byFlux$0.064 / 每次
Flux Kontext Pro
$ 
byFlux$0.032 / 每次
Ideogram Reframe v3
$ 
byIdeogram$0.048 / 每次
Ideogram Edit v3
$ 
byIdeogram$0.048 / 每次
Ideogram Remix v3
$ 
byIdeogram$0.048 / 每次
Midjourney
$ 
byMidjourney$0.0608 / 每次
模型解析度輸入 → 輸出
Grok 2 Image目前
$ 
$0.04 / 每次—
輸入: 文字
輸出: 圖像
GPT Image 2.5 Sunburst
$ 
$7.60 / $28.50 每 1M—
輸入: 文字輸入: 圖像
輸出: 圖像
GPT Image 2.5 Flare
$ 
$7.60 / $28.50 每 1M—
輸入: 文字輸入: 圖像
輸出: 圖像
Grok Imagine Image 2.0
$ 
—$0.04 / 每次1K · 2K · more
輸入: 文字輸入: 圖像
輸出: 圖像
Seedream 5.0 Pro (Build 260628)
$ 
$0.04 / 每次1K · 2K
輸入: 文字輸入: 圖像
輸出: 圖像
Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
$ 
$0.02 / 每次1K
輸入: 文字輸入: 圖像
輸出: 圖像
Nano Banana 2 (Gemini 3.1 Flash Image)
$ 
$0.04 / 每次1K · 2K · 4K
輸入: 文字輸入: 圖像
輸出: 圖像
GPT Image 2
$ 
$6.40 / $24.00 每 1M—
輸入: 文字輸入: 圖像
輸出: 圖像
Nano Banana 2 (Gemini 3.1 Flash Image)
$ 
$0.04 / 每次1K · 2K · 4K
輸入: 文字輸入: 圖像
輸出: 圖像
Seedream 5.0 (Build 260128)
$ 
$0.03 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Doubao Seedream 5.0 (Build 260128)
$ 
$0.03 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Grok Imagine Image
$ 
$0.01 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Kling Image o1
$ 
$0.02 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Grok Imagine 0.9
$ 
—$0.14 / 每次—
輸入: 文字
輸出: 圖像
Grok 4 Image
$ 
$0.04 / 每次—
輸入: 文字
輸出: 圖像
Image Watermark Remover
$ 
—$0.01 / 每次—
輸入: 圖像
輸出: 圖像
Image Zoom
$ 
—$0.02 / 每次—
輸入: 圖像
輸出: 圖像
Qwen Image
$ 
$0.03 / 每次—
輸入: 文字
輸出: 圖像
Flux Kontext Max
$ 
$0.06 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Flux Kontext Pro
$ 
$0.03 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像
Ideogram Reframe v3
$ 
$0.05 / 每次—
輸入: 圖像
輸出: 圖像
Ideogram Edit v3
$ 
$0.05 / 每次—
輸入: 圖像
輸出: 圖像
Ideogram Remix v3
$ 
$0.05 / 每次—
輸入: 文字
輸出: 圖像
Midjourney
$ 
$0.06 / 每次—
輸入: 文字輸入: 圖像
輸出: 圖像

grok 4 image 的主要功能

探索讓 grok 4 image 成為多模態 AI 領域領導者的技術能力。

頂尖視覺推理

在 MMMU 等基準測試中達到或超越 GPT-4o,擅長解讀圖表、科學圖表以及複雜的視覺邏輯。

高保真 OCR

能精準從密集文件、手寫筆記和低對比度的環境照片中擷取文字,準確度極高。

空間智慧

在辨識物件相對位置,以及估算 2D 畫面內物件尺寸等幾何任務中表現出色。

視覺轉程式碼

能有效地將 UI 線框圖或草圖轉換為功能完整的 React、Tailwind 或 Python 程式碼,加速快速原型開發。

grok 4 image 常見問題:您需要知道的一切

取得關於使用 grok 4 image 執行視覺任務的常見問題解答,包括定價、遷移和即時功能。

grok 4 image 如何處理即時新聞?

grok 模型獨特地整合了 X 資料流。這讓它能在當前全球事件的背景下解讀圖片——例如突發新聞照片或符號——提供其他因知識截止日期較早而無法匹敵的視覺模型所不能提供的洞察。這項整合讓 grok 成為時間敏感型分析和社群媒體監控的絕佳選擇,因為相關情境每分鐘都可能改變。

grok 視覺任務的上下文視窗是多少?

此模型支援 131,072 個 token(128k)的超大上下文視窗。這讓使用者能在複雜的推理過程中,同時處理大量圖片內容與詳盡的文字指示或文件歷史,而不會失去連貫性或細節。對於多步驟任務尤其有效,模型必須記住先前的視覺輸入,同時在同一個工作階段中分析新資料。

我可以使用 grok 4 image 根據 UI 產生程式碼嗎?

可以。grok 視覺系列最強大的功能之一,就是將線框圖或白板草圖轉換為程式碼。它可以透過分析上傳圖片中的空間配置和設計元素,產生 React、Tailwind 或 Python 樣板程式碼。這能簡化前端開發流程,讓團隊以顯著更少的人工投入,從視覺概念快速轉變為功能性原型。

grok 圖片請求的定價結構如何?

我們的平台提供具競爭力的價格:每 1M 個輸入 token 收費 $5.00,每 1M 個輸出 token 收費 $15.00。圖片會根據解析度進行 token 化;典型的高解析度圖片大約會消耗 1,000 至 3,000 個 token,具體取決於像素與 token 的比例。這種透明的定價方式,無論視覺複雜程度為何,都能讓您的應用程式多模態需求成長時實現可預測的擴展。

我的圖片資料會被用來訓練 grok 模型嗎?

不會。隱私與 E-E-A-T 標準是我們服務的核心。透過 GPTProto.com API 聚合層傳送的任何請求,都不會被 xAI 用於模型訓練或改進。我們確保您的專有視覺資料和提示詞保持安全與私密,滿足所有專業使用者對企業級合規性和資料主權的嚴格要求。

如何從 GPT-4o 遷移到 grok 4 image?

由於 grok API 與 OpenAI 相容,因此遷移非常順暢。您只需更新基礎 URL,並將模型識別碼變更為 grok vision 名稱即可。內容陣列(文字和 image_url)的訊息結構維持不變,確保現有的圖片處理流程只需進行極少的程式碼變更,就能持續運作並獲得 xAI 獨特的推理能力。

相關場景

所有工具
印章產生器

印章產生器

使用終極印章產生器工具建立自訂數位郵資

品牌海報

品牌海報

在幾秒內生成專業行銷圖像和獨特的品牌海報。

產品行銷活動海報

產品行銷活動海報

使用我們先進的 AI 廣告設計工具,立即生成專業的產品行銷活動海報。

雜誌封面風格

雜誌封面風格

將任何圖像轉換為具有光澤質感的雜誌封面版面。使用我們由 AI 驅動的編輯排版和電影感燈光,提升您下一張特寫肖像的質感。

相關文章

與本模型相關的指南、對比與更新。

所有文章
xAI Grok API 定價 2026:模型、Token 費率與成本指南

xAI Grok API 定價 2026:模型、Token 費率與成本指南

想了解 2026 年 xAI Grok API 的定價嗎?本指南將詳細解析每個 Grok 模型的 Token 費率、訂閱方案、免費額度,以及與 GPT 和 Claude 的比較,協助你選擇合適的方案,避免支付過高費用。

監控 Grok 伺服器狀態:xAI 超級運算的脈動

監控 Grok 伺服器狀態:xAI 超級運算的脈動

隨時掌握 Grok 伺服器狀態,確保你的 AI 工作流程順暢無礙。了解 xAI 的基礎架構如何影響效能與可靠性。

Grok API:未經過濾的強大功能與隱藏費用

Grok API:未經過濾的強大功能與隱藏費用

Grok API 提供原始的即時資料,卻隱藏著高昂的審核費用。了解如何管理成本,並立即打造更智慧的應用程式。

GPT Proto

以全球規模與穩定性,賦能 AI 創新:

透過我們的旗艦產品 GPT Proto,我們提供統一的介面,讓您能存取並整合全球頂尖 AI 供應商的 API,涵蓋文字、視覺、語音等領域。我們協助開發者與企業簡化整合流程,並無限制地加速創新。

全球基礎設施,在地合規:

To ensure enterprise-grade reliability and compliance, Talent Tech Global Limited operates specifically as our global Billing and Contracting Entity. Meanwhile, our core technical infrastructure and R&D teams are strategically distributed across global innovation hubs, including Silicon Valley, Singapore, and Hong Kong.

為擴展而生:

我們深知穩定性至關重要。我們的平台建立在強大的去中心化架構之上,支援動態自動擴展。無論您是進行試點專案還是處理數百萬次併發請求,我們的系統都能即時擴展以滿足需求,確保您的業務永遠不會受限於基礎設施。

導覽

  • 儀表板
  • 模型
  • 建立圖片
  • AI 圖片放大
  • AI 背景移除
  • 建立影片
  • 在畫布中編輯
  • 聊天
  • 功能
  • 定價
  • AI 文件
  • AI 部落格
  • AI 洞察
  • AI 技能

功能

  • AI 貓跳舞影片生成器
  • 無限制 AI 影片生成器
  • AI 包裝設計生成器
  • 動漫 AI 藝術生成器
  • AI 物件移除器
  • AI 圖片編輯器
  • AI 動作轉移
  • AI 浮水印移除工具
  • 線上 AI 圖片增強器
  • 線上背景移除工具
  • AI 臉部交換圖片
  • AI 護照照片製作器
  • MS Paint AI 生成器
  • AI 衣物移除器
  • 無限制AI圖片生成器
  • AI 法式接吻生成器
  • AI 電影海報產生器
  • Artlist IO 工作室
  • 線上魔術橡皮擦
  • Luma Dream Machine
Explore all features >

LLM

  • DeepSeek Flash
  • GLM 5.3
  • Claude Fable 5
  • DeepSeek v4 Pro
  • Gemini 3.7 Flash
  • Grok 4.6
  • Hy4 Preview
  • GPT 6 Astra
  • Gemini 3.8 Flash
  • Claude Fable 5.1
  • Qwen3.8 Max 0902
  • GLM 5.3 Flash
  • DeepSeek v4 Flash Vision Exp
  • Qwen3.8 Max
  • Claude Opus 5
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash Lite
  • Kimi K3
  • GPT 5.6 Luna
  • GPT 5.6 Terra
探索所有模型 >

影像

  • GPT Image 2.5 Sunburst
  • GPT Image 2
  • Nano Banana Pro (Gemini 3 Pro Image)
  • Nano Banana 2 (Gemini 3.1 Flash Image)
  • Midjourney
  • GPT Image 2.5 Flare
  • Grok Imagine Image 2.0
  • Seedream 5.0 Pro (Build 260628)
  • Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
  • Nano Banana 2 (Gemini 3.1 Flash Image)
  • Seedream 5.0 (Build 260128)
  • Doubao Seedream 5.0 (Build 260128)
  • Vidu Q2
  • Grok Imagine Image
  • Kling Image O1
  • GPT Image 1.5
  • Seedream 4.5 (Build 251128)
  • Doubao Seedream 4.5 (Build 251128)
  • Grok Imagine 0.9
  • Qwen Image Lora
探索所有模型 >

影片

  • Minimax H3
  • Seedance 2.5 (Build 260628)
  • Seedance 2.0 (Build 260128)
  • Seedance 2.0 Mini (Build 260615)
  • Kling v3.0 4k
  • Vidu Q3 Turbo
  • Wan 3.0
  • Kling v3 Omni 4k
  • Seedance 2.0 Fast (Build 260128)
  • Vidu 2.0
  • Doubao Seedance 2.0 (Build 260128)
  • Doubao Seedance 2.0 Fast (Build 260128)
  • Kling v3 Omni Pro
  • Kling v3 Omni Std
  • Kling v3.0 Pro
  • Kling v3.0 Std
  • Vidu Q3 Pro
  • Kling v2.6 Std
  • Vidu Q2 Pro
  • Vidu Q2 Turbo
探索所有模型 >

聯絡我們

有任何問題或回饋嗎?歡迎透過以下管道與我們聯繫。

TelegramWhatsApp

© 2026 Talent Tech Global Limited (Hong Kong). 保留所有權利。

註冊地址: Unit 1022a, Beverley Commercial Centre, 87-105 Chatham Road South, Tsim Sha Tsui, Hong Kong商業登記證號碼: 79462435-000-12-25-0
  • 關於我們
  • 隱私權政策
  • 服務條款
  • 網站地圖
友情連結logoto.videotopostudio.cc