GPT Proto

GPTProto

  • 儀表板
  • LLM

    • claude
      Claude Opus 5新功能
    • google
      Gemini 3.6 Flash
    • google
      Gemini 3.5 Flash Lite
    • moonshotai
      Kimi K3
    • openai
      GPT 5.6 Luna

    影像

    • bytedance
      Dola Seedream 5.0 Pro 260628新功能
    • google
      Gemini 3.1 Flash Lite Image
    • google
      Gemini 3.1 Flash Image
    • openai
      GPT Image 2
    • google
      Gemini 3.1 Flash Image Preview

    影片

    • kling
      Kling v3.0 4k新功能
    • bytedance
      Dreamina Seedance 2.0 Mini 260615
    • kling
      Kling v3 Omni 4k
    • bytedance
      Dreamina Seedance 2.0 Fast 260128
    • bytedance
      Dreamina Seedance 2.0 260128
    探索 214+ 種模型 >
  • 生成器

    • 建立圖片
    • 建立影片
    • 在畫布中編輯

    功能

    • 動漫轉真人 AI新功能
    • 動漫 AI 藝術生成器
    • AI 物件移除器
    • AI 圖片編輯器
    • 無限制 AI 圖像生成器
    • AI 動作轉移
    • AI 衣物移除器
    • AI 浮水印移除工具
    • 線上 AI 圖片增強器
    • 線上背景移除工具
    探索全部 >

    提示詞

    • Seedance 2.0 提示詞新功能
    • GPT Image 2 提示詞
    • Nano Banana Pro 提示詞
    • Seedream 5.0 Pro 提示詞
  • AI 部落格

    • GLM 5.2 與 MiniMax M3:哪個更適合程式設計與前端工作?
    • 如何使用 API 建立自己的 AI 角色——無需撰寫程式碼
    • Kimi K3 與 Claude Opus 5:哪個更適合程式設計與 AI 代理?
    • 20 個免費 Seedream 5.0 Pro 產品與電子商務包裝設計提示詞
    • GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?
    探索全部 >

    AI 洞察

    • 什麼是 Emochi AI?以及它為什麼成長得這麼快?(2026)
    • Kimi K3 是什麼?真的接近 GPT-5.6 與 Fable 5 嗎?
    • 2026 年 YouTube、TikTok、文字與圖片適用的 12 款最佳 AI 影片生成工具
    • 什麼是 Qwen 3.8 Max?發布日期、2.4T 預覽版、價格與早期基準測試
    • Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 詳解:您應該使用哪一個?
    探索全部 >

    AI 文件

    • gpt-image-2
    • gpt-5.4
    • kimi-k2.5
    • claude-opus-4-6
    • kling-v3.0-pro
    探索全部 >

    AI 技能

    • browser-use
    • claude-to-im
    • competitive-ads-extractor
    • content-creator
    • data-storytelling
    探索全部 >
定價
English繁體中文한국어日本語EspañolРусский
立即開始
  1. 首頁
  2. /模型
  3. /MoonshotAI
  4. /kimi-k3
MoonshotAI
kimi-k3
對話說明文件
說明文件
Kimi K3 是 Moonshot AI 的 2.8T 參數多模態推理模型,專為長期程式設計與知識工作而打造。GPTProto 以每 100 萬個 token 的輸入 $2.70、輸出 $13.50 提供 Kimi K3 API 存取,價格比 Moonshot 目前的牌價低 10%。

$ 2.7
$ 3

$ 13.5
$ 15

text

text

$ 2.7
$ 3

text

$ 13.5
$ 15

text

相關模型
所有模型
Claude
Claude
claude-opus-5
$ 20
$ 25
Google
Google
gemini-3.6-flash
$ 4.5
$ 7.5
OpenAI
OpenAI
gpt-5.6-luna
$ 0.96
$ 1.2
Grok
Grok
grok-4.5
$ 3.6
$ 6
MiniMax
MiniMax
MiniMax-M3
$ 0.96
$ 1.2
Z-AI
Z-AI
glm-5.2
$ 3.96
$ 4.4

適用於程式設計、代理與視覺的 Kimi K3 API

透過單一 GPTProto 金鑰執行 Moonshot AI 的 2.8 兆參數旗艦模型。在 100 萬 Token 上下文視窗中處理大型程式碼庫、多模態輸入、工具呼叫與結構化輸出。

100 萬 Token 多模態上下文

在單一上下文視窗中分析長篇程式碼儲存庫、文件、圖片與影片。K3 結合原生視覺理解與文字推理,支援多模態代理工作流程。

Kimi 128k 上下文

長期程式設計

瀏覽大型程式碼儲存庫、協調終端機工具、根據日誌與螢幕截圖進行除錯,並在較少人工監督下持續處理多步驟工程工作。

Kimi 程式設計能力

相容 OpenAI SDK 的呼叫

使用熟悉的 Chat Completions 請求格式。對於 K3,在繼續對話或完成工具迴圈時,請保留完整的 assistant 訊息,包括 reasoning_content。

Kimi API 整合

推理、工具與 JSON

K3 始終進行推理,並支援低、高或最大努力程度。它也支援工具選擇、動態工具載入、JSON 模式,以及嚴格的 JSON Schema 輸出。

Kimi 數學推理

什麼是 Kimi K3 API?

Kimi K3 API 為開發者提供 Moonshot AI 旗艦模型的代管存取能力,適用於長期程式設計、多模態分析、工具使用,以及端到端知識工作。K3 於 2026 年 7 月 16 日發布,是一個擁有 2.8 兆參數的混合專家模型(Mixture-of-Experts)。它每個 token 啟用 896 個專家中的 16 個,並結合 Kimi Delta Attention、Attention Residuals 和 Stable LatentMoE,相較於總規模相近的稠密模型,能更有效率地處理長序列。

K3 接受文字、圖像和影片輸入,並回傳文字。其 100 萬 token 的上下文視窗適用於無法縮減為短提示的工作負載:儲存庫規模的程式設計、多文件分析、長時間工具記錄,以及視覺回饋迴圈。模型始終會進行推理。開發者可以將 reasoning_effort 設定為 low、 high 或 max,其中 max 為預設值,而不是切換思考功能的開啟與關閉。

GPTProto 在模型周圍提供不同的存取層。一組 Kimi K3 API 金鑰和餘額,也可以用於 200 多個文字、圖像、影片和音訊模型。本頁顯示的費率為每 100 萬輸入 token 2.70 美元、每 100 萬輸出 token 13.50 美元,比 Moonshot 目前的 3/15 牌價低 10%。因此,您可以更輕鬆地在 GPT-5.6 Sol、Claude Fable 5、GLM-5.2 或其他模型旁測試 K3,而不必為每個實驗開設並儲值不同供應商的帳戶。

規格 Kimi K3
供應商 Moonshot AI
發布日期 2026 年 7 月 16 日
模型類別 2.8T 參數混合專家模型
啟用的專家 每個 token 為 896 個中的 16 個
架構 Kimi Delta Attention、Attention Residuals、Stable LatentMoE
輸入 文字、圖像和影片
輸出 文字
上下文視窗 1,048,576 tokens
完成上限 預設為 131,072 tokens;在總上下文預算內可設定至 1,048,576
推理 始終開啟;推理程度為 low、 high 或 max 
API 功能 串流、工具呼叫、 tool_choice、動態工具、JSON 模式、嚴格 JSON Schema,以及 Partial Mode

Kimi K3 API 應用情境

當任務結合大型工作集與重複操作時,K3 最能發揮作用。程式設計代理可以檢查儲存庫、編輯多個檔案、執行測試、讀取日誌,並利用螢幕截圖改善前端或遊戲。研究工作流程可以將大型文件集保留在上下文中、呼叫外部工具,並回傳符合嚴格 JSON Schema 的結果。多模態 QA 系統可以將介面螢幕截圖與實作細節進行比較,而影片工作流程則可以分析上傳的影片,並回傳場景備註、摘要或結構化中繼資料。

對於短篇分類、簡單聊天,或較小模型已能達到品質門檻的大量擷取任務,模型的吸引力較低。K3 始終會進行推理,因此即使是較低的推理程度設定,也應評估其延遲與輸出 token 成本。請先從一個具代表性的工作流程開始,衡量任務完成情況,而非單一回應,並在將所有流量導向 K3 之前,先將 K3 與較小的模型進行比較。

遷移前應檢查的 API 詳細資訊

K3 支援 OpenAI SDK 和 Chat Completions 請求格式,但它具有模型專屬行為,單純替換模型名稱可能會遺漏這些行為。

首先,Preserved Thinking 始終處於啟用狀態。在多輪對話和工具迴圈中,請從先前的回應中回傳完整的助理訊息,包括 reasoning_content 和 tool_calls。只保留可見的 content 可能會中斷推理連續性,並使長時間工作階段變得不穩定。歷史推理也會消耗上下文,並按 token 使用量計費,因此請精簡已完成的工作,而不要永遠攜帶每一輪內容。

其次,請使用頂層的 reasoning_effort 欄位,而不是較舊 K2.x 的 thinking 設定。K3 支援 low、 high 和 max。其採樣值是固定的,因此應用程式不應依賴自訂 temperature 或 penalty 設定。

第三,請從最終的 content 欄位解析結構化結果,而不是從 reasoning_content 解析。K3 透過 response_format 支援 JSON 模式和嚴格 JSON Schema,這對擷取管線、工具引數和機器可讀的研究輸出都很有用。

最後,多模態請求需要結構化內容部分。Moonshot 的原生介面接受 base64 圖像或上傳的檔案參照,而不是公開圖像 URL。在部署多模態工作流程之前,請確認目前的 GPTProto 文件,以了解此端點公開的確切圖像和影片欄位。

何時應選擇 Kimi K3?

Moonshot 自己的發布文章表示,K3 的整體效能仍落後於 Claude Fable 5 和 GPT-5.6 Sol。選擇 K3 的理由並不是宣稱它在每項基準測試中都勝出。它最具優勢的情況,是結合了 100 萬 token 上下文視窗、原生影片理解、長期程式設計能力,以及大幅較低的 token 價格。

決策因素 Kimi K3 GPT-5.6 Sol Claude Fable 5
官方 API 每 100 萬 token 的牌價 輸入 3 美元 / 輸出 15 美元 輸入 5 美元 / 輸出 30 美元 輸入 10 美元 / 輸出 50 美元
上下文視窗 1,048,576 1,050,000 1,000,000
最大輸出 上下文內最多 1,048,576;預設為 131,072 128,000 128,000
原生輸入 文字、圖像、影片 文字、圖像 文字、圖像
模型存取

代管 API;官方模型權重由 Moonshot AI 另行發布

封閉式 API 封閉式 API
最適合 重視成本的程式設計、多模態代理、大型工作集 最高階的程式設計、電腦使用和 OpenAI 工具工作流程 長時間執行的代理、複雜視覺任務和高階知識工作

當較低的 API 成本、原生影片輸入或 100 萬 token 上下文視窗,比在最廣泛的前沿評估中勝出更重要時,請選擇 K3。當您自己的任務層級評估顯示較高的完成率足以抵銷較高的 token 價格時,請選擇 GPT-5.6 Sol 或 Claude Fable 5。若要逐項基準測試討論,請閱讀 什麼是 Kimi K3——它真的接近 GPT-5.6 和 Fable 5 嗎?.

 

如何取得 kimi-k3 API 金鑰

取得 kimi-k3 API 金鑰只需四個步驟,僅需幾分鐘。建立免費的 GPTProto 帳號、儲值、產生金鑰,並進行第一次呼叫 — 在 $2.7 / $13.5 這裡能以比直連更划算的價格取得 kimi-k3 API 金鑰,且單一金鑰即可在平台上所有模型通用。完整 kimi-k3 說明文件 請參閱說明文件。

註冊

註冊

建立您的免費 GPT Proto 帳號即可開始。您可以隨時為您的團隊設定組織。

儲值

儲值

您的餘額可用於平台上的所有模型,包括 kimi-k3,讓您能靈活地進行實驗並隨需求擴充。

產生您的 API 金鑰

產生您的 API 金鑰

在您的儀表板中建立 API 金鑰 — 進行 kimi-k3 請求時,您將需要它來進行驗證。

進行第一次 API 呼叫

進行第一次 API 呼叫

使用您的 API 金鑰搭配我們的範例程式碼,透過 GPT Proto 向 kimi-k3 發送請求,並立即查看 AI 生成的結果。

取得 API 金鑰

Kimi K3 API:常見技術問題

取得關於 Kimi K3 API 定價、上下文限制、多模態輸入、推理行為與模型選擇的精簡解答。

在 GPTProto 上使用 Kimi K3 API 的費用是多少?

本頁目前顯示的 GPTProto 費率為每 100 萬個輸入 token 2.70 美元,以及每 100 萬個輸出 token 13.50 美元。這比 Moonshot AI 目前每 100 萬個 token 的輸入 3 美元、輸出 15 美元的牌價低 10%。推理內容會計入 token 用量。

如何取得 Kimi K3 API 金鑰?

建立 GPTProto 帳戶,為共享餘額儲值,在控制面板中產生 API 金鑰,並使用此端點文件中記載的模型字串。同一組金鑰可在 GPTProto 上存取 K3 及其他 200 多個模型。

Kimi K3 API 的上下文視窗有多大?

Kimi K3 支援總計 1,048,576 個 token 的上下文視窗。max_completion_tokens 預設為 131,072,只要輸入內容與要求的輸出內容總和仍在模型的總上下文限制內,就可以提高此值。

Kimi K3 API 是否支援視覺與影片輸入?

底層的 Kimi K3 模型接受文字、圖片和影片,並輸出文字。請查看 GPTProto 文件,瞭解目前的多模態請求結構、支援的上傳方式、檔案限制,以及 Moonshot 原生支援的每種輸入格式是否都能透過此端點使用。

Kimi K3 API 是否完全相容於 OpenAI 程式碼?

您可以使用 OpenAI SDK 和熟悉的 Chat Completions 訊息結構,但 K3 在行為上並不完全等同於 OpenAI 模型。請使用 reasoning_effort,在多輪對話中保留完整的 assistant 訊息,並在遷移前確認 K3 專用的多模態與工具欄位。

Kimi K3 支援哪些推理強度值?

K3 一律會進行推理,並透過頂層的 reasoning_effort 欄位接受 low、high 或 max。預設值為 max。當延遲與 token 用量比任務深度更重要時,對較簡單的請求測試較低的推理強度。

Kimi K3 是開源模型嗎?

Moonshot AI 於 2026 年 7 月 27 日以其自訂的 Kimi K3 License 發布了官方 Kimi K3 模型權重。因此,與其不加限定地使用「開源」一詞,不如更精確地將 K3 描述為開放權重模型。GPTProto 提供託管的 Kimi K3 API 存取服務,但不會分發模型權重。

Kimi K3 能取代 GPT-5.6 Sol 或 Claude Fable 5 嗎?

不一定。Moonshot 表示,K3 整體表現仍落後於這兩個模型,但 K3 提供更低的官方 token 價格、原生影片輸入,以及出色的長期程式設計能力。請在所有候選模型上執行相同的程式碼儲存庫任務或代理工作流程,並比較完成率、延遲與 token 總數。

Kimi K3 最適合哪些程式設計用途?

K3 適合用於程式碼儲存庫導覽、多檔案實作、以終端機為基礎的除錯、測試與修復迴圈、利用螢幕截圖回饋進行的前端工作,以及長時間執行的研究工程。對於自動補全、簡短轉換或簡單分類,較小型的模型可能更具成本效益。

相關文章

更多部落格
GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?

GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?

比較 GLM-5.2 與 Kimi K3 在程式設計、程式碼審查、遊戲開發、基準測試和 API 成本方面的表現,找出 2026 年更適合開發者的模型。

如何將 GLM-5.2 用於程式設計代理,同時避免浪費 1M 上下文?

如何將 GLM-5.2 用於程式設計代理,同時避免浪費 1M 上下文?

使用 Claude Code 或相容 OpenAI 的 API,將 GLM-5.2 作為程式設計代理執行。內容包括實際設定、儲存庫層級提示詞、本機需求和成本範例。

Kimi K3 是什麼?它真的接近 GPT-5.6 和 Fable 5 嗎?

Kimi K3 是什麼?它真的接近 GPT-5.6 和 Fable 5 嗎?

Kimi K3 是開源模型嗎?它真的接近 GPT-5.6 和 Fable 5 嗎?探索其 1M 上下文、API 定價、獨立基準測試和 Reddit 上的反應。

2026 年開發者最佳 AI API:比較 10 個平台

2026 年開發者最佳 AI API:比較 10 個平台

從實際定價、模型涵蓋範圍、延遲、SDK 和生產環境適用性等方面,比較 OpenAI、Claude、Gemini、OpenRouter、fal.ai、Replicate 和 GPTProto。

GPT Proto

以全球規模與穩定性,賦能 AI 創新:

透過我們的旗艦產品 GPT Proto,我們提供統一的介面,讓您能存取並整合全球頂尖 AI 供應商的 API,涵蓋文字、視覺、語音等領域。我們協助開發者與企業簡化整合流程,並無限制地加速創新。

全球基礎設施,在地合規:

To ensure enterprise-grade reliability and compliance, Talent Tech Global Limited operates specifically as our global Billing and Contracting Entity. Meanwhile, our core technical infrastructure and R&D teams are strategically distributed across global innovation hubs, including Silicon Valley, Singapore, and Hong Kong.

為擴展而生:

我們深知穩定性至關重要。我們的平台建立在強大的去中心化架構之上,支援動態自動擴展。無論您是進行試點專案還是處理數百萬次併發請求,我們的系統都能即時擴展以滿足需求,確保您的業務永遠不會受限於基礎設施。

導覽

  • 儀表板
  • 模型
  • 建立圖片
  • AI 圖片放大
  • AI 背景移除
  • 建立影片
  • 在畫布中編輯
  • 功能
  • 定價
  • AI 文件
  • AI 部落格
  • AI 洞察
  • AI 技能

功能

  • 動漫轉真人 AI
  • 動漫 AI 藝術生成器
  • AI 物件移除器
  • AI 圖片編輯器
  • 無限制 AI 圖像生成器
  • AI 動作轉移
  • AI 衣物移除器
  • AI 浮水印移除工具
  • 線上 AI 圖片增強器
  • 線上背景移除工具
  • AI 臉部交換圖片
  • AI 護照照片製作器
  • MS Paint AI 生成器
Explore all features >

LLM

  • Claude Opus 5
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash Lite
  • Kimi K3
  • GPT 5.6 Luna
  • GPT 5.6 Terra
  • GPT 5.6 Sol
  • Grok 4.5
  • Claude Sonnet 5
  • Minimax M3
  • GLM 5.2
  • GPT 5.1 Chat Latest
  • Claude Fable 5
  • Qwen3.7 Max
  • Claude Opus 4.8 Thinking
  • Claude Opus 4.8
  • Gemini 3.5 Flash
  • DeepSeek v4 Flash
  • DeepSeek v4 Pro
  • Grok 4.3
探索所有模型 >

影像

  • Dola Seedream 5.0 Pro 260628
  • Gemini 3.1 Flash Lite Image
  • Gemini 3.1 Flash Image
  • GPT Image 2
  • Gemini 3.1 Flash Image Preview
  • Seedream 5.0 260128
  • Doubao Seedream 5.0 260128
  • Vidu Q2
  • Grok Imagine Image
  • Kling Image O1
  • GPT Image 1.5
  • Seedream 4.5 251128
  • Doubao Seedream 4.5 251128
  • Grok Imagine 0.9
  • Gemini 3 Pro Image Preview
  • Qwen Image Lora
  • Qwen Image Plus Lora
  • Qwen Image Plus
  • Grok 4 Image
  • GPT Image 1 Mini
探索所有模型 >

影片

  • Kling v3.0 4k
  • Dreamina Seedance 2.0 Mini 260615
  • Kling v3 Omni 4k
  • Dreamina Seedance 2.0 Fast 260128
  • Dreamina Seedance 2.0 260128
  • Vidu 2.0
  • Doubao Seedance 2.0 260128
  • Doubao Seedance 2.0 Fast 260128
  • Kling v3 Omni Pro
  • Kling v3 Omni Std
  • Vidu Q3 Turbo
  • Kling v3.0 Pro
  • Kling v3.0 Std
  • Vidu Q3 Pro
  • Kling v2.6 Std
  • Vidu Q2 Pro
  • Vidu Q2 Turbo
  • Vidu Q2 Pro Fast
  • Vidu Q2
  • Kling Video O1 Pro
探索所有模型 >

© 2026 Talent Tech Global Limited (Hong Kong) / Talent Tech Global LLC (US). 保留所有權利。

  • 關於我們
  • 隱私權政策
  • 服務條款
  • 網站地圖