GPT Proto

GPTProto

  • 儀表板
  • LLM

    • claude
      Claude Opus 5新功能
    • google
      Gemini 3.6 Flash
    • google
      Gemini 3.5 Flash Lite
    • moonshotai
      Kimi K3
    • openai
      GPT 5.6 Luna

    影像

    • bytedance
      Dola Seedream 5.0 Pro 260628新功能
    • google
      Gemini 3.1 Flash Lite Image
    • google
      Gemini 3.1 Flash Image
    • openai
      GPT Image 2
    • google
      Gemini 3.1 Flash Image Preview

    影片

    • kling
      Kling v3.0 4k新功能
    • bytedance
      Dreamina Seedance 2.0 Mini 260615
    • kling
      Kling v3 Omni 4k
    • bytedance
      Dreamina Seedance 2.0 Fast 260128
    • bytedance
      Dreamina Seedance 2.0 260128
    探索 214+ 種模型 >
  • 生成器

    • 建立圖片
    • 建立影片
    • 在畫布中編輯

    功能

    • 動漫轉真人 AI新功能
    • 動漫 AI 藝術生成器
    • AI 物件移除器
    • AI 圖片編輯器
    • 無限制 AI 圖像生成器
    • AI 動作轉移
    • AI 衣物移除器
    • AI 浮水印移除工具
    • 線上 AI 圖片增強器
    • 線上背景移除工具
    探索全部 >

    提示詞

    • Seedance 2.0 提示詞新功能
    • GPT Image 2 提示詞
    • Nano Banana Pro 提示詞
    • Seedream 5.0 Pro 提示詞
  • AI 部落格

    • GLM 5.2 與 MiniMax M3:哪個更適合程式設計與前端工作?
    • 如何使用 API 建立自己的 AI 角色——無需撰寫程式碼
    • Kimi K3 與 Claude Opus 5:哪個更適合程式設計與 AI 代理?
    • 20 個免費 Seedream 5.0 Pro 產品與電子商務包裝設計提示詞
    • GLM-5.2 與 Kimi K3 程式設計比較:2026 年哪個更適合開發者?
    探索全部 >

    AI 洞察

    • 什麼是 Emochi AI?以及它為什麼成長得這麼快?(2026)
    • Kimi K3 是什麼?真的接近 GPT-5.6 與 Fable 5 嗎?
    • 2026 年 YouTube、TikTok、文字與圖片適用的 12 款最佳 AI 影片生成工具
    • 什麼是 Qwen 3.8 Max?發布日期、2.4T 預覽版、價格與早期基準測試
    • Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 詳解:您應該使用哪一個?
    探索全部 >

    AI 文件

    • gpt-image-2
    • gpt-5.4
    • kimi-k2.5
    • claude-opus-4-6
    • kling-v3.0-pro
    探索全部 >

    AI 技能

    • browser-use
    • claude-to-im
    • competitive-ads-extractor
    • content-creator
    • data-storytelling
    探索全部 >
定價
English繁體中文한국어日本語EspañolРусский
立即開始
  1. 首頁
  2. /模型
  3. /Google
  4. /gemini-3.5-flash-lite
Google
gemini-3.5-flash-lite
對話說明文件
說明文件
Gemini 3.5 Flash 是 Google 推出的成本最佳化、超低延遲模型。它具備 100 萬個 token 的上下文視窗,並原生支援大規模的文字、影片與音訊多模態任務。

$ 0.18
$ 0.3

$ 1.5
$ 2.5

text

text

$ 0.18
$ 0.3

text

$ 1.5
$ 2.5

text

相關模型
所有模型
Claude
Claude
claude-opus-5
$ 20
$ 25
Google
Google
gemini-3.6-flash
$ 4.5
$ 7.5
MoonshotAI
MoonshotAI
kimi-k3
$ 13.5
$ 15
OpenAI
OpenAI
gpt-5.6-luna
$ 0.96
$ 1.2
Grok
Grok
grok-4.5
$ 3.6
$ 6
MiniMax
MiniMax
MiniMax-M3
$ 0.96
$ 1.2

Gemini 3.5 Flash-Lite API

在 GPTProto 上使用 Google 速度最快且最具成本效益的 Gemini 3.5 模型,每 100 萬個輸入 token 價格為 $0.18,每 100 萬個輸出 token 價格為 $1.50,比 Google 的標準 API 費率低 40%。使用一組 GPTProto 金鑰,即可在 200 多個文字、圖片、影片和音訊模型之間進行平衡。

每秒 350 個輸出 Token

根據 Artificial Analysis 的測試,Google 報告的輸出速度約為每秒 350 個 token。Flash-Lite 專為重視吞吐量和回應時間,而非最大推理深度的工作負載而設計。

快速 Gemini API

多模態輸入、文字輸出

可傳送文字、圖片、影片、音訊和 PDF 檔案。模型會回傳文字,適合用於文件解析、媒體理解、轉錄分析、摘要,以及多模態資料擷取。

多模態 Gemini

結構化輸出與工具使用

使用受結構描述約束的輸出和函式呼叫,進行資料擷取、路由及工具型代理。部署前,請確認程式碼執行、檔案搜尋、URL 上下文和搜尋接地功能是否可針對特定路由使用。

Gemini JSON 模式

100 萬 Token 上下文視窗

可處理最多 1,048,576 個輸入 token,並生成最多 65,536 個輸出 token。此容量支援大型文件集、長篇逐字稿、報告、程式碼儲存庫,以及詳細的子代理交接內容。

Gemini 上下文

什麼是 Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite 是 Google’ 針對高流量代理任務、翻譯、文件處理、分類和結構化擷取推出的正式商用效率模型。它於 2026 年 7 月 21 日發布,是 Gemini 3.5 系列中速度最快的模型,定位適用於延遲、吞吐量和 API 成本比最高推理深度更受限制的應用程式。

Google Gemini 3.5 Flash-Lite API 可在 1,048,576 個 token 的輸入視窗內接受文字、圖片、影片、音訊和 PDF 檔案。它可產生最多 65,536 個 token 的文字回應,並在 Google’ 的原生 API 中支援思考、結構化輸出、函式呼叫、快取、程式碼執行、檔案搜尋、URL 內容和搜尋 grounding。它不會產生圖片或音訊,也不支援 Live API。透過 OpenAI 相容閘道使用時,供應商特定工具的可用性可能有所不同,因此在依賴 Google 原生擴充功能前,請先查閱 GPTProto 文件。

規格 Gemini 3.5 Flash-Lite
供應商 Google
穩定模型 ID gemini-3.5-flash-lite
發布階段 正式商用
發布日期 2026 年 7 月 21 日
輸入限制 1,048,576 個 token
最大輸出 65,536 個 token
接受的輸入 文字、圖片、影片、音訊、PDF
輸出 文字
核心功能 思考、結構化輸出、函式呼叫、快取
不支援 圖片生成、音訊生成、Live API、調校

Gemini 3.5 Flash-Lite 的最佳用途

當應用程式以高流量重複執行聚焦任務時,Flash-Lite 最能發揮效用。它可以作為功能更強大的協調器底下的低成本工作模型,也可以處理決策範圍狹窄且容易驗證的完整工作流程。

  • 分類與路由:為支援工單加上標籤、偵測意圖、指派文件,或選擇下一個工具,無需每次請求都支付前沿模型的成本。

  • 文件解析與 JSON 擷取:讀取 PDF、發票、收據、報告和產品記錄,然後回傳符合既定結構描述的欄位。

  • 翻譯與摘要:處理大量多語言文字、會議逐字稿、評論或目錄內容,適用於單位成本會影響整體營運支出的情境。

  • 多模態審查:從圖片、錄音、影片和 PDF 中擷取文字與事實,同時讓輸出維持在文字型下游工作流程中。

  • 聚焦型子代理:將搜尋、擷取、程式碼編輯、驗證和工具呼叫委派給專門工作模型,同時保留更強大的模型負責規劃或最終審查。

當單一困難請求需要最高程度的程式碼準確性、長期規劃,或從工具錯誤中反覆復原時,這個模型就不太適合。對於這類工作負載,請先使用相同的評估資料集測試 Gemini 3.5 Flash 或 Gemini 3.6 Flash,再決定是否只依據 token 價格進行選擇。

依任務複雜度選擇思考層級

Gemini 3.5 Flash-Lite 在 Google’ 的原生 API 中支援可設定的思考功能。Google 建議對延遲敏感的分類、路由和 JSON 擷取使用 MINIMAL。這是預設設定,可限制可預測任務中不必要的推理 token。

對於需要撰寫程式碼、執行終端機命令、呼叫多個 API 或從中間錯誤中復原的子代理,請使用 MEDIUM 或 HIGH。更多思考可以改善多步驟執行,但也會增加輸出 token 用量和回應時間。如果透過 GPTProto’ 的 OpenAI 相容端點呼叫模型,請在傳送供應商特定欄位前,查閱目前文件以確認對應的思考參數。

Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash

Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash 共用 1,048,576 個 token 的上下文視窗和 65,536 個 token 的最大輸出,但兩者針對不同的工作負載經濟性而設計。Flash-Lite 優先考量吞吐量和低單位成本;Flash 則針對更複雜的程式碼開發、代理規劃和知識工作。

比較 Gemini 3.5 Flash-Lite Gemini 3.5 Flash
最適合 高流量子代理、擷取、翻譯、文件解析 複雜程式碼開發、代理規劃、更深入的知識工作
模型定位 3.5 系列中速度最快、成本最低的模型 功能更強大的 Flash 系列模型
輸入上下文 1,048,576 個 token 1,048,576 個 token
最大輸出 65,536 個 token 65,536 個 token
Google 標準輸入價格 $0.30/每 1M token $1.50/每 1M token
Google 標準輸出價格 $2.50/每 1M token $9.00/每 1M token
GPTProto Flash-Lite 價格 每 1M token 的輸入 $0.18/輸出 $1.50 請參閱 Gemini 3.5 Flash 模型頁面

按照 Google’ 的標準費率,Flash-Lite 的輸入成本比 Gemini 3.5 Flash 低 80%,輸出成本低約 72%。當請求量和回應時間比偶爾重試的成本更重要時,請選擇 Flash-Lite。當少量較困難的任務使首次執行品質比最低 token 費率更重要時,請選擇 Flash。

透過 GPTProto 使用 Gemini 3.5 Flash-Lite

GPTProto 透過同一個帳戶、API 金鑰和餘額提供 Gemini 3.5 Flash-Lite API 存取權,這些資源也可用於超過 200 個模型。當應用程式將簡單擷取路由至 Flash-Lite、複雜推理路由至 Gemini 3.5 Flash 或 Gemini 3.6 Flash,並將媒體工作路由至獨立的圖片、影片或音訊模型時,這可減少帳戶和計費的分散情況。

對於現有的 OpenAI 相容應用程式,請保留周邊的用戶端結構,並使用 GPTProto 文件中所示的端點、驗證方法和模型字串。不要假設每個 Google 原生欄位都能一對一對應。將正式環境流量遷移前,請先測試思考控制、快取、grounding、檔案處理、工具結構描述和串流行為。

現有 Gemini 工作負載的遷移注意事項

Google 記錄了幾項可能影響從舊版 Gemini 模型遷移的相容性差異。自訂的 temperature、top-K 和 top-P 值可能會被忽略。自訂的頻率和存在懲罰可能會導致錯誤。最終對話回合具有 model 角色的請求同樣不受支援。

在切換高流量工作流程前,請重播具代表性的測試集,並檢查 JSON 結構描述相容性、工具呼叫完成情況、token 用量、延遲和重試頻率。具成本效益的 Gemini 3.5 Flash-Lite API 部署,應以每項成功任務的成本評估,而不只是每個 token 的成本。這對多步驟代理尤其重要,因為過低的思考設定可能會使工具序列過早停止。

如何取得 gemini-3.5-flash-lite API 金鑰

取得 gemini-3.5-flash-lite API 金鑰只需四個步驟,僅需幾分鐘。建立免費的 GPTProto 帳號、儲值、產生金鑰,並進行第一次呼叫 — 在 $0.18 / $1.5 這裡能以比直連更划算的價格取得 gemini-3.5-flash-lite API 金鑰,且單一金鑰即可在平台上所有模型通用。完整 gemini-3.5-flash-lite 說明文件 請參閱說明文件。

註冊

註冊

建立您的免費 GPT Proto 帳號即可開始。您可以隨時為您的團隊設定組織。

儲值

儲值

您的餘額可用於平台上的所有模型,包括 gemini-3.5-flash-lite,讓您能靈活地進行實驗並隨需求擴充。

產生您的 API 金鑰

產生您的 API 金鑰

在您的儀表板中建立 API 金鑰 — 進行 gemini-3.5-flash-lite 請求時,您將需要它來進行驗證。

進行第一次 API 呼叫

進行第一次 API 呼叫

使用您的 API 金鑰搭配我們的範例程式碼,透過 GPT Proto 向 gemini-3.5-flash-lite 發送請求,並立即查看 AI 生成的結果。

取得 API 金鑰

常見問題

在 GPTProto 上使用 Gemini 3.5 Flash-Lite API 的費用是多少?

GPTProto 將 Gemini 3.5 Flash-Lite 的價格列為每 100 萬個輸入 token $0.18,以及每 100 萬個輸出 token $1.50。Google 的標準 API 費率分別為 $0.30 和 $2.50,因此 GPTProto 的費率低 40%。一個使用 10,000 個輸入 token 和 2,000 個輸出 token 的請求,費用約為 $0.0048。

我需要另外申請 Google Gemini 3.5 Flash-Lite API 金鑰嗎?

不需要。GPTProto 上的 Gemini 3.5 Flash-Lite API 存取權使用您的 GPTProto API 金鑰和共用帳戶餘額。同一個金鑰可以呼叫 200 多個支援的模型,因此您不需要為每個模型分別申請供應商帳戶或準備信用額度。

Gemini 3.5 Flash-Lite 的上下文限制是多少?

此模型最多接受 1,048,576 個輸入 token,並可回傳最多 65,536 個輸出 token。此限制適用於分詞後的提示內容和多模態輸入總量,因此大型 PDF、音訊和影片所消耗的上下文可能與純文字不同。

Gemini 3.5 Flash-Lite 能處理圖片、影片、音訊和 PDF 嗎?

可以。它接受文字、圖片、影片、音訊和 PDF 輸入,然後回傳文字。它可以分析或擷取這些媒體類型中的資訊,但不是圖片生成、影片生成、文字轉語音或即時語音模型。

Gemini 3.5 Flash-Lite 支援 JSON 模式和函式呼叫嗎?

Google 將結構化輸出和函式呼叫列為支援的功能。它們適合用於基於結構描述的擷取和工具驅動的代理程式。由於閘道的參數對應可能有所不同,請先透過 GPTProto 驗證確切的請求結構描述和工具行為,再部署關鍵工作流程。

我應該使用 Gemini 3.5 Flash-Lite 還是 Gemini 3.5 Flash?

對於高流量的分類、擷取、翻譯、文件處理和專注型子代理程式,請使用 Flash-Lite。當複雜的程式設計、更深入的規劃或更強的初步推理能力足以 оправjustify 較高的 token 成本時,請使用 Gemini 3.5 Flash。當失敗或重試成本較高時,請在具代表性的任務上測試兩者。

Gemini 3.5 Flash-Lite 是穩定版模型嗎?

可以。Google 將 gemini-3.5-flash-lite 列為一款於 2026 年 7 月 21 日發布的正式可用模型。這表示它不同於預覽版模型 ID;預覽版模型 ID 可能更頻繁變更,或有更嚴格的使用限制。

相關文章

更多部落格
2026 年 7 款最佳無限制 AI 圖像生成器(比較)

2026 年 7 款最佳無限制 AI 圖像生成器(比較)

不再受安全限制阻礙。找出最佳無限制 AI 圖像生成器,重拾您的創作自由。比較頂尖工具,立即開始創作。

Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 詳解:您該使用哪一個?

Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 詳解:您該使用哪一個?

比較 Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 的定價、速度、基準測試和使用情境。了解哪個全新的 Google 模型最適合您的 AI 工作負載。

Qwen 3.8 Max 與 GLM 5.2:2026 年哪個更適合程式設計?

Qwen 3.8 Max 與 GLM 5.2:2026 年哪個更適合程式設計?

比較 Qwen 3.8 Max 與 GLM 5.2 在程式設計、API 存取、上下文、定價和開放權重方面的表現。了解 2026 年哪個模型更適合安全地用於生產環境。

Kimi K3 是什麼——它真的接近 GPT-5.6 和 Fable 5 嗎?

Kimi K3 是什麼——它真的接近 GPT-5.6 和 Fable 5 嗎?

Kimi K3 是開放原始碼模型嗎?它真的接近 GPT-5.6 和 Fable 5 嗎?探索其 1M 上下文、API 定價、獨立基準測試和 Reddit 使用者反應。

GPT Proto

以全球規模與穩定性,賦能 AI 創新:

透過我們的旗艦產品 GPT Proto,我們提供統一的介面,讓您能存取並整合全球頂尖 AI 供應商的 API,涵蓋文字、視覺、語音等領域。我們協助開發者與企業簡化整合流程,並無限制地加速創新。

全球基礎設施,在地合規:

To ensure enterprise-grade reliability and compliance, Talent Tech Global Limited operates specifically as our global Billing and Contracting Entity. Meanwhile, our core technical infrastructure and R&D teams are strategically distributed across global innovation hubs, including Silicon Valley, Singapore, and Hong Kong.

為擴展而生:

我們深知穩定性至關重要。我們的平台建立在強大的去中心化架構之上,支援動態自動擴展。無論您是進行試點專案還是處理數百萬次併發請求,我們的系統都能即時擴展以滿足需求,確保您的業務永遠不會受限於基礎設施。

導覽

  • 儀表板
  • 模型
  • 建立圖片
  • AI 圖片放大
  • AI 背景移除
  • 建立影片
  • 在畫布中編輯
  • 功能
  • 定價
  • AI 文件
  • AI 部落格
  • AI 洞察
  • AI 技能

功能

  • 動漫轉真人 AI
  • 動漫 AI 藝術生成器
  • AI 物件移除器
  • AI 圖片編輯器
  • 無限制 AI 圖像生成器
  • AI 動作轉移
  • AI 衣物移除器
  • AI 浮水印移除工具
  • 線上 AI 圖片增強器
  • 線上背景移除工具
  • AI 臉部交換圖片
  • AI 護照照片製作器
  • MS Paint AI 生成器
Explore all features >

LLM

  • Claude Opus 5
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash Lite
  • Kimi K3
  • GPT 5.6 Luna
  • GPT 5.6 Terra
  • GPT 5.6 Sol
  • Grok 4.5
  • Claude Sonnet 5
  • Minimax M3
  • GLM 5.2
  • GPT 5.1 Chat Latest
  • Claude Fable 5
  • Qwen3.7 Max
  • Claude Opus 4.8 Thinking
  • Claude Opus 4.8
  • Gemini 3.5 Flash
  • DeepSeek v4 Flash
  • DeepSeek v4 Pro
  • Grok 4.3
探索所有模型 >

影像

  • Dola Seedream 5.0 Pro 260628
  • Gemini 3.1 Flash Lite Image
  • Gemini 3.1 Flash Image
  • GPT Image 2
  • Gemini 3.1 Flash Image Preview
  • Seedream 5.0 260128
  • Doubao Seedream 5.0 260128
  • Vidu Q2
  • Grok Imagine Image
  • Kling Image O1
  • GPT Image 1.5
  • Seedream 4.5 251128
  • Doubao Seedream 4.5 251128
  • Grok Imagine 0.9
  • Gemini 3 Pro Image Preview
  • Qwen Image Lora
  • Qwen Image Plus Lora
  • Qwen Image Plus
  • Grok 4 Image
  • GPT Image 1 Mini
探索所有模型 >

影片

  • Kling v3.0 4k
  • Dreamina Seedance 2.0 Mini 260615
  • Kling v3 Omni 4k
  • Dreamina Seedance 2.0 Fast 260128
  • Dreamina Seedance 2.0 260128
  • Vidu 2.0
  • Doubao Seedance 2.0 260128
  • Doubao Seedance 2.0 Fast 260128
  • Kling v3 Omni Pro
  • Kling v3 Omni Std
  • Vidu Q3 Turbo
  • Kling v3.0 Pro
  • Kling v3.0 Std
  • Vidu Q3 Pro
  • Kling v2.6 Std
  • Vidu Q2 Pro
  • Vidu Q2 Turbo
  • Vidu Q2 Pro Fast
  • Vidu Q2
  • Kling Video O1 Pro
探索所有模型 >

© 2026 Talent Tech Global Limited (Hong Kong) / Talent Tech Global LLC (US). 保留所有權利。

  • 關於我們
  • 隱私權政策
  • 服務條款
  • 網站地圖