100万トークンのマルチモーダルコンテキスト
テキスト、画像、動画、音声、PDFを1回のリクエストで処理できます。1,048,576トークンの入力ウィンドウにより、大規模なリポジトリ、長いレポート、録画された会議、複数ファイルの分析を、すべて短い抜粋に圧縮することなく扱えます。
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "gemini-3.7-flash",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, coding agents & document work. Priced per 1M tokens — input, cached input and output are billed separately. GPTProto is 40% below official rates.
| シナリオ | Google リスト | OpenRouter | GPTProto | 月間の節約 |
|---|---|---|---|---|
| Personal10M トークン / 月(キャッシュ 4.8M) | $20.52 | $21.65 | $12.31 | −$8.21≈ $98.50 / 年 |
| Team100M トークン / 月(キャッシュ 48M) | $205.20 | $216.49 | $123.12 | −$82.08≈ $984.96 / 年 |
| Business500M トークン / 月(キャッシュ 240M) | $1026.00 | $1082.43 | $615.60 | −$410.40≈ $4924.80 / 年 |
マルチモーダル入力、1,048,576トークンのコンテキストウィンドウ、設定可能な推論、そしてコーディング、ツール利用、構造化出力、長文書ワークフローに対応するOpenAI互換の呼び出しを備えた、Googleの最新FlashモデルをGPTProto経由で実行できます。
100万トークンのマルチモーダルコンテキスト
テキスト、画像、動画、音声、PDFを1回のリクエストで処理できます。1,048,576トークンの入力ウィンドウにより、大規模なリポジトリ、長いレポート、録画された会議、複数ファイルの分析を、すべて短い抜粋に圧縮することなく扱えます。
コーディングとUI実装
スクリーンショットやデザインの参考資料をコンテキストとして使用しながら、コードの生成、デバッグ、リファクタリングを行えます。Gemini 3.7 Flashは、Googleが公開している評価において、Gemini 3.6 Flashよりも初回コード生成の精度とデザインへの準拠度が向上しています。
エージェントツールと構造化出力
選択したAPIルートが対応している場合、関数呼び出し、構造化出力、コード実行、ファイル検索、URLコンテキスト、検索グラウンディングを利用できます。これにより、調査、実行、検証済みデータの返却が必要な多段階エージェントに適したモデルとなります。
低・中・高の推論レベル
日常的な処理を高速に行う場合は低、コーディングやエージェント処理のバランスを重視する場合は中、難しい推論やツール利用には高を選択できます。Gemini 3.7 Flashは最小の思考レベルには対応していません。
Gemini 3.7 Flash APIは、Google'の最新の一般提供Flashモデルにプログラムからアクセスできるようにします。2026年8月13日にリリースされたこのモデルは、ソフトウェアエンジニアリング、Web開発、マルチモーダルなドキュメント処理、そして従来のFlashリリースよりも強力な指示追従と信頼性の高いツール利用を必要とする複数ステップのエージェント向けに設計されています。
Gemini 3.7 Flashは、テキスト、画像、動画、音声、PDFを入力として受け付けますが、返すのはテキストのみです。そのため、製品のスクリーンショットの理解、録画したワークフローの確認、レポートからの証拠抽出、リポジトリ全体にまたがる推論などに適しています。ネイティブな画像・動画・音声生成モデルではありません。
GPTProtoでは、開発者はプロバイダーごとに個別の残高を管理することなく、このモデルにアクセスできます。同じキーで200以上の対応モデルにリクエストをルーティングできるため、Geminiと他のモデルを比較したり、別のプロバイダーアカウントを作成せずにフォールバックを追加したりできます。現在のGemini 3.7 Flash APIの料金と表示されている40%割引については、ライブ料金パネルが最新情報の基準となります。
| 仕様 | Gemini 3.7 Flash |
|---|---|
| プロバイダー | |
| リリース状況 | 一般提供(GA) |
| リリース日 | 2026年8月13日 |
| 公式モデルID | gemini-3.7-flash |
| 入力モダリティ | テキスト、画像、動画、音声、PDF |
| 出力モダリティ | テキスト |
| 入力トークン上限 | 1,048,576トークン |
| 最大出力 | 65,536トークン |
| 思考レベル | low、medium(デフォルト)、high |
| 上流で対応される機能 | キャッシュ、関数呼び出し、構造化出力、コード実行、ファイル検索、URLコンテキスト、検索およびMapsグラウンディング、Computer Use(プレビュー) |
| 上流で未対応 | minimal思考、ネイティブ画像生成、音声生成、Live API |
| 上流での利用オプション | Standard、Batch、Flex、Priority |
Gemini 3.7 Flash APIは、短い回答を1つ求めるよりも、複数のステップを組み合わせるワークロードに最適です。コーディングでは、リポジトリのコンテキストを調べ、複数のファイルにまたがって問題を追跡し、最小限のパッチを提案して変更内容を説明できます。フロントエンド作業では、リクエストにスクリーンショットやデザインリファレンスを含めることで、モデルが意図したレイアウトと実装を比較できます。
エージェントワークフローでは、モデルが関数を呼び出すタイミングを判断し、ツールの結果を解釈して、JSONスキーマに従ったレスポンスを返せます。実用的な用途には、サポートチケットのトリアージ、ドキュメントからデータベースへの抽出、コンプライアンス確認、社内調査、ワークフロー自動化などがあります。開発者は、時間が重視される分類では推論レベルを下げ、難しいデバッグや計画タスクでは上げることができます。
マルチモーダル入力はナレッジワークにも役立ちます。1つのワークフローで、PDF、グラフ、スクリーンショット、録画した会議、文章による指示を組み合わせられます。出力はテキストのままなので、最終成果物が画像、動画、音声ファイルである必要がある場合は、専用の生成モデルを使用してください。
Gemini 3.7 Flashは、Gemini 3.6 Flashと同じ1,048,576トークンの入力上限、65,536トークンの出力上限、幅広い入力モダリティを維持しています。アップグレードの理由は、コンテキストウィンドウが大きくなったことではありません。コーディング、Web開発、ドキュメント理解、指示追従、エージェント実行が改善されたことです。
Google'のリリース評価では、以下の変更が報告されています。これらはプロバイダーが報告したベンチマーク結果であり、GPTProtoによる独立したテストではありません。
| 評価 | Gemini 3.7 Flash | Gemini 3.6 Flash | 報告された変化 |
|---|---|---|---|
| FrontierCode 1.1 Main | 43.6% | 34.4% | +9.2ポイント |
| DeepSWE v1.1 | 65.3% | 49.0% | +16.3ポイント |
| WebDev Arena | 1588 Elo | 1538 Elo | +50 Elo |
| GDP.pdf | 34.0% | 22.0% | +12.0ポイント |
| AutomationBench | 30.4% | 17.0% | +13.4ポイント |
互換性に関するトレードオフが1つあります。Gemini 3.6 Flashはminimal、low、medium、highの思考レベルを受け付けますが、3.7が対応するのはlow、medium、highのみです。既存のワークフローが、単純で大量のリクエストに対するほぼゼロの思考に依存している場合は、3.6をA/Bテストに残すか、すべてのトラフィックを移行する前にFlash-Liteモデルと比較してください。
モデル名の変更は最初のステップにすぎません。既存のアプリケーションでGemini 3.6 Flash、Gemini 3.5 Flash、Gemini 3 Flash Preview、またはGemini 3.1 Proを置き換える前に、以下のチェックリストを使用してください。
GPTProtoのドキュメントに記載された正確なモデル文字列を使用してください。Google'の公式安定版IDはgemini-3.7-flashです。公開またはデプロイする前に、GPTProtoのルートが同じ文字列を使用していることを確認してください。
「thinking_level: "minimal"」は送信しないでください。Googleのドキュメントではmediumがデフォルトとされており、minimalを選択すると検証エラーが返されます。
ネイティブGemini Interactions APIへの移行では、非推奨のtemperature、top_p、top_k、candidate_count設定を削除し、thinking_budgetをthinking_levelに置き換え、事前入力されたモデルターンを削除してください。
マルチモーダルに関する前提を正確に保ってください。画像、音声、動画、PDFは入力形式であり、レスポンスはテキストです。
Googleの上流ツールがすべてOpenAI互換ルートで自動的に利用できるとは限りません。対応するパラメーター、ツール、ファイル処理、レスポンスフィールドについては、GPTProtoの最新APIドキュメントを確認してください。
すべてのリクエストを移行する前に、自分のコーディングタスク、スキーマ、ツール呼び出し、レイテンシ目標、トークン予算を使ってカナリアテストを実行してください。
この移行ガイダンスは、単なるモデル一覧と、実際に使えるGemini 3.7 Flash APIアクセスページとの大きな違いです。新しいモデルIDが正しくても、どの既存リクエストが失敗する可能性があるかを開発者に伝えています。
長いコンテキストウィンドウ、複数の入力形式、より強力な初回コーディング、または大規模なフラッグシップモデルより低いトークン価格での複数ステップのツールオーケストレーションが必要なワークロードには、Gemini 3.7 Flashを選択してください。minimal思考が重要な場合や、既存アプリケーションがまだ回帰テストに合格していない場合は、Gemini 3.6 Flashを使い続けてください。
Grok 4.6とGemini 3.7 Flashの比較では、判断はより具体的になります。Geminiは音声、動画、PDF入力を受け付け、Grok'の2倍を超えるコンテキストウィンドウを提供します。Grok 4.6にはxhigh推論オプションがあり、SpaceXAIは固定のテキスト出力上限を文書化していません。どちらのモデルが普遍的に優れているわけでもないため、デフォルトを選ぶ前に代表的なタスクを両方にルーティングしてください。
| 判断基準 | Gemini 3.7 Flash | Gemini 3.6 Flash | Grok 4.6 |
|---|---|---|---|
| 最適な用途 | コーディング、デザイン準拠、マルチモーダルなドキュメント、複数ステップのエージェント | 既存のFlashワークフローとminimal思考のトラフィック | xhigh推論や非常に長いテキスト出力を必要とするコーディングとエージェント
|
| コンテキストウィンドウ | 1,048,576トークン | 1,048,576トークン | 500,000トークン |
| ネイティブ入力 | テキスト、画像、動画、音声、PDF | テキスト、画像、動画、音声、PDF | テキスト、画像 |
| テキスト出力上限 | 65,536トークン | 65,536トークン | SpaceXAIによる固定上限の文書化なし |
| 推論制御 | Low、medium、high | Minimal、low、medium、high | Low、medium、high、xhigh |
| 公式の短いコンテキスト向けトークン価格* | $0.75(入力) / $3.75(出力)、2026年12月31日まで | $0.75(入力) / $3.75(出力)、2026年12月31日まで | $2(入力) / $6(出力)、入力トークン200K未満 |
*公式プロバイダー料金は、モデル選択の参考情報としてのみ表示されています。GPTProto経由で請求される料金については、GPTProtoのライブ料金パネルを使用してください。