GLM-5-Turbo API:GPTProtoで手頃に利用できるZ-AIアクセス
GLM-5-Turboは、リアルタイムチャット補完、ツール呼び出し、マルチターンのエージェントループ向けに設計された、Z-AIの高速ティアのテキストモデルです。テキスト入力・テキスト出力に対応し、262Kのコンテキストウィンドウと設定可能な推論機能を備えています。GPTProtoでは、GLM-5-Turbo APIを100万トークンあたり入力$1.08/出力$3.60で利用できます — 通常価格より10%安く、200以上の他のモデルにも使える1つの残高で支払えます。
GLM-5-Turboとは?
GLM-5-Turboは、Z-AI(Zhipu AI)によるテキスト間モデルです。テキストプロンプトを受け取り、テキストを返します — 画像や音声の入力には対応していないため、マルチモーダルモデルではなく、チャット、推論、生成エンジンとして扱ってください。262Kトークンのコンテキストウィンドウ、ストリーミング応答、関数/ツール呼び出し、停止シーケンス、temperature/top_pの制御(デフォルト値は0.95/0.7)に対応しています。GLM-5-Turboはクローズドウェイトモデルです — ダウンロードして利用することはできないため、API経由でのみ実行できます。GPTProtoでは、GLM-5-TurboモデルAPIをホスト型エンドポイント(モデル文字列はglm-5-turbo)として利用できるため、GPUのプロビジョニングやクォータ設定は不要です。リクエストとパラメーターの詳細は、glm-5-turbo APIドキュメントに記載されています。
GLM-5-Turbo vs GLM-5 vs GLM-5.2
3つすべてをGPTProtoで1つの残高から利用できます。重視するトレードオフに応じて選択してください。
| GLM-5-Turbo | GLM-5 | GLM-5.2 | |
|---|---|---|---|
| 最適な用途 | 大量のチャット、エージェント、低レイテンシ | 最高峰の推論品質 | 最新世代の性能 |
| 位置付け | 速度/コストティア | フラッグシップのベースモデル | 最新リリース |
| 価格(100万トークンあたり) | $1.08(入力)/$3.60(出力) | GLM-5ページを見る GLM-5 page | GLM-5.2ページを見る GLM-5.2 page |
| モデル文字列 | glm-5-turbo |
glm-5 |
glm-5.2 |
| 選ぶべきタイミング | 最も安価で高速なGLM-5クラスの応答が必要な場合 | 最高水準の推論の深さを求める場合 | GLMの最新の改善を利用したい場合 |
本番トラフィックの大部分では、まず GLM-5-Turbo から始め、最も難しいプロンプトだけをglm-5またはglm-5.2に振り分けるのがおすすめです — 同じAPIを使えるため、変更は1行だけです。
GLM-5-Turbo APIへの切り替え(ドロップイン)
すでにZ-AIまたはOpenAI互換エンドポイントを呼び出している場合、GPTProtoでのGLM-5-Turbo APIアクセスへの移行はドロップイン変更です — アプリを書き直す必要はありません。ベースURLをhttps://gptproto.com/v1に変更し、AuthorizationにはGPTProtoのキーを使用して、モデルをglm-5-turboに設定してください。既存のmessages配列、ストリーミング、ツール呼び出しのコードはそのまま使えます。
# 変更するのはモデル文字列(およびベースURL + キー)のみ: "model": "glm-5-turbo"
1つの残高、ドルベースの請求
GPTProtoでは、ポイントやモデルごとのクレジットではなく、通常のドル残高を使用します。1回チャージすれば、GLM-5-Turboを含むすべてのモデルに対して同じ残高から支払い、ダッシュボードでリアルタイムの使用状況を確認できます — 大量処理にはGLM-5-Turboを、難しいプロンプトにはフラッグシップモデルを使い分けるプロジェクトに便利です。







