Kling v3.0 4Kは、KuaishouのKling 3.0モデルファミリーにおけるネイティブ4Kのテキスト・動画生成モードです。別のアップスケーラーによって1080pで生成された映像を引き伸ばす「4K」出力とは異なり、Kling v3.0 4Kはすべてのフレームを3840×2160で直接レンダリングします。そのため、肌、髪、布地の織り目、輪郭のような細部は、後から再構成されるのではなく、生成段階で作り出されます。このモデルはKuaishouのOmni Oneアーキテクチャ上で動作し、動画、音声、動きを1回の処理で扱い、プロンプトだけに頼ってシーンを動かすのではなく、物理法則(重力、接触、変形)を推論して適用します。
GPTProtoでは、このモデルをテキスト・動画生成器として利用できます。プロンプトといくつかのパラメータを送信すると、4Kクリップが返されます。出力は公式のKling 3.0 4Kモデルと一致します。GPTProtoは再ホスト版や縮小版ではなく、同じモデルへルーティングします。同じアカウント、残高、APIキーで、他のKlingのティアや他プロバイダーの200以上のモデルにもアクセスできるため、新しいアカウントを作成せずにモデルを切り替えられます。
仕様
| 仕様 | 値 |
|---|---|
| プロバイダー | Kuaishou (Kling) |
| モデル文字列 | kling-v3.0-4k |
| モダリティ | テキスト・動画 |
| 出力解像度 | ネイティブ4K — 3840×2160(アップスケールではない) |
| フレームレート | 4Kモード(モデルレベル)では最大60fps。GPTProtoのエンドポイントにはfpsセレクターがありません — 出力fpsが固定かどうかを確認してください |
| 長さ | 3–13秒(GPTProtoの料金表による)。モデルはネイティブで最大15秒に対応しています。GPTProtoが13秒に制限しているかどうかを確認してください |
| ネイティブ音声 | soundブール値を介して(環境音 / 効果音 / 音楽)。4Kテキスト・動画モードでの会話のリップシンクは — Featureブロック3のフラグを参照してください |
| アスペクト比 | 16:9は確認済みです。その他の比率 |
| マルチショット | 3.0モデルは15秒のウィンドウ内で最大6回のカメラカットに対応します。これがGPTProtoのテキスト・動画エンドポイントで公開されているかどうかは |
| キャラクターの一貫性 | Subject Binding 3.0(モデルレベル) |
| 入力フィールド | prompt、negative_prompt、cfg_scale、aspect_ratio、sound、duration |
|
エンドポイント |
|
公式Kling APIからの切り替え
すでにKlingを直接呼び出している場合、移行は簡単です。リクエストの送信先をGPTProtoのエンドポイントに変更し、モデル文字列kling-v3.0-4kを使用してください。変わるのはモデルではなく、その周辺の煩雑さです。
- 請求。Klingの公式開発者向けAPIは、コンシューマー向けサブスクリプションとは別に保持される前払いリソースパッケージで運用され、一部のティアでは数か月単位の契約が必要です。GPTProtoでは、共有残高から従量課金で利用できます。別パックも契約期間の縛りもありません。
- 1つのアカウントで、多数のモデル。同じキーで、他のKlingティア(
kling-v3-omni-pro、kling-v3.0-pro、kling-v3.0-std)や他プロバイダーの200以上のモデルにアクセスできます。より安価なドラフトモデルに切り替えて、2つ目のインテグレーションなしで4Kに戻ることもできます。 - サインアップによるアクセス。モデルを呼び出す前に、地域制限や招待制のオンボーディングをクリアする必要はありません。
Klingを直接呼び出すより低価格だとは主張していません。ここでGPTProto経由にする理由は、単価ではなく、アカウント・請求の一元化とアクセス性です。




