零樣本語音複製
僅使用 5 秒的語音樣本,即可以 94% 的相似度複製任何目標聲音,並支援跨語言合成。

輸入
讓 2.5 HD 預覽模型在合成語音技術領域領先的技術亮點。
僅使用 5 秒的語音樣本,即可以 94% 的相似度複製任何目標聲音,並支援跨語言合成。

專為廣播設計的高畫質輸出,相較於 24kHz 標準模型,提供更卓越的清晰度。

最佳化的處理管線確保快速 TTFB,成為對話式 AI 應用程式的最快選擇。

模型會自動解析文字語境,加入自然停頓、嘆息與情感深度,無需手動使用 SSML 標籤。

取得 speech-2.5-hd-preview API 金鑰只需四個步驟,僅需幾分鐘。建立免費的 GPTProto 帳號、儲值、產生金鑰,並進行第一次呼叫 — 在 $0 / $60 這裡能以比直連更划算的價格取得 speech-2.5-hd-preview API 金鑰,且單一金鑰即可在平台上所有模型通用。完整 speech-2.5-hd-preview 說明文件 請參閱說明文件。

註冊

儲值

產生您的 API 金鑰

進行第一次 API 呼叫
關於將 text speech 2.5 整合至應用程式,以進行高品質音訊製作的常見問題。