Chatterbox Turbo - 文字轉語音
使用 Chatterbox Turbo 從文字產生富有表現力、聽起來自然的語音。快速、開源的 AI 具有內建浮水印和零樣本語音複製功能。
Save Your Audios
Login to save, manage and share all your generated audios
Community Audios
Chatterbox Turbo 可以做什麼?
零樣本語音複製
僅需 5 秒的參考音訊即可複製任何聲音。無需訓練。非常適合跨專案創建一致的人聲配音。
副語言情感
使用基於文字的標籤(如 <laugh>、<sigh>、<cough> 和 <gasp>)添加自然的聲音反應。使語音聽起來真正像人聲。
情感誇張控制
使用單一參數調整語音表現力,從單調到極具表現力。非常適合任何內容語氣。
內建浮水印
每個音訊輸出都包含 PerTh 浮水印,用於負責任的 AI 部署。追蹤 AI 生成的內容,而不影響品質。
超快速生成
在 GPU 上比即時快 6 倍。非常適合即時應用、語音助理和互動式媒體。
開源和 MIT 許可
第一個不犧牲速度或品質的開源 TTS。專為生產而建,為開發人員而設計。
如何使用 Chatterbox Turbo
- 1
輸入您的文字
輸入或貼上您要轉換為語音的文字。添加情感標籤,如 <laugh> 或 <sigh> 以獲得自然的表達。
- 2
上傳參考音訊(可選)
上傳 5 秒的音訊以複製任何聲音。跳過此步驟以使用預設聲音。
- 3
調整設定
控制誇張、溫度和創造力參數,以微調您的語音輸出。
- 4
生成並下載
點擊生成並在幾秒鐘內收到您的高品質音訊。下載並在任何地方使用它。
常見問題
零樣本語音複製如何運作?
Chatterbox Turbo 僅需 5 秒的參考音訊即可複製任何聲音。只需上傳您的音訊檔,模型就會比對風格、音調和特徵,而無需任何訓練或微調。
支援哪些副語言標籤?
Chatterbox Turbo 支援多種自然的聲音反應標籤,包括 <laugh>、<chuckle>、<sigh>、<cough>、<sniffle>、<groan>、<yawn> 和 <gasp>。這些標籤在複製的聲音中產生自然的反應,並具有匹配的情感基調。
Chatterbox Turbo 有多快?
Chatterbox Turbo 在 GPU 上生成語音的速度比即時快 6 倍。這使其非常適合需要速度的即時應用、語音助理和互動式媒體。
什麼是誇張參數?
誇張參數 (0.0-1.0) 控制語音表現力。較低的值會產生單調的語音,而較高的值會使聲音更具戲劇性和表現力。預設值為 0.25,用於自然傳遞。
輸入和輸出支援哪些音訊格式?
您可以上傳 MP3、WAV 或 MPEG 格式的參考音訊。Chatterbox Turbo 產生高品質的音訊輸出,適合任何專業用例。
如何計算價格?
Chatterbox Turbo 每 1000 個字元收取 6 個額度。少於 1000 個字元的文字將四捨五入為 1000 個。這使其成為現有最具成本效益的專業 TTS 解決方案之一。
內建浮水印有什麼作用?
Chatterbox Turbo 產生的每個音訊檔案都包含 PerTh(感知閾值)浮水印。這種深度神經網路浮水印以無法察覺的方式嵌入資料,幫助您追蹤 AI 生成的內容,以實現負責任的 AI 部署,而不會影響音訊品質。
定價
提供免費方案
- 文字轉語音
- 每 1000 個字元 6 個額度
技術規格
| 輸出格式 | 高品質音訊 |
|---|---|
| 參考音訊 | 複製需要 5 秒 |
| 處理時間 | 比即時快 6 倍 |
| 成本 | 每 1000 個字元 6 個額度 |
| 誇張範圍 | 0.0 - 1.0 |
| 溫度範圍 | 0.05 - 5.0 |
| 許可證 | MIT(開源) |
| 浮水印 | 內建 PerTH |