我們閱讀並認真對待每一項回饋。

欲查看所有可用限定詞,請參閱我們的文件。

載入時發生錯誤。請重新載入此頁面。

最新消息:Kitten TTS v0.8 已發布 -- 現已提供 1500 萬、4000 萬和 8000 萬參數的模型。

Kitten TTS 是一個開源、輕量級的文字轉語音函式庫,建構於 ONNX 之上。其模型大小從 1500 萬到 8000 萬參數不等(磁碟上約 25-80 MB),能在 CPU 上實現高品質語音合成,無需 GPU。

狀態:開發者預覽 -- API 可能會在版本之間變動。

注意:部分使用者回報了 kitten-tts-nano-0.8-int8 模型的問題。如果您遇到問題,請提出 issue。

直接在您的瀏覽器中透過 Hugging Face Spaces 試用 Kitten TTS。

從文字合成語音,返回 24 kHz 音訊樣本的 NumPy 陣列。

合成語音並直接寫入音訊檔案。

在不產生音訊的情況下,為 TTS 標準化文字。

當 return_spans=True 時,結果包含原始到標準化字元的跨距,用於變更的區段,例如縮寫、日期、時間、數字、貨幣、URL 和標點符號。

返回可用語音名稱的列表:['Bella', 'Jasper', 'Luna', 'Bruno', 'Rosie', 'Hugo', 'Kiki', 'Leo']

建議使用虛擬環境(conda、venv 或類似環境)以避免依賴衝突。

我們為將 Kitten TTS 整合到其產品中的團隊提供商業支援。這包括整合協助、自訂語音開發和企業授權。

此專案根據 Apache 授權 2.0 授權。