我們閱讀並認真對待每一項回饋。
欲查看所有可用限定詞,請參閱我們的文件。
載入時發生錯誤。請重新載入此頁面。
最新消息:Kitten TTS v0.8 已發布 -- 現已提供 1500 萬、4000 萬和 8000 萬參數的模型。
Kitten TTS 是一個開源、輕量級的文字轉語音函式庫,建構於 ONNX 之上。其模型大小從 1500 萬到 8000 萬參數不等(磁碟上約 25-80 MB),能在 CPU 上實現高品質語音合成,無需 GPU。
狀態:開發者預覽 -- API 可能會在版本之間變動。
注意:部分使用者回報了 kitten-tts-nano-0.8-int8 模型的問題。如果您遇到問題,請提出 issue。
直接在您的瀏覽器中透過 Hugging Face Spaces 試用 Kitten TTS。
從文字合成語音,返回 24 kHz 音訊樣本的 NumPy 陣列。
合成語音並直接寫入音訊檔案。
在不產生音訊的情況下,為 TTS 標準化文字。
當 return_spans=True 時,結果包含原始到標準化字元的跨距,用於變更的區段,例如縮寫、日期、時間、數字、貨幣、URL 和標點符號。
返回可用語音名稱的列表:['Bella', 'Jasper', 'Luna', 'Bruno', 'Rosie', 'Hugo', 'Kiki', 'Leo']
建議使用虛擬環境(conda、venv 或類似環境)以避免依賴衝突。
我們為將 Kitten TTS 整合到其產品中的團隊提供商業支援。這包括整合協助、自訂語音開發和企業授權。
此專案根據 Apache 授權 2.0 授權。