前提条件
このチュートリアルでは、シェル環境にCartesia APIキーが必要です。https://play.cartesia.ai/keys でAPIキーを取得し、次のコマンドを実行するか、.bashrc または .zshrc に追加してください:
WAVファイルを生成する
- Python
- JavaScript
- cURL
1
SDKをインストールする
2
音声を生成する
generate_speech.py
3
実行する
次のステップ
Text-to-Speech クイックスタート
WebSocketストリーミングを使用してLLMの出力をリアルタイムでTTSにパイプします。
ボイスを選ぶ
ボイスを閲覧し、ユースケースに合った適切なボイスの選び方を学びます。
TTS 出力オーディオフォーマット
ユースケースに合った出力フォーマット、サンプルレート、エンコーディングを選びます。