Skip to main content
テキストから音声を生成し、WAVファイルとして保存します。

前提条件

このチュートリアルでは、シェル環境にCartesia APIキーが必要です。https://play.cartesia.ai/keys でAPIキーを取得し、次のコマンドを実行するか、.bashrc または .zshrc に追加してください:

WAVファイルを生成する

1

SDKをインストールする

2

音声を生成する

generate_speech.py
3

実行する

上記で使用されているボイスは、プレイグラウンドで確認できます。その他のボイスは play.cartesia.ai/voices で閲覧できます。

次のステップ

Text-to-Speech クイックスタート

WebSocketストリーミングを使用してLLMの出力をリアルタイムでTTSにパイプします。

ボイスを選ぶ

ボイスを閲覧し、ユースケースに合った適切なボイスの選び方を学びます。

TTS 出力オーディオフォーマット

ユースケースに合った出力フォーマット、サンプルレート、エンコーディングを選びます。