Cartesia
Cartesia
リアルタイム音声合成・音声認識のAPI。音声エージェントの構築を主な用途に据える。
音声・音楽API・モデル基盤無料プランあり

公式サイトへ
対応プラットフォーム
WebAPI
概要
Cartesia は音声合成(Text to Speech)と音声認識(Speech to Text)をAPIで提供するサービスです。料金は使ったクレジットとエージェントの通話分に応じた従量制で、どのプランでもワークスペースの席数は無制限と案内されています。無料プランから始められ、有料プランでは商用利用ライセンスと即時のボイスクローニング、上位プランではプロ向けのボイスクローニングや高い同時実行数が利用できます。
主な機能
- リアルタイムの音声合成
- 音声認識(Speech to Text)
- ボイスクローニング
- 音声エージェントの構築
- クレジットと通話分による従量課金
- ワークスペースの席数は無制限
料金プラン
Cartesiaは世界共通の料金を掲載し、USDで課金します。各国通貨での個別価格はありません。
スクリーンショット
