Fish Audio
Hanabi AI Inc.
感情表現に強いリアルタイム音声合成とボイスクローン。15秒の音声から声を複製でき、30言語以上に対応する。
音声・音楽API・モデル基盤無料プランあり

公式サイトへ
対応プラットフォーム
WebAPI
概要
Fish Audio は Hanabi AI Inc. が運営する音声AIのプラットフォームです。最新モデル S2.1 Pro を「最も表現豊かで感情を制御できるリアルタイム音声モデル」と説明し、[laughing] や [whispering] といったタグで感情や話し方を指定できます。15秒の音声から声を複製するボイスクローン、音声認識、音声エージェント向けのAPIを備え、30言語以上に対応します。200万件以上の音声がライブラリに公開されています。無料プランは個人利用に限られ、商用利用には有料プランへの加入が必要です。インターフェースは日本語にも対応します。
主な機能
- 感情タグ付きの音声合成(S2.1 Pro)
- 15秒の音声からのボイスクローン
- 音声認識(Speech to Text)
- 音声エージェント向けAPI
- 30以上の言語に対応
- 200万件以上の音声ライブラリ
- 日本語インターフェース
おすすめの活用シーン
音声制作
- 動画のナレーション
- オーディオブック
- キャラクターボイス
- 音声チャットボット
料金プラン
料金情報は未確認です。公式サイトをご確認ください。
スクリーンショット
