CoAI

Fish Audio

Hanabi AI Inc.

感情表現に強いリアルタイム音声合成とボイスクローン。15秒の音声から声を複製でき、30言語以上に対応する。

音声・音楽API・モデル基盤無料プランあり
公式サイトへ

対応プラットフォーム

WebAPI

概要

Fish Audio は Hanabi AI Inc. が運営する音声AIのプラットフォームです。最新モデル S2.1 Pro を「最も表現豊かで感情を制御できるリアルタイム音声モデル」と説明し、[laughing] や [whispering] といったタグで感情や話し方を指定できます。15秒の音声から声を複製するボイスクローン、音声認識、音声エージェント向けのAPIを備え、30言語以上に対応します。200万件以上の音声がライブラリに公開されています。無料プランは個人利用に限られ、商用利用には有料プランへの加入が必要です。インターフェースは日本語にも対応します。

主な機能

  • 感情タグ付きの音声合成(S2.1 Pro)
  • 15秒の音声からのボイスクローン
  • 音声認識(Speech to Text)
  • 音声エージェント向けAPI
  • 30以上の言語に対応
  • 200万件以上の音声ライブラリ
  • 日本語インターフェース

おすすめの活用シーン

音声制作

  • 動画のナレーション
  • オーディオブック
  • キャラクターボイス
  • 音声チャットボット

料金プラン

料金情報は未確認です。公式サイトをご確認ください。

スクリーンショット

Fish Audioの公式サイト
Fish Audio 公式サイト(2026-09-22撮影)

関連するAIツール