Fish Audio
Hanabi AI Inc.
擅长情感表达的实时语音合成与声音克隆,15秒音频即可复制声音,支持30多种语言。
Voice & audioAI models & APIs提供免费套餐

访问官网
支持平台
WebAPI
概览
Fish Audio是Hanabi AI Inc.运营的语音AI平台。其最新模型S2.1 Pro被描述为“表现力最强、可控制情感的实时语音模型”,可用[laughing]、[whispering]等标签指定情感与说话方式。平台提供15秒音频即可复制声音的声音克隆、语音识别,以及面向语音智能体的API,支持30多种语言,公开的声音库超过200万个。免费方案仅限个人使用,商用需订阅付费方案。界面也支持日语等多种语言。
主要功能
- 带情感标签的语音合成(S2.1 Pro)
- 15秒音频即可完成的声音克隆
- 语音识别(Speech to Text)
- 面向语音智能体的API
- 支持30种以上语言
- 超过200万个声音的音色库
- 多语言界面
推荐使用场景
语音制作
- 视频旁白
- 有声书
- 角色配音
- 语音聊天机器人
套餐与价格
价格信息尚未核实,请以官网为准。
截图
