Fish Audio
Hanabi AI Inc.
Síntesis de voz expresiva en tiempo real y clonación a partir de 15 segundos, en más de 30 idiomas.

Plataformas
Descripción general
Fish Audio es una plataforma de IA de voz operada por Hanabi AI Inc. Describe su modelo más reciente, S2.1 Pro, como el modelo de voz en tiempo real más expresivo y con más control emocional, con etiquetas como [laughing] o [whispering] para marcar emoción y forma de hablar. Ofrece clonación de voz a partir de 15 segundos de audio, reconocimiento de voz y API para agentes de voz, con soporte para más de 30 idiomas y una biblioteca pública de más de 2 millones de voces. El plan gratuito es solo para uso personal; el uso comercial requiere un plan de pago. La interfaz está disponible en varios idiomas.
Funciones principales
- Síntesis de voz con etiquetas de emoción (S2.1 Pro)
- Clonación de voz con 15 segundos de audio
- Reconocimiento de voz (Speech to Text)
- API para agentes de voz
- Más de 30 idiomas
- Biblioteca de más de 2 millones de voces
- Interfaz en varios idiomas
Casos de uso recomendados
Producción de voz
- Locución de vídeos
- Audiolibros
- Voces de personajes
- Chatbots de voz
Precios
Precio sin verificar: consulta el sitio web oficial.
Capturas de pantalla

Herramientas de IA relacionadas
ElevenLabs
ElevenLabs es un servicio de IA de generación de voz que se puede usar para narración y doblaje.
Cartesia
API de síntesis de voz y reconocimiento de voz en tiempo real, orientada a construir agentes de voz.
Murf AI
Murf AI es un servicio de IA de generación de voz que se puede usar para narración y producción de video.
Hume AI
API de voz centradas en la emoción: síntesis de voz, interfaz de voz conversacional y medición de la expresión.