Fish Audio
Hanabi AI Inc.
Synthèse vocale expressive en temps réel et clonage à partir de 15 secondes, en plus de 30 langues.

Plateformes
Aperçu
Fish Audio est une plateforme d'IA vocale exploitée par Hanabi AI Inc. Son modèle le plus récent, S2.1 Pro, y est décrit comme le modèle vocal temps réel le plus expressif et le plus contrôlable émotionnellement, avec des balises comme [laughing] ou [whispering] pour orienter l'émotion et le débit. La plateforme propose le clonage vocal à partir de 15 secondes d'audio, la reconnaissance vocale et des API pour agents vocaux, dans plus de 30 langues, avec une bibliothèque publique de plus de 2 millions de voix. L'offre gratuite est réservée à un usage personnel ; l'usage commercial nécessite une offre payante. L'interface est disponible en plusieurs langues.
Fonctionnalités principales
- Synthèse vocale avec balises d'émotion (S2.1 Pro)
- Clonage vocal à partir de 15 secondes
- Reconnaissance vocale (Speech to Text)
- API pour agents vocaux
- Plus de 30 langues
- Bibliothèque de plus de 2 millions de voix
- Interface multilingue
Cas d'usage recommandés
Production audio
- Voix off de vidéos
- Livres audio
- Voix de personnages
- Agents conversationnels vocaux
Tarifs
Tarifs non vérifiés — consultez le site officiel.
Captures d'écran

Outils d'IA similaires
ElevenLabs
ElevenLabs est un service de génération vocale par IA utilisable pour la narration ou le doublage.
Cartesia
API de synthèse vocale et de reconnaissance vocale en temps réel, orientée agents vocaux.
Murf AI
Murf AI est un service de génération vocale par IA, utile pour les voix off et la production vidéo.
Hume AI
API vocales centrées sur l'émotion : synthèse vocale, interface vocale conversationnelle et mesure de l'expression.