Fish Audio
Hanabi AI Inc.
Sintesi vocale espressiva in tempo reale e clonazione da 15 secondi di audio, in oltre 30 lingue.

Piattaforme
Panoramica
Fish Audio è una piattaforma di IA vocale gestita da Hanabi AI Inc. Il modello più recente, S2.1 Pro, è descritto come il modello vocale in tempo reale più espressivo e controllabile dal punto di vista emotivo, con tag come [laughing] o [whispering] per indicare emozione e modo di parlare. La piattaforma offre clonazione vocale da 15 secondi di audio, riconoscimento vocale e API per agenti vocali, con supporto per oltre 30 lingue e una libreria pubblica di oltre 2 milioni di voci. Il piano gratuito è riservato all'uso personale; l'uso commerciale richiede un piano a pagamento. L'interfaccia è disponibile in più lingue.
Funzionalità principali
- Sintesi vocale con tag di emozione (S2.1 Pro)
- Clonazione vocale da 15 secondi di audio
- Riconoscimento vocale (Speech to Text)
- API per agenti vocali
- Oltre 30 lingue
- Libreria di oltre 2 milioni di voci
- Interfaccia in più lingue
Casi d'uso consigliati
Produzione audio
- Voce fuori campo per video
- Audiolibri
- Voci di personaggi
- Chatbot vocali
Prezzi
Prezzo non ancora verificato: consulta il sito ufficiale.
Screenshot

Strumenti AI correlati
ElevenLabs
ElevenLabs è un servizio di intelligenza artificiale per la generazione vocale, utilizzabile per narrazioni e doppiaggio.
Cartesia
API di sintesi vocale e riconoscimento vocale in tempo reale, pensate per costruire agenti vocali.
Murf AI
Murf AI è un servizio di generazione vocale AI utile per narrazioni e produzione video.
Hume AI
API vocali incentrate sull'emozione: sintesi vocale, interfaccia vocale conversazionale e misura dell'espressione.