O ElevenLabs é uma plataforma de voz com IA centrada na síntese de voz (Text to Speech), que converte texto em áudio, e que também oferece transcrição, clonagem de voz, dublagem e geração de efeitos sonoros e música. Neste artigo, reunimos os recursos, os preços, as condições de uso comercial e a situação do suporte ao japonês, com base no que verificamos em 4 de outubro de 2026 (UTC) no site oficial, na central de ajuda e na documentação oficial do ElevenLabs.
O que é o ElevenLabs
O site oficial apresenta o serviço dividido em três grandes áreas.
- ElevenCreative: um app web para criadores, usado para produzir voz, música, efeitos sonoros, imagens e vídeos
- ElevenAgents: uma plataforma para criar e operar agentes de IA conversacionais que atendem por telefone ou chat
- ElevenAPI: APIs para desenvolvedores integrarem síntese de voz, transcrição e outros recursos aos próprios apps
Este artigo se concentra nas assinaturas do ElevenCreative, que costumam ser as primeiras avaliadas por pessoas físicas e equipes pequenas, e trata apenas de forma resumida do modelo de preços da API.
Principais recursos
Estes são os principais recursos que conseguimos confirmar na página oficial de preços e na lista de modelos da documentação oficial.
- Text to Speech: converte texto em áudio. Além do modelo mais recente, o "Eleven v4" (lançado em setembro de 2026, segundo o site oficial), há modelos como Eleven v3, Multilingual v2 e o Flash v2.5, de baixa latência
- Studio: para criar projetos longos de áudio e vídeo, como audiolivros e podcasts
- Clonagem de voz: o Instant Voice Cloning, que cria uma voz a partir de um áudio curto, e o Professional Voice Cloning, que treina um modelo dedicado com gravações longas
- Voice Design: cria uma nova voz a partir de uma descrição em texto das características desejadas
- Speech to Text (transcrição), Dubbing (dublagem), Voice Changer, Voice Isolator (remoção de ruído), Sound Effects, Music
Há um limite de caracteres por geração. A central de ajuda informa, para a interface web, 5.000 caracteres nos planos pagos e 2.500 no plano gratuito, enquanto a página de apresentação do Eleven v4 fala em até 10.000 caracteres. Pelas informações oficiais, não foi possível determinar qual limite vale ao usar o v4 pela interface web.
Preços e como funcionam os créditos
A unidade de cobrança são os "créditos"
Nos planos do ElevenCreative, cada recurso consome os "créditos" concedidos todo mês. Segundo a página de preços, os créditos são compartilhados entre todos os produtos; por isso, o que você gasta em um recurso reduz o que sobra para os demais. Como referência de consumo, são indicados, entre outros, 1 crédito por caractere no Text to Speech, 330 créditos por minuto no Speech to Text, 900 créditos por minuto no Music e 200 créditos por geração no Sound Effects (todos valores aproximados oficiais).
Segundo a central de ajuda, a contagem de caracteres inclui pontuação, espaços e tags de áudio. Os créditos são consumidos a cada geração, e não no download; porém, segundo a documentação, é possível gerar de novo sem custo quando certas condições são atendidas, por exemplo ao refazer na versão web, em até 2 horas, com o mesmo texto, a mesma voz e o mesmo modelo.
Preço e créditos mensais por plano
Em 4 de outubro de 2026, a página de preços (na exibição de pagamento mensal) mostrava os seguintes planos principais. Os preços estão em dólares americanos e não incluem impostos.
- Free: US$ 0, 10.000 créditos por mês
- Starter: US$ 6 por mês, 30.000 créditos por mês. Inclui, entre outros, licença comercial e Instant Voice Cloning
- Creator: US$ 22 por mês, 121.000 créditos por mês. Inclui, entre outros, Professional Voice Cloning
- Pro: US$ 99 por mês, 600.000 créditos por mês
- Scale: US$ 299 por mês, 1.800.000 créditos por mês, 3 assentos
- Business: US$ 990 por mês, 6.000.000 créditos por mês, 10 assentos
- Enterprise: sob consulta
Diferenças entre preço normal, desconto no primeiro mês, pagamento anual e promoções
No momento da verificação, a página de preços exibia, além dos preços normais, ofertas por tempo limitado. Tudo o que segue reflete o que estava exibido no momento da verificação e pode mudar.
- Desconto no primeiro mês: Starter por US$ 1 no primeiro mês (normalmente US$ 6, com a indicação "até 18 de outubro") e Creator por US$ 11 no primeiro mês (normalmente US$ 22). Segundo a página, o desconto vale apenas para o primeiro mês. Para o desconto do primeiro mês do Creator, a página consultada não mostrava uma data de término explícita
- Pagamento anual: o FAQ da página de preços explica que o preço anual equivale a "preço mensal × 10 meses", o que corresponde a 2 meses grátis. No pagamento anual, o equivalente mensal é de US$ 5 no Starter, US$ 18,33 no Creator e US$ 82,50 no Pro. Não conseguimos confirmar se o desconto do primeiro mês pode ser combinado com o pagamento anual
- Promoção do Eleven v4: no topo do site havia o aviso "créditos triplicados nos planos Creator e superiores até 12 de outubro". Já o texto da página de preços descreve uma ação de "duas semanas": "nos planos Creator e superiores, os créditos usados no Text to Speech com o v4 não são descontados do saldo até o limite de 2 vezes os créditos mensais (somente web e app móvel)", sem data de término no texto. Ambas são ações temporárias e não estão incluídas nos créditos mensais indicados acima
Acúmulo de créditos e o que fazer quando faltam
Segundo o FAQ da página de preços, nos planos pagos os créditos não usados podem ser acumulados por até 2 meses, mas expiram ao fim do período de cobrança em caso de downgrade ou cancelamento. O plano gratuito não permite acúmulo. A documentação de cobrança informa que, nas assinaturas novas, é possível comprar créditos pré-pagos Pay As You Go (válidos por 12 meses) quando os créditos não forem suficientes.
O uso da API tem uma página de preços do ElevenAPI separada, cujo FAQ explica que a cobrança é feita em dólares americanos, e não em créditos (por exemplo, US$ 0,08 a cada 1.000 caracteres nos modelos multilíngues do Text to Speech).
Condições de uso comercial
Aqui resumimos a explicação da central de ajuda e o que dizem os documentos legais. Os termos de uso (para residentes fora do EEE, da Suíça e do Reino Unido) estabelecem que usuários gratuitos só podem usar o serviço para fins não comerciais, enquanto usuários pagantes podem usá-lo para fins comerciais.
- Plano gratuito: não inclui licença comercial e não pode ser usado para fins comerciais. Ao publicar áudio criado no plano gratuito ou sem login, é preciso indicar que ele foi criado com o ElevenLabs, incluindo "elevenlabs.io" ou "11.ai" no título (para música criada com o Eleven Music, a indicação é "Eleven Music"). A Prohibited Use Policy também inclui entre as proibições o uso comercial por usuários gratuitos, como em anúncios
- Planos pagos: todos os planos pagos incluem licença comercial. No entanto, o conteúdo criado com recursos classificados como alfa, beta, prévia ou similares (Beta Services) não pode ser usado para fins comerciais nem em produção. Não conseguimos identificar quais recursos se enquadram nisso atualmente
- Áudio criado durante o período pago: segundo a empresa, pode continuar sendo usado comercialmente mesmo após o fim da assinatura. Já o áudio criado no plano gratuito antes ou depois do período pago não pode ser usado comercialmente
- Condições adicionais por produto: Music, Sound Effects, Studio, Dubbing v2 e outros têm Service-Specific Terms próprios. Por exemplo, a Prohibited Use Policy proíbe vender ou distribuir como pacote de materiais avulso os sons criados com o Sound Effects. Além disso, os Sound Effects Terms estabelecem que é possível desativar, pela função "Disable" na página do produto, o sublicenciamento a terceiros (incluindo outros usuários do ElevenLabs) dos efeitos sonoros criados
Como observação da redação, vídeos monetizados, anúncios e vídeos institucionais publicados externamente muito provavelmente se enquadram como uso comercial. Evite produzi-los no plano gratuito e confira os termos mais recentes antes de usar.
Requisitos para clonagem de voz
- Instant Voice Cloning: segundo a documentação de cobrança, a clonagem de voz está disponível a partir do Starter. A documentação recomenda cerca de 1 a 2 minutos de áudio sem ruído. Na criação, há uma etapa para confirmar que você tem o direito e o consentimento para reproduzir aquela voz
- Professional Voice Cloning: disponível a partir do Creator. Segundo a central de ajuda, a quantidade de clones que podem ser criados (vagas) é 1 no Creator e no Pro, 3 no Scale e 10 no Business. O áudio recomendado é de cerca de 30 a 180 minutos (segundo o FAQ da documentação do Instant Voice Cloning), e o treinamento costuma levar de 3 a 6 horas
- Somente a própria voz: com o Professional Voice Cloning só é possível criar a sua própria voz e não a de outra pessoa, mesmo com o consentimento dela. É necessária uma verificação que comprove que você é o dono da voz. Para usar a voz de outra pessoa, a orientação é que ela crie o clone na própria conta e o compartilhe
- Proibições: a Prohibited Use Policy proíbe reproduzir intencionalmente a voz de outra pessoa sem consentimento ou direito legal e usar o serviço para ocultar que uma voz foi gerada por IA
Vale observar também que os termos de uso determinam que o usuário concede ao ElevenLabs uma licença para usar o conteúdo enviado e gerado (incluindo a voz) para fornecer e melhorar o serviço e desenvolver novos serviços e produtos, e que essa licença é perpétua e irrevogável. É possível recusar o uso para treinamento na configuração "Data use", mas isso não se aplica aos usos anteriores. Por outro lado, a página de apresentação do Eleven v4 afirma que os textos enviados, entre outros, não são usados para treinamento sem consentimento; não conseguimos determinar como isso se relaciona com os termos de uso.
Suporte ao idioma japonês
Aqui separamos o "idioma de exibição da interface (UI)" do "idioma da leitura".
Quanto à leitura, na lista de modelos da documentação oficial o japonês aparece entre os idiomas suportados pelo Eleven v4, v3, Multilingual v2 e Flash v2.5 (o Flash v2 é somente em inglês). Segundo a central de ajuda, a versão web detecta automaticamente o idioma pelo texto inserido, por isso recomenda-se não misturar vários idiomas em uma mesma entrada; na API, é possível definir o idioma com language_code. No entanto, o exemplo de tela da página de apresentação do v4 mostra um item "Language override", então confira a situação atual da versão web na interface mais recente.
A central de ajuda explica que o idioma é definido pelo texto inserido, e o sotaque e a pronúncia, pela voz. Como as vozes predefinidas e as vozes geradas são todas vozes em inglês, a orientação é procurar vozes em japonês com o filtro de idioma da Voice Library ou criar um clone a partir de uma gravação em japonês. A documentação do Eleven v4 afirma ainda que o modelo foi projetado para falar com naturalidade mesmo em um idioma diferente do da voz clonada, sem levar junto o sotaque original (afirmação do fornecedor).
Quanto à interface, o site oficial tem uma versão em japonês, incluindo uma página de preços em japonês (com preços em dólares americanos, iguais aos da versão em inglês). Por outro lado, as informações oficiais consultadas não deixam claro se as telas do app após o login podem ser exibidas em japonês (da central de ajuda, verificamos apenas a versão em inglês). O mais seguro é avaliar o serviço partindo do princípio de que o app será usado em inglês.
Para avaliar a qualidade da pronúncia em japonês e a leitura de kanji e números, o mais confiável é ouvir um teste com o texto que você pretende usar. A central de ajuda tem artigos sobre o que fazer quando números, datas ou abreviações não são lidos corretamente. Além disso, segundo a página de apresentação do Eleven v4, há também um recurso de dicionário de pronúncia (Pronunciation Dictionary) para definir como as palavras devem ser lidas.
Para que é indicado e para que não é
O que segue é uma avaliação da redação com base nas especificações confirmadas nas informações oficiais.
Casos em que consideramos que é indicado:
- Quando você quer produzir áudio a partir de textos de forma contínua, como narração de vídeos ou audiolivros
- Quando você quer criar áudio em vários idiomas com a mesma voz
- Quando você quer reduzir o trabalho de gravação usando um clone da sua própria voz
- Quando você quer integrar síntese de voz a apps ou agentes conversacionais por meio da API
Casos em que pode não ser indicado:
- Quando você quer usar o plano gratuito em anúncios ou conteúdo monetizado
- Quando você quer clonar a voz de outras pessoas, como celebridades ou colegas, sem passar pela conta delas
- Quando a exibição das telas do app em japonês é um requisito obrigatório (não conseguimos confirmar)
- Quando o objetivo principal é a edição de vídeo em si (além da geração de voz, é preciso avaliar uma ferramenta de edição de vídeo)
Exemplo de uso (ilustrativo, não testado)
O exemplo a seguir serve para explicar o funcionamento; a redação não o produziu nem testou na prática.
Imagine que você vai adicionar uma narração em japonês a um vídeo de apresentação de produto de cerca de 3 minutos, para publicação externa. Como a publicação externa pode ser considerada uso comercial, partimos de um plano pago, como o Starter.
- Preparar o texto: números e nomes próprios podem ter leituras diferentes, então, se necessário, escreva-os em kana ou configure o dicionário de pronúncia
- Escolher a voz: procure vozes em japonês com o filtro de idioma da Voice Library e ouça-as com o seu texto
- Gerar: gere parágrafo por parágrafo e refaça apenas os trechos que não ficarem bons
- Finalizar: baixe o arquivo de áudio e sincronize-o com as imagens em uma ferramenta de edição de vídeo
Como a referência para o Text to Speech é de 1 crédito por caractere, um texto de 1.000 caracteres consome cerca de 1.000 créditos por geração (pode variar conforme o modelo ou o canal usado). Também é preciso reservar créditos para as gerações refeitas.
Como escolher em relação a outras ferramentas
Entre as ferramentas relacionadas estão o Murf AI, que oferece um Studio para produzir locuções e APIs de voz, e o Descript, um editor com IA que permite editar vídeo e áudio editando a transcrição (em ambos os casos, segundo a descrição no site oficial de cada empresa). Este artigo não compara preços nem outros dados numéricos das empresas.
Na hora de escolher, vale comparar estes pontos:
- Se o objetivo principal é gerar áudio, editar vídeo e áudio ou integrar via API
- A unidade de cobrança (créditos, tempo gerado, número de caracteres etc.) e o volume mensal previsto
- Se o plano gratuito permite uso comercial e se exige atribuição
- Os requisitos para clonagem de voz (verificação de identidade, planos disponíveis, quantidade de clones)
- A qualidade da leitura em japonês (avalie ouvindo testes com textos reais) e se existe interface em japonês
Uma visão geral do ElevenLabs também está disponível na nossa página sobre o ElevenLabs.
Perguntas frequentes
O ElevenLabs pode ser usado de graça?
Existe um plano gratuito, com 10.000 créditos por mês. Mas ele não permite uso comercial e, ao publicar, é preciso incluir "elevenlabs.io" ou "11.ai" no título.
Depois de cancelar, ainda posso usar o áudio criado no período pago?
Segundo a documentação oficial, o áudio criado durante o período pago pode ser usado sob a licença comercial mesmo após o fim da assinatura. Já os créditos não usados expiram ao fim do período de cobrança.
Data de verificação e fontes
As informações deste artigo foram verificadas em 4 de outubro de 2026 (UTC) nas páginas oficiais abaixo. Preços, promoções e especificações podem mudar; confira as informações mais recentes antes de usar.
- Site oficial do ElevenLabs
- Página de preços do ElevenLabs (ElevenCreative)
- Página de preços do ElevenLabs (versão em japonês)
- Página de preços do ElevenLabs (ElevenAPI)
- Página de apresentação do Eleven v4
- ElevenLabs Docs: lista de modelos
- ElevenLabs Docs: Eleven v4
- ElevenLabs Docs: cobrança (Billing)
- ElevenLabs Docs: conta
- ElevenLabs Docs: Instant Voice Cloning
- Central de ajuda: publicação do conteúdo gerado (uso comercial)
- Central de ajuda: número máximo de caracteres por geração
- Central de ajuda: como os caracteres são contados
- Central de ajuda: idiomas suportados
- Central de ajuda: idiomas que a IA fala
- Central de ajuda: como escolher idioma e sotaque
- Central de ajuda: vozes nativas de um idioma específico
- Central de ajuda: artigos sobre Text to Speech
- Central de ajuda: quantidade de Professional Voice Clones
- Central de ajuda: diferenças entre Instant Voice Cloning e Professional Voice Cloning
- Central de ajuda: Professional Voice Clone da voz de outra pessoa
- ElevenLabs Prohibited Use Policy
- ElevenLabs Service-Specific Terms
- ElevenLabs Sound Effects Terms
- Termos de uso do ElevenLabs (Terms of Service, para residentes fora do EEE, da Suíça e do Reino Unido)
- ElevenLabs Beta Services Addendum
- Site oficial do Murf AI
- Site oficial do Descript
