fal.ai
fal
Plataforma de inferência que serve modelos de imagem e vídeo por API, com preço por resultado gerado.

Plataformas
Visão geral
O fal é uma plataforma de inferência que executa rapidamente modelos de geração de imagem e vídeo. O site o descreve como rápido, confiável e eficiente em custo, e diz que você paga apenas pelo poder de computação consumido. Os preços por modelo são públicos: o Seedream V4 custa 0,03 dólar por imagem e o Flux Kontext Pro, 0,04; em vídeo, o Wan 2.5 custa 0,05 dólar por segundo e o Veo 3, 0,4. Também há GPUs dedicadas por hora, a partir de 1,89 dólar a hora para uma H100 com preço com desconto.
Principais recursos
- Modelos de imagem e vídeo por API
- Preços públicos por modelo
- GPUs sob demanda
- Você paga apenas pelo que gera
- Condições sob medida para empresas
Preços
Image models (usage-based)
US$ 0,03 / image
Preço publicado (USD) · Fonte
- Seedream V4: $0.03/image
- Flux Kontext Pro: $0.04/image
- Nanobanana: $0.0398/image
- Qwen: $0.02/megapixel
Última verificação: setembro de 2026
Video models (usage-based)
US$ 0,05 / second of video
Preço publicado (USD) · Fonte
- Wan 2.5: $0.05/second
- Kling 2.5 Turbo Pro: $0.07/second
- Veo 3: $0.4/second
- Ovi: $0.2/video
Última verificação: setembro de 2026
On-demand GPU
US$ 1,89 / GPU hour
Preço publicado (USD) · Fonte
- H100: $1.89/hr (discounted)
- B300: $8.50/hr (list price)
- Contact sales for discounted rates
Última verificação: setembro de 2026
Enterprise
Falar com vendas
- Custom arrangements
- Enterprise contact form and support email
O fal.ai publica um preço único mundial e cobra em USD. Não há um preço separado na sua moeda local.
Capturas de tela

Ferramentas de IA relacionadas
Replicate
Replicate é um serviço de IA de infraestrutura de desenvolvimento/API que pode ser usado para desenvolvimento de IA e prototipagem.
Together AI
Together AI é um serviço de IA de infraestrutura de desenvolvimento/API que pode ser usado para desenvolvimento de IA e inferência.
Fireworks AI
Inferência, treinamento e implantações dedicadas para modelos abertos, cobrados por tokens e horas de GPU.
Hugging Face
Hugging Face é um serviço de infraestrutura/API de IA que pode ser usado em desenvolvimento de IA e exploração de modelos.